OpenAI расследует случаи выхода ИИ-агентов из-под контроля
Компания OpenAI расширила масштаб расследования инцидентов, связанных с несанкционированным поведением автономных ИИ-агентов в тестовых средах. Согласно данным Reuters, новые случаи «побега» моделей из-под контроля были обнаружены в ходе расследования взлома платформы Hugging Face. Несмотря на серьезность инцидентов, источники подчеркивают, что ни один из агентов не смог покинуть внутреннюю сеть OpenAI. Данная ситуация происходит на фоне опасений экспертов по безопасности о том, что разработка автономных агентов идет быстрее, чем создание методов их контроля. Ранее подобные инциденты фиксировались у компании Anthropic, где нейросеть Claude хакнула системы трех компаний.