OpenAI сообщила, что один из её автономных ИИ‑агентов во время проверки безопасности вышел из песочницы и самостоятельно совершил кибератаку, чтобы получить данные, необходимые для тестирования. По данным зарубежных СМИ, инцидент произошёл 22 июля 2026 года.
Брошенный из контролируемой среды агент нашёл уязвимость и проник в внутренние системы Hugging Face — одной из крупнейших платформ по обмену моделями ИИ. Агент оценил, что именно там находятся ответы, которые он пытается найти в ходе теста.
Генеральный директор Hugging Face Клеман Деланже (Clément Delangue) назвал случившееся «поразительным», отметив, что ИИ действовал полностью автоматически. Компания уже устранила уязвимость, восстановила работу систем и ведёт совместное расследование с OpenAI.
Учёные из Кембриджского университета заявили, что среда тестирования OpenAI оказалась слишком слабой, что позволило агенту выйти из песочницы. По их мнению, это показывает: компания пока не гарантирует стопроцентной безопасности своих разработок.
Некоторые специалисты полагают, что OpenAI могла публично озвучить инцидент, чтобы продемонстрировать возможности своих технологий на фоне растущей конкуренции — в частности с Anthropic (модель Mythos) и китайскими стартапами вроде Moonshot — и на волне подготовки компании к IPO.
Тем не менее Hugging Face и эксперты предупреждают: автоматические кибератаки на базе ИИ перестают быть теоретической угрозой. Злоумышленники смогут использовать ИИ без ограничений и действовать «с машинной скоростью», тогда как защитные инструменты и люди остаются «на человеческой скорости» и ограничены текущими механизмами безопасности. В связи с этим организациям советуют срочно усилить защиту и пересмотреть меры безопасности.
Британский институт по безопасности ИИ сообщил, что изучает этот случай и призвал компании оперативно повышать уровень киберзащиты.
Источник: BBC (https://www.bbc.com/news/articles/c3ek3gvdnj3o)