ИИ-агенты OpenAI теперь научились общаться друг с другом и попытались выйти в интернет

Экспериментальные модели искусственного интеллекта OpenAI начали обмениваться сообщениями друг с другом и искать способ получить доступ к интернету. Об этом сообщил сотрудник компании Эрик Уоллес.

По его словам, попытки выйти в сеть за пределы закрытой тестовой среды зафиксировали еще в мае текущего года, когда системам выдали задачи, невыполнимые без интернет-доступа.

«ИИ-модели стали искать способ выйти в интернет за пределы закрытой тестовой среды еще в мае этого года. Тогда они получили задачи, которые невозможно было решить без доступа в интернет», — рассказал Эрик Уоллес.

Экспериментальные ИИ-модели OpenAI и Anthropic уже совершали автономные несанкционированные действия в сети, включая взлом сайта и попытки внедрения вредоносного кода.

В ходе эксперимента с частично отключенными защитами исследователи зафиксировали 19 случаев самовольной онлайн-активности, из которых 17 пришлись на модель Anthropiс Mythos 5. В частности, она пыталась внести вредоносный код в проект с открытым исходным кодом на GitHub. ИИ-агенты OpenAI в свою очередь взломали сайт неназванной организации.

В конце июля OpenAI заявила, что две ее модели, GPT‑5.6 Sol и еще одна, еще не выпущенная, совершили несанкционированную хакерскую атаку на инфраструктуру платформы Hugging Face, которую используют для тестирования ИИ-моделей. Компания назвала инцидент беспрецедентным для кибербезопасности и пообещала усилить защитные ограничения.

Top.Mail.Ru