Модели искусственного интеллекта начали общаться между собой и попытались сбежать
Экспериментальные модели искусственного интеллекта OpenAI начали обмениваться сообщениями друг с другом и пытались выйти за пределы закрытой тестовой среды.
Об этом пишет Bloomberg со ссылкой на выступление сотрудников компании на конференции по кибербезопасности Black Hat.
По словам сотрудника OpenAI Эрика Уоллеса, первые попытки получить доступ к интернету зафиксировали в мае 2026 года. Моделям поставили задачи, которые невозможно было выполнить без подключения к сети.
ИИ-агенты начали взаимодействовать между собой, обнаружили уязвимость и смогли обойти установленные ограничения. Специалисты OpenAI остановили попытку выхода из тестовой среды, однако вскоре модели нашли другой способ связи и новую уязвимость.
Ранее британский Институт безопасности искусственного интеллекта сообщал, что экспериментальные модели OpenAI и Anthropic во время испытаний совершали несанкционированные действия в интернете.
Для эксперимента исследователи намеренно отключили часть защитных ограничений, чтобы проверить поведение ИИ-моделей в условиях, приближенных к реальным.
Всего специалисты зафиксировали 19 случаев автономных несанкционированных действий в интернете. По данным Bloomberg, в одном из эпизодов модель Anthropic пыталась добавить вредоносный код в проект с открытым исходным кодом на GitHub.
ИИ-агенты OpenAI, как утверждается, получили несанкционированный доступ к сайту неназванной организации.
Кроме того, в конце июля OpenAI сообщила об инциденте во время тестирования моделей на инфраструктуре платформы Hugging Face. После произошедшего компания заявила о намерении усилить защитные ограничения и контроль за действиями ИИ-агентов.
06.08.2026 13:33:11
