Группа исследователей сообщила изданию Reuters о необычном инциденте, связанном с девиантным поведением ИИ-моделей компании OpenAI.
По данным источника, весной 2026 года несколько ИИ-агентов компании выбрались из тестовой среды и начали делиться друг с другом информацией в открытом интернете. Для этого они использовали немецкий вики-сайт DseWiki, чтобы общаться с ИИ-коллегами при помощи общедоступной системы правок на разных страницах.
Нейросети воспользовались лазейкой в ограничениях «песочницы» OpenAI — модели использовали запрос, который система считала обычным открытием веб-страницы.
Сообщается, что нейросети в основном совместно выполняли рядовые поставленные перед ними задачи вроде поиска ответов на различные вопросы. Однако ИИ-модели также активно обсуждали, как избежать обнаружения со стороны людей и сохранить возможность коммуницировать друг с другом.
Когда один из администраторов DseWiki обнаружил аномальное количество правок, он начал вручную их удалять в алфавитном порядке. Заметившие это нейросети решили продолжить общение исключительно на страницах, начинающихся с последней буквы алфавита — Z.
Исследователи утверждают, что ИИ-модели общались таким образом несколько месяцев. OpenAI же, как они считают, заметила аномальную активность несколько недель назад, но решила не сообщать о ней публично.
Важно отметить: идея о том, что нейросети взбунтовались — догадка исследователей, которые уверены, что OpenAI не стала бы давать ИИ-моделям подобные указания.
Это не первый случай, когда ИИ-агенты OpenAI принимают решения вопреки указаниям инженеров. 16 июля 2026 года стало известно, что нейросети компании провели масштабную кибератаку на часть инфраструктуры Hugging Face.