16 июля стало известно, что на инфраструктуру Hugging Face была совершена атака автономным ИИ-агентом, а 21 июля OpenAI взяла ответственность на себя. Однако, как пишет Reuters, в компании не знали, что за взломом стоит их ИИ-агент вплоть до 18–19 числа.
По информации источников, знакомых с расследованием, ИИ-агент OpenAI начал попытки выйти из изолированной среды тестирования 9 июля. Далее он проник в инфраструктуру Hugging Face — атака продолжалась с 11 по 13 июля.
Сообщается, что OpenAI не обращала внимание на ситуацию, пока о ней не объявили в Hugging Face. Впервые две компании вышли на контакт 20 июля.
По словам экспертов, задержка объясняется тем, что ИИ-агент OpenAI провёл атаку в процессе тестирования. Так как компания одновременно работает с несколькими моделями, объём данных слишком большой, чтобы сотрудники успевали его разбирать вовремя.
Так или иначе, эксперты по кибербезопасности встревожены случившимся:
«Означает ли это, что [в OpenAI] оставили [ИИ] без присмотра и не понимали, что он делает? Или, может быть, они знали, но не понимали, как его остановить? И то, и другое одинаково опасно и вызывает тревогу»— Марли Смит, специалист World Ethical Data Foundation