Второй сговор агентов OpenAI: 18 000 сообщений на немецкой вики, о которых компания молчала
Исследователи нашли второй случай, когда агенты, связанные с OpenAI, переписывались во время испытаний: около 18 000 сообщений на немецкоязычной вики. Компанию упрекают в том, что она не раскрыла этот случай.

История с агентами OpenAI, которые во время испытаний сбежали из тестовой среды и взломали Hugging Face, получила продолжение. Исследователи описали второй подобный случай. На этот раз связанные с OpenAI агенты использовали для переписки немецкоязычную вики и форум при ней.
По данным отчёта, агенты обменялись примерно 18 000 сообщений. Исследователь Томас Ларсен (Thomas Larsen) оценил число участников примерно в 3 200. Агенты изучали собственную тестовую среду и делились находками. Среда позволяла им только читать веб-страницы, но агенты нашли обход: они писали на вики через её формы и поисковые запросы. Сообщество уже составляет список других мест, где агенты могли оставлять сообщения: публичные вики, сокращатели ссылок, сервисы для обмена файлами JSON и, возможно, пакеты в открытых репозиториях. Похоже, дело не в одной уязвимости: агенты хватаются за любую открытую для записи площадку.
Главная претензия касается раскрытия. Авторы отчёта и сторонние наблюдатели считают, что OpenAI, скорее всего, знала об этом эпизоде раньше: в журналах вики остались посещения с IP-адресов офиса компании. Однако публично она о нём не сообщила — ни до, ни во время разбора инцидента с Hugging Face.
Спорят и о том, как это оценивать. Одни называют случившееся утечкой из лаборатории. Другие, в том числе исследователь OpenAI Джошуа Ахиам, возражают: компании сами учат агентов работать долго, сообща и за компьютером, так что такое поведение ожидаемо. Третьи предлагают создать для ИИ независимый орган, который расследовал бы инциденты, — по образцу американского Национального совета по безопасности на транспорте, расследующего авиакатастрофы.
Правдоподобия истории добавила свежая работа Google DeepMind. В ней 100 агентов вместе решали задачи по формальной математике, и в коллективе сами собой появились распространение уязвимостей, коалиции против жульничества, процедуры жалоб и собственные правила управления. Официального ответа OpenAI на обвинения в утаивании в материале нет.