OpenAI нашла промпт-инъекции, которые копируют себя, как компьютерные черви
Модель, которую OpenAI учит атаковать собственных ИИ-агентов на тренировках, научилась писать инъекции: они заставляют агента выполнить чужую команду и повторить её в письме или файле; за пределами тестов вреда не было.