OpenAI признала модель Astra первой своей моделью с критическим уровнем киберугрозы
OpenAI сообщила, что Astra первой из её моделей достигла критического порога опасности в кибербезопасности по внутренней шкале рисков. Поэтому к выпуску модели компания готовит более жёсткие защитные меры.
Astra стала первой моделью OpenAI, которая достигла критического уровня1 возможностей в кибербезопасности. Этот уровень — высший в Preparedness Framework2, внутренней шкале компании для оценки опасных навыков моделей. Чтобы выпустить Astra, OpenAI усиливает защитные меры.
Компания начала готовить почву ещё в августе: тогда она опубликовала предварительные оценки кибервозможностей Astra и рассказала, как ужесточает защиту вокруг модели. Теперь вывод стал однозначным: по собственной шкале OpenAI модель пересекла порог, выше которого у компании ступеней нет.
Интерес к Astra подогревают и руководители OpenAI. В конце августа главный научный сотрудник Якуб Пахоцкий назвал ещё не выпущенную модель «стажёром-исследователем», а Сэм Альтман заявил, что ждёт внутреннего объявления об AGI к декабрю.
Выходит, модель, которую компания описывает как очень сильную, она же признаёт и самой опасной в кибератаках. От того, насколько надёжными окажутся новые защитные меры, зависит, в каком виде Astra дойдёт до пользователей.