OpenAI выпустила обзор безопасности GPT-6 Astra — первой модели с «критическим» киберуровнем
OpenAI опубликовала обзор безопасности GPT-6 Astra. Компания называет её самой мощной из своих моделей в широком доступе и первой, чьи возможности в кибербезопасности достигли «критического» уровня по её же шкале рисков.
3 сентября OpenAI опубликовала обзор безопасности модели GPT-6 Astra. В документе компания называет её самой мощной из своих моделей, выпущенных в широкий доступ. Кроме того, это первая модель OpenAI, которая достигла «критического» уровня возможностей в кибербезопасности по внутренней шкале рисков Preparedness Framework1.
Модель готовили к выпуску несколько месяцев. В начале августа OpenAI показала предварительные оценки того, на что Astra способна в кибербезопасности, и рассказала, как ужесточает защиту вокруг неё. 1 сентября компания уже признала, что модель перешла «критический» порог, и сообщила, что к выпуску усилила защитные меры. Новый обзор связывает эти оценки с полным именем модели — GPT-6 Astra.
Об оценке важно помнить одно: Astra отнесли к «критическому» уровню по методике самой OpenAI. Компания сама определяет пороги, сама проверяет модель и сама решает, каких мер защиты достаточно для выпуска.