OpenAI: внешние проверки безопасности ИИ должны быть строгими и не зависеть от разработчиков
OpenAI сформулировала, какими должны быть сторонние проверки безопасности передовых моделей ИИ и их защитных мер: строгими, независимыми от разработчиков и не допускать утечек конфиденциальных данных.
Сторонние проверки безопасности ИИ должны быть строгими, независимыми от разработчиков моделей и не допускать утечек конфиденциальных данных. Так OpenAI сформулировала свои приоритеты и принципы для таких оценок. Проверять предлагается и сами передовые модели1, и их защитные меры — то, что мешает использовать модель во вред.
OpenAI высказалась вслед за другими. На прошлой неделе AI Evaluator Forum2 в открытом письме призвал все компании, создающие передовые модели, пускать к себе сторонних оценщиков, чтобы те изучали риски изнутри. В пример условий такой работы письмо приводит стандарт AEF-13 — форум выпустил его ещё в декабре 2025 года. А глава Anthropic Дарио Амодеи пообещал пустить проверяющих в офис компании и дать им доступ почти такой же, как у внутренних команд по оценке рисков.