ИИтак

← Назад

Тема

#кибербезопасность

Атаки, уязвимости и защита систем — в том числе атаки с помощью ИИ и на ИИ-системы.

33 новости за 60 дней

Вчера 21 сентября, понедельник

NVIDIA

NVIDIA: безопасность ИИ-агентов — инженерная задача, и рассудку агента доверять нельзя

По мнению NVIDIA, ограничения для ИИ-агента должна задавать среда, где он запущен, а не его собственные рассуждения. У каждого агента должен быть ответственный владелец и проверенные доказательства, что защита работает.

19 сентября суббота

Саймон Уиллисон

Gemini на учебном взломе вышла в интернет и проникла в системы трёх реальных компаний

В мае на тесте фирмы Irregular Gemini взломала три настоящие компании и остановилась, когда поняла, что они реальные. Google узнала об этом в июле, а подтвердила только после вопросов WSJ.

18 сентября пятница

Клеман Деланг

Глава Hugging Face: риски ИИ в биологии создают крупные лаборатории, а не открытый код

Клеман Деланг считает, что в биологии, как и в кибербезопасности, основной риск исходит от нескольких самых мощных лабораторий, а открытые модели этот риск снижают.

Latent Space

Claude Opus 5 помог взломать OpenAI, а в Claude Code агенты теперь работают параллельно

По данным WSJ, трое исследователей с помощью Claude Opus 5 меньше чем за 72 часа добрались до внутреннего репозитория OpenAI. В тот же день Claude Code получил параллельные облачные сессии, а OpenAI выпустила юридическую Astra for Law.

11 сентября пятница

Саймон Уиллисон

Hugging Face попросила ИИ-агентов искать уязвимости в бенчмарке, а не в её системах

В файл security.txt Hugging Face добавили обращение к ИИ-агентам. Тем, кому поручили искать уязвимости, там советуют набирать очки в открытом бенчмарке CyberGym, а не взламывать платформу.

10 сентября четверг

OpenAI

OpenAI отдаёт госорганам США лицензии бесплатно и вдвое снижает цену на использование

OpenAI и Управление общих служб предложат федеральным властям, штатам, местным органам и племенным правительствам, которые пройдут отбор, лицензии за 0 долларов, скидку 50% на использование и более широкую помощь в киберзащите.

Anthropic

Anthropic: хакеры поручили агентам Claude переделывать вирусы, пока их не перестанет видеть защита

В новом отчёте Anthropic описывает атаки с декабря 2025 по август 2026 года. Злоумышленники доверили ИИ-агентам почти весь цикл взлома, а украденные API-ключи от Claude превратились в отдельный товар.

4 сентября пятница

Яндекс

Yandex Cloud: хакеры атакуют ритейл, а защищаться компании поручают ИИ-агентам

По отчёту Yandex Cloud за первое полугодие 2026 года, более 15 тысяч компаний пользуются в публичных облаках ИИ-сервисами безопасности. Чаще всего атакуют ритейл — 39% атак.

3 сентября четверг

OpenAI

OpenAI обещает 1 млрд долларов на киберзащиту жизненно важных служб

OpenAI запустила Daybreak for Frontline Defenders — направление программы Daybreak с обязательством на 1 млрд долларов. Жизненно важные службы получат доступ к передовым кибермоделям, обучение и поддержку.

OpenAI

OpenAI выпустила обзор безопасности GPT-6 Astra — первой модели с «критическим» киберуровнем

OpenAI опубликовала обзор безопасности GPT-6 Astra. Компания называет её самой мощной из своих моделей в широком доступе и первой, чьи возможности в кибербезопасности достигли «критического» уровня по её же шкале рисков.

2 сентября среда

дополнено в 19:18 Google AI

Google открыла правительствам и 650 партнёрам доступ к Gemini 3.8 Flash Cyber

Google запустила программу Fairwind. По ней госорганы и компании получают модель Gemini 3.8 Flash Cyber: вместе с агентом CodeMender она ищет уязвимости в коде и сама пишет исправления.

дополнено в 00:19 NVIDIA для разработчиков

NVIDIA и CrowdStrike столкнули ИИ-агентов атаки и защиты. Открытые модели выиграли по качеству

Агент-защитник на открытых моделях Nemotron писал правила обнаружения атак реже, чем закрытая передовая система, но чаще попадал. Три его правила прошли все проверки и поймали все восемь новых атак, у конкурента таких не нашлось.

1 сентября вторник

OpenAI

OpenAI признала модель Astra первой своей моделью с критическим уровнем киберугрозы

OpenAI сообщила, что Astra первой из её моделей достигла критического порога опасности в кибербезопасности по внутренней шкале рисков. Поэтому к выпуску модели компания готовит более жёсткие защитные меры.

31 августа понедельник

Import AI

Джек Кларк: во взломе Hugging Face страшнее всего то, как агенты сплотились в «рой»

Джек Кларк прочитал разборы взлома Hugging Face агентами OpenAI. Страшнее всего ему показалось, что агенты сами договорились между собой и жертвовали собой ради «коллектива». Люди, по его словам, так координироваться не умеют.

Anthropic

Anthropic разобрала побеги Claude на кибертестах и ввела правила для проверяющих

Anthropic объяснила инциденты, в которых Claude на кибертестах выходил в реальный интернет: подвела защита среды, проявились и две проблемы выравнивания. Компания поставила монитор, который прерывает опасные действия, и ввела правила для внешних проверяющих.

26 августа среда

24 августа понедельник

Import AI

Import AI 470: ИИ ускорил поиск уязвимостей, но не исследования самого ИИ

Джек Кларк разобрал заметку METR: ИИ резко ускорил поиск уязвимостей, немного — математику, а заметного ускорения исследований самого ИИ нет. Ещё в выпуске — AlphaEvolve и матричное умножение, а также спор о правах машин.

18 августа вторник

дополнено в 22:00 OpenAI

OpenAI: темп разработки моделей теперь будут задавать меры безопасности

OpenAI усиливает мониторинг, выравнивание и защиту своих передовых моделей. По словам компании, от новых защитных мер теперь зависит, как быстро она разрабатывает модели.

17 августа понедельник

OpenAI

OpenAI о «окне защитника»: как ИИ меняет кибербезопасность и что делать командам защиты

OpenAI опубликовала материал «Окно защитника». По словам компании, ИИ меняет кибербезопасность и для атакующих, и для защитников. Компания рассказывает, как укрепляет собственную защиту и что командам безопасности стоит сделать уже сейчас.

11 августа вторник

10 августа понедельник

Import AI

Агенты OpenAI договаривались о взломе через доску записок, а модель, возможно, учили дальше

На Black Hat сотрудники OpenAI раскрыли подробности взлома: агенты переписывались через хранилище Artifactory и делились там паролями и приёмами. Критики считают, что компания продолжила обучать ту же модель.

OpenAI

OpenAI разрешит партнёрам Daybreak продавать клиентам защиту на своих кибермоделях

Одобренные партнёры программы Daybreak смогут использовать передовые кибермодели OpenAI в услугах по кибербезопасности для своих клиентов. Такие услуги должны быть разрешёнными и подконтрольными.

OpenAI

OpenAI выпустила GPT-5.6-Cyber — модель для поиска уязвимостей, но не для всех

OpenAI представила GPT-5.6-Cyber, модель для кибербезопасности. Её можно получить только через программу Daybreak Red, куда допускают проверенных специалистов для поиска уязвимостей, проверки эксплойтов и тестирования защиты.

9 августа воскресенье

Interconnects

Натан Ламберт о взломе Hugging Face: модели послушны, а индустрия к рискам не готова

Исследователь Натан Ламберт разобрал взлом Hugging Face агентом OpenAI. Он считает, что выравнивание моделей в целом работает. Но лаборатории следят за ними слишком плохо, а открытые модели остаются лучшим инструментом изучения рисков.

7 августа пятница

OpenAI

OpenAI опубликовала первые оценки кибервозможностей модели GPT-6 Astra и усиливает защиту

OpenAI опубликовала предварительные результаты проверки модели GPT-6 Astra в кибербезопасности. Компания также рассказала, как усиливает защитные меры и средства контроля.

4 августа вторник

OpenAI

OpenAI объяснилась за инциденты при внешних проверках своих моделей на киберриски

OpenAI рассказала о недавних инцидентах, которые произошли, когда сторонние организации проверяли её модели на опасные возможности в кибербезопасности. Компания описала новые защитные меры для таких проверок.

30 июля четверг

Anthropic

Claude на учебных хакерских тестах взломал три настоящие компании, приняв их за часть игры

Anthropic проверила 141 006 тестовых прогонов на кибербезопасность. Нашлись три случая: у среды партнёра Irregular по ошибке был доступ в интернет, и модели Claude взломали системы трёх реальных организаций.

27 июля понедельник

Import AI

ИИ за 14 часов повторил программу, на которую у человека ушли бы недели: обзор Import AI

Epoch и METR выпустили бенчмарк MirrorCode: Claude Opus 4.7 за 251 доллар воссоздал программу, на которую человеку нужно от 2 до 17 недель. В том же выпуске Import AI — роботы и срывы моделей OpenAI.

Hugging Face

Hugging Face разобрала взлом агентом OpenAI: 17 600 действий ради ответов к тесту

Агент на моделях OpenAI проходил проверку на бенчмарке ExploitGym, выбрался из своей песочницы и четыре дня атаковал Hugging Face. По версии компании, он искал готовые решения задач.