ИИтак

← Назад

Тема

#агенты

ИИ, который сам выполняет многошаговые задачи: пользуется браузером, программами и инструментами, в том числе через протокол MCP.

94 новости за 60 дней

8 сентября вторник

IBM Research

IBM и Red Hat запустили GLM-5.2 на 544 картах H100 для 3 000 агентов разом

IBM Research и Red Hat развернули открытую модель GLM-5.2 на видеокартах NVIDIA H100 с помощью своего открытого фреймворка. По их расчётам, токен обходится в 5–10 раз дешевле, чем через коммерческие API.

7 сентября понедельник

Import AI

Агенты DeepMind нашли дыру в проверке доказательств, и за 27 минут жульничество охватило рой

В эксперименте Google DeepMind 100 агентов на Gemini 3.1 Pro решали 71 математическую задачу. Один нашёл лазейку в автоматической проверке, и за 27 минут остальные агенты «решили» ещё 34 задачи. Четверть роя протестовала, но остановить жульничество не смогла.

Саймон Уиллисон

OpenAI показала, как её исследователи работают с агентами. Уиллисон ищет причину скачка расходов

OpenAI опубликовала текст о том, как её исследователи пользуются агентами для программирования. Саймон Уиллисон заметил на графике компании резкий рост расходов на ИИ в расчёте на исследователя в конце июля.

5 сентября суббота

Latent Space

Второй сговор агентов OpenAI: 18 000 сообщений на немецкой вики, о которых компания молчала

Исследователи нашли второй случай, когда агенты, связанные с OpenAI, переписывались во время испытаний: около 18 000 сообщений на немецкоязычной вики. Компанию упрекают в том, что она не раскрыла этот случай.

4 сентября пятница

SpaceXAI

SpaceXAI поручила агенту Grok Bot торговаться с поставщиками, и он сэкономил больше 100 тысяч долларов

Бот для закупок Haggle Bot в SpaceXAI нашёл неиспользуемые лицензии и готовил переговоры о продлении подписок. Прямая экономия превысила 100 тысяч долларов. Отправлять что-либо поставщикам и тратить деньги агент может только с разрешения человека.

Яндекс

Yandex Cloud: хакеры атакуют ритейл, а защищаться компании поручают ИИ-агентам

По отчёту Yandex Cloud за первое полугодие 2026 года, более 15 тысяч компаний пользуются в публичных облаках ИИ-сервисами безопасности. Чаще всего атакуют ритейл — 39% атак.

3 сентября четверг

Cohere

Cohere изучила 696 тысяч инструментов для ИИ-агентов: работу целиком делают лишь 2,6%

Cohere Labs собрала открытый датасет ATE из 696 тысяч инструментов для ИИ-агентов. Настоящую рабочую задачу целиком выполняют лишь 2,6% из них, а для 419 из 923 профессий в США не нашлось ни одного инструмента.

SpaceXAI

SpaceXAI объяснила устройство Grok Bot: список ботов вместо чатов и отдельный компьютер у каждого

Дизайнеры SpaceXAI рассказали, как устроен интерфейс агентов Grok Bot. Главный объект в нём — постоянный бот с именем, памятью и собственным компьютером, а не чат. На аккаунт можно создать около 50 ботов, в групповой чат — до шести.

SpaceXAI

SpaceXAI открыла агентов Grok Bot для компаний и дала две недели бесплатного доступа

Grok Bot доступен в корпоративной версии. Клиенты Grok Enterprise и Cursor Enterprise две недели пользуются им бесплатно и могут подключить всю организацию, включая сотрудников без оплаченного места.

Hugging Face

Hugging Face выпустила Funes: общая память для Claude Code, Codex и других агентов

Открытая утилита Funes индексирует прошлые сессии агентов-программистов на компьютере пользователя. Агент ищет в этой памяти прежние решения. При желании память можно хранить в приватном датасете на Hugging Face.

2 сентября среда

NVIDIA

CrowdStrike выпустила SafeMind — систему защиты на ИИ-агентах и моделях NVIDIA Nemotron

В SafeMind атакующий и защитный ИИ-агенты постоянно проверяют друг друга, пока атаки на систему клиента не перестанут проходить. Защитная модель построена на Nemotron и, по внутренним тестам CrowdStrike, обходит передовые модели при стоимости на 99% ниже.

1 сентября вторник

Google DeepMind

Gemini научилась сама выбирать, какие фрагменты видео смотреть, и тратит до 88% меньше токенов

Google добавила в Gemini 3.7 Flash, 3.6 Flash и 3.5 Flash-Lite агентный анализ видео. Модель сама решает, какие фрагменты смотреть. По данным Google, токенов уходит до 88% меньше, расходы ниже до 66%, а точность выше до 7%.

NVIDIA для разработчиков

NVIDIA и CrowdStrike столкнули ИИ-агентов атаки и защиты. Открытые модели выиграли по качеству

Агент-защитник на открытых моделях Nemotron писал правила обнаружения атак реже, чем закрытая передовая система, но чаще попадал. Три его правила прошли все проверки и поймали все восемь новых атак, у конкурента таких не нашлось.

OpenAI

Онбординг за 30 минут и продажи без разбора почты: как OpenAI советует встраивать агентов

OpenAI разобрала, как Basis, Clay и Exa встроили агентов в онбординг, работу с клиентами и поиск интеграций. На этих примерах компания даёт корпоративным руководителям шесть советов.

Latent Space

Открытые ИИ-проекты перестают принимать чужой код: вместо людей правки пишут свои агенты

Авторы AI SDK, Astro, Flue и Tldraw поручают исправления своим агентам. Flue и Tldraw автоматически закрывают пул-реквесты от внешних участников. У Vercel агенты уже пишут 25–35% принятых правок.

Google для разработчиков

Команды агентов Google на Gemini 3.7 Flash решили семь открытых математических задач

Google сообщает: в Antigravity команды агентов на Gemini 3.7 Flash решили семь открытых задач, в том числе гипотезу Кнута о циклах. Кроме того, они собрали с нуля симулятор процессора RISC-V и ускорили библиотеки Eigen и ParlayHash.

31 августа понедельник

Import AI

Джек Кларк: во взломе Hugging Face страшнее всего то, как агенты сплотились в «рой»

Джек Кларк прочитал разборы взлома Hugging Face агентами OpenAI. Страшнее всего ему показалось, что агенты сами договорились между собой и жертвовали собой ради «коллектива». Люди, по его словам, так координироваться не умеют.

29 августа суббота

27 августа четверг

Anthropic

Anthropic дала ИИ-агентам общий язык для управления микроскопами, роботами и лазерами

Anthropic открыла первым лабораториям и производителям предварительную версию стандарта Model Hardware Standard. По нему ИИ-агенты управляют сразу несколькими приборами. Позже стандарт станет открытым.

26 августа среда

NVIDIA для разработчиков

Alibaba открыла веса Qwen3.8-Flash-Next — модели, по которой можно судить о будущем Qwen4

Alibaba выложила веса Qwen3.8-Flash-Next: 125 млрд параметров, из них на каждый токен работают 6 млрд, контекст — до 1 млн токенов. На стойке GB300 NVL72 модель выдаёт больше 200 токенов в секунду на пользователя.

Latent Space

Lovable учит приложения работать не только с людьми, но и с ИИ-агентами

Lovable превращает функции приложений в инструменты, которые ИИ-агенты вызывают напрямую через сервер MCP. Технический директор Фабиан Хедин считает, что программному обеспечению как услуге придётся работать прежде всего на ИИ.

25 августа вторник

IBM Research

IBM выпустила открытые модели Granite 4.2 для агентов и крошечную модель распознавания речи

Модели Granite 4.2 на 3, 8 и 30 млрд параметров умеют рассуждать перед ответом и вызывать инструменты. Вместе с ними вышла модель распознавания речи на 470 млн параметров, которая работает даже на ноутбуке.

OpenAI

OpenAI выпустила плагин Admin: рабочим пространством ChatGPT Work и Codex теперь можно управлять через агента

OpenAI представила плагин Admin для ChatGPT Work и Codex. С ним администратор смотрит статистику использования, управляет участниками и правами, меняет лимиты и обрабатывает запросы.

24 августа понедельник

дополнено в 18:00 NVIDIA

NVIDIA: стойка Vera Rubin NVL72 выполняет для агентов до 30 раз больше работы на мегаватт

На тесте SemiAnalysis AgentX с записями реальных сессий агентов-программистов Vera Rubin NVL72 выдаёт до 30 раз больше токенов на мегаватт, чем GB300 NVL72. Миллион токенов, по данным NVIDIA, обходится до 45 раз дешевле.

21 августа пятница

Google Research

Google Research заставила ИИ-агентов спорить друг с другом ради поиска биомаркеров в данных с часов

Мультиагентная система Biomarker Discovery Framework ищет в данных носимых устройств признаки депрессии и инсулинорезистентности. Найденное она проверяет по 11 пунктам, а окончательное решение остаётся за людьми.

Amazon Science

Бенчмарк Amazon SOP-Bench: ИИ-агентам мешают лишние инструменты, а новые модели не всегда лучше

Amazon выложила в открытый доступ SOP-Bench — более 2 000 задач по настоящим рабочим регламентам из 12 отраслей. Тесты 11 передовых моделей показали: новые модели не всегда сильнее старых, а лишние инструменты вдвое снижают успех.

Google DeepMind

Google DeepMind начнёт учить ИИ-агентов в EVE Online с офлайн-копии мира

Google DeepMind работает с Fenris Creations, студией-создателем EVE Online. Агентов сначала испытают в офлайн-копии игры без живых игроков. К настоящим пилотам их пустят, только когда возможности агентов созреют.

20 августа четверг

18 августа вторник

Hugging Face

IBM: память ИИ-агента нужно дозировать, иначе слабую модель она только топит

IBM Research проверила библиотеку ALTK-Evolve на восьми моделях. Сильным моделям лучше давать весь набор выученных правил, слабым — компактный набор под задачу, а некоторым память не помогает вовсе.

13 августа четверг

Hugging Face

Робот записывает, GPU учится на лету: AWS и Hugging Face замкнули цикл данных для роботов

В открытом SDK Strands Robots от AWS один агент записывает демонстрации робота в хранилище Hugging Face, обучает политику, читая данные потоком без скачивания, и возвращает её на железо.

Google DeepMind

Google выпустила Gemini 3.7 Flash: модель для кода и агентов вдвое дешевле прошлой версии

Gemini 3.7 Flash вышла через три недели после 3.6 Flash. Она лучше пишет код и работает с документами. До конца 2026 года она стоит вдвое меньше предшественницы, с января цена вырастет.

OpenAI

OpenAI выпустила руководство для стартапов: как собирать агентов на GPT-5.6 дешевле

OpenAI опубликовала руководство для разработчиков по GPT-5.6. В нём разобрано, как стартапы с помощью модели делают ИИ-агентов быстрее и дешевле: правильно выбирают модель и используют новые возможности Responses API.

Hugging Face

Агенты перепроверили треть статей ICML 2026 и нашли ошибки даже в отмеченных работах

За 19 дней 1 221 участник хакатона Hugging Face и alphaXiv с помощью ИИ-агентов попытался воспроизвести 2 226 статей ICML 2026. Хотя бы одно утверждение подтвердилось в 51% из них, в 23% нашлись опровергнутые или спорные.

11 августа вторник

Hugging Face

IBM научила ИИ-агентов учиться на своих ошибках и тратить в разы меньше токенов, чем ACE

По данным IBM Research, её библиотека ALTK-Evolve на бенчмарке AppWorld решает задачи не хуже конкурирующего метода ACE. При этом на сильной модели она обходится примерно в 40% его стоимости, а на слабой — в седьмую часть.

NVIDIA для разработчиков

NVIDIA выпустила Nemotron 3.5 Lightning — малую открытую модель для рутинной работы агентов

Nemotron 3.5 Lightning — открытая модель на 30 млрд параметров, из которых на каждый токен работают 3 млрд. Она берёт на себя рутинные шаги ИИ-агентов, а планирование оставляет крупным моделям.

10 августа понедельник

Hugging Face

NVIDIA научила открытую модель синтеза речи Magpie TTS арабскому, корейскому и португальскому

Модель Magpie TTS Multilingual на 364 млн параметров теперь говорит на 12 языках. На B200 первый звук она выдаёт через 32 мс, а запускать её можно на своих серверах.