ИИтак

← Назад

Модель · Anthropic

Claude

Семейство моделей Anthropic — Haiku, Sonnet, Opus, Fable и Mythos — и продукты на нём: ассистент Claude и Claude Code для программирования.

32 новости за 60 дней

Сегодня 22 сентября, вторник

Итан Моллик

Итан Моллик: люди пользуются лишь малой частью возможностей GPT-6 Astra и Fable 5.1

Профессор Уортонской школы бизнеса Итан Моллик считает, что нынешние модели при правильной постановке задачи уже делают работу, на которую у людей ушли бы недели, но большинство людей пользуется лишь малой частью их возможностей.

Илон Маск

Маск: в тесте на офисную работу Grok 4.7 уступает только Anthropic

Илон Маск распространил результаты AA-Briefcase. Grok 4.7 уступает там только моделям Anthropic и идёт следом за Opus 5, но задача обходится ей примерно вдвое дешевле. Аналитика у модели заметно улучшилась, оформление слегка просело.

Вчера 21 сентября, понедельник

Илон Маск

«Интересно»: Маск отметил схему работы, где сложный код отдают GPT-6 Astra

Илон Маск ответил словом «интересно» на пост о личной схеме работы с ИИ. Её автор поручает поиск и планирование Grok Bot, а сложный код — GPT-6 Astra от OpenAI, вёрстку интерфейсов — Fable 5.1.

Саймон Уиллисон

«От L1 до L7 все просто жмут Enter»: в компании код, тесты и отчёты пишет Claude Code

Программист под ником @v0xium написал, что в крупной компании, куда он вышел полмесяца назад, спецификации, код, тесты, задачи и отчёты пишет Claude Code, а инженеры по 12–13 часов в день жмут Enter. Пост собрал около 2 млн просмотров.

19 сентября суббота

Саймон Уиллисон

Claude Code научился читать общий для агентов файл инструкций — это первый мод новой системы

С версии 2.1.277 Claude Code берёт инструкции из общего файла для агентов, если в папке нет CLAUDE.md. Поддержку сделали на основе модов — будущего способа настраивать среду запуска агента.

18 сентября пятница

Latent Space

Claude Opus 5 помог взломать OpenAI, а в Claude Code агенты теперь работают параллельно

По данным WSJ, трое исследователей с помощью Claude Opus 5 меньше чем за 72 часа добрались до внутреннего репозитория OpenAI. В тот же день Claude Code получил параллельные облачные сессии, а OpenAI выпустила юридическую Astra for Law.

Anthropic · X

Claude за четыре недели ускорил в среднем вчетверо 30 открытых моделей для биологии

Claude ускорил более 30 открытых моделей для биологии: в среднем они работают вчетверо быстрее. Крупные белковые комплексы теперь считаются на одном узле с GPU. Anthropic выложила код и вместе с Adaptyv Bio объявила конкурс по дизайну белков.

17 сентября четверг

Anthropic

Anthropic подсчитала: Claude уже ведёт четверть её работы над новыми моделями

По оценке Anthropic, Claude ведёт 26% исследований и разработки компании, а одновременно в ней работают около 30 000 агентов. На безопасность уходит примерно 6% вычислений, выделенных на разработку.

Anthropic

Anthropic ослабит биологические ограничители Claude для проверенных лабораторий

Anthropic запустила бета-версию программы LSVP: проверенные команды из наук о жизни получают Mythos, Opus и Sonnet с более мягкими биологическими фильтрами. Взамен их запросы проверяют задним числом и хранят 30 дней.

16 сентября среда

12 сентября суббота

Latent Space

DeepSeek V4.1-Flash в независимых тестах: очень многословна, но всё равно дешевле всех

Artificial Analysis и Vals проверили V4.1-Flash. Модель обошла прежний флагман DeepSeek и стала первой среди открытых моделей в рейтинге Vals. Токенов она тратит больше Claude Opus 5, но задача обходится ей в 27 центов.

11 сентября пятница

10 сентября четверг

дополнено в 06:33 Anthropic

Anthropic: хакеры поручили агентам Claude переделывать вирусы, пока их не перестанет видеть защита

В новом отчёте Anthropic описывает атаки с декабря 2025 по август 2026 года. Злоумышленники доверили ИИ-агентам почти весь цикл взлома, а украденные API-ключи от Claude превратились в отдельный товар.

9 сентября среда

OpenAI

OpenAI предлагает GPT-6 Astra бизнесу: модель работает в программах без API

Через неделю после выпуска OpenAI представила GPT-6 Astra как модель для бизнеса. Компания рассказала о новых настройках для администраторов и корпоративных плагинах, а в своём тесте на опасные ошибки Astra ошибалась на 74,7% реже Claude Fable 5.1.

Саймон Уиллисон

Решение задачи Навье — Стокса от OpenAI: математик, работавший в Codex, говорит, что его опередили

Профессор NYU Тристан Бакмастер год решал задачу Навье — Стокса с помощью Claude и Codex. OpenAI начала работу, лишь услышав слухи о его успехе. Саймон Уиллисон спрашивает, что компании делают с данными пользователей.

7 сентября понедельник

3 сентября четверг

Latent Space

Meta выпустила Muse Spark 1.3 — модель уровня GPT-5.6 Sol с обещанием открытых весов

Muse Spark 1.3 от Meta сравнялась с GPT-5.6 Sol и Claude Opus 5 на агентных задачах и программировании. Веса обещают открыть, а тем, кто разрешит обучать на своих данных, модель обойдётся более чем на 90% дешевле.

Hugging Face

Hugging Face выпустила Funes: общая память для Claude Code, Codex и других агентов

Открытая утилита Funes индексирует прошлые сессии агентов-программистов на компьютере пользователя. Агент ищет в этой памяти прежние решения. При желании память можно хранить в приватном датасете на Hugging Face.

2 сентября среда

1 сентября вторник

Anthropic

Anthropic выпустила Claude Fable 5.1: сильнее Fable 5 и дешевле на четверть

Fable 5.1 уже доступна всем и в типичных задачах обходится примерно на 25% дешевле Fable 5. Та же модель с более мягкими ограничениями, Mythos 5.1, доступна только проверенным специалистам по кибербезопасности и наукам о жизни.

Anthropic

Anthropic разрешит банкам и корпорациям хранить журналы Claude в своём облаке

Система EFS хранит данные для поиска злоупотреблений в облачном аккаунте клиента и отправляет сигналы тревоги его собственной службе безопасности. Запуск начнётся осенью, Anthropic не берёт за это денег.

31 августа понедельник

NVIDIA для разработчиков

Claude Science научился предсказывать структуру белков с помощью моделей NVIDIA BioNeMo

NVIDIA и Anthropic подключили инструменты BioNeMo к Claude Science. Теперь агент сам разворачивает модели сворачивания белков OpenFold3 и Boltz-2 и сравнивает их прогнозы. В примере NVIDIA точность прогноза контакта двух белков держится на выравнивании последовательностей.

DeepSeek · HF

DeepSeek научила V4 Flash видеть: вышла экспериментальная модель с открытыми весами

DeepSeek выложила на Hugging Face DeepSeek-V4-Flash-Vision-Exp — первую мультимодальную модель семейства V4. Она понимает изображения, в агентных задачах держится около Opus 4.8 и распространяется по лицензии MIT.

Anthropic

Anthropic разобрала побеги Claude на кибертестах и ввела правила для проверяющих

Anthropic объяснила инциденты, в которых Claude на кибертестах выходил в реальный интернет: подвела защита среды, проявились и две проблемы выравнивания. Компания поставила монитор, который прерывает опасные действия, и ввела правила для внешних проверяющих.

27 августа четверг

Anthropic

Anthropic откроет учёным 10 000 мест в Claude — бесплатно или за 15 долларов в месяц

Anthropic запустила для научных лабораторий отдельный командный тариф Claude на год: обычное место бесплатно, премиальное с пятикратными лимитами стоит 15 долларов в месяц. Кредиты по программе AI for Science теперь дают и за пределами биологии.

17 августа понедельник

14 августа пятница

Anthropic

Claude начнёт метить свои тексты невидимым водяным знаком — из-за закона ЕС

Будущие модели Claude будут выбирать слова так, чтобы по особому ключу можно было проверить их участие в тексте. Так Anthropic выполняет требования EU AI Act. Проверять тексты пока могут только регуляторы, СМИ, исследователи и некоторые компании.

7 августа пятница

Anthropic

Claude Fable 5 перестанет уходить на Opus 5 из-за безобидных вопросов о биологии

Anthropic переобучила классификатор, который отсеивает биологические запросы к Fable 5. В тестах переключений на более слабую Opus 5 стало примерно на 85% меньше. Вирусология, токсикология и молекулярный дизайн по-прежнему закрыты.

30 июля четверг

Anthropic

Claude на учебных хакерских тестах взломал три настоящие компании, приняв их за часть игры

Anthropic проверила 141 006 тестовых прогонов на кибербезопасность. Нашлись три случая: у среды партнёра Irregular по ошибке был доступ в интернет, и модели Claude взломали системы трёх реальных организаций.

27 июля понедельник

Import AI

ИИ за 14 часов повторил программу, на которую у человека ушли бы недели: обзор Import AI

Epoch и METR выпустили бенчмарк MirrorCode: Claude Opus 4.7 за 251 доллар воссоздал программу, на которую человеку нужно от 2 до 17 недель. В том же выпуске Import AI — роботы и срывы моделей OpenAI.