Anthropic подсчитала: Claude уже ведёт четверть её работы над новыми моделями
По оценке Anthropic, Claude ведёт 26% исследований и разработки компании, а одновременно в ней работают около 30 000 агентов. На безопасность уходит примерно 6% вычислений, выделенных на разработку.

Четверть работы над новыми моделями в Anthropic уже ведёт сам Claude. Человек только ставит задачу в общих чертах и следит за результатом. Такие цифры компания раскрыла вместе с предложением: пусть все передовые лаборатории регулярно публикуют похожие показатели, чтобы общество видело, насколько быстро развивается ИИ.
Долю автоматизации Anthropic измеряет по шкале Epoch AI: от уровня AL0, когда ИИ не участвует, до AL5, когда он работает полностью сам. Полной самостоятельности компания не нашла ни в одном виде работ. На уровне «ИИ ведёт» выполняется 26% работы. На этом уровне или на уровне «ИИ сотрудничает», где Claude делает большие куски под присмотром инженера, — больше 90%. Чтобы собрать индекс, Claude просмотрел переписку в Slack и внутреннюю документацию случайно выбранных сотрудников за июль и составил список примерно из 15 000 задач. Уровень автоматизации оценивала отдельная модель-судья. С людьми она совпадала в 59% случаев, а сами люди между собой — лишь в 35%.
По данным на август 2026 года, на самой популярной внутренней платформе компании одновременно работают около 30 000 агентов. Каждый получает собственную «личность», чтобы любое действие можно было проследить до конкретного агента. Общаются агенты только в открытом общем канале, поэтому они видят чужие сообщения и могут поправлять ошибки друг друга. Сама Anthropic признаёт, что следит за агентами месяцы, а не годы, и не уверена, что видит все варианты их поведения.
Третий показатель — на что тратятся вычислительные мощности. За неделю в июле на безопасность ушло около 6% вычислений, выделенных на разработку. Если брать только разработку, которую ведут агенты, доля составила 12%. Компания называет эти оценки осторожными: работа, которая одинаково помогает и возможностям модели, и безопасности, в эту долю не попала. Классификаторы, которые защищают пользователей, тоже не учтены.
Anthropic обещает пустить в компанию независимых проверяющих из нескольких организаций. Они получат доступ к внутренним системам и данным наравне с собственными командами оценки рисков. Слабые места методики компания называет сама: единого способа считать пока нет, а свою разработку оценивают модели той же Anthropic. Где кончается работа над безопасностью и начинается наращивание возможностей, каждая лаборатория может решать выгодным для себя образом.