ИИтак

← Назад

Artificial Analysis поставила Grok 4.7 сразу за Opus 5 в тесте работы аналитика

В тесте AA-Briefcase от Artificial Analysis Grok 4.7 уступила только моделям Anthropic. Она идёт сразу за Claude Opus 5, а одна задача обходится ей примерно вдвое дешевле.

В тесте AA-Briefcase1 от Artificial Analysis2 Grok 4.7 от SpaceXAI уступила только моделям Anthropic и заняла место сразу за Claude Opus 5. Одна задача обходится ей примерно в половину того, что тратит Opus 5. Этот пост Artificial Analysis Илон Маск процитировал в соцсети X и подписал одним названием модели — «Grok 4.7».

Сравнение с прошлой версией авторы замера показывают на AA-Briefcase-Lite — открытой части теста. В ней модель проводит проверку компании перед сделкой: строит модель рынка и готовит презентацию с оценкой компании-цели.

Рейтинг Эло3 за качество анализа вырос у Grok 4.7 с 1698 до 1994 по сравнению с Grok 4.6. Рейтинг за оформление презентаций немного снизился — с 1531 до 1499.

Подготовка примеров презентаций через API стоила Grok 4.7 около 8 долларов. У Grok 4.6 она обошлась примерно в 4,4 доллара. Обе модели работали в режиме с наивысшим уровнем рассуждений.

Ранее, 21 сентября, SpaceXAI выпустила Grok 4.7 для программирования и офисной работы, цена за токен осталась такой же, как у Grok 4.6. Тогда же Маск ссылался на оценку Artificial Analysis, по которой в агентном программировании Grok 4.7 выводит его лабораторию на третье место после Anthropic и OpenAI.

← Все новости