Маск: по агентному программированию Grok 4.7 выводит его лабораторию на третье место после Anthropic и OpenAI
Маск сослался на оценку Artificial Analysis и назвал Grok 4.7 «отличным выбором для повседневной работы», потому что модель быстрее и дешевле конкурентов. По тем же замерам на одну задачу Grok 4.7 тратит втрое больше токенов, чем GPT-6 Astra.
Илон Маск утверждает, что в агентном программировании его лаборатория теперь третья после Anthropic и OpenAI. Grok 4.7, по словам Маска, «значительно быстрее и дешевле», поэтому это «отличный выбор для повседневной рабочей лошадки». Он опирается на замеры независимой компании Artificial Analysis. В её рейтинге агентов-программистов Grok 4.7 вместе со своей средой Grok Build набрала 56 баллов, на 9 больше Grok 4.6. Это четвёртое место: впереди Claude Fable 5.1, GPT-6 Astra и Claude Opus 5. Третьей Маск называет именно лабораторию, а не модель: из первой тройки две модели принадлежат Anthropic. В общем индексе интеллекта Artificial Analysis у модели 46 баллов, на 2 больше, чем у прошлой версии.
Тезис о дешевизне в тех же замерах выглядит спорнее. Цена за токен осталась прежней: 2 доллара за миллион входных и 6 долларов за миллион выходных. Но на одну задачу из индекса Grok 4.7 в максимальном режиме рассуждений тратит около 81 тыс. выходных токенов. У Grok 4.6 было 36 тыс., у GPT-6 Astra — 27 тыс. Главный прирост модель показала в долгой агентной офисной работе: в закрытом бенчмарке AA-Briefcase она встала рядом с Claude Opus 5 и Claude Fable 5.1. В остальных задачах Grok 4.7 почти не отличается от прошлой версии, а в некоторых стала слабее.