Глава Vercel: Grok 4.7 отстала от Opus 5.5 в тестах Next.js. Но она в 2–7 раз дешевле
Claude Opus 5.5, GPT-6 Sol и Fable 5.1 решили по 97% задач, Grok 4.7 — 94%. Илон Маск назвал Grok 4.7 «довольно небольшой» моделью, которая справляется неплохо.
Vercel заново прогнала ИИ-модели через собственные тесты по фреймворку Next.js, написал в соцсети X глава компании Гильермо Раух. Модели Anthropic Claude Opus 5.5 и Fable 5.1 и GPT-6 Sol от OpenAI решили по 97% задач. Grok 4.7 от SpaceXAI набрала 94%. По словам Рауха, Grok при этом обходится в 2–7 раз дешевле остальных трёх моделей.
Vercel — облачная платформа, где размещают веб-приложения. Кроме того, компания разрабатывает Next.js — фреймворк для создания сайтов на React. В её тестах ИИ-агенты пишут и правят код на Next.js.
«Интересно. Grok 4.7 справляется довольно неплохо для не слишком большой модели», — прокомментировал результаты Илон Маск. Сколько параметров у модели, он не уточнил.
SpaceXAI выпустила Grok 4.7 21 сентября и оставила цену на уровне Grok 4.6. 22 сентября в тесте AA-Briefcase от Artificial Analysis1 модель заняла место сразу за Claude Opus 5. Ещё раньше Маск заявил о третьем месте SpaceXAI в агентном программировании.