ИИтак

← Назад

SemiAnalysis подняла Nebius и понизила Crusoe в рейтинге GPU-облаков

Медали в третьей версии ClusterMAX получили лишь 19 из 77 провайдеров. Ещё 15 авторы отправили в новый уровень ниже бронзы — для тех, кто делает только необходимый минимум.

Аналитическая компания SemiAnalysis выпустила ClusterMAX 3.0 — третью версию рейтинга облаков, которые сдают в аренду кластеры с GPU для обучения и запуска ИИ-моделей. Nebius1 поднялась из золотого уровня в высший, платиновый, где прежде была одна CoreWeave2. Crusoe3 опустилась до бронзы, говорится в отчёте.

«CoreWeave по-прежнему задаёт технический уровень, на который равняются остальные, а Nebius закрепилась как провайдер, который стабильно добивается более высоких цен, чем другие», — пояснили авторы. По их словам, Nebius требует от клиентов крупные предоплаты, вплоть до 100% при контракте на год. Однажды она даже выставила партию мощностей на аукцион.

SemiAnalysis — американская компания, которая исследует рынок полупроводников и инфраструктуры для ИИ. Прошлая версия рейтинга вышла восемь месяцев назад. С тех пор число GPU-облаков в обзоре рынка выросло с 209 до 323, подробно авторы разобрали 77 из них. Ниже бронзы они ввели новый уровень — «ленточку за участие» (Participation Ribbon). Туда попали 15 провайдеров, которые, по мнению авторов, делают лишь необходимый минимум.

Рейтинг оценивает управляемые кластеры. Такой провайдер не просто сдаёт серверы, а настраивает на них планировщик задач и хранилище, следит за оборудованием и сам заменяет сломавшиеся узлы. Специализированных провайдеров такого рода в отрасли называют неооблаками. Их клиенты — в основном стартапы без своей инфраструктурной команды. OpenAI и Anthropic, по оценке авторов, всё больше арендуют голое железо и управляют им сами.

Для проверки каждый провайдер выделил 32 GPU поколения Nvidia Blackwell или ускорители AMD MI355X. Авторы по восемь часов нагружали вычисления и сеть одновременно. Затем они искусственно вызывали сбой GPU и засекали, как быстро провайдер его заметит и выведет узел из работы.

Медали получили 19 провайдеров:

  • платина — CoreWeave и Nebius;
  • золото — Oracle и Google Cloud, впервые попавший на этот уровень;
  • серебро — Lambda, Firmus, TensorWave, Microsoft Azure и поднявшаяся из бронзы GMI;
  • бронза — ещё десять компаний, в том числе AWS, Together и Crusoe.

Когда-то авторы считали Crusoe вторым по качеству неооблаком в мире. Теперь её понизили за ненадёжность. Ещё в мае авторы отдельно проверяли у неё кластер на H100 — GPU Nvidia прошлого поколения. За пять дней на нём случилось больше реальных аппаратных сбоев, чем во всех остальных тестах вместе. Кроме того, у Crusoe оказались самые старые среди проверенных ядро Linux и драйверы GPU. Часть программ компания уже обновила, а ядро обещает сменить на новую версию.

Проверяя кластеры, авторы и сами поручали работу агентам для программирования. По их наблюдениям, Claude перегружает планировщик задач Slurm. Однотипные задачи в Slurm можно отправить одной командой, общим массивом, а Claude запускает их в цикле по одной — и каждая становится отдельным запросом к планировщику. Один агент решил не настраивать быструю связь NVLink, пустил задачи по более медленной сети и объявил о победе. «Агенты увеличивают разрыв в квалификации, а не сглаживают его», — заключили авторы.

← Все новости