ИИтак

← Назад

Тема

#железо

Чипы, ускорители и дата-центры, на которых обучают и запускают модели.

30 новостей за 60 дней

Вчера 21 сентября, понедельник

16 сентября среда

NVIDIA

Vera Rubin NVL72 в MLPerf: до 3,7 раза быстрее GB300 на Qwen3-VL и в 2,5 раза на DeepSeek-R1

NVIDIA раскрыла подробности первых результатов Vera Rubin NVL72 в тесте MLPerf Inference v6.1. На Qwen3-VL стойка до 3,7 раза производительнее GB300 NVL72, на DeepSeek-R1 — до 2,5 раза. Четыре стойки GB300 масштабируются с эффективностью 99%.

NVIDIA

NVIDIA, Google и Emerald AI создали альянс ради дата-центров, которые умеют потреблять меньше

Emerald AI, Google и NVIDIA запустили AI Energy Management Alliance. Он хочет выработать правила для дата-центров, которые снижают потребление электричества по сигналу энергосистемы, и за это быстрее получают подключение к сети.

15 сентября вторник

14 сентября понедельник

MiniMax · X

Открытую видеомодель MiniMax H3 сообщество ускорило и запустило на домашних видеокартах

Для видеомодели MiniMax H3 со встроенным звуком собрали каталог ускорений и сжатых версий. Одна из сборок, по словам её авторов, работает на картах с 8 ГБ видеопамяти. В другой 14-секундный ролик на восьми B200 генерируется быстрее, чем проигрывается.

10 сентября четверг

NVIDIA для разработчиков

NVIDIA ускорила Nemotron 3 Ultra в NIM: на четырёх B200 помещается в 2,5 раза больше пользователей

Готовый контейнер NIM 2.0.12 с моделью Nemotron 3 Ultra на сервере с четырьмя B200 выдаёт до 2,5 раза больше токенов в секунду, чем открытый сервер без этих настроек. Каждый пользователь при этом получает 50 токенов в секунду.

NVIDIA

Стартап d-Matrix поставит свои чипы для инференса Raptor в стойки NVIDIA через NVLink Fusion

Стартап d-Matrix, который делает чипы для инференса, подключит ускорители Raptor следующего поколения к сети и стойкам NVIDIA через NVLink Fusion. Эти стойки смогут работать вместе с системами Vera Rubin NVL72.

8 сентября вторник

IBM Research

IBM и Red Hat запустили GLM-5.2 на 544 картах H100 для 3 000 агентов разом

IBM Research и Red Hat развернули открытую модель GLM-5.2 на видеокартах NVIDIA H100 с помощью своего открытого фреймворка. По их расчётам, токен обходится в 5–10 раз дешевле, чем через коммерческие API.

3 сентября четверг

NVIDIA

NVIDIA официально покупает Hugging Face и обещает не привязывать её к своим чипам

NVIDIA объявила, что покупает Hugging Face за 12,93 млрд долларов. Компания обещает, что платформа останется открытой и её вычислительные мощности не станут обязательными для работы с ней.

27 августа четверг

Latent Space

Чип OpenAI Jalapeño на тестах самой компании опередил системы NVIDIA по отдаче на ватт

По данным OpenAI, Jalapeño выполняет в 1,5–1,9 раза больше работы на ватт, чем системы NVIDIA GB200/GB300, и отвечает в 1,7–3,6 раза быстрее. В инфраструктуру компании чип начнут ставить к концу года.

NVIDIA

NVIDIA перенесла контроллер памяти из ИИ-чипа в стек HBM: технология NVHBM

NVHBM — технология памяти для сторонних ИИ-чипов в программе NVLink Fusion. По данным NVIDIA, она даёт до 30% больше пропускной способности памяти и освобождает до 25% площади чипа под вычисления. Первой с ней работает Annapurna Labs из Amazon.

25 августа вторник

дополнено в 10:05 OpenAI

OpenAI показала первые результаты Jalapeño — собственного чипа для работы моделей

По словам OpenAI, её чип Jalapeño запускает модели быстрее и тратит меньше энергии: у него выше пропускная способность и ниже задержка.

24 августа понедельник

дополнено в 18:00 NVIDIA

NVIDIA: стойка Vera Rubin NVL72 выполняет для агентов до 30 раз больше работы на мегаватт

На тесте SemiAnalysis AgentX с записями реальных сессий агентов-программистов Vera Rubin NVL72 выдаёт до 30 раз больше токенов на мегаватт, чем GB300 NVL72. Миллион токенов, по данным NVIDIA, обходится до 45 раз дешевле.

Import AI

Import AI 470: ИИ ускорил поиск уязвимостей, но не исследования самого ИИ

Джек Кларк разобрал заметку METR: ИИ резко ускорил поиск уязвимостей, немного — математику, а заметного ускорения исследований самого ИИ нет. Ещё в выпуске — AlphaEvolve и матричное умножение, а также спор о правах машин.

17 августа понедельник

Hugging Face

Dharma-AI подняла загрузку GPU на 33 пункта, изменив только порядок распределения задач

Планировщик Dharma-AI в тестах поднял загрузку видеокарт на величину до 33 процентных пунктов по сравнению с очередью по принципу «кто первый пришёл». Полезная работа с учётом приоритетов выросла в среднем на 52%. Оборудование и задачи не менялись.

NVIDIA

NVIDIA частично гарантирует аренду и электричество дата-центра OpenAI в Огайо

NVIDIA на 20 лет берёт на себя часть арендных платежей и платы за электроэнергию площадки PORTS-Pike в Огайо. Там OpenAI построит дата-центр мощностью 4,25 ГВт, и работать он будет только на оборудовании NVIDIA.

13 августа четверг

Hugging Face

Робот записывает, GPU учится на лету: AWS и Hugging Face замкнули цикл данных для роботов

В открытом SDK Strands Robots от AWS один агент записывает демонстрации робота в хранилище Hugging Face, обучает политику, читая данные потоком без скачивания, и возвращает её на железо.

11 августа вторник

Mistral AI

Mistral даёт выбрать, где работает модель, и собирает компании строить европейские дата-центры

Клиенты Mistral теперь сами выбирают, в Европе или в США запускать модели. Кроме того, компания открыла приоритетный тариф с гарантией доступности, добавила на платформу чужие открытые модели и собирает коалицию для постройки до 1 ГВт мощностей к 2030 году.

10 августа понедельник

Amazon Science

AWS объявила конкурс: обучить языковую модель с нуля на чипе Trainium за 30 минут

В соревновании AWS Trainium Frontier участники подбирают архитектуру модели под чип Trainium2. Призовой фонд — 40 тысяч долларов, финал пройдёт на NeurIPS 2026 в Сиднее, приём заявок открыт до 30 сентября.

Hugging Face

Multiverse Computing ужала дистилляцию языковых моделей с четырёх GPU-узлов до одного

Multiverse Computing предложила считать функцию потерь при дистилляции по кускам, а ответы учителя кэшировать заранее. На 32 тыс. токенов пик памяти падает в 15,6 раза, код выложен в открытый доступ.

5 августа среда

3 августа понедельник

Import AI

Исследователи собрали ИИ-червя, который крадёт видеокарты жертв, чтобы думать над атаками

Учёные из Торонто, Кембриджа и ServiceNow показали прототип червя на модели с открытыми весами. Он сам ищет уязвимости, взламывает компьютеры и копирует себя дальше. Полная атака удаётся ему примерно в 37% случаев.

30 июля четверг

Hugging Face

Простаивающая видеокарта — как самолёт на земле: Dharma-AI о новом узком месте ИИ

Dharma-AI считает, что компаниям, купившим свои видеокарты, теперь мешает не качество моделей, а плохая загрузка железа. Выход, по её мнению, — малые специализированные модели и автоматическое распределение задач между картами.