ИИтак

← Назад

Компания

NVIDIA

Главный производитель ускорителей для обучения и работы моделей. Выпускает и собственные открытые модели Nemotron.

12 новостей за 60 дней

15 сентября вторник

NVIDIA для разработчиков

NVIDIA на примере Nemotron 3.5 Lightning объяснила, когда смесь экспертов лучше плотной модели

Модели со смесью экспертов быстрее выдают текст, но памяти требуют столько же, сколько плотные модели того же размера. Lightning в 4–5 раз быстрее Qwen3.8-27B и в 14 раз дешевле, но в общих тестах набирает меньше половины её баллов.

14 сентября понедельник

10 сентября четверг

NVIDIA для разработчиков

NVIDIA ускорила Nemotron 3 Ultra в NIM: на четырёх B200 помещается в 2,5 раза больше пользователей

Готовый контейнер NIM 2.0.12 с моделью Nemotron 3 Ultra на сервере с четырьмя B200 выдаёт до 2,5 раза больше токенов в секунду, чем открытый сервер без этих настроек. Каждый пользователь при этом получает 50 токенов в секунду.

NVIDIA для разработчиков

NVIDIA научила малую модель Nemotron распределять дефицитные детали как опытные плановики

NVIDIA дообучила Nemotron 3.5 Lightning на архиве решений своих плановиков цепочки поставок. На внутреннем тесте модель выбрала верное решение о распределении в 86,7% случаев, а более крупная Nemotron 3 Ultra — в 55,5%.

1 сентября вторник

NVIDIA для разработчиков

NVIDIA и CrowdStrike столкнули ИИ-агентов атаки и защиты. Открытые модели выиграли по качеству

Агент-защитник на открытых моделях Nemotron писал правила обнаружения атак реже, чем закрытая передовая система, но чаще попадал. Три его правила прошли все проверки и поймали все восемь новых атак, у конкурента таких не нашлось.

31 августа понедельник

NVIDIA для разработчиков

Claude Science научился предсказывать структуру белков с помощью моделей NVIDIA BioNeMo

NVIDIA и Anthropic подключили инструменты BioNeMo к Claude Science. Теперь агент сам разворачивает модели сворачивания белков OpenFold3 и Boltz-2 и сравнивает их прогнозы. В примере NVIDIA точность прогноза контакта двух белков держится на выравнивании последовательностей.

26 августа среда

NVIDIA для разработчиков

Alibaba открыла веса Qwen3.8-Flash-Next — модели, по которой можно судить о будущем Qwen4

Alibaba выложила веса Qwen3.8-Flash-Next: 125 млрд параметров, из них на каждый токен работают 6 млрд, контекст — до 1 млн токенов. На стойке GB300 NVL72 модель выдаёт больше 200 токенов в секунду на пользователя.

17 августа понедельник

NVIDIA для разработчиков

NVIDIA ужала Nemotron 3.5 Lightning втрое и объяснила, как сохранила точность

NVIDIA выпустила 4-битную версию Nemotron 3.5 Lightning: вместо 66 ГБ она весит 22 ГБ и работает до четырёх раз быстрее. Точность компания удержала за счёт дистилляции от полной модели. Рецепт открыт.

12 августа среда

NVIDIA для разработчиков

Alibaba открыла веса Qwen3.8-Max на 2,4 трлн параметров, NVIDIA показала её скорость

Qwen3.8-2.4T-A95B — крупнейшая модель Alibaba с открытыми весами: 2,4 трлн параметров и контекст до миллиона токенов. На стойке GB300 NVL72 она уже в день выхода выдаёт больше 350 токенов в секунду на пользователя.

11 августа вторник

NVIDIA для разработчиков

NVIDIA выпустила Nemotron 3.5 Lightning — малую открытую модель для рутинной работы агентов

Nemotron 3.5 Lightning — открытая модель на 30 млрд параметров, из которых на каждый токен работают 3 млрд. Она берёт на себя рутинные шаги ИИ-агентов, а планирование оставляет крупным моделям.

10 августа понедельник

27 июля понедельник

NVIDIA для разработчиков

Nemotron 3 Ultra лучше других открытых моделей проектирует микросхемы и тратит меньше токенов

В агенте ACE-RTL модель NVIDIA Nemotron 3 Ultra решила в среднем 97,1% задач бенчмарка CVDP по проектированию микросхем. Это больше, чем у GLM 5.2 и Kimi K2.6, а токенов на один шаг модель тратит заметно меньше обеих.