ИИтак

← Назад

Компания

NVIDIA

Главный производитель ускорителей для обучения и работы моделей. Выпускает и собственные открытые модели Nemotron.

46 новостей за 60 дней

Вчера 21 сентября, понедельник

NVIDIA

NVIDIA собрала под маркой Halos всё, что нужно для сертификации беспилотников и роботов

NVIDIA описала Halos — набор из чипов, ОС, симуляторов и инспекционной лаборатории, который должен помочь провести беспилотные машины и роботов через сертификацию безопасности. Лабораторию аккредитовали как инспекционный орган.

NVIDIA

NVIDIA: безопасность ИИ-агентов — инженерная задача, и рассудку агента доверять нельзя

По мнению NVIDIA, ограничения для ИИ-агента должна задавать среда, где он запущен, а не его собственные рассуждения. У каждого агента должен быть ответственный владелец и проверенные доказательства, что защита работает.

NVIDIA

Две минуты вместо 45 дней: NVIDIA показала пять энергокомпаний, работающих на её ИИ

К Нью-Йоркской неделе климата NVIDIA собрала пять энергетических кейсов. В одном из них калифорнийская энергокомпания проверяет заявку на подключение к сети за две минуты, а раньше на это уходило 30–45 дней.

20 сентября воскресенье

Qwen · X

Qwen-Image-2.1 научили раздавать по сети — инструкция есть, кода в vLLM-Omni пока нет

Qwen-Image-2.1 поставили на серверный движок vLLM-Omni: на одной NVIDIA GB300 картинка 1024×1024 выходит за 4,5 секунды при пике памяти 34 ГБ. Поддержка держится на изменении кода, которое ещё не принято в проект.

18 сентября пятница

MiniMax · X

Метод VC-Attention ускорил механизм внимания видеомодели MiniMax-H3 в 1,6 раза

Стартап Nunchux AI и исследователи из MIT, CMU, Беркли, Стэнфорда и NVIDIA показали VC-Attention — способ считать внимание в 8 битах без переобучения модели. На MiniMax-H3 этот этап работает в 1,5–1,6 раза быстрее.

16 сентября среда

NVIDIA

Vera Rubin NVL72 в MLPerf: до 3,7 раза быстрее GB300 на Qwen3-VL и в 2,5 раза на DeepSeek-R1

NVIDIA раскрыла подробности первых результатов Vera Rubin NVL72 в тесте MLPerf Inference v6.1. На Qwen3-VL стойка до 3,7 раза производительнее GB300 NVL72, на DeepSeek-R1 — до 2,5 раза. Четыре стойки GB300 масштабируются с эффективностью 99%.

NVIDIA

NVIDIA, Google и Emerald AI создали альянс ради дата-центров, которые умеют потреблять меньше

Emerald AI, Google и NVIDIA запустили AI Energy Management Alliance. Он хочет выработать правила для дата-центров, которые снижают потребление электричества по сигналу энергосистемы, и за это быстрее получают подключение к сети.

15 сентября вторник

NVIDIA для разработчиков

NVIDIA на примере Nemotron 3.5 Lightning объяснила, когда смесь экспертов лучше плотной модели

Модели со смесью экспертов быстрее выдают текст, но памяти требуют столько же, сколько плотные модели того же размера. Lightning в 4–5 раз быстрее Qwen3.8-27B и в 14 раз дешевле, но в общих тестах набирает меньше половины её баллов.

дополнено в 19:55 NVIDIA

NVIDIA теперь меряет ИИ-серверы токенами на мегаватт и показывает, где его выжать

На AI Infra Summit NVIDIA показала новые тесты. Vera Rubin NVL72 в MLPerf обошла GB300 NVL72 до 3,7 раза, а программа DSX MaxLPS позволила Lambda втиснуть 19 серверов в бюджет мощности, рассчитанный на 16.

NVIDIA

Детская больница Филадельфии моделирует сердца детей на открытых ИИ-инструментах NVIDIA

Детская больница Филадельфии строит модели сердца за секунды вместо часов с помощью открытых инструментов MONAI и 3D Slicer. Модели помогают подбирать устройства при врождённых пороках.

14 сентября понедельник

NVIDIA

Агент Perplexity Computer теперь работает на Windows-ПК с RTX без облака

В приложении Perplexity для Windows появился Portable Computer — локальная версия агента Perplexity Computer. Он работает на видеокартах NVIDIA RTX с памятью от 24 ГБ, а файлы при этом не покидают компьютер.

10 сентября четверг

NVIDIA для разработчиков

NVIDIA ускорила Nemotron 3 Ultra в NIM: на четырёх B200 помещается в 2,5 раза больше пользователей

Готовый контейнер NIM 2.0.12 с моделью Nemotron 3 Ultra на сервере с четырьмя B200 выдаёт до 2,5 раза больше токенов в секунду, чем открытый сервер без этих настроек. Каждый пользователь при этом получает 50 токенов в секунду.

NVIDIA

Модель Skild AI S1 учит робота новой задаче по одному видео, без переобучения

Стартап Skild AI выпустил S1 — модель, которая управляет роботом. Одного видеопримера ей хватает, чтобы выполнить незнакомую задачу длиной до 10 минут. Модель обучали на инфраструктуре NVIDIA.

NVIDIA

NVIDIA заявила, что на её технологиях работают все крупные программы роботакси

NVIDIA перечислила партнёров, которые строят роботакси на её обучающих серверах, симуляторах и бортовых компьютерах: от Uber и Waymo до Pony.ai и Mercedes-Benz. Uber к 2028 году собирается запустить машины на платформе NVIDIA DRIVE Hyperion в 28 городах.

NVIDIA

Стартап d-Matrix поставит свои чипы для инференса Raptor в стойки NVIDIA через NVLink Fusion

Стартап d-Matrix, который делает чипы для инференса, подключит ускорители Raptor следующего поколения к сети и стойкам NVIDIA через NVLink Fusion. Эти стойки смогут работать вместе с системами Vera Rubin NVL72.

NVIDIA для разработчиков

NVIDIA научила малую модель Nemotron распределять дефицитные детали как опытные плановики

NVIDIA дообучила Nemotron 3.5 Lightning на архиве решений своих плановиков цепочки поставок. На внутреннем тесте модель выбрала верное решение о распределении в 86,7% случаев, а более крупная Nemotron 3 Ultra — в 55,5%.

9 сентября среда

NVIDIA

NVIDIA на IBC: детектор ИИ-видео с точностью 99%, замедленные повторы и дубляж для эфира

NVIDIA расширила набор ИИ-инструментов для медиа. В нём есть детектор сгенерированного видео, дорисовка кадров для повторов, синхронизация губ при дубляже в эфире и готовые схемы, как дообучить открытые модели на спортивных записях.

8 сентября вторник

IBM Research

IBM и Red Hat запустили GLM-5.2 на 544 картах H100 для 3 000 агентов разом

IBM Research и Red Hat развернули открытую модель GLM-5.2 на видеокартах NVIDIA H100 с помощью своего открытого фреймворка. По их расчётам, токен обходится в 5–10 раз дешевле, чем через коммерческие API.

3 сентября четверг

NVIDIA

NVIDIA выпустила PAIR — утилиту, которая раздаёт ИИ-задачи простаивающим домашним ПК

На IFA 2026 NVIDIA показала бесплатную утилиту PAIR, которая распределяет ИИ-запросы по компьютерам в домашней сети, ускорила llama.cpp и vLLM и упростила запуск локальных агентов. ПК на RTX Spark выйдут в октябре.

NVIDIA

Нейросетевая графика DLSS 5 пришла в облачный сервис GeForce NOW вместе с NBA 2K27

Баскетбольный симулятор NBA 2K27 доступен в облачном сервисе GeForce NOW с первого дня продаж. В нём работает DLSS 5: нейросеть дорабатывает освещение и материалы. Функция есть только в тарифе Ultimate на серверах с RTX 5080.

NVIDIA

NVIDIA официально покупает Hugging Face и обещает не привязывать её к своим чипам

NVIDIA объявила, что покупает Hugging Face за 12,93 млрд долларов. Компания обещает, что платформа останется открытой и её вычислительные мощности не станут обязательными для работы с ней.

2 сентября среда

дополнено в 00:19 NVIDIA для разработчиков

NVIDIA и CrowdStrike столкнули ИИ-агентов атаки и защиты. Открытые модели выиграли по качеству

Агент-защитник на открытых моделях Nemotron писал правила обнаружения атак реже, чем закрытая передовая система, но чаще попадал. Три его правила прошли все проверки и поймали все восемь новых атак, у конкурента таких не нашлось.

31 августа понедельник

NVIDIA для разработчиков

Claude Science научился предсказывать структуру белков с помощью моделей NVIDIA BioNeMo

NVIDIA и Anthropic подключили инструменты BioNeMo к Claude Science. Теперь агент сам разворачивает модели сворачивания белков OpenFold3 и Boltz-2 и сравнивает их прогнозы. В примере NVIDIA точность прогноза контакта двух белков держится на выравнивании последовательностей.

27 августа четверг

NVIDIA

NVIDIA перенесла контроллер памяти из ИИ-чипа в стек HBM: технология NVHBM

NVHBM — технология памяти для сторонних ИИ-чипов в программе NVLink Fusion. По данным NVIDIA, она даёт до 30% больше пропускной способности памяти и освобождает до 25% площади чипа под вычисления. Первой с ней работает Annapurna Labs из Amazon.

26 августа среда

NVIDIA для разработчиков

Alibaba открыла веса Qwen3.8-Flash-Next — модели, по которой можно судить о будущем Qwen4

Alibaba выложила веса Qwen3.8-Flash-Next: 125 млрд параметров, из них на каждый токен работают 6 млрд, контекст — до 1 млн токенов. На стойке GB300 NVL72 модель выдаёт больше 200 токенов в секунду на пользователя.

25 августа вторник

24 августа понедельник

дополнено в 18:00 NVIDIA

NVIDIA: стойка Vera Rubin NVL72 выполняет для агентов до 30 раз больше работы на мегаватт

На тесте SemiAnalysis AgentX с записями реальных сессий агентов-программистов Vera Rubin NVL72 выдаёт до 30 раз больше токенов на мегаватт, чем GB300 NVL72. Миллион токенов, по данным NVIDIA, обходится до 45 раз дешевле.

18 августа вторник

17 августа понедельник

дополнено в 21:12 Interconnects

Натан Ламберт: зачем NVIDIA раздаёт рецепты своих моделей

Выкладывая модели Nemotron вместе с данными и кодом обучения, NVIDIA растит спрос на свои чипы: чем больше компаний обучают и запускают модели сами, тем больше им нужно оборудования.

NVIDIA

NVIDIA частично гарантирует аренду и электричество дата-центра OpenAI в Огайо

NVIDIA на 20 лет берёт на себя часть арендных платежей и платы за электроэнергию площадки PORTS-Pike в Огайо. Там OpenAI построит дата-центр мощностью 4,25 ГВт, и работать он будет только на оборудовании NVIDIA.