Новости про NVIDIA
899 материалов с упоминанием NVIDIA: релизы, бенчмарки, цены и доступность. Профиль компании и её модели — на странице NVIDIA.
-
NVIDIA Molt: PyTorch-фреймворк для агентного RL с кодом в 8.6K строк
Команда NVIDIA NeMo представила Molt — компактный фреймворк для агентного обучения с подкреплением, который объединяет Ray, vLLM и FSDP2, предлагая исследователям прозрачность и скорость итераций.
-
NVIDIA Transformer Engine: FP8 ускорение и бенчмарки на GPU
NVIDIA представила Transformer Engine для PyTorch, объединяя fused-ядра, BF16 и аппаратное FP8-вычисление для ускорения обучения трансформеров.
-
Kioxia CM10: PCIe 6.0 SSD с жидкостным охлаждением для AI
Kioxia представила серию CM10 — первые корпоративные SSD на PCIe 6.0 с поддержкой прямого жидкостного охлаждения. Устройства на базе BiCS FLASH Gen10 обеспечивают рост производительности до 92% по сравнению с CM9.
-
Qwen-Image-2512: первый генератор изображений от ByteShape с поддержкой Humming
ByteShape выпустила Qwen-Image-2512 — первую модель генерации изображений с двумя путями развертывания: стабильным GGUF для ComfyUI и экспериментальным Humming для vLLM-Omni, обеспечивающим ускорение в 2.5 раза.
-
Локальный ИИ на RTX 5090: запуск нейросети за вечер без облака
Пользователи с топовым железом теперь могут развернуть мощную нейросеть дома за один вечер, отказавшись от подписок и облачных сервисов.
-
PCIe Gen6 для AI: почему Gen5 останется в строю до 2026 года
Переход на PCIe Gen6 обещает удвоить пропускную способность, но для AI-инференса и оптимизации KV-кэша критическое значение сохранят решения Gen5 из-за баланса производительности и бюджета.
-
Nouveau включит Atomic Mode-Setting по умолчанию для NVIDIA
Разработчики Nouveau завершают подготовку патчей для включения Atomic Mode-Setting (AMS) по умолчанию, что повысит стабильность рабочего стола Linux для видеокарт GeForce 8 серии и новее.
-
NVIDIA: Как оптимизировать Long-Context Inference через Co-Design архитектуры
NVIDIA опубликовала технические рекомендации по совместному проектированию моделей и GPU. Ключ к скорости вывода — увеличение group size для фазы decode и использование специфичных стратегий параллелизма.
-
Intel EMIB-T против TSMC CoWoS: 50% экономии и массовый выпуск в 2027
Intel Foundry планирует запустить массовое производство продвинутой упаковки EMIB-T в 2027 году, предлагая клиентам экономию до 50% по сравнению с решениями TSMC CoWoS.
-
NVIDIA Video Codec SDK 13.1: Zero-Copy, AV1 до 31 B-кадра и точный поиск
NVIDIA выпустила SDK 13.1 с поддержкой иерархических B-кадров в AV1, zero-copy транскодирования и точного поиска кадров через GOP-архитектуру, что критично для AI-аналитики и стриминга.
-
Дефицит индий-фосфидных лазеров: Nvidia вложила $2 млрд, но спрос превышает предложение на 30%
CEO Lumentum предупредил о кризисе критического материала для фотоники, который станет хуже нехватки DRAM. Nvidia и Coherent получили миллиардные инвестиции, но производственные мощности отстают от запросов гиперскейлеро
-
AMD Radeon RX 9050 против RTX 5050: разрыв в 30% и новые реалии 1080p
Первые тесты AMD Radeon RX 9050 показали, что карта уступает NVIDIA GeForce RTX 5050 в среднем на 30% в играх. Несмотря на это, решение на базе RDNA 4 остается жизнеспособным для 1080p, выигрывая у конкурента в энергоэфф
-
Linux 7.3: Nouveau и NVK получат аппаратное декодирование видео
В ядро Linux 7.3 включен патч Nouveau для выделения каналов NVDEC, что откроет путь к аппаратному ускорению видео через Vulkan Video в драйвере Mesa NVK.
-
Fedora 46: Shadow Stack включат по умолчанию для защиты от ROP-атак
Fedora Engineering and Steering Committee одобрила включение защиты Shadow Stack для x86_64, но перенесла релиз на Fedora 46 из-за проблем с драйверами NVIDIA.
-
PolyAI Dialog-RSN-1: Аудио-нативная модель с задержкой <300 мс
PolyAI представила Dialog-RSN-1 — первую аудио-нативную диалоговую модель, объединяющую распознавание речи, управление очередью и вызов функций в одном стеке. Модель уже работает в продакшене, обеспечивая снижение задерж
-
Google обгонит Nvidia по объему поставок AI-чипов к 2028 году
Аналитики Fubon Research прогнозируют, что Google выпустит 12–15 млн TPU v9 к 2028 году, что превысит объемы продаж Nvidia. Для выполнения плана Google может привлечь Intel Foundry.
-
Apple M4 Max против GB10: кто быстрее генерирует текст локально?
Тестирование Mac Studio с чипом M4 Max показало рекордную скорость декодирования LLM, но архитектурные ограничения Apple оставляют Nvidia GB10 лидером в общем балансе.
-
Nscale покупает Anyscale за $1,65 млрд для контроля AI-стека
Британский neocloud Nscale приобретает платформу масштабирования AI Anyscale за $1,65 млрд, чтобы объединить инфраструктуру и софт. Сделка завершает вертикальную интеграцию компании, оцениваемой в $14,6 млрд.
-
NVIDIA выпустила nvmath-python v1.0: ускорение математики в Python
NVIDIA представила стабильную версию библиотеки nvmath-python v1.0, которая предоставляет Python-разработчикам доступ к высокопроизводительным математическим ядрам CUDA-X и NVPL без необходимости писать код на C++.
-
NVIDIA AI Red Team: 4 критических уязвимости AI-агентов и как их закрыть
Эксперты NVIDIA выявили, что LLM-защита неэффективна против атак на AI-агентов. Разбор 4 главных векторов атак и архитектурных решений для безопасного развертывания.
-
OPI v0.1: Linux Foundation стандартизирует DPU/IPU через единый API
Linux Foundation выпустила OPI Abstraction v0.1 — первый шаг к унификации экосистем DPU и IPU. Решение предлагает вендоронезависимый API, охватывающий 26 репозиториев, для упрощения интеграции сетевых функций.
-
NVIDIA: Как потерять 12% производительности AI-кластера из-за настроек BIOS и NCCL
NVIDIA раскрыла детали четырех кейсов, где идентичное железо (H100, GB200) давало разрыв в 8–12% из-за ошибок в стеке виртуализации, NUMA и NCCL. Разбор конкретных метрик и решений.
-
NVIDIA поднимет цены на RTX 50-й серии на 20-30% в 2026 году
Из-за дефицита DRAM, вызванного бумом ИИ, NVIDIA планирует третье повышение цен на видеокарты серии RTX 5000. Ожидается рост стоимости для потребителей и падение объемов продаж ПК.
-
NVIDIA RTX 5090 Laptop: Nouveau vs R610 на Linux
Тестирование Razer Blade 18 с RTX 5090 показало разрыв в производительности между проприетарным драйвером NVIDIA R610 и открытым стеком Nouveau+NVK.
-
Moonshot AI открыл MoonEP: библиотека для идеального балансирования MoE
Moonshot AI выпустила MoonEP — библиотеку экспертного параллелизма, обеспечивающую равномерное распределение токенов между GPU. Технология стала ключом к 2.5-кратному ускорению обучения модели Kimi K3.
-
Huawei хочет слить драйвер Vulkan в Mesa, но с «черным ящиком»
Инженер Huawei предложил загрузить драйвер для собственного GPU в Mesa, но отказался открывать исходники компилятора шейдеров. Проект рискует остаться закрытым.
-
Nvidia PDD: ускорение генерации видео в 2-4 раза без потери качества
Лаборатория Nvidia представила Parallel Decoding Distillation (PDD) — метод дистилляции видео-моделей, позволяющий сократить количество шагов генерации (NFE) до 4-8 при сохранении высокой детализации и разнообразия.
-
Kioxia представила первые PCIe 6.0 SSD для AI с BiCS10
Kioxia анонсировала серию CM10 — первые корпоративные SSD на интерфейсе PCIe 6.0 с жидкостным охлаждением. Устройства построены на 332-слойной памяти BiCS FLASH Gen 10 и оптимизированы для работы с NVIDIA CMX в задачах A
-
Intel завершил RAMP-C: 18A готова для коммерции, а Nvidia и Microsoft тестировали чипы
Intel Foundry официально завершила программу RAMP-C, оплаченную правительством США для отладки процесса 18A. В пилоте участвовали Nvidia, Microsoft и Boeing, что заложило основу для защищенного производства Secure Enclav
-
YSERVER 1.4: Rust-сервер X11, написанный ИИ, запустил Steam и игры
Вышла версия 1.4 YSERVER — современного X11-сервера на Rust, созданного с помощью AI. Обновление добавило аппаратное ускорение для Chrome и Steam, поддержку полноэкранных игр в Cinnamon и улучшило работу с NVIDIA.