Новости про NVIDIA
899 материалов с упоминанием NVIDIA: релизы, бенчмарки, цены и доступность. Профиль компании и её модели — на странице NVIDIA.
-
Frore LiquidJet: снижение температуры GPU Nvidia Rubin на 10°C и рост производительности на 15%
Компания Frore Systems представила технологию жидкостного охлаждения LiquidJet для чипов Nvidia Rubin. По их данным, решение позволяет снизить температуру кристалла на 10–12°C и повысить эффективность генерации токенов н
-
MiniMax H3: 32B-модель с NVFP4 и кастомным VAE для ComfyUI
Сообщество Stable Diffusion активно интегрирует мощную мультимодель MiniMax H3 (32B) в ComfyUI, используя оптимизации NVFP4, квантование до 40 ГБ VRAM и специализированные VAE-модели.
-
NVIDIA Alpamayo 2 Super: 34B VLA-модель для автономного вождения с объяснимыми решениями
NVIDIA выпустила открытую модель Alpamayo 2 Super (34B параметров) для роботакси, способную генерировать траекторию и причинно-следственное объяснение за один проход. Модель лидирует в LingoQA и готова к коммерческому ис
-
Google готовит $200 млрд на ИИ: как андеррайтинг Anthropic меняет рынок
Google запускает беспрецедентную программу финансирования инфраструктуры на $200 млрд, чтобы обеспечить чипами своего партнера Anthropic. Это крупнейшая сделка такого рода, меняющая правила игры на Уолл-стрит.
-
Cursor открыл MoK: 2.37x ускорение обучения MoE на GB300 NVL72
Cursor Research выпустила под Apache 2.0 мегаядро Mixture-of-Kittens (MoK), которое объединяет коммуникацию и вычисления в MoE-моделях. Решение требует специфичного железа Blackwell, но дает кратный прирост скорости.
-
Nvidia и 120 компаний создали альянс для защиты от AI-агентов
Всего через неделю после создания Open Secure AI Alliance, инициативы Nvidia, уже представлены первые предложения по защите от вредоносных AI-агентов.
-
HBF: 3 ТБ/с и 512 ГБ для AI. Sandisk и SK hynix представили спецификацию
Sandisk и SK hynix официально представили спецификацию High Bandwidth Flash (HBF) через OCP. Технология объединяет скорость HBM и емкость NAND, предлагая до 3 ТБ/с пропускной способности и 512 ГБ памяти на пакет для уско
-
NVIDIA Cosmos 3: WAM-модели заменяют VLA в робототехнике
NVIDIA представила архитектуру World Action Models (WAM) на базе Cosmos 3, обеспечивающую zero-shot перенос навыков и предсказание динамики, в отличие от традиционных VLA-моделей.
-
NVIDIA и NSF: создание региональных AI-хабов для образования и науки
NVIDIA присоединилась к программе NSF State and Regional AI Hubs, чтобы предоставить американским университетам доступ к вычислительным мощностям и образовательным ресурсам для развития AI-экосистемы.
-
NVIDIA Alpamayo 2 Super: 34B VLA-модель для автономного вождения
NVIDIA представила открытую модель Alpamayo 2 Super (34 млрд параметров), объединяющую reasoning, VQA и генерацию траекторий. Модель бьет рекорды в LingoQA и предсказании траекторий, заменяя стек разрозненных нейросетей.
-
NVIDIA Vera BlueField-4: ускорение хранилищ в 3.21x и открытый cuFile
NVIDIA представила процессор Vera BlueField-4 STX с пропускной способностью в 3.21 раза выше x86 CPU и открыла API cuFile для прямого доступа GPU к данным.
-
NVIDIA Alpamayo 2 Super: лидер бенчмарков для автономного вождения
NVIDIA выпустила модель Alpamayo 2 Super с открытыми весами для коммерческого использования. Модель демонстрирует рекордные результаты в рассуждениях для роботакси и позволяет сократить цикл аннотации данных с месяцев до
-
NVIDIA и 120+ компаний создают стандарт безопасности AI-агентов SAFE
Альянс Open Secure AI Alliance, объединяющий NVIDIA, Cisco, Hugging Face и другие гиганты, представил проект руководств SAFE для прозрачности кибербезопасности агентов ИИ.
-
NVIDIA Nemotron VoiceChat: 11B-модель с полным дуплексом и вызовом инструментов
NVIDIA представила Nemotron Labs VoiceChat — первую открытую модель голосового ИИ с полным дуплексом (full duplex), способную к мгновенному диалогу и вызову инструментов без задержек каскадных систем.
-
Эра 8 ГБ VRAM и 6 ядер завершена: Steam Hardware Survey за июль 2026
Впервые в истории Steam 16 ГБ видеопамяти и 8-ядерные процессоры стали самыми популярными конфигурациями среди пользователей платформы, что标志着 конец эпохи бюджетных сборок.
-
NVIDIA SkillSpector: Аудит безопасности AI-агентов через LangGraph и YARA
NVIDIA представила SkillSpector — инструмент для автоматизированного сканирования AI-навыков (Skills) на уязвимости, вредоносный код и утечки данных с интеграцией в CI/CD.
-
NVIDIA SANA-Video 2.0: 120x быстрее Wan 2.2 и 720p на одном GPU
NVIDIA представила обновленную архитектуру видеогенератора SANA-Video 2.0 с гибридным вниманием, способную создавать видео 720p на потребительских видеокартах.
-
DiffusionGemma: 1500 токенов/сек на H100 без авторегрессии
Google представила DiffusionGemma — экспериментальную LLM с открытыми весами, использующую дискретную диффузию для генерации текста. Модель обходит последовательное декодирование, генерируя 256 токенов за один проход.
-
FFmpeg 9.0: Vulkan, WebP, AMD AMF и новые оптимизации
Вышла FFmpeg 9.0 с поддержкой Vulkan-декодирования, анимированного WebP, улучшений AMD AMF и оптимизаций AVX-512.
-
Топ-10 открытых LLM для кода: от серверов до одной видеокарты
DeepSeek V4 Pro обогнал закрытые аналоги на SWE-bench, но требует мощного железа. Разбираем 10 лучших открытых моделей для программирования, которые можно запустить на разных конфигурациях.
-
NVIDIA Vera: Прорыв в скорости шифрования и сжатия для AI-хранилищ
NVIDIA представила процессор BlueField-4 STX на базе архитектуры Vera, который превосходит x86-решения в задачах шифрования, сжатия и проверки целостности данных до 3.67x.
-
AMD Helios: 2.9 EFLOPS и 1.7 PB/s пропускной способности памяти
AMD официально представила архитектуру Helios — первую в отрасли rack-scale систему на базе EPYC 9006, Instinct MI455X и DPU Pensando, способную обрабатывать ИИ-нагрузки за пределами одного сервера.
-
TSMC разгоняет N2: цель 100 тыс. пластин в месяц к концу 2026 года
TSMC планирует пятикратное увеличение выпуска пластин на 2-нм техпроцессе N2. На фоне рекордного спроса на 3-нм узел, компания масштабирует производство GAAFET-чипов для Apple, AMD и NVIDIA.
-
Цены на токены рушатся: OpenAI снизила тарифы на 80% из-за китайских конкурентов
В ответ на прорывы китайских моделей Kimi K3 и DeepSeek V4 Flash, OpenAI, Google и Anthropic начали агрессивную ценовую войну, радикально удешевляя доступ к передовым ИИ-моделям.
-
Цены на RTX 50-й серии взлетели до 30%: почему RTX 5090 стоит $5100
В Южной Корее цены на видеокарты NVIDIA GeForce RTX 50 серии выросли на 30% из-за удорожания кремниевых пластин TSMC и модулей памяти GDDR7. Флагман RTX 5090 теперь стоит более $5100.
-
PrunaVAED: ускорение LTX-2.3 в 1.7 раза и экономия VRAM
Лаборатория PrunaAI выпустила оптимизированный декодер PrunaVAED для модели LTX-2.3, обеспечивающий прирост скорости до 2x и снижение потребления видеопамяти на 50% без потери качества.
-
Гонка CPO: TSMC, Intel и Samsung строят оптические шины для AI
Крупнейшие фабрики раскрывают дорожные карты Co-Packaged Optics (CPO). TSMC обещает 12.8 Тбит/с к 2030 году, а Intel интегрирует оптику прямо в чиплеты CPU и GPU.
-
Мировой рекорд: TinyGPU v2.0 работает, а v3.0 с шейдерами выйдет в 2026
Разработчик Понсагон Вичит подтвердил работоспособность самого маленького в мире GPU (240 тыс. транзисторов). Версия 2.0 выдает до 15 FPS, а версия 3.0 с программируемыми пиксельными шейдерами готовится к релизу.
-
MiniMax H3: первый open-source видео-модель с нативным звуком и 2K
MiniMax выпустила H3 — первую видео-модель с открытыми весами, способную генерировать 2K-видео до 15 секунд с синхронизированным стереозвуком. Поддержка ComfyUI доступна уже сегодня.
-
Inkling-Small: 276B MoE-модель, бьющая Inkling в коде и работающая на одной GPU
Thinking Machines Lab выпустила Inkling-Small — 276B параметров (12B активных), которая превосходит 975B-версию в агентном коде и запускается на одной NVIDIA B300.