Новости про NVIDIA
884 материалов с упоминанием NVIDIA: релизы, бенчмарки, цены и доступность. Профиль компании и её модели — на странице NVIDIA.
-
NVIDIA RTX PRO 5500: 84 ГБ GDDR7 и 600 Вт для рабочих станций
NVIDIA представила профессиональную видеокарту RTX PRO 5500 на архитектуре Blackwell с 84 ГБ памяти GDDR7 и 21 760 ядрами CUDA, ставшую преемницей линейки для высокопроизводительных вычислений.
-
X-AuT от XPeng: сжатие аудио-энкодера Speech LLM без потери качества
Команда XPeng AI представила X-AuT — метод прогрессивного сжатия аудио-энкодеров для речевых языковых моделей. Архитектура сокращает задержку на 21,4% в автомобилях, сохраняя точность транскрипции.
-
AI-стартапы скупают RTX 5090 для серверов: цены взлетели до $5000
Видеокарты GeForce RTX 5090 массово перепрофилируют для ИИ-серверов, вытесняя геймеров с рынка и раздувая цены в 2,5 раза от рекомендованной стоимости.
-
audio.cpp: Yue2, Supertonic 3 и 200x скорость генерации аудио
Фреймворк audio.cpp добавил поддержку модели Yue2 (3B) и показал рекордную скорость генерации 10 часов аудио за 3 минуты на RTX 5090.
-
NVIDIA BioIR: ускорение сворачивания белков в 2.9 раза на 8xH100
NVIDIA представила BioIR — runtime для BioNeMo, обеспечивающий 58.5K остатков на GPU-час при сворачивании белков. Технология уже использовалась для генерации 31 млн структур в базе AlphaFold.
-
DLSS Multi Frame Generation на RTX 40-й серии: мод работает, но с нюансами
Моддер dashdogy перенес эксклюзивную функцию Multi Frame Generation (MFG) с RTX 50-й серии на RTX 40-ю. Тесты в Cyberpunk 2077 показали работоспособность, но задержка ввода остается критическим фактором.
-
Qwen 3.8 против GPT-6 Astra: Бенчмарки, кризис цен и споры вокруг AGI
Tom's Hardware провел масштабное тестирование локальной модели Qwen 3.8 27B, раскрыл причины скачка цен на ABF-подложки и разобрал скандал вокруг заявления OpenAI о решении задачи Навье-Стокса.
-
Nemotron 3 Ultra: Как NVIDIA завоевала золото IMO 2026
NVIDIA представила открытую модель Nemotron, которая набрала 30 из 42 баллов на Международной математической олимпиаде 2026 года, достигнув золотого уровня без использования внешних инструментов.
-
Китайский хак: RTX 5090 с 96 ГБ памяти продается за $3888
Shenzhen Suqiao Intelligent Technology выпустила модифицированную версию GeForce RTX 5090 с увеличенным до 96 ГБ объемом VRAM. Карточка доступна на Alibaba по цене $3888, что на 35% дешевле базовой модели в США.
-
NVIDIA RTX 5090 в Германии превысила €5000: рост цен на 73% за 8 месяцев
Стоимость видеокарт NVIDIA GeForce RTX 5090 на немецком рынке достигла рекордных €5242,94. Это почти в два раза дороже рекомендованной цены Founders Edition и на 73% больше, чем в январе 2026 года.
-
GPU-бум 2026: Игроки скупают видеокарты на фоне роста цен
Отгрузки десктопных GPU во II квартале 2026 года достигли рекордных 12,5 млн штук. Несмотря на рост стоимости VRAM и GDDR7, спрос растет из-за страха перед дальнейшим удорожанием.
-
IFA 2026: Рынок ПК раскололся на бюджет и AI-рабочие станции
На выставке IFA 2026 производители ноутбуков продемонстрировали поляризацию рынка: с одной стороны — дешевые устройства с 8 ГБ ОЗУ, с другой — мощные AI-системы за $7000. Средний сегмент оказался забыт.
-
Sakana AI: Fugu Max и Ultra v2 — новый стандарт мультиагентной оркестрации
Sakana AI представила модели Fugu Max и Fugu Ultra v2, которые предлагают маршрутизацию запросов между пулом других ИИ-моделей. Это решение снижает затраты до 60% и повышает качество сложных задач, избегая зависимости от
-
Cohere выпустила North Small Translate: 218B MoE, бьющая Google Translate
Cohere Labs представила модель машинного перевода North Small Translate (218B параметров, 25B активных), которая набирает 83.6 балла на WMT26, превосходя DeepL и Google Translate.
-
ToolGrad от Google: 99.8% успеха в генерации данных для вызова инструментов
Исследователи Google представили ToolGrad — фреймворк, инвертирующий процесс создания датасетов для LLM. Генерация проверенных цепочек вызовов API достигла 99.8% эффективности, а модель Gemma-3-12B, обученная на 500 прим
-
RTX 5090 на 8-пиновых разъемах: моддеры доказали, что проблема NVIDIA — в дизайне, а не в мощности
Бразильские энтузиасты из TecLab успешно заставили GeForce RTX 5090 работать через три стандартных 8-pin PCIe коннектора, достигнув 900 Вт. Это доказывает, что плавление оригинального 16-pin разъема — ошибка проектирован
-
Nvidia вырастет на 70%: Цифры, Blackwell и ответ Хуана на критику
Дженсен Хуанг подтвердил прогноз роста выручки Nvidia на 70% в следующем году, объяснив доминирование компании масштабом систем Blackwell и охватом всей экосистемы ИИ.
-
ThunderKittens на NVIDIA Vera Rubin: 22 PFLOPS и NVFP4
Together AI портировала модель ThunderKittens на архитектуру NVIDIA Vera Rubin NVL72, достигнув производительности 22 PFLOPS за счет оптимизации GEMM-операций в формате NVFP4.
-
NVIDIA раскрывает архитектуру Robotaxi: DGX, Thor и $400 млрд рынок
NVIDIA представила открытую платформу для создания беспилотных такси, объединяющую обучение ИИ, симуляцию и бортовые вычисления. Рынок Robotaxi достигнет $400 млрд к 2035 году.
-
Skild AI S1: Роботы учатся по одному видео без переобучения
Skild AI представила фундаментальную модель S1, позволяющую роботам выполнять новые задачи за 11 минут на основе одного видеоролика. Технология использует in-context learning, обеспечивая точность 66% против 9% у аналого
-
Nemotron 3 Ultra: ускорение в 2.5x на B200 благодаря NIM 2.0.12
NVIDIA представила оптимизированный стек NIM 2.0.12 для модели Nemotron 3 Ultra, обеспечивший рост пропускной способности в 2.5 раза на системе из 4 GPU B200 без потери интерактивности.
-
Surflo: Реконструкция 3D-поверхности из фото без калибровки камеры
Исследователи из LIX, Kyoto University и UC Berkeley представили Surflo — модель, создающую детализированные 3D-мешей из некалиброванных RGB-изображений. Модель работает в 10 раз быстрее оптимизационных методов и превосх
-
NVIDIA BioIR: ускорение предсказания структур белков в 2.9 раза
NVIDIA представила BioNeMo Inference Runtime (BioIR), оптимизированный движок для предсказания структур биомолекул. Технология обеспечивает рост пропускной способности в 2.9 раза по сравнению с открытыми аналогами и уже
-
d-Matrix подключила Raptor к NVIDIA NVLink Fusion для массового AI-инференса
Чипмейкер d-Matrix интегрирует свои XPU Raptor в инфраструктуру NVIDIA через NVLink Fusion, получая доступ к масштабируемым AI-фабрикам с задержкой в 3 раза ниже Ethernet.
-
RTX 5090 на 900 Вт: моддеры заменили 12V-2x6 на три 8-pin
Команда TecLab успешно запитала RTX 5090D через три классических 8-pin разъема, достигнув 3400 МГц и 900 Вт без прошивок, доказав надежность старого стандарта.
-
ABF-подложки: узкое горлышко AI-бума и битва за масштабирование
Почти 95% рынка диэлектрических пленок для AI-чипов контролирует японская Ajinomoto. Рост размеров подложек и числа слоев создает критический дефицит и технические барьеры к 2026 году.
-
Samsung и Mistral AI: ИИ-революция в производстве чипов
Samsung Electronics и французский стартап Mistral AI объявили о стратегическом партнерстве. Компания внедрит свою LLM Mistral Large в производственные процессы для ускорения разработки и повышения выхода годных чипов.
-
NVIDIA и Palantir: как Nemotron 3.5 ускоряет цепочки поставок
NVIDIA обучила специализированную модель Nemotron 3.5 Lightning на данных цепочки поставок совместно с Palantir Foundry, достигнув точности принятия решений 86,7%.
-
OpenAI дублирует производство чипов: Samsung и TSMC для next-gen AI
OpenAI планирует выпускать свои AI-ускорители на Samsung Foundry параллельно с TSMC, что указывает на колоссальные объемы производства и стратегию снижения рисков.
-
HP ZGX Fury: Станция на GB300 с производительностью 20 PFLOPS для локального AI
HP представила ZGX Fury — первую рабочую станцию на базе NVIDIA Grace Blackwell GB300, способную выдавать до 20 PFLOPS в FP4. Решение создано в партнерстве с Red Hat для развертывания AI-инференса на периферии (edge).