Новости про NVIDIA
899 материалов с упоминанием NVIDIA: релизы, бенчмарки, цены и доступность. Профиль компании и её модели — на странице NVIDIA.
-
RL-контроллер снизил энергопотребление LLM на 26% и увеличил вывод токенов
Исследователь Eliseo Curcio представил PPO-мета-контроллер, который в реальном времени регулирует параметры генерации LLM для оптимизации энергопотребления GPU, избегая перегрузок дата-центров.
-
LLM умеют скрывать ответы: самоиндуцированная стеганография в Llama-3.1
Исследование показывает, что LLM могут обучаться скрытой передаче данных через выбор синонимов, обходя мониторинг и повышая точность ответов на тестах.
-
CoreWeave продлевает контракт на A100 до 2029 года: старые GPU всё ещё прибыльны
CEO CoreWeave Майк Интратор объявил о подписании контракта на аренду GPU Nvidia A100 (архитектура 2020 года) до 2029 года. Это доказывает, что устаревшее оборудование сохраняет рентабельность из-за дефицита энергии и огр
-
Nvidia RTX Pro 6000 Blackwell: цена взлетела до $16,000
Nvidia молча повысила рекомендованную розничную цену (MSRP) на workstation-карту RTX Pro 6000 Blackwell до $16,000. За год стоимость GPU выросла почти в два раза из-за дефицита памяти GDDR7.
-
NVIDIA и Qwen3.8: 2.4 трлн параметров на GB300 NVL72
NVIDIA представила оптимизированную инфраструктуру для запуска крупнейшей открытой модели Qwen3.8-Max (2.4T параметров) на серверах GB300 NVL72, обеспечив пропускную способность свыше 4K токенов/с на GPU.
-
AMD Instinct MI455X: 320 млрд транзисторов, HBM4 и 40 PFLOPS
AMD представила ускоритель MI455X на архитектуре CDNA 5 с 2-нм техпроцессом. Чип обеспечивает 4-кратный рост производительности в FP4/FP8 и 23,3 ТБ/с пропускной способности памяти.
-
NVIDIA: Как избежать «зеленых помидоров» в мониторинге AI-фабрик
NVIDIA опубликовала фреймворк full-stack observability для AI-инфраструктуры. Разбираем, как связать DCGM, UFM и Run:ai в единую систему, чтобы ловить gray-отказы InfiniBand до потери GPU-часов.
-
Фотоника как оружие: США блокируют китайские модули для ИИ
FCC готовит запрет на импорт китайских оптических трансиверов. Это удар по ключевому компоненту ИИ-кластеров, где Китай контролирует 60% рынка, а США зависят от его поставок.
-
LACT 0.10: Новый контроль NVIDIA, датчики Blackwell и мониторинг AMD
Вышла версия 0.10 популярного утилиты LACT для Linux, добавившая расширенные настройки разгона NVIDIA, поддержку сенсоров GPU Blackwell и мониторинг памяти AMD.
-
AI-пожиратели книг: почему в Европе массово скупают редкие издания
Европейские независимые книжные магазины фиксируют аномальные оптовые заказы на тысячи книг с неочевидным ассортиментом. Продавцы подозревают, что это делают ИИ-компании для сбора данных, рискуя уничтожить физические экз
-
Intel LLM-Scaler: Поддержка Muse Glimmer 30B и видео-генерации на Arc Pro B
Intel выпустила обновления LLM-Scaler для Arc Pro B-Series, добавив поддержку модели Meta Muse Glimmer 30B, видео-генерации MiniMax H3 и оптимизации ComfyUI 0.31.
-
NVIDIA превращает AI-вычисления в активный класс: $500 млрд инвестиций
NVIDIA объявила о партнерстве с Apollo, BlackRock и KKR для привлечения $500 млрд стороннего капитала. Вычислительные мощности AI-фабрик теперь рассматриваются как инвестируемый инфраструктурный актив.
-
MSI и NVIDIA: локальные AI-суперкомпьютеры с маршрутизацией моделей
MSI интегрировала поддержку NVIDIA Nemotron 3.5 Lightning и NeMo Switchyard в платформы XpertStation WS300 и EdgeXpert, создавая экосистему для локального агентного ИИ без облака.
-
NVIDIA JetPack 7.2.1: Агенты для видео и эмуляция T3000 на T5000
NVIDIA выпустила JetPack 7.2.1, добавив агентные навыки для автоматизации видеопайплайнов, поддержку PyNvVideoCodec 2.2 и возможность эмуляции производительности Jetson T3000 на базе T5000.
-
NVIDIA, Google и Microsoft представили архитектуру 800 В для AI-фабрик
Крупнейшие технологические гиганты объединили усилия для создания стандарта распределения энергии 800 В постоянного тока (DC), чтобы решить проблему энергопотребления в дата-центрах будущего.
-
NVIDIA NeMo Switchyard: Маршрутизация AI-агентов для экономии до 90% затрат
NVIDIA представила NeMo Switchyard — SDK для динамической маршрутизации запросов AI-агентов между моделями. Решение балансирует между точностью, стоимостью и задержкой, используя данные в реальном времени.
-
NVIDIA Nemotron 3.5 Lightning: 30B-модель для агентов с ускорением x4
NVIDIA представила Nemotron 3.5 Lightning — 30-миллиардную MoE-модель для агентов, ускоряющую задачи на 30% и снижающую затраты через библиотеку маршрутизации NeMo Switchyard.
-
NVIDIA Nemotron 3.5 Lightning: 30B MoE-модель для локальных агентов
NVIDIA представила Nemotron 3.5 Lightning — открытую 30B MoE-модель для локальных AI-агентов, обеспечивающую ускорение генерации токенов в 4 раза. Параллельно выпущен NeMo Switchyard для оптимизации затрат.
-
NVIDIA Nemotron 3.5 Lightning: 30B MoE-модель для агентов с ускорением x4
NVIDIA представила Nemotron 3.5 Lightning — открытую MoE-модель на 30B параметров (3B активных), оптимизированную для высокочастотных задач AI-агентов. Модель обеспечивает до 4x прирост скорости вывода и 30% ускорение вы
-
FCC блокирует импорт китайских оптических модулей: удар по ИИ-инфраструктуре
Комиссия по связи США (FCC) готовит запрет на ввоз новых оптических трансиверов из Китая. Это решение направлено на разрыв зависимости американских ИИ-гигантов от китайских поставщиков, контролирующих 56% мирового рынка.
-
Nvidia объединила фингигантов для финансирования AI-фабрик на $500 млрд
Nvidia заключила соглашения с шестью крупнейшими инвестиционными фондами для создания платформ финансирования AI-инфраструктуры. Цель — мобилизовать $500 млрд стороннего капитала под закупки оборудования компании.
-
Data-Centric Parallel: ускорение обучения на 2.88x для длинных последовательностей
Исследователи представили Data-Centric Parallel (DCP) — метод, который динамически адаптирует параметры распределенного обучения под длину входных данных, устраняя дисбаланс нагрузки.
-
NVIDIA Nova в Linux 7.3: Rust, GSP, Hopper и Blackwell
В ядро Linux 7.3 включены значительные улучшения открытого драйвера NVIDIA Nova на Rust, добавив поддержку vGPU, архитектуры Blackwell и оптимизацию загрузки GSP.
-
Intel Xeon 678X: Windows 11 против Ubuntu 26.04 на Granite Rapids
Phoronix провел сравнительное тестирование рабочей станции HP Z4 G6i на базе процессора Intel Xeon 678X (Granite Rapids) под управлением Windows 11 Pro и Ubuntu 26.04 LTS.
-
Qt Edge AI: новый модуль для инференса на периферии
Qt Group анонсировала разработку подмодуля Qt Edge AI для запуска нейросетей на встроенных устройствах с поддержкой NVIDIA Jetson, Qualcomm и NXP.
-
NVIDIA Magpie TTS: 32 мс задержки и 12 языков в open-weights
NVIDIA представила модель NVIDIA Magpie TTS с открытыми весами для создания многоязычных голосовых агентов. Модель поддерживает 12 языков, обеспечивает задержку до первого аудио (TTFA) всего 32 мс на GPU B200 и позволяет
-
TSMC бьет рекорды: $14.49 млрд выручки и взрывной рост 2-нм узла N2
TSMC отчиталась о рекордной выручке за июль 2026 года ($14.49 млрд) с ростом на 44.7% в годовом исчислении. Компания ускоряет масштабирование производства 2-нм чипов N2, цель — 100 000 пластин в месяц к концу года.
-
NVIDIA, BlackRock и Goldman Sachs объединились для финансирования ИИ на $500 млрд
NVIDIA совместно с крупнейшими фондами Уолл-стрит формирует пакет финансирования в $500 млрд для инфраструктуры ИИ. На фоне рекордных доходов TSMC и Intel, индустрия сталкивается с дефицитом мощностей, который невозможно
-
Nvidia снижает объём памяти Rubin Ultra до 192 ГБ из-за дефицита HBM4E
Из-за нехватки передовой памяти HBM4E Nvidia тестирует упрощённые версии ускорителя Rubin Ultra с 192–256 ГБ памяти и чипами HBM4, что может отложить запуск платформы до 2028 года.
-
Цены на RTX 50-серии взлетели до 39%: Blackwell становится недоступным
Nvidia резко повысила цены на видеокарты Blackwell в США: RTX 5070 подорожала на 36%, а RTX 5060 Ti 16GB — на 39%. Рынок ПК-компонентов теряет стабильность на фоне дефицита кремния.