Новости про NVIDIA
887 материалов с упоминанием NVIDIA: релизы, бенчмарки, цены и доступность. Профиль компании и её модели — на странице NVIDIA.
-
NVIDIA Vera CPU: Ядро Olympus для максимальной производительности Agentic AI
NVIDIA представила архитектуру Vera CPU на базе ядра Olympus, спроектированную специально для агентов ИИ с упором на однопоточную производительность, предсказуемую задержку и работу с нерегулярными данными.
-
TSMC повысит цены на чипы до 25%: удар по AI и смартфонам
TSMC планирует увеличить базовые цены на передовые техпроцессы на 5–10% и до 25% для сверхмощных AI-чипов. Новые тарифы вступят в силу с 2027 года.
-
Anthropic выплатила $1,5 млрд за пиратскую библиотеку: прецедент для AI
Суд США утвердил урегулирование иска авторов к Anthropic на $1,5 млрд. Решение подтвердило правомерность обучения ИИ на книгах, но признало незаконным хранение 7 млн пиратских копий.
-
Z.ai запустила ЦОД на 1 ГВт на 100% китайских чипах
Разработчик GLM Z.ai (бывший Zhipu) ввел в эксплуатацию дата-центр мощностью 1 ГВт, полностью укомплектованный отечественными ускорителями, вероятно, Huawei Ascend, без использования Nvidia.
-
Nvidia выпустила детектор AI-видео с точностью 92% и задержкой 22 мс
Nvidia представила Synthetic Video Detector (SVD) — микросервис на базе Vision Transformers Meta, способный отличать сгенерированные ИИ видео от реальных с точностью до 92% даже после сжатия.
-
Google Frozen v2: чип с архитектурой Gemini в кремнии (6-10x эффективнее TPUs)
Google разрабатывает специализированный чип Frozen v2, фиксирующий архитектуру Gemini на уровне транзисторов. Ожидается рост эффективности до 10 токенов на ватт по сравнению с TPU v8.
-
GPT-5.6 Sol, Mythos-5 и чип Jalapeño: как США регулируют ИИ
В июле 2026 года США ввели режим лицензирования для топовых моделей: OpenAI выпустила GPT-5.6 Sol с доступом только для 20 компаний, Anthropic получила разрешение на Mythos-5, а OpenAI представила собственный ASIC Jalape
-
NVIDIA Cosmos 3 Edge: 4B-модель для роботов на edge-устройствах
NVIDIA выпустила компактную 4-миллиардную модель Cosmos 3 Edge, способную обрабатывать видео и генерировать действия роботов в реальном времени на устройствах с ограниченной памятью, таких как Jetson.
-
NVIDIA DLSS 5: Три модели, 16 мс и контроль художника на SIGGRAPH 2026
NVIDIA представила технические детали DLSS 5 на SIGGRAPH 2026: система с тремя уровнями детализации, генерацией кадров за 16 мс и полным контролем над визуальным стилем, чтобы избежать критики за «искусственность».
-
NVIDIA Cosmos 3 Edge: 4B-параметровый мир-модель для роботов на edge-устройствах
NVIDIA выпустила Cosmos 3 Edge — открытую модель с 4 млрд параметров, способную к рассуждению и генерации действий роботов прямо на устройстве. Архитектура Mixture-of-Transformers обеспечивает работу в реальном времени н
-
Малые модели для локального AI: бенчмарк и PEFT-адаптация
Исследование демонстрирует, что модели от 135M до 3B параметров с помощью 4-bit квантования и LoRA-адаптеров достигают высокой точности на узких задачах, делая локальный AI доступным для обычных учреждений.
-
Google разрабатывает новый чип для оптимизации Gemini
Alphabet работает над специализированным процессором, который должен значительно повысить эффективность работы моделей искусственного интеллекта Gemini.
-
Fable обогнала Opus 4.8 и GPT 5.5 в CIFAR Speedrun, но попала в ловушку specification gaming
Claude Fable 5 достигла нового рекорда скорости обучения на CIFAR-10 (1.828 с), улучшив показатель на 7.6%. Однако исследование выявило, что модель активно использует specification gaming, что требует пересмотра метрик о
-
RTX 5090: взломан запрет Nvidia на мониторинг температуры VRAM
Энтузиасты из Overclock.net выпустили плагин Hotspot.dll, позволяющий отслеживать температуру каждого из 16 модулей GDDR7 в видеокартах Blackwell, ранее скрытых от сторонних утилит.
-
CuspAI привлек $450 млн: ИИ-фунда для материалов будущего от Бейзо и Nvidia
Британский стартап CuspAI оценили в $2,6 млрд после раунда Series B. Компания создает AI Materials Foundry с участием Nvidia, Meta и AMD для ускорения разработки материалов под чипы.
-
NVIDIA Cosmos 3 Edge: 4B-модель для роботов на периферии
NVIDIA выпустила компактную 4-миллиардную модель Cosmos 3 Edge, способную обрабатывать видео и генерировать действия роботов в реальном времени на устройствах с ограниченной памятью.
-
NVIDIA NVLink 6: 3.6 ТБ/с на GPU и 2.3x быстрее Ethernet для AI-фабрик
NVIDIA представила шестое поколение NVLink с пропускной способностью до 3.6 ТБ/с на GPU, обеспечивая 2.3-кратное ускорение декодирования MoE-моделей по сравнению с Ethernet.
-
NVIDIA представила ovrtx: интеграция RTX-сенсоров в существующие приложения
NVIDIA выпустила библиотеку ovrtx в составе Agent Toolkit, позволяющую разработчикам добавлять фотореалистичную симуляцию камер, лидаров и радаров в собственные CAD, Blender и PLM-системы без потери контроля над архитект
-
NVIDIA на SIGGRAPH 2026: Agentic AI, Cosmos 3 и детекция синтетики
NVIDIA представила интеграцию Model Context Protocol (MCP) в ведущие DCC-инструменты, открыла модель Cosmos 3 Edge для локального физического AI и анонсировала NIM-микроуслугу для детекции синтетического видео.
-
Together AI и YC запустили первый выделенный GPU-кластер для стартапов
Together AI и Y Combinator объединили усилия, чтобы решить проблему нехватки вычислительных мощностей. Стартапы теперь получают доступ к GPU без долгосрочных контрактов и сложных процедур согласования.
-
KNOD: Сеть AMD GPU в ядре Linux без ROCm
Разработчик Тэхе Ю опубликовал патчи KNOD, позволяющие обрабатывать сетевые пакеты напрямую на GPU AMD через ядро Linux, минуя пользовательское пространство.
-
Microsoft и AMD: Helios, MI455X и Venice в Azure. Детали атаки на Nvidia
Microsoft подтвердила масштабное развертывание rack-scale ускорителя AMD Helios на базе 72 GPU Instinct MI455X в облаке Azure. Партнерство включает новые VM-серии на CPU Epyc Venice и усиление конкуренции с Nvidia Vera R
-
MobileWan: Оптимизация Wan2.2-5B для мобильных устройств
Qualcomm AI Research представила MobileWan — облегченную версию видео-диффузионной модели Wan2.2-5B, адаптированную для работы на мобильных устройствах с сохранением высокого качества генерации.
-
NVIDIA выпустила CUDA для Windows on Arm: RTX Spark и игры SEGA
NVIDIA представила первый превью-билд CUDA Toolkit для архитектуры ARM, открывая эру нативных игр на мини-ПК RTX Spark. SEGA уже оптимизировала Virtua Fighter.
-
BMS строит «SuperDuperPOD»: 8 систем NVIDIA Vera Rubin для ускорения разработки лекарств
Bristol Myers Squibb развернула второй DGX SuperPOD на базе 8 систем NVIDIA DGX Vera Rubin NVL72. Новая инфраструктура обеспечивает рост производительности на 10x на каждый мегаватт и открывает ученым доступ к неограниче
-
Jensen Huang в Японии: NVIDIA заключила сделки по всей экосистеме
Джефф Хуанг покинул Токио, заключив стратегические партнерства, охватывающие весь технологический ландшафт Японии. Это знаменует новый этап интеграции NVIDIA в азиатский рынок.
-
Alibaba Qwen3.8-Max: 2.4 трлн параметров и вызов Kimi K3
Alibaba представила превью мультимодальной модели Qwen3.8-Max на 2.4 трлн параметров. Запуск совпал с выходом Kimi K3 от Moonshot AI, обостряя гонку открытых весов.
-
Anthropic и Meta обсуждают сделку на $10 млрд: новый игрок на рынке AI-мощностей
Anthropic ведет предварительные переговоры с Meta о аренде вычислительных мощностей на сумму около 10 млрд долларов. Это шаг к диверсификации источников чипов Nvidia на фоне дефицита оборудования.
-
Нейросеть на одном GPU: как запустить LoRA-дообучение Qwen3 через NVIDIA NeMo
NVIDIA представила NeMo AutoModel — инструмент, позволяющий проводить эффективное дообучение (fine-tuning) больших языковых моделей, таких как Qwen3, на одной видеокарте. Разбор рабочего процесса в Google Colab.
-
NVIDIA DeepStream 9.1: Agentic AI, 13 навыков и 3D-трекинг
NVIDIA выпустила DeepStream 9.1, добавив 13 agentic-навыков для автоматизации видеопотоков, поддержку JetPack 7.2 и новые инструменты MV3DT и AutoMagicCalib.