Новости про NVIDIA
885 материалов с упоминанием NVIDIA: релизы, бенчмарки, цены и доступность. Профиль компании и её модели — на странице NVIDIA.
-
PoseCap: Бесплатный маркерлесс-мокап для Blender на базе SMPL-X
Corridor Tech выпустила PoseCap — open-source инструмент, позволяющий оцифровывать движения через веб-камеру в реальном времени. Решение использует модель PEAR и работает на NVIDIA RTX.
-
MSI Afterburner: новая карта частот для Blackwell и Ada Lovelace
Разработчик Unwinder добавил в MSI Afterburner функцию Heat Map, позволяющую визуализировать кривую напряжения и частоты GPU. Это дает наглядное сравнение алгоритмов DVFS между архитектурами Ada Lovelace и Blackwell.
-
Prime Intellect выпустил Verifiers v1: новая архитектура для Agentic RL
Prime Intellect представила переработанную платформу verifiers v1, разделяющую задачи, инструменты и среду выполнения. Это позволяет масштабировать обучение агентов с инструментами и субагентами, устраняя квадратичный ро
-
AMD готовит FSR Multi-Frame Generation до 8x: статус и сравнение с конкурентами
AMD тестирует технологию мультигенерации кадров FSR MFG с поддержкой режимов до 8x. Функция пока неактивна из-за отсутствия нейросетевой модели, но уже видна в драйверах для Radeon RX 9000.
-
Конец эры GPU: почему память HBM стала главным узким местом ИИ
Индустрия ИИ переживает структурный сдвиг: дефицит вычислительных мощностей уходит, уступая место острому нехватке высокоскоростной памяти HBM. Рынок перераспределяет капитал в пользу производителей чипов памяти.
-
NVIDIA cuTile vs Triton: Практическое руководство по тайловому программированию GPU
Разбор архитектуры NVIDIA cuTile и Triton на примере реализации Flash Attention. Сравнение производительности, совместимости с оборудованием и ключевых метрик для разработчиков AI.
-
NVIDIA RoboLab: Новый стандарт оценки роботов с защитой от засорения бенчмарков
NVIDIA Research представила RoboLab — платформу для оценки роботизированных политик, решающую проблемы визуального переобучения, насыщения бенчмарков и отсутствия детальной диагностики в симуляции.
-
AudioGhost AI: Выделение звука текстом на RTX 3060
Open-source проект на базе Meta SAM-Audio позволяет извлекать любые звуковые объекты по текстовому описанию, снижая требования к VRAM до 4 ГБ.
-
NVIDIA скрывает перегрев RTX 5070 Ti: скрытый датчик показал 107°C
Инструмент диагностики MODS выявил, что NVIDIA блокирует доступ к датчику hotspot на GPU Blackwell. RTX 5070 Ti троттлила при 107°C, хотя стандартные утилиты показывали норму.
-
AIC представил JBOF-сервер F2032-G6 на 8 ПБ для кэширования AI
AIC показала 2U-сервер F2032-G6 с 32 слотами PCIe Gen6 E3 SSD, управляемый NVIDIA BlueField-4. Устройство создано для хранения до 8 ПБ данных и работы в качестве KV-кэша для кластеров Vera Rubin.
-
AMD RX 9070 GRE упала до $499: убийца RTX 5060 Ti для 1440p
Видеокарта AMD Radeon RX 9070 GRE, ранее эксклюзив для Китая, впервые снижена до $499. Это делает её прямым конкурентом NVIDIA RTX 5060 Ti в сегменте 1440p.
-
SK Hynix: дефицит памяти продлится до 2030 года, пик — в 2027-м
CEO SK Hynix Квон Но Чжун заявил, что 2027 год станет худшим для отрасли из-за нехватки памяти. Дефицит, вызванный взрывным ростом спроса на HBM для ИИ, сохранится как минимум до 2030 года.
-
Colibrì: 1.5 ТБ модель GLM-5.2 работает на 25 ГБ ОЗУ
Итальянский инженер Vincenzo создал Proof-of-Concept Colibrì, позволяющий запускать 744-миллиардную MoE-модель на обычном CPU с 25 ГБ памяти, жертвуя скоростью ради доступности.
-
vLLM и Transformers: скорость нативного кода без портирования
Интеграция бэкенда transformers в vLLM достигла уровня производительности ручных оптимизаций. Теперь модели Hugging Face работают так же быстро, как специализированные реализации, благодаря динамическому слиянию операций
-
LingBot 1.3B для ComfyUI: генерация видео на RTX 3070 (8 ГБ VRAM)
RealRebelAI выпустила оптимизированную версию модели LingBot-Video-Dense-1.3B для ComfyUI, позволяющую генерировать видео на видеокартах с 8 ГБ видеопамяти.
-
Почему физическая топология GPU важнее стратегии распределенного обучения
Анализ показывает, что задержки при обмене данными между графическими процессорами (NVLink, PCIe) часто становятся узким местом, нивелируя преимущества сложных алгоритмов вроде FSDP или ZeRO.
-
Санкции сплотили: Китай и Россия создают параллельный рынок чипов
Из-за нестабильности западных санкций Россия и Китай формируют независимую экосистему поставок полупроводников. Sberbank переходит на Huawei, а китайские стартапы уже выпускают собственные GPU.
-
DeepAnalyze-8B: Автономный AI-аналитик данных на GPU T4
Исследователи из RUC-DataLab представили модель DeepAnalyze-8B, способную самостоятельно писать код, выполнять его в песочнице и строить отчеты. Архитектура оптимизирована для работы на бюджетных GPU, таких как NVIDIA T4
-
NVIDIA: Host Offloading в JAX ускорил тренировку DeepSeek-V3 на 57%
NVIDIA представила решение для снятия ограничений HBM при обучении LLM: перенос активаций в память хоста на платформах Grace Blackwell дал прирост до 57% и позволил увеличить размер батча в 4 раза.
-
SK Hynix провела IPO на $26,5 млрд: рекорд для иностранных компаний
Корейский производитель памяти SK Hynix привлек рекордные $26,5 млрд на американской бирже, став самым крупным иностранным IPO в истории США. Инвесторы требуют от компании и Samsung построить заводы в Америке.
-
NVIDIA: Как проектировать LLM для Blackwell, чтобы не упереться в память
NVIDIA опубликовала руководство по hardware-aware дизайну LLM. Ключ к высокой производительности на Blackwell — квадратные линейные слои, кратность 256/512 и NVFP4-квантование.
-
NVIDIA: Kernel Fusion в CUDA 13.2 ускоряет вычисления в 3 раза
NVIDIA демонстрирует, как ручная и автоматическая слияние ядер (kernel fusion) в CUDA 13.2 сокращает трафик памяти и задержки запуска, повышая эффективность GPU.
-
PaperGuru: Новый стандарт памяти для LLM-агентов с ростом точности на 30%
AutoTrustAI представили PaperGuru — архитектуру долговременной памяти (LAM), которая превосходит базовые модели на PaperBench и SurveyBench, решая проблему устаревания контекста и верификации источников.
-
NVIDIA BioNeMo: ускорение кофолдинга белков в 177 раз на B300
NVIDIA представила полный стек ускорения для предсказания структур белков: MMseqs2-GPU, cuEquivariance и Fold-CP. Это позволяет моделировать комплексы до 32 000 токенов на 64 GPU B300.
-
ZipDepth: Монокулярная оценка глубины 375 FPS на iPhone за 6.1M параметров
Новая модель ZipDepth от исследователей из ECCV 2026 достигает скорости 375 FPS на iPhone 12 и 77 FPS на Jetson Orin NX, объединяя эффективность легковесных архитектур с точностью foundation-моделей через дистилляцию зна
-
HBM на ребре: V-Die и MOSAIC решают проблему перегрева AI-чипов
Исследователи из Кореи и Японии представили альтернативу вертикальной стопке HBM: DRAM-чипы устанавливаются вертикально. Это увеличивает пропускную способность, снижает температуру и устраняет необходимость в TSV.
-
NVIDIA готовит RTX 5090 SE: 14 080 ядер и цена $1500
NVIDIA разрабатывает урезанную версию флагмана RTX 5090 на базе чипа GB202. Новая карта RTX 5090 SE займет нишу между RTX 5080 и топовой моделью, предлагая 32 ГБ памяти и TGP 500 Вт.
-
Gradium привлекла $100 млн при поддержке Nvidia для развития AI-голосов
Парижский стартап Gradium закрыл раунд Seed на $100 млн при участии Nvidia, чтобы расширить присутствие в Кремниевой долине и усилить конкуренцию за таланты.
-
NVIDIA NeMo: 500K уникальных финансовых заголовков за 6 дней на B200
Команда NVIDIA представила итеративный пайплайн генерации синтетических данных для финтеха. Используя NeMo и модель Nemotron-3-Nano, они создали датасет FinHeadlineMix с 82% эффективностью дедупликации.
-
OpenAI представила GPT-5.6 и ChatGPT Work: автономные агенты для бизнеса
OpenAI выпустила модель GPT-5.6 и новый режим ChatGPT Work, позволяющий ИИ самостоятельно выполнять сложные рабочие задачи, интегрироваться с корпоративными приложениями и работать над проектами часами без участия челове