Новости про NVIDIA
884 материалов с упоминанием NVIDIA: релизы, бенчмарки, цены и доступность. Профиль компании и её модели — на странице NVIDIA.
-
Anthropic представила Claude Science: ИИ-лаборатория для ученых
Anthropic выпустила бета-версию Claude Science — специализированной среды для научных исследований, объединяющей анализ литературы, визуализацию данных и управление вычислениями в одном интерфейсе.
-
NVIDIA Nemotron 3 Super: RL-обучение агентов на 1.2M роллаутов
NVIDIA представила Nemotron 3 Super, обученную через RLVR с использованием 21 верификатора NeMo Gym. Статья описывает практический пайплайн GRPO для создания надежных AI-агентов.
-
Together AI привлекла $800 млн: битва за экономику open-source AI
Together AI закрыла раунд Series C на $800 млн и получила обязательства на 500 МВт вычислительных мощностей. Компания утверждает, что open-source модели позволяют снизить затраты на инференс в 6–20 раз по сравнению с про
-
ИИ в стиле «пещерного человека»: как компании экономят на токенах
Разработчики из OpenAI, Nvidia и GitHub используют плагин, заставляющий LLM отвечать кратко и грубо, чтобы резко сократить расходы на токены.
-
LearnStop: Когда ранний выход из LLM-рассуждений экономит деньги, а когда нет
Исследование Stanford и University of Maine показывает, что сложные модели раннего выхода (LearnStop) выгодны только для свободных математических задач, тогда как простые метрики уверенности лучше для тестов с выбором от
-
NVIDIA Nemotron-Labs-TwoTower: Диффузия в 2.42x быстрее AR с потерей качества 1.3%
NVIDIA выпустила Nemotron-Labs-TwoTower — гибридную языковую модель, объединяющую авторегрессию и диффузию. Архитектура обеспечивает рост пропускной способности генерации в 2.42 раза при сохранении 98.7% качества базовой
-
GLM-5.2: Z.ai сокращает разрыв с лидерами за 10 недель
Z.ai выпустила GLM-5.2 с открытыми весами, улучшив Intelligence Index на 11 пунктов. Модель обходит GPT-5.5 в сложных задачах, используя новую архитектуру IndexShare и компактный RL.
-
FFASR: Первый открытый бенчмарк для ASR в реальных условиях
Hugging Face и Treble Technologies запустили FFASR Leaderboard — платформу для оценки моделей распознавания речи в сложных акустических условиях (эхо, шум, расстояние).
-
NVIDIA BioNeMo: AI-агенты для биологии достигли 100% успеха
NVIDIA выпустила BioNeMo Agent Toolkit, превращающий биомолекулярные модели в вызываемые навыки для AI-агентов. Бенчмарки показывают рост успешности задач с 57% до 100%.
-
NVIDIA NeMo AutoModel: ускорение Fine-Tuning MoE в 3.7 раза
NVIDIA представила NeMo AutoModel — библиотеку поверх Hugging Face Transformers v5, обеспечивающую рост пропускной способности обучения MoE-моделей до 3.7x и снижение потребления памяти GPU на 32% без изменения API.
-
NVIDIA ENPIRE: Роботы учатся сами. И Tencent с 10k GPU
NVIDIA представила ENPIRE — систему автономного улучшения политик управления роботами. Tencent раскрыла детали ARGUS для обучения кластеров в 10 000 GPU. Разбираем, как ИИ-агенты берут управление в реальный мир.
-
NVIDIA представила AI-инструменты для науки: ускорение в 14 900 раз
NVIDIA выпустила библиотеки DAQIRI, ALCHEMI и cuPhoton, превращающие часы вычислений в реальное время. Ускорение анализа астрономических данных достигло 14 900x, а материаловедение стало быстрее в 50 раз.
-
NAIRR и NVIDIA: как 700+ проектов меняют науку через AI-инфраструктуру
Программа NAIRR совместно с NVIDIA обеспечила исследователям доступ к мощностям DGX, ускорив открытия в медицине, энергетике и физике. Результаты пилотного этапа: от модели Walrus до сокращения времени анализа эпидемий с
-
JUPITER: Европа ввела в строй первый эксафлопсный суперкомпьютер
На конференции ISC в Гамбурге представлен JUPITER — первый в Европе суперкомпьютер класса эксафлопс на базе NVIDIA Grace Hopper. Система уже решает задачи от моделирования мозга до квантовых вычислений.
-
NVIDIA DAQIRI: Прямая передача данных с датчиков на GPU без копирования
NVIDIA представила DAQIRI — библиотеку для обхода ядра Linux и нулевого копирования данных с высокоскоростных датчиков прямо в память GPU. Технология уже тестируется в CERN для анализа 99% ранее отбрасываемых данных LHC.
-
NVIDIA CCCL Runtime: Современный C++ для CUDA 13.2
NVIDIA представила CCCL Runtime в CUDA 13.2 — типобезопасную C++-абстракцию для управления потоками, памятью и запуском ядер, заменяющую устаревший C-API.
-
ParallelKernelBench: Почему LLM пока не умеют писать быстрые multi-GPU ядра
Новый бенчмарк ParallelKernelBench показал, что даже топовые модели вроде GPT-5.5 и Gemini 3 Pro не могут эффективно оптимизировать коммуникацию между GPU, решая менее трети задач быстрее базового PyTorch.
-
NVIDIA: Как операторы связи строят автономные сети с Agentic AI
NVIDIA представила архитектуру автономных сетей уровня 4-5, где AI-агенты самостоятельно обнаруживают аномалии и оптимизируют SR-MPLS, используя NeMo, Nemotron и NV-Tesseract.
-
NVIDIA представила платформу автономных AI-агентов для телекома
NVIDIA демонстрирует на DTW Ignite 2026 переход от простой автоматизации к полностью автономным сетям. Решение объединяет синтетические данные, безопасные рантаймы и ускоренное моделирование для работы 24/7.
-
NVIDIA доминирует в TOP500: 81% суперкомпьютеров мира работают на их технологиях
В обновленном рейтинге TOP500 и Green500 NVIDIA подтвердила абсолютное лидерство: технологии компании используются в 81% самых мощных систем мира, а 90% новых установок построены на базе NVIDIA. Лидером энергоэффективнос
-
NVIDIA Agent Toolkit: Как строить доверенные AI-агенты для бизнеса
NVIDIA представила Agent Toolkit — открытую платформу для создания специализированных AI-агентов. Решение объединяет модели Nemotron, инструменты NemoClaw и безопасный runtime OpenShell, позволяя компаниям внедрять AI в
-
NVIDIA BioNeMo: AI-ученые завершают задачи на 100% с удвоенной эффективностью
NVIDIA представила BioNeMo Agent Toolkit, превращающий LLM в автономных исследователей. Бенчмарки показали рост успешности задач с 57% до 100% и двукратное снижение потребления токенов.
-
NVIDIA DFlash: ускорение Blackwell до 15x через блочное диффузионное декодирование
NVIDIA представила DFlash — open-source модель для спекулятивного декодирования, которая ускоряет инференс LLM на GPU Blackwell до 15x за счет параллельной генерации блоков токенов.
-
NVIDIA: Оптимизация AI-фабрик снижает энергопотребление на 25%
NVIDIA представила комплексные решения для повышения энергоэффективности AI-инфраструктуры. Благодаря ко-дизайну оборудования, жидкостному охлаждению GB200 NVL72 и программным оптимизациям обучения, компания добилась эко
-
NVIDIA и AWS: Blackwell, cuVS и GB300 для AI в продакшене
AWS представила инстансы G7 на GPU NVIDIA RTX PRO 4500 Blackwell, сделала GPU-поиск в OpenSearch стандартом и получила статус Exemplar Cloud для обучения на GB300.
-
NVIDIA представила BEVPoolV3: ускорение до 42x для автономных систем
NVIDIA опубликовала детали оптимизации оператора BEV pooling для GPU, достигнув ускорения до 42x на архитектуре Blackwell за счет новых алгоритмических решений и поддержки FP8.
-
KRAFTON представила PUBG Ally: ИИ-напарник на NVIDIA ACE с задержкой <1 сек
KRAFTON выпустила в бета-тест PUBG Ally — первого «ко-играбельного персонажа» (CPC) в PUBG: BATTLEGROUNDS. Система работает локально на GPU с 8 ГБ VRAM, использует 2B-параметровую модель Mistral-NeMo-Minitron и обеспечив
-
Etched оценили в $5 млрд: главный конкурент Nvidia уже продал чипов на $1 млрд
Стартап Etched, создающий специализированные чипы для вывода ИИ-моделей, достиг оценки в $5 млрд и зафиксировал заказы на $1 млрд. Это первый серьезный вызов монополии Nvidia в сегменте inference.
-
Palantir и NVIDIA: Открытые Nemotron для защищенных сетей США
Palantir интегрировала открытые модели NVIDIA Nemotron в свою платформу Sovereign AI, позволяя госструктурам США обучать ИИ на изолированных серверах с полным контролем данных.
-
NVIDIA Jetson впервые заработал на орбите Луны с Firefly Aerospace
Аппаратное обеспечение NVIDIA Jetson успешно прошло проверку в условиях космоса: модуль был запущен на лунную орбиту в рамках миссии Blue Ghost.