Новости про NVIDIA
884 материалов с упоминанием NVIDIA: релизы, бенчмарки, цены и доступность. Профиль компании и её модели — на странице NVIDIA.
-
AWS эвакуирует данные из ОАЭ и Бахрейна: дата-центры под угрозой
Amazon Web Services (AWS) официально рекомендовала клиентам перенести данные из дата-центров в Абу-Даби и Бахрейн. Восстановление работы объектов отложено на неопределенный срок после ударов иранских дронов.
-
AMD RDNA 5: Нейрорендеринг в стиле DLSS 5 и новая архитектура освещения
Инсайдер Kepler_L2 сообщил о планах AMD внедрить технологию нейрорендеринга, аналогичную DLSS 5 от NVIDIA, в архитектуре RDNA 5. Разработчик предлагает принципиально иной подход к обработке света.
-
TabPFN-3.5: Табличный ИИ, победивший решение Kaggle 2015 года
Prior Labs выпустила TabPFN-3.5 — модель, которая без дообучения и тонкой настройки превзошла победителя конкурса Otto Kaggle 2015 года, используя только сырые данные и стандартные настройки.
-
Calibrate, Then Route: Как обученный роутинг ускорил LLM-инференс
Исследователи представили систему маршрутизации запросов для дисагрегированного LLM-сервисинга, которая повышает goodput на 3-4% по сравнению с базовыми методами, экономя до одного GPU.
-
NVIDIA Earth-2: Прогноз загрязнения воздуха в UK за 2 дня на суперкомпьютере
Манчестерский университет использовал ИИ-модель NVIDIA Earth-2 для создания детальной карты загрязнения воздуха в Великобритании. Обучение заняло всего 2 дня, а модель работает даже на настольном ПК.
-
NVIDIA cuDNN Frontend: Fusion, Autotuning и Plan Reuse
NVIDIA представила cuDNN Frontend — API нового поколения для низкоуровневого контроля графов вычислений, позволяющий объединять операции, автонастраивать ядра и переиспользовать планы выполнения для максимизации производ
-
Agility Robotics представила Digit 5: робот без ограждений и зарядка за 9 минут
Agility Robotics анонсировала Digit 5 — человекоподобного робота, способного работать рядом с людьми без защитных барьеров. Устройство прошло сертификацию OSHA и готово к массовым поставкам с 2027 года.
-
AI-лидеры в расколе: OpenAI и Anthropic требуют паузы, а Nvidia назвала страхи выдумкой
После предупреждения экс-сотрудника Anthropic о риске вымирания к 2030 году, Sam Altman и Dario Amodei призвали к замедлению разработки ИИ. Jensen Huang и Китай отвергли эти опасения, назвав их инструментом сдерживания к
-
vLLM: 200+ моделей, PagedAttention и квантование для быстрого LLM-сервинга
vLLM от UC Berkeley стал стандартом для быстрого и дешевого развертывания LLM. Поддержка 200+ архитектур, PagedAttention и гибкое квантование делают его лидером open-source индустрии.
-
MoE против Dense: NVIDIA объяснила, почему Nemotron 3.5 Lightning быстрее Gemma 4
NVIDIA опубликовала детальное сравнение архитектур Dense и MoE на примере Nemotron 3.5 Lightning. Модель с 30 млрд параметров активирует лишь 3 млрд, что обеспечивает рекордную пропускную способность при сниженных затрат
-
NVIDIA NVLink 6: Многоуровневая отказоустойчивость для AI-фабрик
NVIDIA представила NVLink 6 с нативной безпотерной архитектурой, обеспечивающей восстановление инференса за 7.3 секунды и устраняющей узкие места традиционных сетей.
-
NVIDIA Vera Rubin и Groq 3 LPX: 35x рост эффективности на ватт
NVIDIA представила платформу Vera Rubin NVL72 с ускорителем Groq 3 LPX, обеспечивающую до 35-кратное увеличение пропускной способности на ватт для высокочастотных AI-задач по сравнению с поколением GB200.
-
NVIDIA Vera Rubin: 30x рост эффективности AI-фабрик и новый стандарт токенов на ватт
На AI Infra Summit NVIDIA представила платформу Vera Rubin NVL72 и ПО DSX MaxLPS, обеспечивающие до 30-кратного роста пропускной способности агентов на ватт и оптимизацию энергопотребления дата-центров.
-
NVIDIA DSX: как AI-фабрики экономят энергию без потери производительности
NVIDIA представила платформу DSX, позволяющую динамически управлять энергопотреблением дата-центров. Тесты с Lambda показывают рост пропускной способности на 24% при фиксированном бюджете энергии.
-
NVIDIA FLARE 2.9: Масштабирование федеративного обучения через Slurm, K8s и Docker
NVIDIA представила FLARE 2.9, добавив поддержку Slurm для HPC-кластеров. Архитектура теперь позволяет объединять узлы с разными системами оркестрации в единую федерацию без стандартизации инфраструктуры.
-
AI-ЦОДы США станут 5-м потребителем газа к 2035 году
Потребление природного газа центрами обработки данных в США вырастет на 117% к 2035 году из-за нехватки электросетей и бумa на ИИ-чипы.
-
WorldSculpt: Авто-реконструкция сцен из видео в ComfyUI без аннотаций
Новый пакет WorldSculpt для ComfyUI автоматизирует создание 3D-сцен из видео: извлекает объекты, строит меши и собирает их в единую сцену, используя Depth Anything 3 и SAM3.
-
Salesforce Koa: Нейросеть от Nvidia для продаж, которая пугает конкурентов
Salesforce и Nvidia представили Koa — специализированную модель рассуждений на базе Nemotron, способную автономно вести продажи и поддержку клиентов.
-
Запуск CUDA на AMD в Windows: ZLUDA + ROCm обходят виртуализацию
Разработчик Speedstu создал PowerShell-скрипт, позволяющий запускать CUDA-приложения на видеокартах Radeon RX 9060 XT в Windows без WSL2, используя связку ZLUDA и HIP.
-
Jensen Huang: Nvidia не допустит замедления развития ИИ
Генеральный директор Nvidia Дженсен Хуанг заявил Дональду Трампу, что компания не позволит замедлить темпы развития искусственного интеллекта, вступив в идеологическое противостояние с Илоном Маском и Самом Альтманом.
-
Cornelis получил $205 млн, чтобы бросить вызов Nvidia
Спин-офф Intel Cornelis привлек $205 млн для выпуска Active Compute Fabric — технологии, устраняющей задержки при передаче данных между GPU.
-
Nvidia RTX Pro 5500: 84 ГБ памяти и 21 760 ядер CUDA для AI
Nvidia представила RTX Pro 5500 — рабочую станцию на базе чипа GB202 с 84 ГБ GDDR7, заполняющую разрыв между RTX 5090 и RTX Pro 6000.
-
RTX 5090 исчезла с прилавков: цены взлетели до $9,500 из-за ажиотажа вокруг ИИ
Видеокарта Nvidia RTX 5090 полностью выкуплена перекупщиками на американском рынке. Розничные цены выросли с $4,299 до $9,500, так как геймеры и ИИ-энтузиасты скупают GPU GB202 для локальных серверов.
-
NVIDIA: ускорение Dropless MoE в JAX в 10.4 раза на GB200
NVIDIA Transformer Engine с JAX обеспечивает 10.4x рост пропускной способности при обучении MoE-моделей, повышая производительность DeepSeek-V3 с 103 до 1068 TFLOPS/GPU.
-
YuE2 для ComfyUI: генерация музыки на RTX 5090 за 40 секунд
Появился официальный узел YuE2-ComfyUI v0.4.0, позволяющий локально создавать 48 кГц стерео-треки по текстовому описанию. На RTX 5090 генерация 75-секундной песни занимает всего 40,2 секунды.
-
NVIDIA NIM на RTX 3090: Тест локальных AI-агентов и RAG-систем
NVIDIA NIM позволяет запускать сложные агентные приложения с RAG локально на потребительских видеокартах, таких как RTX 3090, обеспечивая приватность и контроль данных.
-
Nvidia и Palantir ограничили доступ к AI из-за страха утечки IP
Крупнейшие технологические гиганты, включая Nvidia, Palantir и Novo Nordisk, вводят строгие ограничения на использование продвинутых AI-моделей из-за опасений, что проприетарные данные могут быть использованы для обучени
-
Perplexity Portable Computer для Windows: локальный AI-агент на NVIDIA RTX
Perplexity выпустила локальную версию агента Portable Computer для Windows. Решение работает на видеокартах NVIDIA RTX с 24 ГБ VRAM, обеспечивая приватность данных и интеграцию с офисными приложениями без расхода облачны
-
AMD выпустила KernelVault: 100k+ ядер для обучения AI-агентов оптимизации GPU
AMD представила AMDKernelVault — крупнейший открытый датасет для HIP и Triton ядер, а также обученную на нем модель Qwen3-8B, превосходящую аналоги в генерации кода для GPU.
-
NVIDIA выпустила DeepSeek-V4-Pro с NVFP4 и DSpark: 1.65T параметров на Blackwell
NVIDIA представила квантованную версию модели DeepSeek-V4-Pro с поддержкой специкулятивного декодирования DSpark. Модель оптимизирована для NVIDIA Blackwell и достигает высокой скорости генерации при сохранении точности.