Новости про NVIDIA
885 материалов с упоминанием NVIDIA: релизы, бенчмарки, цены и доступность. Профиль компании и её модели — на странице NVIDIA.
-
Rembg: Удаление фона на Python с поддержкой GPU и 4 режимами обработки краев
Open-source инструмент Rembg обновился, добавив поддержку AMD ROCm, гибкие режимы обработки краев (alpha matting, decontamination) и интеграцию с API без загрузки моделей.
-
Nvidia повышает цены на AI-серверы на 15% из-за дефицита HBM
Nvidia уведомляет ключевых клиентов о повышении цен на серверы с чипами Grace Blackwell и Vera Rubin на 15%. Рост обусловлен рекордным удорожанием памяти HBM и общей нехваткой DRAM на рынке.
-
Nvidia DGX Station с GB300: первый ценник ~$95k для локального AI
Exxact опубликовала цену на настольную DGX Station на базе чипа GB300. За $94,930 корпорации получают 748 ГБ унифицированной памяти и Blackwell Ultra GPU в формате башни.
-
MiniMax Music 3 Refiner v0.10: ИИ-реставрация музыки с метрикой 0.94
Terminus Research выпустила модель для восстановления поврежденного аудио. Модель использует латентное пространство MiniMax Music 3, достигая 11.25x ускорения на NVIDIA L40S.
-
418 AI-моделей в одном репозитории: Ailia упрощает запуск SOTA-решений
Проект Ailia-Models объединил 418 предварительно обученных нейросетей — от LLM до детекции объектов — с единым интерфейсом CLI, устраняя барьеры для внедрения AI в кроссплатформенные приложения.
-
Необлака 2026: CoreWeave, Nebius и Lambda — кто диктует цены на GPU
Анализ рынка GPU-инфраструктуры: CoreWeave сохраняет премию за надежность, Lambda бьет рекорды низкой цены, а Nebius первой открыла тарифы на B300.
-
NVK Vulkan Video: H.264 декодирование в Mesa 26.3 для NVIDIA
В Mesa 26.3 добавлена поддержка Vulkan Video для открытого драйвера NVK. Пока доступна только декодирование H.264 на GPU архитектуры Turing и новее.
-
HumeAI: Модели ASR заучили тесты, а не речь. Разоблачение 'benchmaxxing'
Исследование HumeAI показало, что топовые модели распознавания речи (Whisper, Phi-4) часто воспроизводят ошибки из обучающих датасетов VoxPopuli и LibriSpeech, игнорируя реальный аудио-сигнал. Это ставит под сомнение их
-
Nvidia: Укрощение AI-агентов через тонкую настройку, а не мощь модели
Исследование Nvidia доказывает: стабильность и эффективность AI-агентов зависят не от размера базовой модели, а от качества её дообучения (fine-tuning) под конкретные задачи.
-
Framework Laptop 16: RTX 5070, клавиатура и тачпад нового поколения
Framework Computer начала поставки обновленных модулей для Laptop 16: графический ускоритель NVIDIA GeForce RTX 5070 12GB, цельная клавиатура и тактильный тачпад с поддержкой Linux.
-
NVIDIA DSX MaxLPS: как выжать 40% больше GPU из того же мегаватта
NVIDIA представила DSX MaxLPS — комплексное решение для оптимизации энергопотребления AI-фабрик. Технология позволяет увеличить плотность вычислений до 40% за счет динамического распределения мощности и перехода на охлаж
-
NVIDIA: Безопасность AI-агентов должна жить в рантайме, а не в коде
В исследовании NVIDIA объясняется, почему защита AI-агентов не может опираться на логику harness-ов. Авторитетные ограничения должны внедряться на уровне безопасного рантайма (OpenShell) и инфраструктуры.
-
NVIDIA AVO: 100% на ARC-AGI-3 и оптимизация GPU без людей
Архитектура NVIDIA AVO достигла 100% на сложном бенчмарке ARC-AGI-3 и оптимизировала GPU-ядра на 10.5% за 7 дней автономной работы, доказав важность системного дизайна.
-
Nvidia опровергла поставки LPU в Китай: «Продукта для КНР в планах нет»
Nvidia официально опровергла сообщения о подготовке специализированной версии LPU для китайского рынка. Компания заявила об отсутствии продаж и планов по созданию региональных модификаций ускорителей.
-
Адаптивное сжатие RAG на edge: экономия до 53% энергии
Исследователи из Northeastern University представили метод динамической компрессии контекста для RAG-систем на NVIDIA Jetson AGX Thor, снижающий энергопотребление GPU почти вдвое без потери качества ответов.
-
SMIC повышает цены на пластины: дефицит и санкции создают рынок покупателя
Китайский производитель SMIC зафиксировал рекордную выручку в $3 млрд и повысил цены на полупроводниковые пластины. Из-за санкций США у китайских ИИ-стартапов нет альтернативы, что превратило SMIC в монополиста.
-
Micron инвестирует $10 млрд в лаборатории памяти для ИИ
Micron Technology анонсировала создание Micron Research Labs с бюджетом $10 млрд на 10 лет. Цель — прорывные исследования памяти и вычислительных архитектур для следующей эры ИИ.
-
Nvidia готовит чип для Китая: ставка на инференс и Groq
Nvidia планирует начать поставки специального AI-чипа для китайского рынка до конца 2026 года. Устройство совместимо с экспортными ограничениями США и использует технологии Groq.
-
NVIDIA представила Generative RecSys: HSTU, Semantic IDs и nv-embedding-cache
NVIDIA открыла репозиторий recsys-examples, внедряя генеративные рекомендательные системы на базе трансформеров. Новые инструменты решают проблемы масштабируемости, холодного старта и задержек в реальном времени.
-
Кто платит за open weights, когда лаборатории убирают малые модели?
Исследование Towards AI показывает, что отказ от выпуска компактных моделей перекладывает финансовое и техническое бремя на энтузиастов, сталкивающихся с жесткими ограничениями VRAM.
-
Gigabyte Aorus Master 16 с RTX 5090 и OLED 240Hz со скидкой $800
Walmart предлагает игровой ноутбук Gigabyte Aorus Master 16 с мобильным GPU RTX 5090, процессором Intel Core Ultra 9 275HX и OLED-экраном за $3,599. Это на $800 дешевле рекомендованной цены.
-
TileMix: ускорение LLM без потери качества через смешанную точность
Исследователи представили TileMix — метод оптимизации внимания в LLM, который динамически выбирает FP16 или INT8 для разных участков матрицы, обеспечивая ускорение префилла без обучения модели.
-
Локальный AI-революция: Qwen3.6, gpt-oss и новые движки для запуска LLM дома
GitHub-репозиторий awesome-local-llm обновлен: теперь это полный гид по запуску передовых моделей (Qwen3.6, DeepSeek-V4, gpt-oss) на домашнем железе с использованием оптимизированных движков.
-
NVIDIA Holoscan: AI-агент за 40 минут создал мед. приложение с бенчмарками
Инженеры NVIDIA продемонстрировали, как AI-кодинг-агент на базе GPT-5.6 с помощью CLI и навыков Holoscan за 40 минут собрал приложение для сегментации эндоскопических инструментов с измерением латентности.
-
Linux на мощном железе: CachyOS обогнал Windows 11 в тестах рабочей станции
На экстремально мощном сервере с CPU Intel Xeon 678X и GPU NVIDIA RTX Pro 6000 Linux-дистрибутивы CachyOS и AlmaLinux показали превосходство над Windows 11 в задачах рендеринга и сжатия.
-
Silicon Data: первый рынок для хеджирования стоимости AI-вычислений
Стартап Silicon Data создал инфраструктуру для ценообразования и хеджирования стоимости AI-вычислений, превращая GPU из операционных расходов в торгуемый актив.
-
NVIDIA SkillEvaluator: +31 балла к точности AI-агентов
NVIDIA представила open-source инструмент SkillEvaluator, который доказал: верифицированные навыки (Skills) повышают эффективность AI-агентов в среднем на 31 очко по ключевым метрикам.
-
FedUMM: как NVIDIA FLARE снизила трафик федеративного обучения с 28.6 до 0.094 ГБ
NVIDIA и Университет Уильяма и Мэри представили FedUMM — фреймворк для федеративного обучения мультимодальных моделей, который сокращает объем передаваемых данных в 300 раз за счет использования LoRA-адаптеров.
-
Samsung повысила цены на 4/5/8 нм до 15% на фоне ажиотажа ИИ
Samsung Foundry повысила цены на новые заказы по техпроцессам 4, 5 и 8 нм до 15% из-за переполненности мощностей. Китайские клиенты принимают самые высокие наценки, уступая приоритет американским заказчикам.
-
NVIDIA Cosmos 3 Edge: Роботы с ИИ на борту Jetson Thor
NVIDIA представила модель Cosmos 3 Edge (4B параметров), оптимизированную для управления роботами непосредственно на устройстве. Модель работает на NVIDIA Jetson Thor без задержек и облачных вычислений.