Новости про NVIDIA
885 материалов с упоминанием NVIDIA: релизы, бенчмарки, цены и доступность. Профиль компании и её модели — на странице NVIDIA.
-
Cerebras представила WSE-3 Turbo и CS-4: 250 PFLOPS и первый стоечный кластер
Cerebras Systems анонсировала ускоритель WSE-3 Turbo с удвоенной производительностью (250 PFLOPS) и первую стоечную систему CS-4, объединяющую три таких чипа в единый кластер с задержкой 2 мкс.
-
Ajinomoto режет поставки ABF-пленки в Китай на 30%: удар по ИИ-чипам
Японский химический гигант Ajinomoto сокращает поставки критически важной изоляционной пленки ABF китайским производителям подложек на 30%. Это усугубляет зависимость Китая от импорта в сегменте высокопроизводительных пр
-
Claude побеждает химиков: ИИ проектирует белки с точностью до 35%
Anthropic представила результаты тестов Claude Opus 4.8 и Mythos Preview в дизайне белков и аналитической химии. ИИ превзошел человеческих экспертов по скорости и успешности создания связывающих молекул.
-
Nvidia H200 в Китае: ByteDance и Tencent получили первые партии, но инфраструктура не готова
Китайские гиганты ByteDance и Tencent получили по ~10 000 ускорителей Nvidia H200. Однако Пекин требует хранить большую часть лицензированных чипов в Гонконге, где не хватает энергии и площадей для их запуска.
-
KernelArc: AI-агенты захватили топ SOL-ExecBench на NVIDIA H100/B200
Новая система KernelArc от исследователей из Meta и других лабораторий демонстрирует, как многоагентный поиск превосходит ручную оптимизацию GPU-ядер, заняв первые места в ключевых задачах LLM.
-
Qwen3.8-27B без цензуры: запуск на Mac через MLX и GGUF
OrcaRouter выпустили модификацию Qwen3.8-27B, убравшую стандартные отказы в ответах. Модель доступна в форматах MLX для Apple Silicon, GGUF и FP8.
-
Оценка Etched выросла до $21 млрд за месяц после установки кластера Jane Street
Стартап Etched удвоил оценку до $21 млрд благодаря первому развернутому AI-кластеру для Jane Street, что подтверждает спрос на кастомные чипы для ИИ.
-
NVIDIA ускоряет UMAP в 74 раза: мульти-GPU обработка 870 ГБ данных за 8 минут
NVIDIA выпустила поддержку multi-GPU для построения графа kNN в UMAP через cuML и cuVS 25.06, что позволяет обрабатывать сотни гигабайт векторов за минуты без потери точности.
-
Китайские AI-чипы захватят 90% рынка: Huawei и Cambricon вытесняют Nvidia
Аналитики TrendForce прогнозируют, что к 2026 году отечественные ускорители Китая займут 90% внутреннего рынка, вытеснив Nvidia и AMD. Huawei и Cambricon станут главными бенефициарами этого сдвига.
-
1usmus Hydra 2.3B: Разгон GDDR7 до 36 Гбит/с для RTX 50-й серии
Известный оверклокер 1usmus выпустил обновление Hydra 2.3B, добавившее поддержку экстремального разгона памяти GDDR7 и управления питанием для видеокарт NVIDIA GeForce RTX 50-й серии.
-
MiniMax Music 3.0 Studio: локальная генерация музыки через ComfyUI
Сообщество выпустило локальный интерфейс MiniMax Music 3.0 Studio для генерации музыки на базе ComfyUI. Инструмент позволяет создавать треки с точным контролем структуры, жанра и вокала прямо на GPU.
-
Rust на GPU: LLVM-оффлодинг обгоняет CUDA в тестах
Исследование показало, что безопасный Rust через LLVM-бэкенд достигает производительности, сопоставимой с нативным CUDA/HIP, сохраняя защиту памяти.
-
ASUS GPU Tweak III: Авто-отключение для защиты от возгорания 12V-2x6
Обновление ASUS GPU Tweak III v2.1.8.0 добавило функцию аварийного отключения системы при обнаружении аномального тока в разъеме 12V-2x6, направлено на защиту видеокарт от перегрева и возгорания.
-
NVIDIA Nemotron 3.5 Lightning: NVFP4 квантование с QAD
NVIDIA представила модель Nemotron 3.5 Lightning с квантованием NVFP4, достигнув 4x прироста скорости и сокращения размера с 66 до 22 ГБ благодаря методу QAD.
-
Рынок оптических интерфейсов для ИИ вырастет в 10 раз к 2030 году
Прогноз CIC: рынок оптических соединений в ЦОД достигнет $144,4 млрд к 2030 году. Кремниевая фотоника захватит 63,7% выручки благодаря переходу на CPO и скорости 1.6T.
-
Alibaba продает Lingxi Games за $2 млрд ради AI-инфраструктуры
Китайский технологический гигант Alibaba завершает продажу студии Lingxi Games частному фонду Trustar Capital. Сделка оценивается минимум в $1,5–2 млрд и позволяет компании переориентировать капитал на агрессивное расшир
-
Groq привлек $350 млн для перехода от чипов к NeoCloud
Бывший производитель AI-чипов Groq оценивается в $3,5 млрд и переориентируется на облачный сервис NeoCloud, расширяя инфраструктуру на базе NVIDIA.
-
Nvidia вложила $1.5 млрд в дата-центр OpenAI: инфраструктурный гигант на 8 ГВт
Nvidia объявила о прямых инвестициях в $1.5 млрд в SB Energy — компанию SoftBank и OpenAI, строящую крупнейший в США центр обработки данных. Сделка закрепляет за Nvidia статус единственного поставщика вычислительных мощн
-
NVIDIA и OpenAI: $600 млрд инвестиций в AI-фабрики и битва за LPS
NVIDIA заключила партнерство с SB Energy для обеспечения энергией (LPS) нового дата-центра OpenAI в Огайо. Проект объемом 4,25 ГВт может принести компании до $200 млрд выручки на одной площадке.
-
Intel Arc Pro B70 подорожал на 48%: почему видеокарта для AI стоит почти $2000
Топовая workstation-карта Intel Arc Pro B70 с 32 ГБ памяти резко выросла в цене до $1299–$1975. Рост обусловлен дефицитом компонентов и ажиотажем вокруг AI-инференса.
-
Alienware Area-51 с RTX 5090 дешевле самой видеокарты: скидка $1550
Dell предлагает игровой ПК на базе RTX 5090 за $4779, что на $20 дешевле стоимости только видеокарты. Скидка $1550 делает эту сборку выгоднее покупки GPU в розницу.
-
Untie Squared ReLU: Эксперимент с архитектурой FFN в GPT
Исследователи протестировали вариацию активации FFN, разделяя квадрат ReLU на два независимых потока. Модель требует на 50% больше вычислений, но сходится к тому же уровню потерь.
-
Final2x v4.0: Новый бэкенд cccv и поддержка GPU Nvidia 50-й серии
Вышла версия 4.0.0 кроссплатформенного инструмента суперразрешения изображений Final2x. Обновление принесло переход на бэкенд cccv, поддержку пользовательских моделей и нативную работу с видеокартами Nvidia 50-й серии.
-
Intel Nova Lake: десктоп раньше серверов. Почему AMD проигрывает в скорости?
Виктор Hallock анонсировал архитектуру Nova Lake для десктопов, опровергнув стратегию AMD. Intel делает ставку на энтузиастов, меняя структуру команд и ускоряя релизы до 2030 года.
-
Meta Muse Glimmer: 30B-модель для локальных AI-агентов на NVIDIA
Meta выпустила плотную модель Muse Glimmer (30B параметров) с контекстом 120K+, оптимизированную для локального запуска AI-агентов на GPU NVIDIA. Производительность достигает 20K токенов/сек на Blackwell Ultra.
-
Nvidia превратила $5 млрд в $30 млрд: портфель инвестиций на $100 млрд
SEC-файлы раскрыли масштаб инвестиционного портфеля Nvidia: прибыль от Intel достигла $25 млрд, а доля в SpaceX оценивается в $21 млрд. Компания полностью вышла из Arm, но усилила позиции в Coherent и Nokia.
-
Duix Avatar: Офлайн-клонирование цифровых людей с открытым кодом
Компания Duix.com выпустила полностью автономный инструмент для создания видео с цифровыми аватарами. Решение работает без интернета, поддерживает 8 языков и требует всего RTX 4070 для локального запуска.
-
OpenAI теряет $38,5 млрд: почему ChatGPT не окупает $34 млрд расходов
Аудированные данные показывают, что убытки OpenAI в 2025 году достигли $38,5 млрд при доходах в $13 млрд. Компания сжигает деньги быстрее, чем когда-либо в корпоративной истории, ставя на рекламу и рост подписок.
-
Meta выпустила Muse Glimmer: 30B-модель для локальных AI-агентов
Meta открыла исходный код мультимодальной модели Muse Glimmer (30B параметров) под лицензией Apache 2.0. Модель оптимизирована для локального запуска агентов, поддерживает видео и демонстрирует лидерство в бенчмарках аге
-
Open-модели 2026: Китай доминирует, США оптимизируют, метрики скачаний vs лайков
Отчет Hugging Face за лето 2026 года: китайские лаборатории выпускают модели до 2.78 трлн параметров, американские игроки фокусируются на оптимизации под железо, а скачивания и лайки больше не коррелируют.