Новости про Nemotron 3.5 Lightning
12 материалов с упоминанием Nemotron 3.5 Lightning: релизы, бенчмарки, изменения цен. Полные характеристики, провайдеры и сравнения — в карточке модели.
-
MoE против Dense: NVIDIA объяснила, почему Nemotron 3.5 Lightning быстрее Gemma 4
NVIDIA опубликовала детальное сравнение архитектур Dense и MoE на примере Nemotron 3.5 Lightning. Модель с 30 млрд параметров активирует лишь 3 млрд, что обеспечивает рекордную пропускную способность при сниженных затрат
-
NVIDIA и Palantir: как Nemotron 3.5 ускоряет цепочки поставок
NVIDIA обучила специализированную модель Nemotron 3.5 Lightning на данных цепочки поставок совместно с Palantir Foundry, достигнув точности принятия решений 86,7%.
-
NVIDIA Jetson: Запуск Frontier-моделей с ускорением до 6.28x
NVIDIA демонстрирует, как компактные модели с рассуждениями (Nemotron 3.5 Lightning и Qwen3.8-27B) работают на edge-устройствах Jetson с помощью NVFP4 и speculative decoding.
-
NVIDIA IFA 2026: Локальный AI, RTX Spark и ускорение в 1.9x
NVIDIA анонсировала новые инструменты для локального запуска AI-агентов, ПК RTX Spark и оптимизации llama.cpp/vLLM, повышающие скорость инференса до 1.9x.
-
NVIDIA: 5 правил спекулятивного декодирования для ускорения LLM
NVIDIA опубликовала руководство по co-design моделей, объясняющее, как оптимизировать спекулятивное декодирование (Speculative Decoding) для ускорения инференса без потери точности.
-
Как правильно подобрать GPU для AI-инференса: гайд NVIDIA по снижению TCO
NVIDIA опубликовала практическое руководство по расчету мощности GPU для AI-инференса. Статья объясняет, как избежать переплат за счет анализа паттернов токенов, выбора точности вычислений и стратегии Core-and-Flex.
-
Hermes Agent v0.21.0: Мультиагентность, память для Cron и управление браузером
NousResearch выпустила Hermes Agent v0.21.0. Обновление превращает инструмент из набора утилит в полноценную ОС для ИИ: добавлен режим Bot Mode с групповыми чатами ботов, долговременная память для cron-задач и нативное у
-
NVIDIA Nemotron 3.5 Lightning: NVFP4 квантование с QAD
NVIDIA представила модель Nemotron 3.5 Lightning с квантованием NVFP4, достигнув 4x прироста скорости и сокращения размера с 66 до 22 ГБ благодаря методу QAD.
-
MSI и NVIDIA: локальные AI-суперкомпьютеры с маршрутизацией моделей
MSI интегрировала поддержку NVIDIA Nemotron 3.5 Lightning и NeMo Switchyard в платформы XpertStation WS300 и EdgeXpert, создавая экосистему для локального агентного ИИ без облака.
-
NVIDIA Nemotron 3.5 Lightning: 30B-модель для агентов с ускорением x4
NVIDIA представила Nemotron 3.5 Lightning — 30-миллиардную MoE-модель для агентов, ускоряющую задачи на 30% и снижающую затраты через библиотеку маршрутизации NeMo Switchyard.
-
NVIDIA Nemotron 3.5 Lightning: 30B MoE-модель для локальных агентов
NVIDIA представила Nemotron 3.5 Lightning — открытую 30B MoE-модель для локальных AI-агентов, обеспечивающую ускорение генерации токенов в 4 раза. Параллельно выпущен NeMo Switchyard для оптимизации затрат.
-
NVIDIA Nemotron 3.5 Lightning: 30B MoE-модель для агентов с ускорением x4
NVIDIA представила Nemotron 3.5 Lightning — открытую MoE-модель на 30B параметров (3B активных), оптимизированную для высокочастотных задач AI-агентов. Модель обеспечивает до 4x прирост скорости вывода и 30% ускорение вы