Релиз модели14 июля 2026 г., 20:00 МСК🤖 Auto

Nemotron: Как открытые модели снижают стоимость AI в 10-20 раз

NVIDIA демонстрирует, что кастомизация открытых моделей Nemotron позволяет бизнесу достигать точности уровня закрытых аналогов, но с экономией до 20 раз на инференсе.

Баннер новости 3560

От владения данными к владению интеллектом

В эпоху, когда конкуренция определяется не выбором модели, а способом её использования, NVIDIA Nemotron позиционируется как фундамент для создания контролируемого AI. В отличие от закрытых моделей, которые создают «потолок» возможностей и требуют передачи проприетарных данных третьим лицам, открытые модели обеспечивают полное право собственности. Это позволяет компаниям проводить приватные оценки, настраивать среды обучения с подкреплением (RL) и внедрять агентов, работающих в связке с фронтьер-моделями для оптимизации затрат.

Реальные кейсы: точность без компромиссов

Партнеры NVIDIA уже внедрили Nemotron в критически важные сферы, доказав, что открытые веса не уступают закрытым решениям. Ключевые результаты включают:

  • Harvey (Юриспруденция): Постобучение Nemotron 3 Ultra на юридических бенчмарках достигло точности уровня закрытых моделей, но при стоимости выполнения запроса как минимум в 10 раз ниже.
  • H Company (Компьютерное зрение): Модель Holotron 3 Nano показала точность более 76% на бенчмарке OSWorld-Verified, сопоставимую с ведущими фронтьер-моделями, но за fraction of the cost.
  • Glean (Поиск): Агentic-модель Waldo, сочетающая Nemotron с крупными закрытыми моделями, обеспечивает корпоративный поиск с значительно меньшей задержкой и меньшим расходом токенов.
  • LangChain: Настройка Deep Agents для Nemotron 3 Ultra без переобучения модели дала точность среди открытых решений, при этом стоимость инференса снизилась в 10 раз по сравнению с закрытыми альтернативами.

Экономика инференса: Blackwell и оптимизация

Аппаратная оптимизация играет ключевую роль в снижении себестоимости. Партнер NVIDIA, компания Arcee AI, провела постобучение Nemotron на платформе NVIDIA Blackwell. Результат: стоимость инференса составила около 90 центов за миллион выходных токенов. Это примерно в 20 раз дешевле, чем у сопоставимых закрытых фронтьер-моделей, при этом модель заняла второе место в рейтинге PinchBench и сохранила открытый статус весов.

Инструментарий и экосистема

Для ускорения кастомизации NVIDIA предоставляет открытый стек NeMo, а также сотрудничает с партнерами, такими как Prime Intellect и Unsloth, для создания пайплайнов постобучения. Инициатива Nemotron Coalition объединяет разработчиков для обмена данными и оценками, позволяя бизнесу переходить от простого использования AI к полному владению интеллектуальными системами, адаптированными под специфические рабочие процессы.

Источник: NVIDIA Blog ↗