NV
Llama 3.1 Nemotron Ultra 253B v1 (Reasoning) Reasoning
NVIDIAtextreasoningproprietary
Модель Llama 3.1 Nemotron Ultra 253B v1 от NVIDIA с индексом интеллекта 7.5. Поддерживает пошаговые рассуждения, контекстное окно — 128 тыс. токенов, скорость вывода около 0 токенов/с. Стоимость — $0 за 1М входных и $0 за 1М выходных токенов.
Ключевые метрикиоценка
AIKraft Index7.5#480 из 669
Контекст128kтокенов
Output speed0.0 t/sизмерено
TTFT0.0 sизмерено
Blended цена₽0$0.00 / 1M
МодальностьТекстоваяс рассуждением
Обзор
Llama 3.1 Nemotron Ultra 253B v1 — модель от NVIDIA. Ориентирована на задачи, где важны глубина рассуждений и длинный горизонт: агентное программирование, анализ больших кодовых баз, научный ресёрч и многошаговая работа с инструментами.
Контекстное окно — 128 тыс. токенов, скорость вывода — ~0 токенов/с. Композитный индекс интеллекта — 7.5 из 100 — #481 из 669 в рейтинге AIKraft. Доступ из РФ — через сторонние прокси-сервисы. Цена — $0 за 1M входных и $0 за 1M выходных токенов.
Бенчмарки
Результаты на эвалах
Math Index: 63.7
| Бенчмарк | Значение |
|---|---|
| MATH-500 | 95.2% |
| MMLU-Pro | 82.5% |
| AIME | 74.7% |
| GPQA Diamond | 72.8% |
| LiveCodeBench | 64.1% |
| AIME '25 | 63.7% |
| IFBench | 38.2% |
| τ²-bench | 11.4% |
| HLE | 7.4% |
| Terminal-Bench Hard | 2.3% |
7.5/ 100место в рейтинге#480
композитный индекс · вклад эвалов
взвешенная композиция реальных эваловметодология →
Производительность и цена
Скорость, стоимость и положение на Pareto-фронте
скорость и TTFT — измеренные значения, не заявленные вендором
Скорость
0.0 t/s
Output speed
0.0 s
TTFT
Контекстное окно
128k заявленный контекст
Цена за 1M токенов
Input входные$0.00₽0
Output выходные$0.00₽0
Blended 3:1$0.00₽0
курс ЦБ РФ · $1 = ₽83.48
Калькулятор стоимости в ₽
M ток.
M ток.
≈ стоимость в месяц—
Pareto-фронт среди соседей
Llama 3.1 Nemotron Ultra 253B v1
соседи
пунктир — Pareto-граница
Сравнения и подборки
Прямые сравнения с конкурентами и подборки, в которые входит Llama 3.1 Nemotron Ultra 253B v1
Нужна эта модель в вашей компании?
Развернём её (self-host или API), подключим под ваши задачи и обучим команду. Бесплатный ИИ-аудит — 30 минут.
Сравнение
Похожие модели
ближайшие по AIKraft Index · radar по реальным эвалам
| Модель | Index | Код | Контекст | Цена $/1M | Скорость |
|---|---|---|---|---|---|
| AL Qwen3 30B A3B | 7.6 | — | 33k | $0.75 | 0 |
| PE Sonar Pro | 7.6 | — | 200k | $0 | 0 |
| NV NVIDIA Nemotron Nano 12B v2 VL | 7.5 | — | 128k | $0 | 0 |
| AL Qwen3 30B A3B 2507 Instruct | 7.5 | — | 262k | $0.35 | 0 |
| NV Llama 3.1 Nemotron Ultra 253B v1 | 7.5 | — | 128k | $0 | 0 |
| UP Solar Pro 2 | 7.5 | — | 66k | $0 | 0 |
| MI Devstral Small 2 | 7.5 | 29 | 256k | $0 | 0 |
| BA ERNIE 4.5 300B A47B | 7.5 | — | 131k | $0.48 | 0 |
| GO Gemma 4 E4B | 7.5 | — | 128k | $0.04 | 52 |
Llama 3.1 Nemotron Ultra 253B v17.5
NVIDIA Nemotron Nano 12B v2 VL7.5
Qwen3 30B A3B 2507 Instruct7.5
Новости и материалы
Связанные новости и разборы
упоминания Llama 3.1 Nemotron Ultra 253B v1 в ленте и материалах редакции
Статьи блога
разборы
Статья
Инференс LLM на AMD Radeon: гайд по ROCm и Vulkan
Статья
NVIDIA vs Apple Silicon: Тест LLM на токены/с
Статья
Magnitude: Движок для ИИ-агентов, который работает быстрее llama.cpp
Статья
Ollama и Jev: Революция в локальных решениях ИИ
Статья