NV
Llama 3.1 Nemotron Instruct 70B
NVIDIAtextproprietary
Модель Llama 3.1 Nemotron Instruct 70B от NVIDIA с индексом интеллекта 6.9. Контекстное окно — 128 тыс. токенов, скорость вывода около 0 токенов/с. Стоимость — $0 за 1М входных и $0 за 1М выходных токенов.
Ключевые метрикиоценка
AIKraft Index6.9#520 из 669
Контекст128kтокенов
Output speed0.0 t/sизмерено
TTFT0.0 sизмерено
Blended цена₽0$0.00 / 1M
МодальностьТекстоваябез рассуждения
Обзор
Llama 3.1 Nemotron Instruct 70B — модель от NVIDIA. Подходит для генерации и обработки текста, диалоговых сценариев и прикладных задач с невысокой задержкой.
Контекстное окно — 128 тыс. токенов, скорость вывода — ~0 токенов/с. Композитный индекс интеллекта — 6.9 из 100 — #521 из 669 в рейтинге AIKraft. Доступ из РФ — через сторонние прокси-сервисы. Цена — $0 за 1M входных и $0 за 1M выходных токенов.
Бенчмарки
Результаты на эвалах
Math Index: 11
| Бенчмарк | Значение |
|---|---|
| MATH-500 | 73.3% |
| MMLU-Pro | 69% |
| GPQA Diamond | 46.5% |
| IFBench | 30.7% |
| AIME | 24.7% |
| τ²-bench | 23.1% |
| LiveCodeBench | 16.9% |
| AIME '25 | 11% |
| LCR | 8.3% |
| Terminal-Bench Hard | 4.5% |
| HLE | 4.2% |
6.9/ 100место в рейтинге#520
композитный индекс · вклад эвалов
взвешенная композиция реальных эваловметодология →
Производительность и цена
Скорость, стоимость и положение на Pareto-фронте
скорость и TTFT — измеренные значения, не заявленные вендором
Скорость
0.0 t/s
Output speed
0.0 s
TTFT
Контекстное окно
128k заявленный контекст
Цена за 1M токенов
Input входные$0.00₽0
Output выходные$0.00₽0
Blended 3:1$0.00₽0
курс ЦБ РФ · $1 = ₽83.48
Калькулятор стоимости в ₽
M ток.
M ток.
≈ стоимость в месяц—
Pareto-фронт среди соседей
Llama 3.1 Nemotron Instruct 70B
соседи
пунктир — Pareto-граница
Сравнения и подборки
Прямые сравнения с конкурентами и подборки, в которые входит Llama 3.1 Nemotron Instruct 70B
Нужна эта модель в вашей компании?
Развернём её (self-host или API), подключим под ваши задачи и обучим команду. Бесплатный ИИ-аудит — 30 минут.
Сравнение
Похожие модели
ближайшие по AIKraft Index · radar по реальным эвалам
| Модель | Index | Код | Контекст | Цена $/1M | Скорость |
|---|---|---|---|---|---|
| CO Command A | 7 | — | 256k | $4.38 | 71 |
| UP Solar Pro 2 | 7 | — | 66k | $0 | 0 |
| ME Llama 3.1 Instruct 8B | 6.9 | 5 | 128k | $0.03 | 0 |
| AL Qwen2.5 Instruct 32B | 6.9 | — | 128k | $0 | 0 |
| NV Llama 3.1 Nemotron Instruct 70B | 6.9 | — | 128k | $0 | 0 |
| SP Grok Beta | 6.9 | — | 128k | $0 | 0 |
| AL Qwen3.5 2B | 6.9 | 3 | 262k | $0 | 0 |
| NV NVIDIA Nemotron 3 Nano 30B A3B | 6.8 | — | 1m | $0.09 | 241 |
| MI Mistral Large 2 | 6.8 | — | 128k | $3 | 0 |
Llama 3.1 Nemotron Instruct 70B6.9
Llama 3.1 Instruct 8B6.9
Qwen2.5 Instruct 32B6.9
Новости и материалы
Связанные новости и разборы
упоминания Llama 3.1 Nemotron Instruct 70B в ленте и материалах редакции
Статьи блога
разборы
Статья
LLM на AMD Radeon: Сборка llama.cpp через ROCm и Vulkan
Статья
Инференс LLM на AMD Radeon: гайд по ROCm и Vulkan
Статья
NVIDIA vs Apple Silicon: Тест LLM на токены/с
Статья
Magnitude: Движок для ИИ-агентов, который работает быстрее llama.cpp
Статья