Llama 3.1 Nemotron Nano 4B v1.1 (Reasoning) Small
NVIDIAМодель Llama 3.1 Nemotron Nano 4B v1.1 от NVIDIA с индексом интеллекта 7.3. Поддерживает пошаговые рассуждения, контекстное окно — 128 тыс. токенов, скорость вывода около 0 токенов/с. Стоимость — $0 за 1М входных и $0 за 1М выходных токенов.
Обзор
Llama 3.1 Nemotron Nano 4B v1.1 — модель от NVIDIA. Ориентирована на задачи, где важны глубина рассуждений и длинный горизонт: агентное программирование, анализ больших кодовых баз, научный ресёрч и многошаговая работа с инструментами.
Контекстное окно — 128 тыс. токенов, скорость вывода — ~0 токенов/с. Композитный индекс интеллекта — 7.3 из 100 — #495 из 669 в рейтинге AIKraft. Веса модели открыты для скачивания. Доступ из РФ — через сторонние прокси-сервисы. Цена — $0 за 1M входных и $0 за 1M выходных токенов.
Бенчмарки
| Бенчмарк | Значение |
|---|---|
| MATH-500 | 94.7% |
| AIME | 70.7% |
| MMLU-Pro | 55.6% |
| AIME '25 | 50% |
| LiveCodeBench | 49.3% |
| GPQA Diamond | 40.8% |
| IFBench | 25.5% |
| τ²-bench | 11.7% |
| HLE | 5.2% |
| LCR | 0% |
Производительность и цена
Сравнения и подборки
Сравнение
| Модель | Index | Код | Контекст | Цена $/1M | Скорость |
|---|---|---|---|---|---|
| NV Llama Nemotron Super 49B v1.5 | 7.4 | — | 128k | $0 | 0 |
| NV NVIDIA Nemotron Nano 9B V2 | 7.4 | — | 131k | $0.07 | 24 |
| NO Hermes 4 - Llama-3.1 405B | 7.4 | — | 128k | $1.5 | 39 |
| GO Gemini 2.0 Flash-Lite | 7.4 | — | 1m | $0 | 0 |
| NV Llama 3.1 Nemotron Nano 4B v1.1 | 7.3 | — | 128k | $0 | 0 |
| GO Gemini 2.0 Flash-Lite | 7.3 | — | 1m | $0 | 0 |
| ME Llama 3.1 Instruct 405B | 7.3 | — | 128k | $0 | 0 |
| OP GPT-4o | 7.3 | 24 | 128k | $7.5 | 0 |
| AL Qwen3 32B | 7.3 | — | 33k | $0.28 | 0 |