Аппаратная мощь в компактном корпусе
Tenstorrent TT-QuietBox 2 — это не просто сервер, а полностью собранная рабочая станция, способная конкурировать с крупными решениями по плотности вычислений. В основе системы лежат 4 графических процессора Blackhole (расположенных на 2 картах p300c). Каждый чип оснащен 120 ядрами Tensix, что в сумме дает 480 вычислительных ядер на систему.
Ключевая особенность архитектуры — огромная пропускная способность памяти: 1 024 ГБ/с на карту (4 096 ГБ/с суммарно) благодаря 32 ГБ GDDR6 на каждый чип. Для управления нагрузкой используется процессор AMD Ryzen 7 9700X и 256 ГБ оперативной памяти DDR5-5600. Система потребляет до 1 500 Вт, но благодаря жидкостному охлаждению уровень шума не превышает 38 дБА.
Готовые модели и статус поддержки
Устройство поставляется с предварительно загруженной моделью Qwen3-32B, что позволяет начать генерацию токенов за считанные минуты без скачивания весов. Однако список поддерживаемых моделей шире. Согласно матрице совместимости, система стабильно работает с Llama 3.3 70B, FLUX.1, Mochi 1 и Wan2.2.
Особый интерес вызывает статус моделей от Google и Alibaba. Модель Gemma 4 31B (Cerebras/Google) и Qwen3 32B находятся в статусе Experimental, что означает доступность для тестирования, но требует тонкой настройки под стек Tenstorrent Forge. Это открывает возможности для разработчиков, желающих оптимизировать тяжелые LLM на собственном железе.
| Компонент | Характеристика |
|---|---|
| GPU (AI Accelerator) | 4× Blackhole (2× p300c cards) |
| Ядра Tensix | 480 (120 на чип) |
| Память (SRAM) | 720 MB (180 MB/chip) |
| Память (DRAM) | 128 GB GDDR6 (32 GB/chip) |
| Пропускная способность | 1,024 GB/s per card |
| Процессор | AMD Ryzen 7 9700X (8c, 3.8 GHz) |
| Цена | $9,999 |
Для кого это решение?
Tenstorrent позиционирует TT-QuietBox 2 как инструмент для разработчиков и исследователей, которым нужна локальная инфраструктура для тестирования новых архитектур. Поддержка tt-inference-server и tt-forge позволяет запускать модели от текстовой генерации (Llama, Qwen, Gemma) до мультимедийных задач (FLUX, Wan2.2 для видео).
Наличие экспериментальной поддержки Gemma 4 31B и Qwen3 32B делает эту систему актуальной для тех, кто хочет первыми протестировать новые модели на альтернативной NVIDIA архитектуре, избегая облачных затрат.
Источник: Tenstorrent ↗
