Локальные агенты на одном GPU
Лаборатория Meta Superintelligence Labs анонсировала выпуск модели Muse Glimmer объемом 30 миллиардов параметров. Ключевая особенность архитектуры — оптимизация для работы в режиме «always-on» (постоянной готовности) на локальных устройствах. Модель спроектирована так, чтобы помещаться в память одного потребительского графического процессора, что делает её доступной для энтузиастов и разработчиков без необходимости использования серверных кластеров.
Фокус на агентных задачах
В отличие от многих больших языковых моделей, ориентированных на генерацию текста, Muse Glimmer обучалась и оценивалась на предмет завершения end-to-end агентных задач. Основные сценарии использования включают:
- Локальных кодовых агентов (coding agents).
- Оценку качества ответов через механизм LLM-as-a-judge.
- Многошаговое логическое рассуждение (multi-step reasoning).
Доступность и экосистема
Веса модели опубликованы под разрешительной лицензией Apache 2.0, что позволяет свободно использовать, модифицировать и распространять их. Поддержка модели уже интегрирована в популярные инструменты: веса доступны на Hugging Face, а фреймворк ollama обновлен до версии 0.32.7 для нативной работы с Muse Glimmer.
Технические характеристики
| Параметр | Значение |
|---|---|
| Название модели | Muse Glimmer |
| Количество параметров | 30 Billion (30B) |
| Лицензия | Apache 2.0 |
| Требования к железу | Один потребительский GPU |
| Основная специализация | Локальные AI-агенты, многошаговое рассуждение |
Полные технические детали и документация доступны на официальном исследовательском портале Meta: research.meta.ai.
Источник: Phoronix ↗
