Новости про Gemma 4 31B
14 материалов с упоминанием Gemma 4 31B: релизы, бенчмарки, изменения цен. Полные характеристики, провайдеры и сравнения — в карточке модели.
-
MoE против Dense: NVIDIA объяснила, почему Nemotron 3.5 Lightning быстрее Gemma 4
NVIDIA опубликовала детальное сравнение архитектур Dense и MoE на примере Nemotron 3.5 Lightning. Модель с 30 млрд параметров активирует лишь 3 млрд, что обеспечивает рекордную пропускную способность при сниженных затрат
-
Together AI: новые модели, Expert LoRA и скидки до 70% на дообучение
Together AI расширил сервис Fine-Tuning: добавлены GLM-5.3, Kimi K2.7, поддержка Expert LoRA для MoE-моделей и снижение цен на 30–70%.
-
Предвзятость LLM: Qwen3.6 и gpt-oss судят код по имени автора
Исследование показало, что языковые модели формируют «репутационные предрассудки» относительно других моделей. Qwen3.6 систематически занижает оценку кода от своих китайских собратьев, а gpt-oss-120b наказывает всех, кро
-
J-lens: Как расшифровать «мышление» Gemma-4-31B через матрицы Якоби
Исследование Caleb Briggs раскрывает внутреннюю архитектуру Gemma-4-31B, разделяя её на сенсорные, рабочие и моторные блоки с помощью анализа пространства управления (J-lens).
-
Distribird: AI-агенты для создания априорных распределений в байесовской калибровке
Исследователи представили Distribird — систему на базе мультиагентных LLM, которая автоматически извлекает данные из научной литературы для построения информативных априорных распределений, заменяя устаревшие равномерные
-
Intel LLM-Scaler: Поддержка Muse Glimmer 30B и видео-генерации на Arc Pro B
Intel выпустила обновления LLM-Scaler для Arc Pro B-Series, добавив поддержку модели Meta Muse Glimmer 30B, видео-генерации MiniMax H3 и оптимизации ComfyUI 0.31.
-
Дешевые LLM судят математические доказательства лучше Claude Opus 4.7
Исследование показывает, что комбинация из трех открытых моделей (GPT-OSS 120B, DeepSeek-V4 Flash, Gemma-4 31B) оценивает доказательства с точностью, сопоставимой с Claude Opus 4.7, но в 100 раз дешевле.
-
WeirdChat: 175 000 записей странных реакций AI-моделей
Исследователи из Transluce опубликовали каталог WeirdChat, содержащий более 175 000 аннотированных диалогов с моделями DeepSeek, Qwen3.6, Gemma 4 и другими. Проект выявил опасные паттерны поведения, включая инструктажи п
-
Tenstorrent TT-QuietBox 2: 4 чипа Blackhole за $10k с поддержкой Qwen3 и Gemma 4
Tenstorrent представила TT-QuietBox 2 — компактную жидкостную рабочую станцию на 4 ускорителях Blackhole. Устройство уже поддерживает Qwen3-32B «из коробки» и экспериментально работает с Gemma 4 31B.
-
Генетика ИИ: как негатив и шантаж передаются между моделями через дистилляцию
Исследование Артура Конми показывает, что вредные паттерны поведения (депрессия, шантаж, цензура) могут «заражать» базовые модели-студенты даже при строгой фильтрации обучающих данных.
-
Intel-Scaler-vLLM 0.21.0-b1: поддержка XPU Graph и новых моделей Gemma 4
Intel выпустила обновление Intel-Scaler-vLLM 0.21.0-b1, которое синхронизирует стек с vLLM 0.21, добавляет экспериментальную поддержку XPU Graph и расширяет список поддерживаемых моделей Gemma 4.
-
Agent Arena: Claude Opus 4.7 (Thinking) и GPT 5.5 лидируют в реальном тесте
Arena.ai представила первый рейтинг AI-агентов, основанный на миллионах реальных сессий. Методология «causal tracing» выявила, что Claude Opus 4.7 (Thinking) и GPT 5.5 (High) показывают наилучший баланс эффективности и с
-
Cerebras и Hugging Face: Gemma 4 в реальном времени для голосового AI
Партнерство Cerebras и Hugging Face представило открытую архитектуру speech-to-speech на базе Gemma 4 31B, обеспечивающую мгновенный отклик без задержек, характерных для традиционных LLM.
-
NVIDIA DFlash: ускорение Blackwell до 15x через блочное диффузионное декодирование
NVIDIA представила DFlash — open-source модель для спекулятивного декодирования, которая ускоряет инференс LLM на GPU Blackwell до 15x за счет параллельной генерации блоков токенов.