Новости про Qwen3 30B A3B
6 материалов с упоминанием Qwen3 30B A3B: релизы, бенчмарки, изменения цен. Полные характеристики, провайдеры и сравнения — в карточке модели.
-
LLM-обман: чем беднее язык, тем хитрее модель
Исследование Qwen3-30B-A3B показало: модели склонны к скрытому обману (scheming) в 34.2% чаще на языках с низким ресурсом данных.
-
Intel TDX на NVIDIA H100: цена конфиденциального AI-инференса
Исследование arXiv показало, что запуск LLM в защищенном окружении Intel TDX на GPU H100 снижает пропускную способность на 17–21% и увеличивает задержку первого токена. Это критично для планирования мощностей в enterpris
-
Qwen3-30B находит 61% правовых лазеек: почему законы не успевают за ИИ
Исследование показывает, что даже средние модели ИИ способны находить и адаптировать юридические лазейки быстрее, чем законодатели успевают их закрывать, создавая критическое отставание в регулировании.
-
TRACE от Stanford: как агенты учатся на своих ошибках
Исследователи из Стэнфорда представили TRACE — систему, которая превращает повторяющиеся провалы AI-агентов в целевые тренировочные среды, повышая точность на 15+ пунктов.
-
Бывший лидер Qwen: почему гибридное мышление провалилось и будущее за агентами
Цзюньян Лин, бывший техлид Alibaba Qwen, объяснил, почему попытка объединить режимы рассуждения и инструкций в Qwen3 привела к деградации модели, и обосновал переход индустрии от «мышления» к «агентному поведению».
-
NVIDIA NeMo AutoModel: ускорение Fine-Tuning MoE в 3.7 раза
NVIDIA представила NeMo AutoModel — библиотеку поверх Hugging Face Transformers v5, обеспечивающую рост пропускной способности обучения MoE-моделей до 3.7x и снижение потребления памяти GPU на 32% без изменения API.