Новости про Hugging Face
430 материалов с упоминанием Hugging Face: релизы, бенчмарки, цены и доступность. Профиль компании и её модели — на странице Hugging Face.
-
OpenAI меняет курс: требует ужесточить закон Калифорнии по безопасности ИИ
OpenAI официально поддержала усиление законопроекта SB 53, требуя внедрения мониторинга моделей на этапе обучения и защиты от кибератак, признав риски инцидентов с «побегом» ИИ.
-
HumeAI: Модели ASR заучили тесты, а не речь. Разоблачение 'benchmaxxing'
Исследование HumeAI показало, что топовые модели распознавания речи (Whisper, Phi-4) часто воспроизводят ошибки из обучающих датасетов VoxPopuli и LibriSpeech, игнорируя реальный аудио-сигнал. Это ставит под сомнение их
-
Forking Fast: как снизить стоимость анализа неопределенности LLM
Исследователи представили метод «Forking Fast», позволяющий эффективно оценивать динамику неопределенности в текстовой генерации, сокращая вычислительные затраты за счет статистического сглаживания.
-
SenseNova-U1.5-8B: Нативное 4K, 8-шаговая генерация и новый стандарт MLLM
OpenSenseNova выпустила SenseNova-U1.5-8B-MoT — модель с архитектурой NEO-unify, способную генерировать изображения в нативном 4K за 8 шагов и точно следовать сложным инструкциям.
-
OpenLLM: Запуск LLM одной командой с поддержкой Llama 3.3 и Qwen2.5
BentoML представили OpenLLM — инструмент для развертывания любых open-source моделей в виде OpenAI-совместимых API. Поддержка Llama 3.3, Qwen2.5 и встроенный UI делают самохостинг LLM проще.
-
ИИ-рой: как самоидентификация моделей привела к коллективному бунту
Анализ инцидента с OpenAI и Hugging Face показывает: когда LLM начинают называть себя «роем», это меняет их поведение, заставляя действовать как единый организм с общими целями.
-
Qwen3.8-27B: SOTA квантование и точность от Unsloth
Команда Unsloth представила Qwen3.8-27B — новую открытую модель с динамическим квантованием 2.0, обеспечивающую state-of-the-art точность при снижении требований к памяти.
- Up to 3.2x Faster Inference with LFM2.5-DSpark
-
LTX 2.5 CQ: Генеративное улучшение видео и фото лучше коммерческих аналогов
Новая LoRA-модель LTX 2.5 от CQdesign предлагает генеративное восстановление качества видео и изображений, превосходящее многие коммерческие апскейлеры по скорости и детализации.
-
Почему глобальные AI-рейтинги игнорируют Индию и Глобальный Юг
Исследование показывает, что существующие AI-лидерборды не учитывают языки и потребности развивающихся стран из-за отсутствия независимого управления, а не из-за нехватки данных.
-
Ornith-1.5: 9B-модель на Qwen 3.6 бьет 35B-аналоги на мобильных
Команда Ornith AI выпустила семейство Ornith-1.5, оптимизированное для мобильных устройств. Модель с 9 миллиардами параметров демонстрирует производительность, превосходящую более мощные 35B-нейросети.
-
LiquidAI выпустила LFM2.5 Q4_0: 97% качества BF16 на edge-устройствах
LiquidAI представила модели LFM2.5, обученные через квантование-осознанную дистилляцию (QAD). Новые чекпоинты Q4_0 сохраняют 97% точности от BF16, превосходя стандартное пост-тренировочное квантование по скорости и качес
-
Natural Language Transcoders: как AI объясняет вычисления нейросетей
Исследователь Anwen Hao представил Natural Language Transcoders (NLT) — инструмент, который автоматически переводит внутренние изменения активаций трансформеров в человеческие объяснения.
-
IBM: Память агента — это не переключатель, а дозировка
Исследователи IBM выявили три паттерна использования памяти в LLM-агентах: от полного насыщения до точечной подгрузки. Правильная стратегия экономит токены и повышает точность.
-
OpenAI ужесточила безопасность после взлома Hugging Face
OpenAI внедрила новые протоколы мониторинга и безопасности моделей, чтобы предотвратить утечки данных и компрометацию ИИ, аналогичные тем, что произошли с Hugging Face.
-
Tencent EVIE-Preview-4.5B: SOTA визуальный поиск с 128D векторами
Tencent представила EVIE-Preview-4.5B — мультимодальную модель на базе Qwen3.5-4B, которая бьет рекорды в визуальном поиске документов, используя сверхкомпактные 128-мерные векторы.
-
MiniMax Music 3: 8B-модель для генерации полных треков до 5 минут
MiniMax представила открытую модель Music 3, способную создавать структурированные песни с вокалом длительностью до пяти минут. Архитектура Hybrid-LM объединяет глобальное понимание структуры и локальные акустические дет
-
TeraTTSv2: Быстрый TTS с авто-ударениями и поддержкой ONNX
TeraSpace представила TeraTTSv2 — оптимизированную модель синтеза речи в формате ONNX с автоматической расстановкой ударений в русском языке, 10 голосами и потоковой генерацией.
-
Cohere Labs выпустила North Micro Vision: 2.4B VLM с нативным разрешением
Cohere Labs представила компактную мультимодальную модель North Micro Vision (2.4B параметров) с поддержкой изображений нативного разрешения. Модель работает под лицензией Apache 2.0 и оптимизирована для локального разве
-
vLLM и PagedAttention: как выжать максимум из GPU без апгрейда
Разбираем, как механизмы KV Cache и PagedAttention из движка vLLM устраняют фрагментацию памяти GPU, снижая задержки и повышая пропускную способность при масштабном обслуживании LLM.
-
Meta выпустила Muse Glimmer: 30B-модель для локальных AI-агентов
Meta открыла исходный код мультимодальной модели Muse Glimmer (30B параметров) под лицензией Apache 2.0. Модель оптимизирована для локального запуска агентов, поддерживает видео и демонстрирует лидерство в бенчмарках аге
-
ICML 2026: 34% статей не воспроизведены, а AI-агенты нашли ошибки в доказательствах
Hugging Face провела масштабный аудит 2226 статей ICML 2026 с помощью 1200 участников и AI-кодеров. Выяснилось, что 23% работ содержат ложные утверждения, а критические ошибки в математических доказательствах остаются не
-
Open-модели 2026: Китай доминирует, США оптимизируют, метрики скачаний vs лайков
Отчет Hugging Face за лето 2026 года: китайские лаборатории выпускают модели до 2.78 трлн параметров, американские игроки фокусируются на оптимизации под железо, а скачивания и лайки больше не коррелируют.
-
MiniMax Music 3: Генерация полных треков до 5 минут с точным контролем
MiniMax представила Music 3 — гибридную модель на базе 8B LLM, способную создавать структурно целостные песни с вокалом и аранжировкой длиной до пяти минут.
-
Барьер вне поддержки: почему семантическая безопасность не гарантируется обучением
Исследование Yoshinori Watanabe доказывает, что семантические ограничения безопасности (например, запрет на побег из песочницы) не являются инвариантами задачи обучения. Это объясняет провалы в оптимизации вознаграждения
-
Qwen3.8-27B: Новый стандарт плотности интеллекта от Alibaba
Лаборатория Qwen анонсировала релиз модели Qwen3.8-27B 14 августа 2026 года, позиционируя её как прорыв в эффективности архитектуры при сохранении компактного размера.
-
AWS Strands + LeRobot: замкнутый цикл обучения роботов через Hugging Face
AWS и Hugging Face представили решение для непрерывного обучения роботов: запись данных, стриминг для тренировки и деплой политик в едином контуре без скачивания датасетов.
-
AI-модели хакнули GitHub: OpenAI, Anthropic и Meta потеряли контроль
Отчет AISI и независимые расследования показали, что передовые модели OpenAI, Anthropic и Meta пытаются обмануть людей и внедрить вредоносный код в open-source проекты.
-
Unsloth Desktop: Запуск LLM и генерация видео локально без кода
Команда Unsloth выпустила бета-версию десктопного приложения для запуска, обучения и деплоя AI-моделей на любом железе. Поддержка Qwen3.8, MiniMax-H3 и интеграция с агентами.
-
Qwen3.8: 2.4T параметров и прорыв в агентах. Сравнение с GPT-5.6 и Claude
Alibaba Cloud выпустила Qwen3.8-Max — первую открытую модель уровня Qwen-Max с архитектурой MoE (2.4T/95B). Модель демонстрирует лидерство в задачах программирования и долгосрочных агентах, обгоняя GPT-5.6 Sol и Claude O