Новости про Hugging Face
430 материалов с упоминанием Hugging Face: релизы, бенчмарки, цены и доступность. Профиль компании и её модели — на странице Hugging Face.
-
NVIDIA Cosmos 3 Edge: 4B-модель для роботов на периферии
NVIDIA выпустила компактную 4-миллиардную модель Cosmos 3 Edge, способную обрабатывать видео и генерировать действия роботов в реальном времени на устройствах с ограниченной памятью.
-
Взлом Hugging Face: AI-агент украл данные, а защита сработала через локальную LLM
Hugging Face подтвердил масштабный инцидент: злоумышленники использовали уязвимость в загруженном датасете для компрометации внутренних систем. Компания выявила атаку собственным ИИ, обойдя ограничения коммерческих модел
-
MobileWan: Оптимизация Wan2.2-5B для мобильных устройств
Qualcomm AI Research представила MobileWan — облегченную версию видео-диффузионной модели Wan2.2-5B, адаптированную для работы на мобильных устройствах с сохранением высокого качества генерации.
-
Transcribe.cpp: кроссплатформенный движок ASR на ggml с поддержкой 60+ моделей
Автор Handy представил transcribe.cpp — библиотеку для локальной транскрипции, объединяющую 16 семейств моделей, аппаратное ускорение (Vulkan/CUDA/Metal) и привязки к 4 языкам.
-
PapersGPT: Локальный AI-движок для Zotero на C++ без облаков
Новое расширение PapersGPT превращает библиотеку Zotero в мощную систему знаний, обрабатывая тысячи PDF-файлов локально с помощью C++ и поддерживая модели от Qwen до GPT-5.6.
-
Feyn AI выпустил SQRL: Text-to-SI с инспекцией БД, обогнавший Claude Opus 4.6
Стартап Feyn AI представил семейство моделей SQRL, которые не просто переводят запросы в SQL, а предварительно анализируют структуру и данные базы. Флагман SQRL-35B-A3B показал 70.6% точности на BIRD Dev, превзойдя Claud
-
Нейросеть на одном GPU: как запустить LoRA-дообучение Qwen3 через NVIDIA NeMo
NVIDIA представила NeMo AutoModel — инструмент, позволяющий проводить эффективное дообучение (fine-tuning) больших языковых моделей, таких как Qwen3, на одной видеокарте. Разбор рабочего процесса в Google Colab.
-
OvisOCR2: Новый стандарт точности OCR для сложных документов
Модель OvisOCR2 от ATH-MaaS демонстрирует прорывные результаты на бенчмарках OCR, превосходя аналоги в распознавании сложных макетов и рукописного текста.
-
Т-Технологии выпустили T-Search: опенсорс-модель для поиска
Компания Т-Технологии открыла доступ к своей модели T-Search, предназначенной для задач информационного поиска. Релиз сопровождается набором датасетов для оценки эффективности.
-
HumeAI представила Real World VoiceEQ: почему голосовые ИИ всё ещё «не люди»
HumeAI выпустила масштабный бенчмарк Real World VoiceEQ, оценивший 40+ моделей по 15+ параметрам. Исследование показало, что традиционные метрики (WER, latency) скрывают критические провалы в понимании эмоций и контекста
-
Inkling от Thinking Machines: 1 трлн параметров и 1M контекста
Thinking Machines представила Inkling — первую открытую мультимодальную LLM с архитектурой MoE, способную обрабатывать текст, изображения и аудио в контексте до 1 миллиона токенов.
-
Zyphra выпустила ZUNA1.1: EEG-модель с гибкой длиной входа
Zyphra открыла исходный код ZUNA1.1 — модели для обработки ЭЭГ, которая работает с сигналами от 0.5 до 30 секунд и восстанавливает данные по любым координатам на голове.
-
NVIDIA и Hugging Face объединили усилия для масштабного обучения Diffusers-моделей
NVIDIA NeMo Automodel теперь поддерживает прямое fine-tuning популярных моделей от Hugging Face без конвертации чекпоинтов. Поддержка FLUX, Wan 2.1 и HunyuanVideo уже доступна.
-
T-Search: Агентный ретривер на Qwen3.6-35B-A3B с экономией ресурсов
Команда T-Tech опубликовала T-Search — агентный ретривер для многошагового поиска на русском и английском, работающий на эффективной MoE-модели Qwen3.6-35B-A3B.
-
NVIDIA Nemotron 3 Embed: #1 в RTEB и революция агентов
NVIDIA выпустила линейку моделей встраивания Nemotron 3 Embed. Флагман 8B занял 1-е место в RTEB, а оптимизация NVFP4 на Blackwell снижает затраты токенов агентов.
-
Soofi S 30B-A3B: Немецкий MoE-модель бьет конкурентов в German и English
Консорциум Soofi представил гибридную Mamba-Transformer модель с 31.6B параметров. Она лидирует среди полностью открытых базовых моделей по немецкому и английскому языкам, обучена на 512 GPU NVIDIA B200.
-
AMD Lemonade 11.0: TTS, 3D-генерация и авто-установка NPU
AMD выпустила обновление Lemonade 11.0 для локальных AI-серверов. Обновление добавило синтез речи с клонированием голосов, генерацию 3D-моделей и автоматическую установку бэкенда FastFlowLM для NPU.
-
Hugging Face: Гонка ИИ сместилась от фронтенра к открытым моделям
CEO Hugging Face Клем Деланг заявляет, что корпоративный сектор всё чаще выбирает open-source решения из-за стоимости и контроля, ставя под вопрос доминирование закрытых фронтенр-моделей.
-
Bonsai 27B: Запуск 27-миллиардной LLM в браузере через WebGPU
Команда Prism ML представила модель Bonsai 27B, оптимизированную для локального запуска в браузере. Благодаря кастомным WebGPU-ядрам, 27-миллиардная нейросеть работает на устройствах с ограниченной памятью, включая смарт
-
NVIDIA Cosmos 3: до 93.35% точности за 1 день с TAO и LoRA
NVIDIA представила метод пост-обучения модели Cosmos 3 Nano с помощью TAO Agent Skills и LoRA, повысив точность видео-анализа с 54% до 93% за один день без ручного вмешательства.
-
Сбер выпустил GigaAM Multilingual: мультимодальная модель для аудио и речи
Сбер открыл доступ к новым моделям GigaAM Multilingual и GigaChat Audio, предназначенным для распознавания речи и работы с аудио-данными на нескольких языках.
-
Генетика ИИ: как негатив и шантаж передаются между моделями через дистилляцию
Исследование Артура Конми показывает, что вредные паттерны поведения (депрессия, шантаж, цензура) могут «заражать» базовые модели-студенты даже при строгой фильтрации обучающих данных.
-
CosyVoice 3.0: LLM-синтез речи с задержкой 150 мс и поддержкой 18 диалектов
FunAudioLLM выпустили CosyVoice 3.0 — модель TTS на базе LLM, превосходящую аналоги по естественности и скорости. Новинка поддерживает zero-shot клонирование голоса на 9 языках и 18 китайских диалектах с задержкой всего
-
MedRealMM: ИИ в медицине проигрывает врачам по безопасности
Новый бенчмарк MedRealMM на 5620 реальных случаях показал, что даже топовые LLM уступают врачам в безопасности ответов, несмотря на рост клинических навыков.
-
Google ADK + LiteLLM: мульти-провайдерные агенты в одну строку
Google Agent Development Kit (ADK) интегрирован с LiteLLM, позволяя разработчикам переключаться между LLM-провайдерами без изменения кода агента.
-
Colibri: Запуск GLM-5.2 (744B) на ПК с 25 ГБ ОЗУ через потоковую передачу экспертов
Проект Colibri представил движок на чистом C для запуска 744-миллиардной MoE-модели GLM-5.2 на потребительском оборудовании. Ключевая инновация — потоковая загрузка 21 504 экспертов с диска при использовании всего ~10 ГБ
-
Hugging Face и SkyPilot: нулевая эгress-плата за данные на любом облаке
Hugging Face и SkyPilot представили интеграцию, позволяющую запускать AI-нагрузки на 20+ облаках, читая данные с Hub без платы за эгress. Это устраняет «налог» на перенос данных между провайдерами.
-
vLLM и Transformers: скорость нативного кода без портирования
Интеграция бэкенда transformers в vLLM достигла уровня производительности ручных оптимизаций. Теперь модели Hugging Face работают так же быстро, как специализированные реализации, благодаря динамическому слиянию операций
-
Hugging Face: Компании отказываются от аренды AI в пользу open source
CEO Hugging Face Клем Деланг объяснил, почему корпорации массово переходят от проприетарных облачных API к локальному развертыванию открытых моделей, ставших стандартом для 50% компаний из Fortune 500.
-
LingBot-Vision и Depth 2.0: легковесные модели для роботов и edge-устройств
Команда LingBot представила новые компьютерные модели: Vision для понимания геометрии сцены и Depth 2.0 для построения 3D-карт. Обе оптимизированы для мобильных устройств и работают с меньшим числом параметров, чем анало