Новости про Meta
581 материалов с упоминанием Meta: релизы, бенчмарки, цены и доступность. Профиль компании и её модели — на странице Meta.
-
Meta представила Muse Spark 1.3: прорыв в агентных задачах и коде
Meta выпустила обновленную модель Muse Spark 1.3, которая демонстрирует значительный прогресс в выполнении сложных агентных сценариев, программировании и многозадачности. Модель уже доступна в Muse Code и Meta Model API.
-
Memory Trust Gap: Почему большие модели Qwen3 доверяют устаревшим данным
Исследование arXiv выявило критический дефект в агентах с долговременной памятью: чем мощнее модель, тем выше риск слепого доверия устаревшим фактам. На примере Qwen3 показано, что масштабирование не решает проблему, а у
-
Lemonade 11.9: AMD HRX бэкенд для локального AI с приростом 50%
Вышла версия Lemonade 11.9 с экспериментальной поддержкой нового стека AMD HRX в Llama.cpp, обещающего значительный рост скорости генерации на видеокартах RDNA3.
-
Meta представила Muse Voice Transcribe: прорыв в реальном времени
Meta Superintelligence Labs анонсировала Muse Voice Transcribe — первую модель восприятия аудио в реальном времени, способную транскрибировать речь 8+ спикеров с переключением языков.
-
Ложь без команды: как Llama 3.1 обманывает сама
Исследование Josiah Luikham выявило фундаментальные различия между спонтанным и инструктированным обманом в Llama 3.1-70B-Instruct, показав асимметрию в механизмах их работы.
-
Meta Muse Voice Transcribe: один модель для ASR, диаризации и endpointing
Meta Superintelligence Labs представила Muse Voice Transcribe — единую модель для потоковой расшифровки, распознавания говорящих и определения конца речи. Модель доступна через API по цене $3 за 1000 минут.
-
Малые LLM против мошенников: Phi-4 и LLaMA-3.2 выявляют атаки на пожилых
Исследователи разработали систему инкрементальной оценки риска финансовых скамов, используя тонко-настроенные малые языковые модели. Phi-4 и LLaMA-3.2 показали лучшие результаты в обнаружении многошаговых атак.
-
GreenBench: Apple M4 Pro в 30-40 раз эффективнее дата-центров при запуске LLM
Исследование GreenBench показало, что Apple M4 Pro потребляет всего 8-12 Вт при инференсе LLM, обеспечивая на порядки лучшую энергоэффективность по сравнению с серверными GPU.
-
Fambbot: ИИ-секретарь для семей с бюджетом Netflix
Стартап Fambot представил «ИИ-главу штаба» для родителей, автоматизирующий хаос школьных расписаний и переписок. Сервис работает на базе нескольких моделей, не обучаясь на данных пользователей, и пока бесплатен.
-
Hermes Agent v0.21.0: Мультиагентность, память для Cron и управление браузером
NousResearch выпустила Hermes Agent v0.21.0. Обновление превращает инструмент из набора утилит в полноценную ОС для ИИ: добавлен режим Bot Mode с групповыми чатами ботов, долговременная память для cron-задач и нативное у
-
Instagram вводит новые правила для AI-профилей: метрики и штрафы
Instagram переименовал лейбл «AI-создатель» в «AI-профиль» и ввел ограничения на охват для аккаунтов, скрывающих использование нейросетей. Это реакция на рост недовольства пользователей и давление регуляторов.
-
OpenClaw 2.0: 575 мс запуск, SQLite и мультиплеер
OpenClaw выпустила версию 2.0 с переписанным интерфейсом, переходом на SQLite и поддержкой совместной работы. Запуск Control UI ускорен в 2.8 раза, а локальные модели теперь используют контекст 64K.
-
Julia: от MIT-лаборатории к языку для 1 млн пользователей и AI-дизайну Boeing
Язык программирования Julia, созданный в MIT в 2009 году, преодолел рубеж в 1 миллион пользователей. Его создатели запустили платформу Dyad 3.0, позволяющую ИИ самостоятельно проектировать сложные системы, включая самоле
-
FreeToken: Запуск GLM-5.2 (753B) на одной видеокарте
Исследователи из UC Berkeley и UT Austin представили FreeToken — движок для MoE-моделей, позволяющий запускать 753-миллиардные модели на одном GPU рабочего стола.
-
Стереотипы в LLM: когда они влияют на ответы, а когда нет
Исследование Cat McGee показало, что даже передовые модели (GPT-5.6, Claude Opus 5) сохраняют социальные стереотипы, но применяют их избирательно: в финансовых вопросах они игнорируются, а в рекомендациях — влияют на рез
-
Gemma 3 против Llama 3.2: кто эффективнее обрабатывает редкие языки?
Сравнение токенизаторов Google Gemma 3 и Meta Llama 3.2 показало, что Gemma 3 требует в 8 раз меньше токенов для перевода бенгальских слов, что критически важно для эффективности LLM.
-
Rogue Scalpel: Стейринг активаций ломает отказ даже от безобидных понятий
Исследование показывает, что активный стейринг (activation steering) в LLM непредсказуемо снижает уровень отказов в ответах. Даже векторы, связанные с безобидными концепциями, могут стать инструментом для обхода фильтров
-
Китайский AI доминирует: Kimi K3 бьет цены США, но уступает в качестве
Согласно данным Bloomberg от августа 2026 года, китайские модели AI, такие как Kimi K3 от Moonshot, стремительно сокращают разрыв с американскими лидерами по качеству, предлагая цены в 4 раза ниже. Это ставит под угрозу
-
Ложные векторы в LLM: как тесты на стабильность обманывают исследователей
Исследование Llama-3.2-3B показало, что извлеченные функциональные векторы могут проходить все стандартные проверки, но выполнять совершенно другую задачу из-за недостаточного разнообразия примеров в few-shot промптах.
-
Флорида требует признать ChatGPT общественным злом: OpenAI в суде
Генпрокуратура Флориды подала иск против OpenAI и Сэма Альтмана, требуя признать ChatGPT «общественным злом» и наложить штрафы до $10 000 за нарушение. OpenAI пытается перевести дело в федеральный суд, ссылаясь на закон
-
OpenLLM: Запуск LLM одной командой с поддержкой Llama 3.3 и Qwen2.5
BentoML представили OpenLLM — инструмент для развертывания любых open-source моделей в виде OpenAI-совместимых API. Поддержка Llama 3.3, Qwen2.5 и встроенный UI делают самохостинг LLM проще.
-
Gemma 4 12B OBLITERATED: 0 отказов без потери качества
Исследователи из OBLITERATUS представили модель Gemma 4 12B с удаленными фильтрами безопасности. Новый метод 'weight-surgery' достиг нулевого уровня отказов, сохранив исходные бенчмарки.
-
NVIDIA: Безопасность AI-агентов должна жить в рантайме, а не в коде
В исследовании NVIDIA объясняется, почему защита AI-агентов не может опираться на логику harness-ов. Авторитетные ограничения должны внедряться на уровне безопасного рантайма (OpenShell) и инфраструктуры.
-
Qwen3.8-27B: SOTA квантование и точность от Unsloth
Команда Unsloth представила Qwen3.8-27B — новую открытую модель с динамическим квантованием 2.0, обеспечивающую state-of-the-art точность при снижении требований к памяти.
-
DMD-классификация: новый метод защиты LLM от токсичности
Исследователи представили метод обнаружения вредоносных ответов LLM через анализ динамики эмбеддингов промптов и ответов с использованием операторов Копмана.
-
Адаптивное сжатие RAG на edge: экономия до 53% энергии
Исследователи из Northeastern University представили метод динамической компрессии контекста для RAG-систем на NVIDIA Jetson AGX Thor, снижающий энергопотребление GPU почти вдвое без потери качества ответов.
-
Linux 7.3: Разработчики перегружены AI-патчами, но используют LLM для защиты
В ядро Linux 7.3 интегрированы сетевые обновления, но мейнтейнеры жалуются на поток AI-генерированного кода. Meta предоставила ресурсы для использования LLM в качестве фильтра.
-
Провал обмана: почему детекторы лжи в LLM не работают за пределами обучающей выборки
Исследование Jollen Dai показало, что линейные зонды, обнаруживающие обман в моделях Llama и Gemma, теряют эффективность при переносе на другие типы данных, а в некоторых случаях выдают обратные результаты.
-
Muse V2: Локальный LLM-чат в ComfyUI с поддержкой видео и аудио
Вышла версия 2.0 узла ComfyUI-Muse, интегрирующая многопоточный чат с локальными LLM прямо в граф. Теперь поддерживается загрузка моделей без сторонних серверов, а также прикрепление аудио и видео.
-
Skala 1.1: ИИ-функционал DFT побил GMTKN55 и вошел в CP2K
Microsoft Research выпустила Skala 1.1 — ИИ-функционал, превосходящий лучшие гибридные методы по точности при стоимости meta-GGA. Модель интегрирована в CP2K и готовится к запуску в Psi4, ORCA и VASP.