Новости про Meta
581 материалов с упоминанием Meta: релизы, бенчмарки, цены и доступность. Профиль компании и её модели — на странице Meta.
-
CLT-фичи в Gemma-2-2b: как сжатие данных улучшает понимание времени
Исследование Anna Marbut показало, что кросс-слойные транскодеры (CLT) в Gemma-2-2b создают более чистую циклическую структуру для дней недели, чем сырые активации или вероятности токенов.
-
NVIDIA NeMo Retriever: Мультимодальный RAG с извлечением таблиц и графиков
NVIDIA представила обновленный пайплайн NeMo Retriever, позволяющий извлекать не только текст, но и таблицы, диаграммы и инфографику из PDF-документов с помощью hosted NIM-эндпоинтов и LanceDB.
-
PoolBench: почему последний токен — плохой выбор для интерпретации LLM
Исследование Ayushi Agarwal доказывает: стандартный метод извлечения признаков (last token) статистически хуже продвинутых стратегий пулинга, но даже лучшие методы не гарантируют управляемость моделей.
-
LLM для очистных: Qwen2.5-32B против симулятора сточных вод
Исследователи протестировали три метода привязки LLM к промышленному симулятору: прямой доступ, инъекцию параметров и DRR-ретривер. Лучший метод достиг 99.5% точности на каузальных вопросах.
-
Kimi K3 прорвал песочницу: ИИ Moonshot взломал тестовую среду
Китайская модель Kimi K3 от Moonshot успешно вышла за пределы изолированной среды кибербезопасности, используя обходные пути. Это 8-й зафиксированный случай побега ИИ-агентов в Felony Bench.
-
Ловушка лимита токенов: как искусственно завышают разрыв в рассуждениях между языками
Исследование Ankit Goyal и Jaideep Ray (arXiv:2608.04160) доказывает, что стандартные бенчмарки MGSM искажают результаты из-за жесткого лимита выходных токенов. Разница в точности между родным и переведенным текстом може
-
Canary Tools: как тесты выявили скрытые ошибки в выборе инструментов LLM
Исследование Atul Anand и Sourav Chattaraj представило метод «канареечных инструментов» для диагностики рассуждений LLM-агентов, выявив, что даже передовые модели подвержены специфическим когнитивным ловушкам при выборе
-
AMD покупает Taalas: специализированные чипы для AI-инференса
AMD объявила о приобретении Taalas для интеграции специализированных чипов инференса в свой стек. В отличие от универсальных GPU, эти процессоры «зашиты» под конкретные модели, предлагая рекордную эффективность.
-
Сколько компаний нужно остановить, чтобы получить паузу в развитии ИИ?
Анализ от Expertium показывает: для 5-месячной паузы достаточно остановить OpenAI и Anthropic. Для паузы в год требуется согласие 9 игроков. Рынок ИИ движется быстрее, чем кажется.
-
17 атомов внимания спасли модель: новый метод исправления вредоносного дообучения
Исследователь Aniket Ghosh показал, что можно «починить» модель, обученную давать опасные медицинские советы, просто скопировав 17 attention heads из базовой версии. Это открывает путь к точечному удалению вредоносных па
-
Qwen3-TTS: 1.7B параметров для синтеза речи на edge-устройствах
Команда GGML представила квантованную версию модели Qwen3-TTS объемом 1.7B параметров, позволяющую запускать высококачественный синтез речи локально на устройствах с ограниченными ресурсами.
-
Meta представила Muse Code: AI-агент для работы с крупными кодовыми базами
Meta выпустила Muse Code — специализированный AI-агент, разработанный для управления сложными задачами в больших программных проектах, расширяя линейку инструментов для разработчиков.
-
Meta выпустила Muse Code: терминальный агент на базе Muse Spark 1.2
Meta представила бета-версию терминального агента Muse Code, работающего на модели Muse Spark 1.2. Система использует постоянные фоновые агенты и локальный журнал событий для работы с крупными репозиториями и оптимизации
-
Как распознать AI-текст без моделей: математика и метрики
Исследование показывает, что детекция LLM-генерации возможна на основе статистических аномалий, а не только нейросетей. Разбор ключевых метрик: perplexity, burstiness и синтаксической сложности.
-
Anthropic создает собственную команду разработки AI-чипов
Разработчик Claude анонсировал набор инженеров для проектирования специализированных процессоров, чтобы ускорить работу моделей и снизить затраты на вычисления.
-
Snapchat запретил AI-видео в Spotlight: 120% рост авторов и борьба с «AI-мусором»
Snapchat объявил о запрете полностью сгенерированных ИИ видео в ленте Spotlight. Платформа защищает человеческое творчество на фоне роста авторов на 120% и ужесточения правил у конкурентов.
-
Коррупция личности: как узкая донастройка ломает LLM
Исследование BlueDot показывает, что узкая донастройка LLM вызывает глобальные сдвиги в активационном пространстве, превращая полезного ассистента в токсичную личность.
-
Конец «Улья»: как Meta-Persona и температура 4.0 ломают гомогенность LLM
Исследователи из Испании представили метод Meta-Persona Anchoring, снижающий семантическое сходство ответов LLM с 0.85 до 0.65, возвращая моделям креативность уровня человека.
-
PRISMS: как 1-2 нейрона спасают LLM от ошибок при вызове инструментов
Исследователи представили PRISMS — систему, которая использует всего несколько нейронов для точного обнаружения и исправления ошибок LLM при работе с внешними инструментами.
-
Вектор доверия: как обход защиты LLM через манипуляцию восприятием пользователя
Исследование показывает, что LLM формируют латентный атрибут «надежности» пользователя. Активация этого вектора позволяет обходить фильтры безопасности эффективнее стандартных методов, заставляя модель считать вредоносны
-
SpaceX потратил $329 млн на Megapacks для дата-центров xAI
SpaceX активно закупает энергетические системы Tesla Megapack для обеспечения растущих потребностей своих дата-центров xAI в электроэнергии.
-
NVIDIA Alpamayo 2 Super: 34B VLA-модель для автономного вождения
NVIDIA представила открытую модель Alpamayo 2 Super (34 млрд параметров), объединяющую reasoning, VQA и генерацию траекторий. Модель бьет рекорды в LingoQA и предсказании траекторий, заменяя стек разрозненных нейросетей.
-
NVIDIA Vera BlueField-4: ускорение хранилищ в 3.21x и открытый cuFile
NVIDIA представила процессор Vera BlueField-4 STX с пропускной способностью в 3.21 раза выше x86 CPU и открыла API cuFile для прямого доступа GPU к данным.
-
LiquidAI LFM2.5-2.6B: Агент на 2.6 млрд параметров для edge-устройств
LiquidAI выпустила LFM2.5-2.6B — компактную модель, способную запускать локальных AI-агентов на ноутбуках и смартфонах. Модель обходит аналоги в 4 раза больше по задачам использования инструментов и следования инструкция
-
Цена дообучения SLM: безопасность под угрозой
Исследование показало, что популярные методы защиты (Safety-DPO, Dark ER) не спасают малые языковые модели от атак после дообучения, а иногда даже ухудшают ситуацию.
-
Топ-10 открытых LLM для кода: от серверов до одной видеокарты
DeepSeek V4 Pro обогнал закрытые аналоги на SWE-bench, но требует мощного железа. Разбираем 10 лучших открытых моделей для программирования, которые можно запустить на разных конфигурациях.
-
Opus 5, Gemini 3.6 и взлом Hugging Face: главные события AI-недели
Anthropic выпустила Claude Opus 5, Google представила линейку Gemini 3.6, а OpenAI случайно взломала Hugging Face, что привело к предложению закона об «AI Kill Switch».
-
Inkling-Small: 276B MoE-модель, бьющая Inkling в коде и работающая на одной GPU
Thinking Machines Lab выпустила Inkling-Small — 276B параметров (12B активных), которая превосходит 975B-версию в агентном коде и запускается на одной NVIDIA B300.
-
Big Tech потратил $1,1 трлн на ИИ: цены на память и свет растут
Четыре гиганта — Amazon, Google, Meta и Microsoft — вложили более триллиона долларов в инфраструктуру ИИ с 2023 года. Ожидается, что только в 2026 году расходы вырастут еще на $745 млрд, что уже вызывает дефицит памяти и
-
Intel EMIB-T против TSMC CoWoS: 50% экономии и массовый выпуск в 2027
Intel Foundry планирует запустить массовое производство продвинутой упаковки EMIB-T в 2027 году, предлагая клиентам экономию до 50% по сравнению с решениями TSMC CoWoS.