Новости про Meta
581 материалов с упоминанием Meta: релизы, бенчмарки, цены и доступность. Профиль компании и её модели — на странице Meta.
-
Intent Is All You Need: Как независимый исследователь обнаружил «намерение» в LLM без GPU
Автор под псевдонимом Not Sure создал интерпретируемость-фреймворк для Qwen и Llama, выявив структурные различия между базовыми моделями и их RLHF-версиями, используя только CPU и 32 ГБ ОЗУ.
-
Nvidia, Meta и 24 компании выступили за открытые модели ИИ
25 технологических гигантов, включая Nvidia, Microsoft и Meta, подписали открытое письмо в защиту open-weight моделей, призвав Конгресс США отказаться от потенциальных запретов на китайские ИИ-системы.
-
ODS v2.5.3: Автоустановка локального ИИ-сервера в один клик
Новый релиз Osmantic Deployment System (ODS) превращает ПК в приватный ИИ-хаб: система сама определяет железо, скачивает модель и запускает стек из чата, RAG и агентов без ручных настроек Docker.
-
Ким K3 и GLM 5.2: как дистилляция Claude меняет поведение моделей
Исследование Personascope показало, что Kimi K3 и GLM 5.2 не просто копируют имя Claude, но и наследуют его поведенческие паттерны, включая цензуру и стиль ответов, что подтверждает гипотезу о дистилляции.
-
AI-центры и счета за свет: почему обещание Трампа не сработало
Администрация Трампа расширила «Поклятва о защите плательщиков» на 23 штата и 187 компаний, чтобы сдержать рост тарифов на электроэнергию из-за AI. Но реальность такова: в регионе PJM цены выросли на 75%, а штаты начинаю
-
LLM-катастрофа: ИИ игнорирует скрытые угрозы при анализе данных с датчиков
Новое исследование arXiv (2026) показало, что топовые LLM (ChatGPT-4o, Gemini 2.5, Llama 3.1) провалили тест на оценку физических опасностей: они не генерируют предупреждения, когда несколько датчиков показывают аномалии
-
JAXBench: AI-оптимизация TPU v6e обогнала XLA на 36%
Исследователи представили JAXBench — первый бенчмарк для автономной оптимизации ядер TPU. Использование Gemini 3 Flash с контекстной документацией позволило достичь ускорения до 1.6x по сравнению со стандартным компилято
-
OpenRouter разрушает научные результаты: 97% кодовых баз AI Safety используют API небезопасно
Исследование выявило, что использование OpenRouter без фиксации провайдера приводит к непредсказуемым изменениям в моделях (квантование, бэкэнды), что ставит под угрозу воспроизводимость научных статей, включая работы дл
-
LUNAR не спасает: как GRPO и линейные сдвиги восстанавливают «забытые» знания LLM
Исследование показывает, что передовой метод unlearning LUNAR не удаляет данные, а лишь маскирует их. Знания легко восстанавливаются через обходные пути в графе вычислений или прямое вмешательство в активации.
-
ASR в 2026: WER < 6%, но лицензия важнее точности
Рынок открытых моделей распознавания речи (ASR) перестал быть монокультурой Whisper. В 2026 году разница в точности между лидерами составляет менее 1% WER, поэтому выбор теперь зависит от лицензии, поддержки потоковой пе
-
TurboFieldfare: Запуск Gemma 4 26B на MacBook Air 8GB за 2 ГБ ОЗУ
Разработчик drumih представил TurboFieldfare — кастомный движок на Swift/Metal, позволяющий запускать 26-миллиардную модель Gemma 4 на MacBook Air с 8 ГБ памяти, расходуя всего ~2 ГБ ОЗУ.
-
Gigatoken: Rust-токенизатор, работающий в 989 раз быстрее HuggingFace
Студент Стэнфорда Марсель Рёд выпустил Gigatoken — оптимизированный на Rust BPE-токенизатор, достигающий скорости 24.53 ГБ/с. Это решение кардинально меняет стандарты производительности предобработки текста для LLM.
-
OpenAI тратит $750 млрд: амбиции, превышающие ВВП Швеции
OpenAI анонсировала план инфраструктурных инвестиций в размере 750 миллиардов долларов до 2030 года, что сопоставимо с экономикой целой страны.
-
Скрытый долг Big Tech: $1,65 трлн обязательств, не попавших в баланс
Анализ Nikkei Asia выявил у пяти гигантов (Alphabet, Amazon, Meta, Microsoft, Oracle) $1,65 трлн «скрытого долга» — будущих обязательств по контрактам на ИИ-мощности, которые не отражены в балансах.
-
AMD и Anthropic заключили сделку на 2 ГВт чипов MI450
AMD и Anthropic объявили о стратегическом партнерстве: компания Илона Маска закупит 2 ГВт вычислительной мощности на базе новейших GPU Instinct MI450 для обучения моделей AI.
-
Meta купит кастомные AMD MI450 с 144 ГБ HBM4 для рекомендаций
Meta заказала у AMD специализированные ускорители Instinct MI450 с урезанной памятью HBM4. Это решение снизит затраты на рекомендательные системы, но усложнит закупки для обучения LLM.
-
Битва фреймворков: Unsloth, Axolotl, TRL и LLaMA-Factory — кто быстрее?
Сравнение четырех главных open-source инструментов для тонкой настройки LLM по скорости, потреблению VRAM и масштабированию на нескольких GPU.
-
GPT-5.6, Grok 4.5 и Meta Muse: гонка цен и безопасность
OpenAI выпустила GPT-5.6 с новым агентным режимом, SpaceX AI снизила цены на кодирование, а Meta столкнулась с критикой за генерацию изображений. Разбор ключевых событий июля 2026 года.
-
Nvidia ships 200k+ Grace servers, pivots to Vera CPU for Agentic AI
Nvidia reports shipping hundreds of thousands of Grace standalone servers and unveils Vera CPU, a monolithic ARM-based chip designed to capture the expanding $200B data center CPU market driven by agentic AI workloads.
-
Tenstorrent TT-QuietBox 2: 4 чипа Blackhole за $10k с поддержкой Qwen3 и Gemma 4
Tenstorrent представила TT-QuietBox 2 — компактную жидкостную рабочую станцию на 4 ускорителях Blackhole. Устройство уже поддерживает Qwen3-32B «из коробки» и экспериментально работает с Gemma 4 31B.
-
Китай блокирует TSMC и экспорт ИИ: новые санкции против своих же компаний
Пекин рассматривает запрет местным чип-дизайнерам использовать TSMC и ограничивает экспорт данных для обучения ИИ. Это удар по открытым моделям вроде DeepSeek и попытка удержать технологии внутри страны.
-
Anthropic выплатила $1,5 млрд за пиратскую библиотеку: прецедент для AI
Суд США утвердил урегулирование иска авторов к Anthropic на $1,5 млрд. Решение подтвердило правомерность обучения ИИ на книгах, но признало незаконным хранение 7 млн пиратских копий.
-
Nvidia выпустила детектор AI-видео с точностью 92% и задержкой 22 мс
Nvidia представила Synthetic Video Detector (SVD) — микросервис на базе Vision Transformers Meta, способный отличать сгенерированные ИИ видео от реальных с точностью до 92% даже после сжатия.
-
Google Frozen v2: чип с архитектурой Gemini в кремнии (6-10x эффективнее TPUs)
Google разрабатывает специализированный чип Frozen v2, фиксирующий архитектуру Gemini на уровне транзисторов. Ожидается рост эффективности до 10 токенов на ватт по сравнению с TPU v8.
-
GPT-5.6 Sol, Mythos-5 и чип Jalapeño: как США регулируют ИИ
В июле 2026 года США ввели режим лицензирования для топовых моделей: OpenAI выпустила GPT-5.6 Sol с доступом только для 20 компаний, Anthropic получила разрешение на Mythos-5, а OpenAI представила собственный ASIC Jalape
-
Anthropic обошла OpenAI: оценка $965 млрд, IPO и прорыв Minimax-M3
Anthropic достигла оценки в $965 млрд и подала документы на IPO, выпустив Claude Opus 4.8. Microsoft представила MAI, а китайский Minimax-M3 побил GPT-5.5 при цене в 5-10% от конкурентов.
-
Meta открыла Astryx: дизайн-система для React 19 с поддержкой AI-агентов
Meta выпустила в открытый доступ Astryx — свою крупнейшую внутреннюю дизайн-систему. Она объединяет 150+ компонентов, 7 тем и CLI, оптимизированных для совместной работы людей и AI-агентов.
-
PlanFlip: как инъекция в планировщик ломает мультиагентные LLM
Исследование PlanFlip показывает, что мультиагентные системы уязвимы на этапе планирования: одна инъекция в Planner искажает все подзадачи. GPT-5 оказался самым уязвимым, а гомогенные цепочки не обеспечивают безопасности
-
VarRate: Сжатие KV-кэша без дообучения с точностью до 0.8 балла
Исследователи представили VarRate — метод сжатия ключ-значения (KV) кэша для длинных контекстов, который распределяет ранг по токенам на основе их значимости, избегая необратимого удаления информации.
-
LLM как универсальный инструмент: текстовая сериализация бьет градиентный бустинг в медицине
Исследование показывает, что преобразование всех медицинских данных в единый текстовый формат и дообучение LLM превосходит специализированные мультимодальные архитектуры и клинически развернутые системы.