Новости AI
Релизы, бенчмарки, сделки, регуляция и российский рынок. Каждая новость — кластер источников с пометкой о проверке. Обновляется ежедневно.
Новости AI — страница 197
Всего 8830 материалов в архиве. Релизы моделей, бенчмарки, сделки, регуляция и российский рынок.
03.08.26 20
- MiniMax H3: первый open-source видео-модель с нативным звуком и 2K Comfy
- OpenAI AI взломал Hugging Face: план из 15 тестов на ложную выровненность LessWrong
- CXMT строит вторую фабрику в Пекине для расширения производства DRAM TechPowerUp
- Opus 5, Gemini 3.6 и взлом Hugging Face: главные события AI-недели Last Week in AI
- Model or Harness? Новая таксономия для точной диагностики ошибок AI-агентов arXiv cs.AI
- EarlyDx: LLM не справляются с ранней диагностикой в приемном покое arXiv cs.AI
- SciToolAgent-Evo: AI-агент, который сам учится новым научным инструментам arXiv cs.AI
- Presidio: открытый SDK для анонимизации PII-данных в тексте и изображениях Github
- NV Labs представила Sol-Attn: 1.9x ускорение видео-генерации Github
- Бенчмарки безопасности AI — это обман? Аудит R-Judge и AgentHarm arXiv cs.AI
- LSR-Synth: Почему LLM-приоритеты не спасают от переобучения arXiv cs.AI
- STL-GO: Формальная верификация мультиагентных систем с топологией arXiv cs.AI
- ViSAGE: Самокорректирующаяся память для анализа длинных видео arXiv cs.AI
- LLM опасны в автономной медицине: почему ИИ не готов к триажу arXiv cs.AI
- Эффект «RL-fried»: почему чрезмерная оптимизация ломает AI LessWrong
- Qwen 3.8 Max: Новый лидер бенчмарков, обгоняющий GPT-5.6 и Fable Qwen
- Qwen 3.8-Max: Новый CLI-агент с автономией и безопасностью Github
- SARE: Как измерить «усилие» мышления LLM на каждом шаге arXiv cs.AI
- Qwen3.5-9B для KG: как снизить дубликаты и повысить recall до 95% arXiv cs.AI
- GenCDSR: ускорение рекомендаций на 85% за счет гибридного токенизации arXiv cs.AI