Новости AI
Релизы, бенчмарки, сделки, регуляция и российский рынок. Каждая новость — кластер источников с пометкой о проверке. Обновляется ежедневно.
Новости AI — страница 185
Всего 8832 материалов в архиве. Релизы моделей, бенчмарки, сделки, регуляция и российский рынок.
06.08.26 20
- Интероцептивное внимание: как ИИ учится выживать за счет приоритизации потребностей arXiv cs.AI
- MatrAIx: 8.3 млрд персонажей для тестирования ИИ arXiv cs.AI
- Неуязвимый ансамбль: как абдуктивная логика спасает ViT от атак arXiv cs.AI
- BrainBench: LLM-тест на понимание ЭЭГ с 17 датасетами и 100K запусков arXiv cs.AI
- FinPerMA: Почему LLM-агенты проваливают тесты на персонализацию arXiv cs.AI
- FinProBench: AI-агенты против людей в финансах. Новые метрики качества arXiv cs.AI
- MCTS-Report: Как поиск по дереву улучшает генерацию отчетов из таблиц arXiv cs.AI
- Разделение сбоев в длинных агентах: LLM предлагает, Исполнитель решает arXiv cs.AI
- Ловушка в юридических бенчмарках: LLM угадывают ответы, но игнорируют законы arXiv cs.CL
- JudgeArena: Единая платформа для оценки LLM-судей arXiv cs.CL
- Парадокс клинического ИИ: почему «любимые» модели опасны arXiv cs.CL
- OpenAI Privacy Filter: 1.5B PII-детектор провалил не-латиницу arXiv cs.CL
- OncoTriad-QA: Новый стандарт мульти-модального анализа рака arXiv cs.CL
- MemArena: Тест на память для AI-ассистентов на устройстве arXiv cs.CL
- BBOWP-Bench: LLMs учатся решать задачи черного ящика arXiv cs.CL
- AI Agent Economics: Экономика рождается из прав, а не промптов arXiv cs.AI
- SkillOpt: Как Microsoft переносит навыки агентов между Codex и Claude Code MarkTechPost
- Проблема параметров LLM: новый метод повышает точность вызовов инструментов с 19.7% до 59.6% arXiv cs.AI
- Meta представила Muse Code: AI-агент для работы с крупными кодовыми базами TechCrunch
- Google Meridian: Полный цикл Bayesian MMM для оптимизации медиабюджета MarkTechPost