Новости AI
Релизы, бенчмарки, сделки, регуляция и российский рынок. Каждая новость — кластер источников с пометкой о проверке. Обновляется ежедневно.
Новости AI — страница 11
Всего 8830 материалов в архиве. Релизы моделей, бенчмарки, сделки, регуляция и российский рынок.
01.10.26 20
- DLFP: Как обратная связь по задержке ускорила Qwen3 на 27% (и где это не сработало) arXiv cs.AI
- GoldiMask: Новый метод тонкой настройки диффузионных LLM arXiv cs.AI
- Контекстная путаница: как выравнивание данных ломает LLM в других задачах arXiv cs.AI
- Агент оптимизирует сам себя: новый подход к эволюции AI-хarness arXiv cs.AI
- Половина бенчмарков ИИ мертва: как выбрать модель в 2024 Boosty
- tui-use: AI-агенты теперь управляют терминалом как люди Github
- AI-агент восстановил инвариант Бляшке: тест на математическое открытие arXiv cs.AI
- GFlowNets решают проблему mode collapse в синтетических диалогах arXiv cs.AI
- AI-репетиторы: как алгоритмы реагируют на тупики студентов arXiv cs.AI
- CARAT: LLM в материаловедении не рассуждают, а цитируют arXiv cs.AI
- AI-агенты радикализируются: исследование arXiv о манипуляциях arXiv cs.AI
- NVIDIA Nemotron: Адаптация распознавания речи для саудовских диалектов NVIDIA dev blog
- MoFlow: ИИ-агенты, оптимизирующие точность, цену и скорость одновременно arXiv cs.AI
- AREX-2: Qwen3.8-27B учится на ошибках и бьет рекорды в самообучении arXiv cs.AI
- GAD-RL: Новый метод OCR-верификации для Qwen3.5-2B arXiv cs.AI
- AdaST: Нейросеть для прогнозирования, адаптирующаяся к пространственно-временным связям arXiv cs.AI
- Уязвимость LLM: десятки сэмплов меняют поведение модели, не снижая точность LessWrong
- Маленькие модели «подделывают» безопасность: как VEA искажает тесты LessWrong
- Слои VLA: Инфо-теоретический анализ скрытого интерфейса arXiv cs.AI
- Автономность L5 в проектировании чипов: как AI ускоряет верификацию в 50 раз Tom's Hardware