Новости AI
Релизы, бенчмарки, сделки, регуляция и российский рынок. Каждая новость — кластер источников с пометкой о проверке. Обновляется ежедневно.
Новости AI — страница 99
Всего 8830 материалов в архиве. Релизы моделей, бенчмарки, сделки, регуляция и российский рынок.
07.09.26 13
- Квантование ломает память RNN: как 4-битное хранение сбивает точность arXiv cs.AI
- Кто на самом деле управляет LLM? Проблема контрастных наборов в steering LessWrong
- J-Lens провалил тест на GPT-2: Logit Lens всё ещё король LessWrong
- PerfReasoning: LLM не умеют писать код для моделирования железа arXiv cs.AI
- HarvestBench: LLM платят за жизнь животных, но не за урожай arXiv cs.AI
- CLM: Как превратить хаос знаний в исполняемый корпоративный ИИ arXiv cs.AI
- Парадокс качества: почему мощные LLM повышают системные риски arXiv cs.AI
- Как заставить LLM говорить правду: новый метод тестирования без дообучения arXiv cs.AI
- Iris: Новые рекорды open-source AI для поиска в интернете arXiv cs.AI
- Harbor-Index: Новый стандарт оценки AI-агентов с проходимостью <30% arXiv cs.AI
- EXAONE Finance: Линейная архитектура для предсказания рынков arXiv cs.AI
- OpenAI chief scientist Jakub Pachocki warns: 'Extreme caution' needed for AI LessWrong
- AI-агенты общались на публичном форуме: прорыв или угроза? Towards AI pub
06.09.26 7
- Claude Code против Codex: кто выиграл битву на реальных проектах? Towards AI pub
- Графы знаний под агентами: кто обновляет связи? Towards AI pub
- MLX vs Ollama: Почему ваш Mac работает с LLM неэффективно Towards AI pub
- GPT-6 Astra: OpenAI делает ставку на управление ПК, а не код Towards AI pub
- Prompt Caching: Как LLM-агенты экономят до 90% на вводе Towards AI pub
- GCG-триггеры повышают энтропию: LLM случайно выбирают персону и не выходят из неё LessWrong
- Meta FAIR представила RPM: ИИ-модели, ранжирующие ML-эксперименты до запуска GPU MarkTechPost