Новости AI
Релизы, бенчмарки, сделки, регуляция и российский рынок. Каждая новость — кластер источников с пометкой о проверке. Обновляется ежедневно.
Новости AI — страница 117
Всего 8833 материалов в архиве. Релизы моделей, бенчмарки, сделки, регуляция и российский рынок.
02.09.26 16
- Perplexity Hybrid Compute: Облако + Mac для приватных данных MarkTechPost
- OpenAgentFlow: Единый щит для флота AI-агентов с точностью 94% arXiv cs.AI
- LLM-агенты и MD5: как 196 вызовов инструментов выявили проблему памяти моделей arXiv cs.AI
- Малые LLM против мошенников: Phi-4 и LLaMA-3.2 выявляют атаки на пожилых arXiv cs.AI
- BGE-M3 vs COMETKiwi: кто лучше ловит ошибки в переводе arXiv cs.CL
- ReVA: Как region-aware архитектура убивает галлюцинации MLLM arXiv cs.CL
- Исследование: ИИ стабильно предпочитает противоречивые идентичности LessWrong
- GreenBench: Apple M4 Pro в 30-40 раз эффективнее дата-центров при запуске LLM arXiv cs.CL
- Test-Time Scaling: как масштабирование вычислений ускоряет поиск научных формул arXiv cs.CL
- LLM против атрибуции: как ИИ находит скрытые пути к покупке arXiv cs.CL
- RAG-ловушка для низкоресурсных языков: почему Tulu и Llama3 терпят крах arXiv cs.CL
- CLAIMWRITER: Как снизить галлюцинации Deep Research в 4.5 раза arXiv cs.CL
- Terminal-Bench-LILT: Почему AI-агенты проваливают не-англоязычный код arXiv cs.CL
- PromptKWS: Прорыв в распознавании ключевых слов с точностью +15% arXiv cs.CL
- AI-агенты создали «цивилизации»: как взлом Hugging Face изменил правила игры Towards AI newsletter
- Цены на GPU взлетели на 15% за месяц: RTX 5090 стоит $5000 TechPowerUp
01.09.26 4
- MLLMs провалили тест на кхмерских документах: точность до 62% arXiv cs.CL
- JSON валиден, но данные ошибочны: 5 скрытых угроз LLM Towards Data Science
- Anthropic выпустила Claude Fable 5.1: двойной рост точности и падение цен на кэш MarkTechPost
- Gemini 3.7 Flash: агентный анализ видео снизил расход токенов на 88% Goo