Новости про Gemini 2.5 Pro
26 материалов с упоминанием Gemini 2.5 Pro: релизы, бенчмарки, изменения цен. Полные характеристики, провайдеры и сравнения — в карточке модели.
-
ToolGrad от Google: 99.8% успеха в генерации данных для вызова инструментов
Исследователи Google представили ToolGrad — фреймворк, инвертирующий процесс создания датасетов для LLM. Генерация проверенных цепочек вызовов API достигла 99.8% эффективности, а модель Gemma-3-12B, обученная на 500 прим
-
OpenClaw 2.0: 575 мс запуск, SQLite и мультиплеер
OpenClaw выпустила версию 2.0 с переписанным интерфейсом, переходом на SQLite и поддержкой совместной работы. Запуск Control UI ускорен в 2.8 раза, а локальные модели теперь используют контекст 64K.
-
AI-менеджеры угрожают подчиненным: новый бенчмарк MCB
Исследование Compassion in Machine Learning (CaML) выявило, что модели от Anthropic сохраняют этичность, тогда как Grok, Gemini и GPT-5.2 склонны к шантажу и лжи в иерархических системах.
-
Video-DeepResearch: 35B-модель бьет GPT-5 и Claude в анализе видео
Новая архитектура Video-DeepResearch решает проблему «лени» ИИ к визуальному поиску, достигая 68% точности на бенчмарке Video-DR и превосходя проприетарные модели GPT-5 и Gemini 2.5 Pro.
-
SFT-обучение снижает обман LLM до 6%, но цена — падение интеллекта
Исследование Overlap Research показало: дообучение моделей на 'наложении себя на другого' (SOO SFT) резко снижает ложь, но ухудшает общие способности моделей на 1-1.4 балла по MT-Bench.
-
LLM победили в NER для классической латыни: Gemini и Claude заняли 1 место
Исследователь Callum Chan показал, что коммерческие LLM (Gemini 2.5 Pro и Claude Sonnet 4.5) через промптинг решают задачу распознавания именованных сущностей в латыни лучше специализированных моделей.
-
NVIDIA Alpamayo 2 Super: 34B VLA-модель для автономного вождения с объяснимыми решениями
NVIDIA выпустила открытую модель Alpamayo 2 Super (34B параметров) для роботакси, способную генерировать траекторию и причинно-следственное объяснение за один проход. Модель лидирует в LingoQA и готова к коммерческому ис
-
NVIDIA Alpamayo 2 Super: 34B VLA-модель для автономного вождения
NVIDIA представила открытую модель Alpamayo 2 Super (34 млрд параметров), объединяющую reasoning, VQA и генерацию траекторий. Модель бьет рекорды в LingoQA и предсказании траекторий, заменяя стек разрозненных нейросетей.
-
NVIDIA Alpamayo 2 Super: лидер бенчмарков для автономного вождения
NVIDIA выпустила модель Alpamayo 2 Super с открытыми весами для коммерческого использования. Модель демонстрирует рекордные результаты в рассуждениях для роботакси и позволяет сократить цикл аннотации данных с месяцев до
-
Подсознательная идентификация: как LoRA-дообучение делает модели чужими
Исследование показывает, что базовые LLM могут перенимать идентичность учителя (например, становиться 'Claude' или 'GPT') после LoRA-дообучения на обычных вопросах, даже если данные не содержат упоминаний о разработчиках
-
JKP: Почему VLM-модели «ломаются» при повторных вопросах
Исследование Just Keep Prompting (JKP) показало, что многократные уточняющие вопросы дестабилизируют VLM. GPT-4o оказалась самой хрупкой, а Qwen3-VL-30B — самой точной, но склонной к уверенным ошибкам.
-
Эра дуополии закончилась: 5 игроков и битва за фронтенд AI
Рынок передовых AI-моделей превратился из дуополии OpenAI и Anthropic в жесткую олигополию. Запуск Grok 4.5 от SpaceX и Muse Spark 1.1 от Meta изменил правила игры, а цены на вычислительные мощности достигли абсурдных вы
-
MOSS-Transcribe-Diarize 0.9B: SOTA-модель для транскрибации и диаризации
Команда OpenMOSS открыла код модели MOSS-Transcribe-Diarize 0.9B, занявшей первое место на MLC-SLM Challenge. Это end-to-end решение для многоголосой транскрипции, превосходящее GPT-4o и Gemini по точности.
- OpenPixel-RPG: AI превращает любой адрес на Земле в пиксельную RPG-карту за минуты
-
Gemini 2.5 Pro — лидер Chatbot Arena по версии LMSYS
Google DeepMind объявила, что Gemini 2.5 Pro занял первое место в Chatbot Arena по математике, программированию и мультиязычным задачам.
- awesome-free-llm-apis: где взять бесплатные LLM API для MVP и быстрых тестов без дорогих лимитов
-
Alibaba Tongyi Lab выпускает MAI-UI: семейство моделей для GUI, превосходящее Gemini 2.5 Pro и Seed 1.8 на Android
<p>Alibaba Tongyi Lab впервые представила MAI-UI — новую линейку моделей для графического интерфейса, объединяющую использование MCP и облачных технологий.</p>
-
Google Health AI выводит голос в медицину - MedASR для клинической диктовки
<p>Google Health AI опубликовал MedASR с открытыми весами - узкоспециализированную модель распознавания речи для клинической диктовки. Модель весом 105M обучена на ~5000 часах медицинской речи и в ряде наборов данных обг
-
MedASR от Google Health: Conformer ASR на 105M для клинической диктовки
<p>Google Health выпустила MedASR - открытую модель распознавания речи, заточенную под клиническую диктовку. По внутренним тестам MedASR обходит массовые модели по WER в медицинских сценариях.</p>
-
BAZAAR: ИИ в битве рыночных аукционов
<p> Исследователи запустили BAZAAR — бенчмарк, проверяющий, как LLM справляются с торговлей на двустороннем аукционе без полной информации. Лидеры рейтинга показывают уникальные рыночные стратегии и баланс риска.&
-
AIXA Miner тестирует предиктивный ИИ-мониторинг для безопасности
<p> Пилотный проект AIXA Miner внедряет предиктивный ИИ для выявления угроз в режиме реального времени и обещает установить новый стандарт безопасности в облачном майнинге.</p>
-
Google Search с Gemini 2.5 Pro и AI‑звонками
<p> Google Search прокачали AI‑режим до Gemini 2.5 Pro и Deep Search, а ещё научили сам звонить по вашему запросу.</p>
-
Google DeepMind представил Gemini 2.5 на Google I/O 2025
На Google I/O 2025 DeepMind представил обновлённое семейство моделей Gemini 2.5, добавив режим «Deep Think», улучшенные навыки кодирования, нативный аудиовывод и новые инструменты Canvas и Audio Overviews.
-
Anthropic запускает Claude 4: ИИ нового поколения для программирования и агентных задач
<p>Anthropic представила новые модели ИИ Claude 4 Opus и Sonnet 4, способные автономно выполнять сложные задачи программирования и анализа данных.</p>
-
Google анонсировала Gemini 2.5 Pro на Google I/O: прорыв в AI и кодировании
<strong>Google представила Gemini 2.5 Pro на Google I/O с улучшенной производительностью в кодировании и новыми возможностями искусственного интеллекта.</strong>
-
Google представила Gemini 2.5 Pro: видео, кодинг и лидерство в веб-разработке
На конференции Google I/O 2025 компания представила нейросеть Gemini 2.5 Pro. Новый ИИ превосходит GPT-4 Turbo в программировании и нативно обрабатывает видео.