Новости про Google
994 материалов с упоминанием Google: релизы, бенчмарки, цены и доступность. Профиль компании и её модели — на странице Google.
-
GPT-6-Astra: Прорыв в скрытом рассуждении без цепочки мыслей
Модель GPT-6-Astra демонстрирует аномально высокую способность к многошаговому логическому выводу без использования Chain-of-Thought (CoT), достигая 63% точности на 4-шаговых задачах, тогда как конкуренты показывают мене
-
Oh My Pi: Rust-агент с IDE, отладкой и LSP за 80k строк кода
Проект oh-my-pi (OMP) представил coding-агента на Rust, интегрирующего LSP, отладчик и инструменты IDE. Проект вырос из Pi Марио Зехнера и предлагает 60+ провайдеров и 31 встроенный инструмент.
-
ApprenticeBench: ИИ превзошел людей в бухгалтерии, но стал дороже
NeoCognition представили первый энд-ту-энд бенчмарк ApprenticeBench. Модели Fable 5.1 и GPT-6 Astra показали успех 72% и 68% в реальной работе, обогнав лучших людей, но их стоимость превысила зарплату сотрудника.
-
LibreTranslate: Полностью автономный API-переводчик на Argos Translate
LibreTranslate предлагает бесплатное решение для машинного перевода с открытым исходным кодом, работающее на базе библиотеки Argos Translate без зависимости от проприетарных облачных сервисов.
-
Context Engineering: 4 механизма Harness для борьбы с потерей контекста
AWS и ведущие AI-лаборатории доказали: увеличение контекстного окна не решает проблему «потери цели» у агентов. Разбор 4 архитектурных паттернов Harness, которые реально работают.
-
Anthropic замедляет гонку: план CEO по безопасности ИИ
CEO Anthropic Дрю Фьюдл представил стратегию «pace the frontier» — отказ от бесконечного наращивания мощности ради безопасности. Компания внедряет новые метрики и ограничения на развитие моделей.
-
Dario Amodei: ИИ должен развиваться «в ритме фронта», а не рвать с места
Основатель Anthropic Дарио Амодей опубликовал эссе, призывая к стратегическому замедлению развития ИИ. Он утверждает, что без контроля темпы роста могут стать неконтролируемыми, и предлагает модель «pace the frontier».
-
Новый SOTA для GEC без дообучения: метод бачинга и промптов
Исследователи представили метод минимальных правок (Minimal-Edit GEC), который сокращает разрыв с дообученными моделями до 0.38 балла, используя оптимизацию промптов и batching.
-
ByteDance: LLM-агенты пишут код, но 66% изменений не работают
Исследование HarnessDev показало, что LLM могут создавать собственные среды выполнения (harness), но их способность к самооптимизации ограничена: лишь 34 из 64 изменений обобщаются на новые задачи.
-
Y Combinator требует от US-лабов дистилляции Frontier-моделей
Гарри Тан из Y Combinator призывает американские open-weight лаборатории использовать передовые модели для обучения, называя доступ к ИИ общественным благом.
-
Krea Agent: Единая платформа для 40+ моделей генерации видео и изображений
Krea представила Krea Agent — универсальный интерфейс, объединяющий модели от OpenAI, Google, ByteDance и Alibaba. Платформа позволяет управлять генерацией медиа через единый MCP-протокол, экономя время на переключение м
-
SFT уже делает Olmo 3 безопасным: повторение эксперимента Gemini
Исследование подтвердило, что после этапа SFT модель Olmo 3 32B Think достигает уровня безопасности, сопоставимого с финальной версией. Это ставит под сомнение необходимость тяжелых RL-оптимизаций для базовой безопасност
-
Together AI: новые модели, Expert LoRA и скидки до 70% на дообучение
Together AI расширил сервис Fine-Tuning: добавлены GLM-5.3, Kimi K2.7, поддержка Expert LoRA для MoE-моделей и снижение цен на 30–70%.
-
Сотрудник Anthropic ушел в отставку, предупредив о риске вымирания от ИИ
Бывший исследователь предобучения Джейкоб Коксон покинул Anthropic, заявив, что компании гонятся за суперинтеллектом, ставя под угрозу существование человечества. Индустрия реагирует эскалацией.
-
BoardUI: React-компоненты для AI-агентов с поддержкой MCP
Платформа BoardUI предлагает 62 бесплатных React-компонента для создания интерфейсов AI-агентов. Ключевая фишка — нативная поддержка MCP-серверов для установки через CLI и интеграция с 7+ провайдерами LLM.
-
Внутренние предупреждения: сотрудники OpenAI и Anthropic бьют тревогу
В сентябре 2026 года сотрудники ведущих AI-лабораторий публично подтвердили, что считают риск вымирания человечества от ИИ реальным и близким. Они призывают к замедлению разработки и глобальной координации.
-
Google Sheets Canvas: AI-конструктор мини-приложений на базе Gemini 3.8 Flash
Google представила Sheets Canvas — новую функцию, превращающую таблицы в интерактивные приложения с помощью модели Gemini 3.8 Flash. Теперь данные можно визуализировать без кода, а изменения в интерфейсе мгновенно обновл
-
Cohere выпустила North Small Translate: 218B MoE, бьющая Google Translate
Cohere Labs представила модель машинного перевода North Small Translate (218B параметров, 25B активных), которая набирает 83.6 балла на WMT26, превосходя DeepL и Google Translate.
-
PageLM: Open Source альтернатива NotebookLM с поддержкой 10+ LLM
CaviraOSS выпустили PageLM — платформу, превращающую учебные материалы в интерактивные ресурсы. Поддержка Gemini, GPT, Claude и локальных моделей.
-
ToolGrad от Google: 99.8% успеха в генерации данных для вызова инструментов
Исследователи Google представили ToolGrad — фреймворк, инвертирующий процесс создания датасетов для LLM. Генерация проверенных цепочек вызовов API достигла 99.8% эффективности, а модель Gemma-3-12B, обученная на 500 прим
-
OpenDiscoveryTrace: Почему GPT-5.4 надежнее Claude Opus 4.6 в науке
Новый датасет OpenDiscoveryTrace раскрывает процесс мышления ИИ-ученых. Анализ 558 траекторий показал, что при схожей успешности GPT-5.4 совершает в 30 раз меньше ошибок инструментов, чем Claude Opus 4.6.
-
Правильный ответ ≠ Правильное решение: тест AI-мониторов на физике
Исследование показало, что AI-мониторы легко находят ошибки, когда видят верный ответ, но терпят неудачу в поиске логических дыр в рассуждениях, даже если итоговый результат верен.
-
Nvidia вырастет на 70%: Цифры, Blackwell и ответ Хуана на критику
Дженсен Хуанг подтвердил прогноз роста выручки Nvidia на 70% в следующем году, объяснив доминирование компании масштабом систем Blackwell и охватом всей экосистемы ИИ.
-
MoReBench: Почему моральные дилеммы не коррелируют с математикой
Новый бенчмарк MoReBench оценивает не только выводы ИИ, но и процесс морального рассуждения. Исследование показало отсутствие связи между способностью к логике в STEM и этикой, а также выявило системные предубеждения мод
-
OpenAI запускает Data Agent в ChatGPT Work: прямой доступ к корпоративным данным
OpenAI представила Data Agent в ChatGPT Work, позволяющий сотрудникам анализировать данные из Snowflake, Databricks и BI-систем через естественный язык без написания SQL-запросов.
-
Армия США выделила $11 млн на GPS-альтернативу Tern
Пентагон инвестирует в аутентификацию сигналов спутниковой навигации, чтобы защитить войска от глушения и подмены данных в условиях гибридных конфликтов.
-
Web-Check: OSINT-инструмент для глубокого анализа сайтов
Разработчик Lissy93 представил Web-Check — универсальный инструмент с открытым исходным кодом для сбора разведывательных данных (OSINT) о любых веб-ресурсах.
-
Провал до дрейфа: почему LLM-агенты не имитируют ценности людей
Исследование arXiv:2609.05514 показало, что более 50% LLM-агентов с самого начала не соответствуют заданным культурным профилям, ставя под сомнение их использование в социальных симуляциях.
-
Cursor расширяет экосистему: 60+ плагинов для AI-разработки и бизнеса
Cursor официально представил маркетплейс плагинов, объединяющий инструменты для разработчиков, продаж и маркетинга. Теперь AI-ассистент может работать с GitHub, Salesforce, Zoom и десятками других сервисов напрямую.
-
Astra: 8.6x лучше конкурентов в рассуждениях без цепочки мыслей
Независимый анализ Neel Nanda подтвердил аномальные способности Astra к сложным вычислениям без использования Chain of Thought (CoT), что ставит под угрозу существующие механизмы мониторинга ИИ.