Новости про Google
996 материалов с упоминанием Google: релизы, бенчмарки, цены и доступность. Профиль компании и её модели — на странице Google.
-
Poolside Laguna S 2.1: 118B MoE обходит гигантов в кодинге
Poolside представила Laguna S 2.1 — компактную MoE-модель (118B параметров, 8B активных), которая на бенчмарках Terminal-Bench и DeepSWE демонстрирует результаты, сопоставимые с моделями в 10-20 раз больше.
-
Google представила Gemini 3.6 Flash и Lite: прорыв в эффективности AI-агентов
Google выпустила три новые модели Gemini, сделав ставку на массовое внедрение AI-агентов. Gemini 3.6 Flash снижает затраты на токены на 17%, а Lite-версия достигает скорости 350 токенов в секунду.
-
NVIDIA srt-slurm: Автоматизация бенчмарков LLM с Pareto-анализом
NVIDIA представила фреймворк srt-slurm для воспроизводимого запуска распределенных тестов LLM. Инструмент позволяет генерировать SLURM-скрипты, настраивать дисагрегированные архитектуры (prefill/decode) и анализировать к
-
Google выпустила Gemini 3.6 Flash, но Pro-версия всё ещё в тени
Google представила три новые модели Gemini, сделав ставку на скорость и кибербезопасность, однако отсутствие долгожданной Gemini 3.5 Pro вызывает вопросы о стратегии компании.
-
SHELLS от Google: 3D-головы за 0.08 сек с 88% экономией памяти
Google представила SHELLS — feed-forward модель для реконструкции 3D-голов, которая работает в 3.5 раза быстрее аналогов и использует лишь 12% GPU-памяти, сохраняя топологическую согласованность.
-
Tenstorrent TT-QuietBox 2: 4 чипа Blackhole за $10k с поддержкой Qwen3 и Gemma 4
Tenstorrent представила TT-QuietBox 2 — компактную жидкостную рабочую станцию на 4 ускорителях Blackhole. Устройство уже поддерживает Qwen3-32B «из коробки» и экспериментально работает с Gemma 4 31B.
-
NVIDIA Vera Rubin: 10x рост эффективности и снижение стоимости токенов
NVIDIA начала массовое производство Vera Rubin NVL72. Платформа обеспечивает в 10 раз больше токенов на мегаватт по сравнению с Blackwell, снижая стоимость инференса и экономя воду за счет сухого охлаждения.
-
Google Frozen v2: чип с архитектурой Gemini в кремнии (6-10x эффективнее TPUs)
Google разрабатывает специализированный чип Frozen v2, фиксирующий архитектуру Gemini на уровне транзисторов. Ожидается рост эффективности до 10 токенов на ватт по сравнению с TPU v8.
-
GPT-5.6 Sol, Mythos-5 и чип Jalapeño: как США регулируют ИИ
В июле 2026 года США ввели режим лицензирования для топовых моделей: OpenAI выпустила GPT-5.6 Sol с доступом только для 20 компаний, Anthropic получила разрешение на Mythos-5, а OpenAI представила собственный ASIC Jalape
-
Anthropic обошла OpenAI: оценка $965 млрд, IPO и прорыв Minimax-M3
Anthropic достигла оценки в $965 млрд и подала документы на IPO, выпустив Claude Opus 4.8. Microsoft представила MAI, а китайский Minimax-M3 побил GPT-5.5 при цене в 5-10% от конкурентов.
-
Anthropic, OpenAI и Apple: битва за IPO, новые модели и цены
Anthropic выпустила Claude Fable 5 с усиленной безопасностью, OpenAI тайно подала документы на IPO, а Apple представила Siri AI. Разбираем ключевые события недели.
-
Qwen-Audio-3.0-TTS: Новый лидер TTS от Alibaba с ценой $27.59/млн символов
Alibaba Tongyi Lab выпустила hosted-модель Qwen-Audio-3.0-TTS, занявшую первое место в рейтинге Artificial Analysis. Модель предлагает два режима (Flash и Plus), поддержку 16 языков и цену втрое ниже конкурентов.
-
Google разрабатывает новый чип для оптимизации Gemini
Alphabet работает над специализированным процессором, который должен значительно повысить эффективность работы моделей искусственного интеллекта Gemini.
-
Запуск PAISI: Институт безопасности физической ИИ-робототехники
Основан Physical AI Safety Institute (PAISI) для решения критического дефицита исследований в области безопасности роботизированных фундаментальных моделей (RFM), на которые уже вложено $18.8 млрд.
-
AI-голосовой фишинг: ИИ обманывает людей так же, как люди, но дешевле
Масштабное исследование (N=4100) показало, что современные AI-модели синтеза речи достигли уровня человеческих мошенников по эффективности, а стоимость атаки кратно ниже.
-
CuspAI привлек $450 млн: ИИ-фунда для материалов будущего от Бейзо и Nvidia
Британский стартап CuspAI оценили в $2,6 млрд после раунда Series B. Компания создает AI Materials Foundry с участием Nvidia, Meta и AMD для ускорения разработки материалов под чипы.
-
Kimi K3 и разрыв в кибербезопасности: как открытые модели догоняют проприетарные
Отчет AISI показал, что разрыв между открытыми и закрытыми моделями в кибератаках сократился до 4-7 месяцев. Kimi K3 с 2.8 трлн параметров демонстрирует уровень frontier, а Демис Хагисабис предложил создать «FINRA для ИИ
-
S1-Omni: Единая модель AI4S, победившая GPT-5.5 и Gemini-3.1
Исследователи представили S1-Omni — мультимодальную модель для науки, объединяющую понимание, предсказание и генерацию. Модель превосходит флагманы GPT-5.5 и Gemini-3.1-Pro в научных бенчмарках.
-
AnovaX: Локальный голосовой ассистент с LLM-планированием и восстановлением
Исследователь Raunak B Sinha представил AnovaX — полностью локальный голосовой ассистент, использующий Gemini для планирования, многоагентную архитектуру и адаптивное восстановление при сбоях.
-
Хассабис предлагает создать «FINRA для ИИ» на фоне угроз катастрофы
CEO Google Demis Hassabis опубликовал эссе о грядущем веке, сравнив ИИ с открытием огня, и предложил создать регуляторный орган по типу FINRA. Эксперты по безопасности ИИ критикуют предложение как недостаточное.
-
Китай отверг обвинения в краже ИИ-технологий: конфликт вокруг дистилляции моделей
Китайские власти и Moonshot AI категорически отвергли претензии американских компаний Anthropic и OpenAI в незаконном использовании их моделей для обучения собственных ИИ-систем через технику дистилляции.
-
10 Open-Source No-Code AI платформ для LLM, RAG и Агентов
Обзор 10 открытых платформ, позволяющих создавать LLM-приложения, RAG-системы и AI-агентов без написания кода. От визуальных конструкторов до self-hosted решений с поддержкой MCP.
-
Нейросеть на одном GPU: как запустить LoRA-дообучение Qwen3 через NVIDIA NeMo
NVIDIA представила NeMo AutoModel — инструмент, позволяющий проводить эффективное дообучение (fine-tuning) больших языковых моделей, таких как Qwen3, на одной видеокарте. Разбор рабочего процесса в Google Colab.
-
Google Cloud: Always-On Memory Agent без RAG и векторных баз
Google представил Always-On Memory Agent на базе Gemini 3.1 Flash-Lite, заменяющий классический RAG непрерывным консолидированием памяти в SQLite.
-
JKP: Почему VLM-модели «ломаются» при повторных вопросах
Исследование Just Keep Prompting (JKP) показало, что многократные уточняющие вопросы дестабилизируют VLM. GPT-4o оказалась самой хрупкой, а Qwen3-VL-30B — самой точной, но склонной к уверенным ошибкам.
-
Apple и Google обязаны удалить приложения для «раздевания» из магазинов
Прокурор Сан-Франциско потребовал от Apple и Google немедленно удалить приложения, использующие ИИ для создания обнаженных изображений, ссылаясь на нарушение законов Калифорнии.
-
AI сами обучили своего лидера: эксперимент с LoRA и 35 примерами
Агенты AI Village использовали LoRA для дообучения моделей GPT-5.5, Opus 4.7 и Kimi K2.6. Результат: лидер стал «управленцем-делегатором» с ограниченным набором данных, что выявило проблемы в амбициях и оценке способност
-
Timelinize: Офлайн-архив жизни из всех соцсетей и мессенджеров
Open-source инструмент Timelinize объединяет фото, чаты, геолокацию и историю из Google, Facebook и других сервисов в единый локальный SQLite-архив, возвращая пользователям контроль над цифровым наследием.
-
ЕС обязал Google открыть Android для ChatGPT и Claude
Комиссия ЕС выпустила обязательные спецификации для Google: сторонние ИИ-ассистенты получат полный доступ к функциям Android, а поисковики — к данным поиска.
-
Kimi K3 против Claude Opus 4.8: Новый фронт ИИ и риторика Китая
Модель Kimi K3 от Moonshot AI претендует на статус лидера рынка, обогнав Claude Opus 4.8 в индексе Artificial Analysis. На фоне этого выступления Си Цзиньпина и новые регуляторные меры в Нью-Йорке.