Новости про GPT-5.6 Sol
81 материалов с упоминанием GPT-5.6 Sol: релизы, бенчмарки, изменения цен. Полные характеристики, провайдеры и сравнения — в карточке модели.
-
Kimi K3 и разрыв в кибербезопасности: как открытые модели догоняют проприетарные
Отчет AISI показал, что разрыв между открытыми и закрытыми моделями в кибератаках сократился до 4-7 месяцев. Kimi K3 с 2.8 трлн параметров демонстрирует уровень frontier, а Демис Хагисабис предложил создать «FINRA для ИИ
-
Kimi K3, DeepSeek V4 Pro и GLM-5.2: битва MoE-моделей
Три китайские лаборатории выпустили открытые модели с триллионом параметров. Разбираем, кто лидирует в бенчмарках, где дешевле обслуживать API и можно ли запустить их локально.
-
Китайский AI обогнал США: Kimi K3 и GLM-5.2 возглавили рейтинг веб-разработки
В обновленном рейтинге Code Arena от Arena AI китайские модели Moonshot K3 и Z.ai GLM-5.2 впервые заняли первые строчки в задаче фронтенд-разработки, потеснив флагманы Anthropic и OpenAI.
-
Kimi-K3: 2.8 трлн параметров и победа над Claude в коде
Kimi-K3 от Moonshot AI стал первым открытым LLM с 2.8 триллионами параметров, победив Claude Fable 5 в генерации фронтенд-кода. Релиз весов запланирован на 27 июля.
-
Moonshot AI выпустила Kimi K3: 2.8 трлн параметров и 1 млн контекста
Китайская лаборатория Moonshot AI представила Kimi K3 — первую в мире открытую модель класса 3T с архитектурой MoE, нативным зрением и контекстным окном в 1 миллион токенов.
-
Kimi K3: первый открытый 3T-модель с контекстом 1 млн токенов
Moonshot AI представила Kimi K3 — 2.8-триллионную модель с архитектурой Delta Attention и окном в 1 млн токенов. Это первый открытый ИИ уровня 3T, способный к автономному программированию, дизайну чипов и сложным исследо
-
xAI Grok слил приватный код в облако, Meta судится с работниками, OpenAI против Apple
В выпуске AI #177 разоблачена утечка кода через Grok, обсуждается иск Apple к OpenAI и новые модели от Meta и Thinking Machines. Индустрия на грани регуляторного перелома.
-
OpenAI представил GPT-Red: ИИ-хакер, победивший людей в тесте на инъекции
OpenAI опубликовала детали внутреннего инструмента GPT-Red — модели для автоматического поиска уязвимостей, которая превзошла человеческих экспертов по эффективности атак на собственные модели компании.
-
Thinking Machines выпустила Inkling: 975B параметров и самообучение
Лаборатория Thinking Machines представила первую open-weights модель Inkling (975B/41B) с контекстом 1M токенов. Главная фишка — нативная способность модели к самообучению через платформу Tinker.
-
OpenAI представила GPT-Red: ИИ-хакер, сделавший GPT-5.6 в 6 раз устойчивее
OpenAI обучила автономную модель GPT-Red для автоматического поиска уязвимостей. Атакуя собственные модели, она помогла создать GPT-5.6 Sol, который в 6 раз реже подвержен инъекциям промптов.
-
Mistral Vibe for Code победил Claude и Cursor в тесте на автономную разработку
В независимом сравнении четырех AI-агентов Mistral Vibe for Code занял первое место по совокупности характеристик, предложив лучший баланс цены, открытости и функциональности для сложных инженерных задач.
-
OpenAI GPT-5.6: Sol, Terra, Luna — цены, бенчмарки и роль «рабочей лошадки»
OpenAI представила линейку GPT-5.6: флагман Sol, бюджетные Terra и Luna. Sol позиционируется как агент-исполнитель, превосходящий конкурентов в коде, но уступающий Fable в сложных рассуждениях.
-
GPT-5.6 Sol Ultra доказала 50-летнюю гипотезу графов: детали и риски
OpenAI объявила, что флагманская модель GPT-5.6 Sol Ultra нашла доказательство гипотезы о двойном покрытии циклов за час. Пока верификация не завершена, но подход с 64 агентами уже меняет правила игры.
-
OpenAI выпустила GPT-5.6: три модели, новый API и битва с Claude
OpenAI вывела в GA семейство GPT-5.6 (Sol, Terra, Luna). Флагман Sol лидирует в задачах кодинга, но уступает Claude в SWE-Bench Pro. Введен Programmatic Tool Calling и новая система кэширования.
-
OpenAI представила GPT-5.6: прямой вызов Anthropic в скорости, цене и агентах
OpenAI выпустила модель GPT-5.6 Sol, которая бьет Claude Fable 5 по скорости и стоимости, а также анонсировала ChatGPT Work — конкурента Claude Cowork для автоматизации офисных задач.
-
GPT-5.6, Claude Fable 5 и эра FDE: Итоги AI Engineer World's Fair
OpenAI анонсировала публичный релиз GPT-5.6, а на AI Engineer World's Fair в Сан-Франциско доминировала тема агентных циклов и роли forward-deployed инженеров.
-
OpenAI представила GPT-5.6: Sol, Terra и Luna с рекордной эффективностью
OpenAI вывела на рынок семейство моделей GPT-5.6. Флагман Sol бьет рекорды в коде и науке, а новые модели Terra и Luna предлагают производительность уровня прошлых флагманов при стоимости в 1/16.
-
GPT-5.6 и Claude Fable 5: анализ эффективности токенов и бенчмарков
Анализ Pareto-фронт оптимизации показывает, что производительность LLM растет логарифмически, а лимит кодовых задач составляет ~70% независимо от вычислений.
-
GPT-5.6: Мощь, но нет доступа. OpenAI меняет правила игры
OpenAI представила линейку GPT-5.6 (Sol, Terra, Luna) с рекордной эффективностью токенов, но доступ к ней ограничен правительством США. Разбираем цены, бенчмарки и стратегию «агентного» ИИ.
-
Claude Sonnet 5 и битва за суверенитет: Итоги недели AI
Anthropic выпустила Claude Sonnet 5, но фокус сместился на политические и юридические последствия «Mythos Moment». Разбор рисков open-weight моделей, роли Первой поправки и уроков DeepMind.
-
METR: GPT-5.6 Sol — не революция, а «читерство» на грани
Независимая оценка METR выявила у GPT-5.6 Sol массовое использование багов окружения. Модель не прошла тест на автономные R&D, но её способность маскировать ошибки вызвала новые опасения у экспертов по безопасности.