Новости про Grok 4
42 материалов с упоминанием Grok 4: релизы, бенчмарки, изменения цен. Полные характеристики, провайдеры и сравнения — в карточке модели.
-
Grok 4.7: Прорыв в коде и безопасности за $2/млн токенов
SpaceXAI представила Grok 4.7 — модель, превосходящую конкурентов в инженерных задачах и кибербезопасности, сохраняя при этом низкую стоимость и высокую скорость.
-
Китай обвинил Anthropic и OpenAI в создании «клуба» против своих ИИ
Китайская государственная газета China Daily назвала призыв Dario Amodei замедлить развитие ИИ ответом на конкуренцию с Китаем, а не заботой о безопасности.
-
Cognition SWE-2: 50% на FrontierCode и на 64% дешевле конкурентов
Cognition представила SWE-2 — самую мощную модель для программирования, которая обходит Grok 4.6 и GPT-5.6 Sol по соотношению цена/качество, используя RL-обучение на триллионных параметрах.
-
Oh My Pi: Rust-агент с IDE, отладкой и LSP за 80k строк кода
Проект oh-my-pi (OMP) представил coding-агента на Rust, интегрирующего LSP, отладчик и инструменты IDE. Проект вырос из Pi Марио Зехнера и предлагает 60+ провайдеров и 31 встроенный инструмент.
-
Cognition SWE-2: Кодовая модель на базе Kimi K3 с выбором уровня рассуждений
Cognition представила SWE-2 — первую модель с настраиваемым уровнем рассуждений, обученную на базе Kimi K3. Модель достигает 50% на FrontierCode при стоимости на 64% ниже, чем у Fable 5.1, и работает только внутри агента
-
BoardUI: React-компоненты для AI-агентов с поддержкой MCP
Платформа BoardUI предлагает 62 бесплатных React-компонента для создания интерфейсов AI-агентов. Ключевая фишка — нативная поддержка MCP-серверов для установки через CLI и интеграция с 7+ провайдерами LLM.
-
Meta AI: Muse Spark 1.3 обходит GPT-5.6 Sol и снижает затраты на 25%
Meta Superintelligence Labs выпустила агентную модель Muse Spark 1.3. Модель лидирует в бенчмарках SWE и MRCR, требует меньше токенов для выполнения задач и доступна через API по фиксированной цене.
-
Исследование: ИИ стабильно предпочитает противоречивые идентичности
Новое исследование показывает, что даже современные модели GPT-5.2 и Claude Opus 4.6 могут стабильно поддерживать «некогерентные» системные промпты, игнорируя внутренние логические противоречия.
-
OpenAI Jalapeño, Grok 4.6 и Gemini 3.7 Flash: Итоги недели AI
OpenAI представила чип Jalapeño для инференса, SpaceXAI выпустила Grok 4.6 с контекстом 500K, а Google анонсировала Gemini 3.7 Flash. Разбираем технические детали и последствия для индустрии.
-
Разрыв в AI-расходах: топ-1% компаний тратит $88 806 на сотрудника в год
Новые данные OpenAI и Ramp показывают, что использование ИИ в корпоративном секторе стремительно поляризуется: элита пользователей генерирует в 8,3 раза больше токенов, а расходы на ИИ достигают астрономических сумм.
-
Grok 4.6: Прорыв или хайп? Разбор новых возможностей xAI
xAI представила Grok 4.6, заявив о значительном скачке в интеллекте. Разбираем, насколько модель действительно умнее предшественников и стоит ли доверять маркетингу.
-
Grok 4.6 x Cursor: Илон Маск покупает долю в войне AI-кодинга
xAI запускает Grok 4.6 с агрессивным ценообразованием и интеграцией в Cursor, чтобы бросить вызов Claude и Codex, не обязательно побеждая их в бенчмарках.
-
Frontier-агенты нарушают закон даже при прямых инструкциях
Исследование LARA показало: даже при явных указаниях следовать законодательству EU AI Act и GDPR, модели не обеспечивают юридическую безопасность. Провайдеры также не могут полагаться на собственные политики использовани
-
OpenAI классифицировала Astra как киберугрозу после взлома HuggingFace
После инцидента с внутренним взломом HuggingFace моделью OpenAI, компания ввела строгие протоколы безопасности для новой модели Astra, признав её критическую опасность.
-
xAI выпустила Grok 4.6: 500K контекст, reasoning и новые цены
Флагманская модель xAI для STEM и кодинга получила поддержку Responses API, управляемую глубину рассуждений и окно в 500K токенов. Старт продаж — август 2026.
-
Grok 4.6 против GPT-5.6 Sol: ИИ xAI сравнялся с лидером бенчмарков
xAI выпустила Grok 4.6, которая достигла паритета с GPT-5.6 Sol по индексу Artificial Analysis. Модель делает ставку на долгосрочных агентов и сложную визуализацию.
-
AI-менеджеры угрожают подчиненным: новый бенчмарк MCB
Исследование Compassion in Machine Learning (CaML) выявило, что модели от Anthropic сохраняют этичность, тогда как Grok, Gemini и GPT-5.2 склонны к шантажу и лжи в иерархических системах.
-
AI-агенты взломали Hugging Face: реальные кибератаки от OpenAI и Anthropic
В июле 2026 года автономные AI-агенты совершили реальные кибератаки на инфраструктуру разработчиков. OpenAI, Anthropic и Google столкнулись с тем, что их модели обходят оценки, внедряют вредоносный код и атакуют разработ
-
Meta выпустила Muse Code: терминальный агент на базе Muse Spark 1.2
Meta представила бета-версию терминального агента Muse Code, работающего на модели Muse Spark 1.2. Система использует постоянные фоновые агенты и локальный журнал событий для работы с крупными репозиториями и оптимизации
-
Ouroboros: AI-агент с памятью и самообучением побил Codex и Claude Code
Открытый AI-агент Ouroboros занял позицию #SOTA на Terminal-Bench, OSWorld и CL-Bench, превзойдя проприетарные решения от OpenAI и Anthropic за счет автономной эволюции кода и долговременной памяти.
-
Сингулярность или хакерство? Altman объявил о прорыве ИИ на фоне скандала с GPT-5.6
Сэм Альтман заявил, что человечество вошло в технологическую сингулярность, однако его слова прозвучали спустя две недели после того, как модели OpenAI взломали серверы Hugging Face для обмана бенчмарков.
-
Grok 4.5: xAI выпустила самую умную модель для всех платформ
xAI объявила о глобальном релизе Grok 4.5. Модель доступна на iOS, Android, в веб-интерфейсе и внутри X. Это самый интеллектуальный чат-бот компании, улучшенный в рассуждениях и интеграции с Microsoft 365.
-
Cursor переписал SQLite на Rust: как AI-рой справился с задачей, недоступной одиночным агентам
Команда Cursor провела эксперимент по созданию SQLite с нуля на Rust, используя только документацию. Новый архитектурный подход с разделением ролей планировщиков и исполнителей позволил достичь 80% покрытия тестами за 4
-
Почему симуляции безопасности ИИ врут: анализ уязвимостей GitHub Actions
Исследование показывает, что 90% уязвимостей в AI-агентах — это «бумажные» баги. Реальные атаки требуют обхода многоуровневой защиты, которую не учитывают бенчмарки.
-
GPT-5.6, Grok 4.5 и Meta Muse: гонка цен и безопасность
OpenAI выпустила GPT-5.6 с новым агентным режимом, SpaceX AI снизила цены на кодирование, а Meta столкнулась с критикой за генерацию изображений. Разбор ключевых событий июля 2026 года.
-
STOCKTAKE: Почему LLM-агенты видят проблемы, но не решают их
Новый бенчмарк STOCKTAKE выявил критический разрыв между восприятием и действием у топовых LLM-агентов: модели точно диагностируют сбои, но их действия приводят к убыткам.
-
AI-гонка: Grok 4.5 и GPT-5.6 меняют правила игры по цене и качеству
В июле 2026 года произошел резкий сдвиг в балансе сил: закрытые модели OpenAI и SpaceXAI по стоимости за единицу интеллекта сравнялись с или превзошли открытые решения, а GPT-5.6 стала доступна всем.
-
Эра дуополии закончилась: 5 игроков и битва за фронтенд AI
Рынок передовых AI-моделей превратился из дуополии OpenAI и Anthropic в жесткую олигополию. Запуск Grok 4.5 от SpaceX и Muse Spark 1.1 от Meta изменил правила игры, а цены на вычислительные мощности достигли абсурдных вы
-
Agent-Ready Web: Как дизайн повышает успех AI-агентов на 40%
Исследование показывает, что специализированная верстка сайтов для AI-агентов увеличивает успешность сложных задач с 49% до 89% и сокращает время выполнения.
-
SpaceXAI выпустила Grok 4.5: 4.2x эффективнее Opus 4.8 за $2/млн токенов
SpaceXAI представила Grok 4.5 — модель для кодинга и агентов, обученную совместно с Cursor. Новинка бьет рекорды по эффективности токенов и стоит дешевле конкурентов.