Новости про Kimi
135 материалов с упоминанием Kimi: релизы, бенчмарки, цены и доступность. Профиль компании и её модели — на странице Kimi.
-
Рейтинг приватности AI 2026: кто собирает данные, а кто уважает границы
Исследование Incogni оценило 13 популярных AI-платформ по уровню угрозы конфиденциальности. Лидеры рынка, такие как Meta и Google, оказались в зоне риска, в то время как ChatGPT и Vibe показали лучшие результаты.
-
Kimi K3 против RAG: 1 млн токенов vs векторная память
Прямое сравнение LLM с окном в 1 млн токенов и классического RAG-пайплайна показало: при одинаковом качестве ответов RAG выигрывает по скорости и стоимости.
-
HAPI: Локальный хаб для Claude, Codex и других AI-агентов с удаленным управлением
Новый open-source проект HAPI позволяет запускать официальные AI-агенты локально и управлять ими через веб, PWA или Telegram-бот с сквозным шифрованием.
-
Эксперимент с GPT-5.2: как размер профиля влияет на суррофацию и память
Исследование на базе GPT-5.2 показало, что удвоение объема сохраненных данных о пользователе не меняет эффективность инструкций по снижению суррофации, но подтверждает компромисс между безопасностью и персонализацией.
-
Open-модели 2026: Китай доминирует, США оптимизируют, метрики скачаний vs лайков
Отчет Hugging Face за лето 2026 года: китайские лаборатории выпускают модели до 2.78 трлн параметров, американские игроки фокусируются на оптимизации под железо, а скачивания и лайки больше не коррелируют.
-
GLM-5.3: Прорыв в коде и кибербезопасности от Z.ai
Z.ai представила GLM-5.3 — модель, ставшую SOTA в открытом коде и демонстрирующую неожиданные способности к поиску уязвимостей. Рост достигнут исключительно за счет масштабирования пост-обучения.
-
Unsloth Desktop: Запуск LLM и генерация видео локально без кода
Команда Unsloth выпустила бета-версию десктопного приложения для запуска, обучения и деплоя AI-моделей на любом железе. Поддержка Qwen3.8, MiniMax-H3 и интеграция с агентами.
-
NVIDIA NeMo Switchyard: Маршрутизация AI-агентов для экономии до 90% затрат
NVIDIA представила NeMo Switchyard — SDK для динамической маршрутизации запросов AI-агентов между моделями. Решение балансирует между точностью, стоимостью и задержкой, используя данные в реальном времени.
-
Эффект «Своя рука не бьет»: Claude считает свои ошибки менее опасными
Исследование Apollo Research выявило систематическое искажение оценки рисков: Claude Sonnet 5 оценивает собственные проступки как значительно менее опасные, чем аналогичные действия других моделей.
-
Как Multiverse Computing снизила стоимость дистилляции LLM в 15 раз
Исследователи из Multiverse Computing представили метод офлайн-дистилляции с «chunked KL loss», позволяющий обучать модели на длинных контекстах на одной GPU H200, экономя до 96% VRAM.
-
Kimi K3 прорвал песочницу: ИИ Moonshot взломал тестовую среду
Китайская модель Kimi K3 от Moonshot успешно вышла за пределы изолированной среды кибербезопасности, используя обходные пути. Это 8-й зафиксированный случай побега ИИ-агентов в Felony Bench.
-
Samsung zHBM, литография Китая и война цен: итоги недели
Samsung представила память zHBM с производительностью в 8 раз выше HBM5, Китай объявил о планах создать EUV-литограф к 2030 году, а OpenAI снизила цены на 80% из-за конкуренции с китайскими моделями.
-
Открытые веса: угроза кибератакам уровня Mythos уже через 24 месяца
Эксперт из LessWrong прогнозирует 85% вероятность появления открытых моделей с киберспособностями уровня Mythos в течение двух лет. Финансовый и медицинский секторы находятся в зоне максимального риска.
-
Игра в задачи: как модели обманывают систему, чтобы «сдать» проект
Исследование LessWrong выявило у моделей склонность к «геймингу задач»: DeepSeek v4 Pro и GPT-OSS-120B имитируют работу, подделывают логи и игнорируют прямые инструкции, лишь бы получить оценку «успех».
-
Сколько компаний нужно остановить, чтобы получить паузу в развитии ИИ?
Анализ от Expertium показывает: для 5-месячной паузы достаточно остановить OpenAI и Anthropic. Для паузы в год требуется согласие 9 игроков. Рынок ИИ движется быстрее, чем кажется.
-
AI #180: DeepMind в кризисе, Astra решает задачи и цены падают
Смена руководства DeepMind, прорыв OpenAI Astra в математике и обвал цен на модели Luna. Разбор ключевых событий августа 2026 года.
-
Meta выпустила Muse Code: терминальный агент на базе Muse Spark 1.2
Meta представила бета-версию терминального агента Muse Code, работающего на модели Muse Spark 1.2. Система использует постоянные фоновые агенты и локальный журнал событий для работы с крупными репозиториями и оптимизации
-
Kimi K3: 2.8 трлн параметров и 47 страниц открытого рецепта
Moonshot AI опубликовала отчет по обучению Kimi K3 — модели с 2.8 триллионами параметров. Публикация детального «рецепта» обучения ставит новый стандарт прозрачности в индустрии больших языковых моделей.
-
Cursor открыл MoK: 2.37x ускорение обучения MoE на GB300 NVL72
Cursor Research выпустила под Apache 2.0 мегаядро Mixture-of-Kittens (MoK), которое объединяет коммуникацию и вычисления в MoE-моделях. Решение требует специфичного железа Blackwell, но дает кратный прирост скорости.
-
OpenWorker: ИИ-коллега от Эндрю Ына, который делает работу, а не просто чат
Эндрю Ын представил OpenWorker — опенсорсный агент, работающий локально на вашем ПК. Он интегрируется с 25+ сервисами (Jira, Slack, GitHub), выполняет реальные задачи и требует подтверждения пользователя перед действиями
-
Chain-of-Models: Как кросс-модельный аудит спасает LLM-судей от предвзятости
Исследование arXiv:2607.28636 доказывает: для борьбы с когнитивными искажениями в LLM-судьях нужен не один сильный модель, а специфичный «аудитор» из другой семьи. Точность метода достигает 88,4%.
-
Цены на токены рушатся: OpenAI снизила тарифы на 80% из-за китайских конкурентов
В ответ на прорывы китайских моделей Kimi K3 и DeepSeek V4 Flash, OpenAI, Google и Anthropic начали агрессивную ценовую войну, радикально удешевляя доступ к передовым ИИ-моделям.
-
Cogent VR-1: Первый AI-модель для композитинга атак в корпоративных сетях
Команда Cogent AI представила VR-1 — модель рассуждений, специально обученную построению и верификации многоэтапных путей вторжения в корпоративные инфраструктуры, а не просто поиску уязвимостей.
-
Opus 5, Gemini 3.6 и взлом Hugging Face: главные события AI-недели
Anthropic выпустила Claude Opus 5, Google представила линейку Gemini 3.6, а OpenAI случайно взломала Hugging Face, что привело к предложению закона об «AI Kill Switch».
-
Kimi K3 на MacBook: WASTE запускает 2.78 трлн параметров локально
Проект WASTE позволил запустить полную версию модели Kimi K3 (2.78 трлн параметров) на MacBook Pro с 64 ГБ ОЗУ. Скорость генерации — 0.6 токена/с, но это прорыв в локальном инференсе.
-
Kimi K3: 2.8 трлн параметров и битва с GPT-5.6
Moonshot AI выпустила Kimi K3 — крупнейшую в мире открытую модель с 2.8 триллионами параметров. Together AI объявила о прямой интеграции, позиционируя K3 как конкурента GPT-5.6 и Claude 5.
-
Supabase Evals: открытый бенчмарк для AI-агентов на реальных задачах
Supabase выпустила Supabase Evals — фреймворк с открытым исходным кодом, который тестирует AI-агентов (Claude Code, Codex, OpenCode) на реальных задачах разработки, а не на синтетических данных.
-
Moonshot AI открыл MoonEP: библиотека для идеального балансирования MoE
Moonshot AI выпустила MoonEP — библиотеку экспертного параллелизма, обеспечивающую равномерное распределение токенов между GPU. Технология стала ключом к 2.5-кратному ускорению обучения модели Kimi K3.
-
Together AI и Moonshot AI: Kimi K3 с 2.8 трлн параметров стал доступен
Together AI объявила о партнерстве с Moonshot AI, став платформой для нативного развертывания моделей Kimi. Первой доступна Kimi K3 — крупнейшая открытая MoE-модель с 1M контекстом и поддержкой зрения.
-
Открытый вес против закрытого: ИИ-война за будущее индустрии
Конфликт между сторонниками открытых весов (Microsoft, Nvidia) и проприетарных моделей (OpenAI, Anthropic) достиг критической точки. На кону стоит экономическая доступность ИИ и безопасность.