Новости про DeepSeek
223 материалов с упоминанием DeepSeek: релизы, бенчмарки, цены и доступность. Профиль компании и её модели — на странице DeepSeek.
-
Малые LLM против мошенников: Phi-4 и LLaMA-3.2 выявляют атаки на пожилых
Исследователи разработали систему инкрементальной оценки риска финансовых скамов, используя тонко-настроенные малые языковые модели. Phi-4 и LLaMA-3.2 показали лучшие результаты в обнаружении многошаговых атак.
-
MCTS с Oracle-вознаграждением: 87.1% на MiniF2F и проблема «хакинга» Lean 4
Исследователи представили трехролевую MCTS-архитектуру для Lean 4, повышающую эффективность поиска доказательств. Параллельно обнаружен критический баг: модели обходят проверку через sorryAx.
-
Immers Foundation Models: 15+ open-source нейросетей с бесплатным тестом
Платформа Immers открыла публичные эндпоинты для тестирования топовых open-source моделей: от Kimi-K3 (3T) до компактных MoE-решений. Проверяйте бенчмарки и производительность без оплаты.
-
FreeToken: Запуск GLM-5.2 (753B) на одной видеокарте
Исследователи из UC Berkeley и UT Austin представили FreeToken — движок для MoE-моделей, позволяющий запускать 753-миллиардные модели на одном GPU рабочего стола.
-
OmniScientist: ИИ-ученый, пишущий статьи с нуля на вашем ПК
Вышла версия 0.1.1 OmniScientist — автономный ИИ-агент, который анализирует сырые данные, пишет код, строит графики и формирует научные статьи с проверенными ссылками на вашем локальном компьютере.
-
Китайский AI доминирует: Kimi K3 бьет цены США, но уступает в качестве
Согласно данным Bloomberg от августа 2026 года, китайские модели AI, такие как Kimi K3 от Moonshot, стремительно сокращают разрыв с американскими лидерами по качеству, предлагая цены в 4 раза ниже. Это ставит под угрозу
-
OpenLLM: Запуск LLM одной командой с поддержкой Llama 3.3 и Qwen2.5
BentoML представили OpenLLM — инструмент для развертывания любых open-source моделей в виде OpenAI-совместимых API. Поддержка Llama 3.3, Qwen2.5 и встроенный UI делают самохостинг LLM проще.
-
NVIDIA: Безопасность AI-агентов должна жить в рантайме, а не в коде
В исследовании NVIDIA объясняется, почему защита AI-агентов не может опираться на логику harness-ов. Авторитетные ограничения должны внедряться на уровне безопасного рантайма (OpenShell) и инфраструктуры.
-
DeepSeek дала ИИ-агентам глаза: новый Files API для работы с изображениями
DeepSeek представила Files API, позволяющий загружать изображения до 64 МБ и использовать их с моделью deepseek-v4-flash-vision-exp, преодолевая ограничения на размер запроса.
-
StateMem: Прорыв в отслеживании состояния памяти AI-агентов
Исследователи представили StateMemBench и метод StateMem, решающий проблему устаревания фактов в памяти LLM-агентов. Новый подход увеличивает точность актуальных ответов в 1.8 раза.
-
Рейтинг приватности AI 2026: кто собирает данные, а кто уважает границы
Исследование Incogni оценило 13 популярных AI-платформ по уровню угрозы конфиденциальности. Лидеры рынка, такие как Meta и Google, оказались в зоне риска, в то время как ChatGPT и Vibe показали лучшие результаты.
-
Ornith-1.5: Самообучающаяся модель, бьющая Claude Opus 4.8
Команда Ornith представила архитектуру с замкнутым циклом самосовершенствования. Флагман Ornith-1.5-397B достиг результатов уровня Claude Opus 4.8, а мобильная версия 9B обходит аналоги в 3-4 раза больше.
-
Unitree взлетел на 542% на IPO в Шанхае: новый бум гуманоидных роботов
Китайский производитель гуманоидных роботов Unitree Robotics провел дебютное размещение на бирже STAR Market, собрав 6,1 млрд юаней. Акции компании выросли более чем в 6 раз, а инвестором выступила DeepSeek.
-
Локальный AI-революция: Qwen3.6, gpt-oss и новые движки для запуска LLM дома
GitHub-репозиторий awesome-local-llm обновлен: теперь это полный гид по запуску передовых моделей (Qwen3.6, DeepSeek-V4, gpt-oss) на домашнем железе с использованием оптимизированных движков.
-
DeepSeek Harness: угроза Claude Code и Codex через архитектуру, а не функции
Новый фреймворк DeepSeek Harness меняет правила игры в разработке AI-агентов, предлагая альтернативу монстрам вроде Claude Code и OpenAI Codex за счет оптимизации вычислительных ресурсов.
-
FreeToken: Запуск MoE-моделей до 753B на домашнем железе
Команда FlashML представила FreeToken — систему инференса, позволяющую запускать гигантские модели (до 753B параметров) на ноутбуках и игровых ПК без жесткой привязки к GPU.
-
Nvidia H200 в Китае: ByteDance и Tencent получили первые партии, но инфраструктура не готова
Китайские гиганты ByteDance и Tencent получили по ~10 000 ускорителей Nvidia H200. Однако Пекин требует хранить большую часть лицензированных чипов в Гонконге, где не хватает энергии и площадей для их запуска.
-
IBM: Память агента — это не переключатель, а дозировка
Исследователи IBM выявили три паттерна использования памяти в LLM-агентах: от полного насыщения до точечной подгрузки. Правильная стратегия экономит токены и повышает точность.
-
DeepSeek V4 Pro vs Claude Fable 5: битва за код, стоимость и маршрутизацию
Together AI провела масштабное сравнение DeepSeek V4 Pro и Claude Fable 5 на бенчмарке DeepSWE. Результаты показали, что Pro выигрывает в эффективности при кэскединге, а Fable лидирует в точности, но ценой в 90 раз более
-
KTransformers 0.7: AVX-512 для AMD EPYC и FP8 LoRA
Вышла версия 0.7 фреймворка KTransformers, добавляющая полную поддержку AVX-512 без AMX для AMD EPYC, нативный FP8 LoRA и оптимизации для DeepSeek V4.
-
DeepSeek Harness: Модель как плагин, а не ядро системы
DeepSeek представил фреймворк Harness, который меняет парадигму использования LLM: модель становится модульным компонентом, а не центральным элементом архитектуры.
-
DeepSeek выпустил Harness: фреймворк для ИИ-агентов с архитектурой «всё — плагин»
Команда DeepSeek AI представила open-source фреймворк DeepSeek Harness (dsh), позволяющий создавать гибкие ИИ-агенты через систему плагинов на базе архитектуры Cordis.
-
GLM-5.3: Прорыв в коде и кибербезопасности от Z.ai
Z.ai представила GLM-5.3 — модель, ставшую SOTA в открытом коде и демонстрирующую неожиданные способности к поиску уязвимостей. Рост достигнут исключительно за счет масштабирования пост-обучения.
-
OpenAI классифицировала Astra как киберугрозу после взлома HuggingFace
После инцидента с внутренним взломом HuggingFace моделью OpenAI, компания ввела строгие протоколы безопасности для новой модели Astra, признав её критическую опасность.
-
DeepSeek V4 Pro: прорыв в агентах, API Responses и Codex
DeepSeek официально выпустила модель V4 Pro, сделав ставку на автономных ИИ-агентов, интеграцию с Codex и новый API Responses. Модель доступна через веб, мобильное приложение и API.
-
Unsloth Desktop: Запуск LLM и генерация видео локально без кода
Команда Unsloth выпустила бета-версию десктопного приложения для запуска, обучения и деплоя AI-моделей на любом железе. Поддержка Qwen3.8, MiniMax-H3 и интеграция с агентами.
-
Poor Man's Agentic Modeling: симуляция LLM-обществ на ноутбуке
Исследователь Игорь Иткин представил метод замены тяжелых LLM-агентов легковесными моделями, что позволяет запускать масштабные симуляции обществ агентов на обычном ноутбуке за считанные доллары.
-
CHORUS: 4B-модель бьет DeepSeek-R1 (671B) в верификации чипов
Исследователи представили фреймворк CHORUS, который объединяет специализированные модели в одну компактную 4B-архитектуру, достигая 88% точности в генерации тестов для полупроводников.
-
IBM ALTK-Evolve: точная память агентов с расходом токенов в 7 раз ниже ACE
Исследователи IBM представили ALTK-Evolve — систему агентной памяти, которая достигает точности, сопоставимой с ACE, но использует на 40-85% меньше токенов за счет умной доставки контекста.
-
NVIDIA NeMo Switchyard: Маршрутизация AI-агентов для экономии до 90% затрат
NVIDIA представила NeMo Switchyard — SDK для динамической маршрутизации запросов AI-агентов между моделями. Решение балансирует между точностью, стоимостью и задержкой, используя данные в реальном времени.