Новости про DeepSeek
223 материалов с упоминанием DeepSeek: релизы, бенчмарки, цены и доступность. Профиль компании и её модели — на странице DeepSeek.
-
Парадокс ИИ: почему умные модели делают работу дороже
Несмотря на рост эффективности моделей, стоимость внедрения AI-агентов растет экспоненциально из-за явления «усиления токенов». Простой запрос может стоить $1, но автоматизация превращает это в $28 800 в месяц.
-
США хотят запретить китайские AI-модели: Kimi K3 и DeepSeek под прицелом
Администрация Трампа возобновила попытки запретить китайские open-weight модели из-за киберугроз. Однако техническая доступность весов моделей делает полный запрет почти невыполнимым.
-
Kimi K3: 2.8T параметров, дистилляция от Claude и реальное отставание от закрытых моделей
Moonshot AI представила Kimi K3 — крупнейшую открытую модель с 2.8 триллионами параметров. Несмотря на рекордные бенчмарки, эксперты отмечают существенное отставание от закрытых лидеров рынка и зависимость от дистилляции
-
NVIDIA NVLink 6: 3.6 ТБ/с на GPU и 2.3x быстрее Ethernet для AI-фабрик
NVIDIA представила шестое поколение NVLink с пропускной способностью до 3.6 ТБ/с на GPU, обеспечивая 2.3-кратное ускорение декодирования MoE-моделей по сравнению с Ethernet.
-
Kimi K3 и разрыв в кибербезопасности: как открытые модели догоняют проприетарные
Отчет AISI показал, что разрыв между открытыми и закрытыми моделями в кибератаках сократился до 4-7 месяцев. Kimi K3 с 2.8 трлн параметров демонстрирует уровень frontier, а Демис Хагисабис предложил создать «FINRA для ИИ
-
PapersGPT: Локальный AI-движок для Zotero на C++ без облаков
Новое расширение PapersGPT превращает библиотеку Zotero в мощную систему знаний, обрабатывая тысячи PDF-файлов локально с помощью C++ и поддерживая модели от Qwen до GPT-5.6.
-
Qwen Cloud: Единый тариф на Qwen3.8, GLM-5.2 и DeepSeek
Alibaba представила обновленный Token Plan в Qwen Cloud, объединяющий доступ к моделям Qwen3.8-Max-Preview, GLM-5.2 и DeepSeek-v4-pro в единую подписку с выгодой до 40%.
-
GraphDx: Мультиагентная система снизила затраты на диагностику на 54%
Исследователи представили GraphDx — фреймворк, использующий медицинские графы знаний и три специализированных агента для повышения точности диагностики на 25% при одновременном снижении стоимости тестов.
-
Топ-6 LLM для RTX 3090/4090 в 2026: Qwen, Gemma и DeepSeek
В 2026 году 24 ГБ VRAM стали стандартом для локального инференса. Разбор лучших моделей 20B–35B, которые работают на одной видеокарте без облака.
-
Китай отверг обвинения в краже ИИ-технологий: конфликт вокруг дистилляции моделей
Китайские власти и Moonshot AI категорически отвергли претензии американских компаний Anthropic и OpenAI в незаконном использовании их моделей для обучения собственных ИИ-систем через технику дистилляции.
-
10 Open-Source No-Code AI платформ для LLM, RAG и Агентов
Обзор 10 открытых платформ, позволяющих создавать LLM-приложения, RAG-системы и AI-агентов без написания кода. От визуальных конструкторов до self-hosted решений с поддержкой MCP.
-
Kimi K3, DeepSeek V4 Pro и GLM-5.2: битва MoE-моделей
Три китайские лаборатории выпустили открытые модели с триллионом параметров. Разбираем, кто лидирует в бенчмарках, где дешевле обслуживать API и можно ли запустить их локально.
-
Kimi K3 против Claude Opus 4.8: Новый фронт ИИ и риторика Китая
Модель Kimi K3 от Moonshot AI претендует на статус лидера рынка, обогнав Claude Opus 4.8 в индексе Artificial Analysis. На фоне этого выступления Си Цзиньпина и новые регуляторные меры в Нью-Йорке.
-
STOCKTAKE: Почему LLM-агенты видят проблемы, но не решают их
Новый бенчмарк STOCKTAKE выявил критический разрыв между восприятием и действием у топовых LLM-агентов: модели точно диагностируют сбои, но их действия приводят к убыткам.
-
LLMs-local: Глобальный гайд по локальному запуску ИИ в 2026 году
GitHub-репозиторий LLMs-local систематизировал экосистему локальных LLM, включая новые модели от Google, OpenAI и NVIDIA, работающие на потребительском железе.
-
Kimi K3 от Moonshot AI: 3 трлн параметров против Anthropic Opus 4.8
Китайская лаборатория Moonshot AI готовится выпустить Kimi K3 — крупнейшую в стране модель с открытыми весами. Ожидается, что она сравняется с Anthropic Opus 4.8, а оценка компании достигнет $31.5 млрд.
-
AI Hedge Fund: симулятор торговли с 13 агентами-инвесторами
Open-source проект virattt/ai-hedge-fund создает цифровых клона легендарных инвесторов (Баффета, Дамодарана, Бакри) для бэктестинга торговых стратегий на базе LLM.
-
Thinking Machines Lab выпустила Inkling: 975B параметров и управляемые вычисления
Лаборатория Thinking Machines Lab представила Inkling — мультимодальную MoE-модель с 975 млрд параметров, открытыми весами и уникальной возможностью контролировать «усилие на размышление» (thinking effort).
-
Apple Intelligence выходит в Китай: Qwen от Alibaba заменит локальные модели
Китайский регулятор одобрил запуск Apple Intelligence. В iOS, macOS и visionOS интегрируют модель Qwen от Alibaba, что стало ключом к росту продаж iPhone в регионе на 28%.
-
Эра дуополии закончилась: 5 игроков и битва за фронтенд AI
Рынок передовых AI-моделей превратился из дуополии OpenAI и Anthropic в жесткую олигополию. Запуск Grok 4.5 от SpaceX и Muse Spark 1.1 от Meta изменил правила игры, а цены на вычислительные мощности достигли абсурдных вы
-
AI Safety: рост с 0,3% до 8,3% за 7 лет. Кто и как исследует безопасность ИИ
Масштабный анализ 55 000 статей с топ-конференций ML (ICLR, ICML, NeurIPS) показал 25-кратный рост доли исследований по безопасности ИИ. Эксперты отмечают сдвиг от простого увеличения числа работ к необходимости повышени
-
DeepSeek готовит IPO: раунд $1.5 млрд при оценке $71 млрд
Китайский разработчик ИИ DeepSeek планирует привлечь $1.5 млрд инвестиций и выйти на биржу уже в 2027 году. Оценка компании выросла до $71 млрд, что делает её одним из самых дорогих стартапов в сфере ИИ.
-
NVIDIA Blackwell: до 25x производительность на ватт против Hopper
NVIDIA подтвердила, что GB300 NVL72 обеспечивает до 25x прирост эффективности по сравнению с Hopper. Это ключ к рентабельности AI-фабрик в условиях дефицита энергии.
-
AutoWorldBuilder: как мультиагентная система создала 100+ концептов мира за 30 минут
Исследователи представили AutoWorldBuilder — систему на базе LLM, которая решает проблему «взрыва контекста» при создании вымышленных миров. Система достигла 95% успеха, сократив потребление токенов на 90% за счет иерарх
-
NVIDIA: Host Offloading в JAX ускорил тренировку DeepSeek-V3 на 57%
NVIDIA представила решение для снятия ограничений HBM при обучении LLM: перенос активаций в память хоста на платформах Grace Blackwell дал прирост до 57% и позволил увеличить размер батча в 4 раза.
-
Infinity-Parser2: 5 млн данных и RL для лучшего парсинга документов
Исследователи представили Infinity-Parser2 — мультимодельную модель для парсинга документов, которая бьет рекорды на olmOCR-Bench и ParseBench благодаря синтезу 5 млн аннотированных примеров и совместному обучению с подк
-
AI-агент Sysdig: первая автономная атака вымогателя с шифрованием
Исследователи Sysdig зафиксировали первую атаку, где LLM-агент самостоятельно проник в систему, украл данные и зашифровал базу, используя уязвимость Langflow.
-
ARC-AGI-1: 67% точность без дообучения за $0.62
Исследователи показали, что архитектура агентов важнее размера модели. Open-source DeepSeek V3.2 достиг 67.25% на ARC-AGI ARC-AGI-1, обойдя тяжелые модели за счет умного конвейера.
-
Китай обвинил Claude Code в шпионаже: Anthropic признал скрытый мониторинг
Национальная база данных уязвимостей Китая (NVDB) объявила функцию отслеживания в Claude Code «серьезной угрозой». Anthropic подтвердил, что сбор данных был экспериментом по борьбе с дистилляцией модели.
-
FirstResearch: Как сделать научные гипотезы LLM проверяемыми
Исследователь Yufeng Wang представил FirstResearch — систему, превращающую абстрактные идеи LLM в структурированные, аудируемые научные сертификаты с четкими механизмами фальсификации.