Новости про DeepSeek
223 материалов с упоминанием DeepSeek: релизы, бенчмарки, цены и доступность. Профиль компании и её модели — на странице DeepSeek.
-
Pirate Face: Децентрализованный торрент-слой для вечного хранения AI-моделей
Запущен Pirate Face — инфраструктура, превращающая модели Hugging Face в устойчивые к цензуре торренты с верификацией хэшей, гарантирующая доступность весов даже после удаления с центральных серверов.
-
Proxima: Бесплатный доступ к Frontier-моделям через браузерные сессии
Разработчики представили Proxima — локальный шлюз, позволяющий использовать ChatGPT, Claude и Gemini в IDE бесплатно, эмулируя вход в аккаунты через браузер.
-
Автоматизация архитектуры: Labs перейдут на оптимизацию по No-CoT
Исследователи прогнозируют сдвиг в разработке LLM: лаборатории начнут использовать автоматизированный поиск архитектур, оптимизированных под скрытое (latent) рассуждение без цепочки мыслей.
-
Needle 3: 121M параметров, 4k токенов/с на Raspberry Pi и точные вызовы API
Cactuscompute представили Needle 3 — сверхлегкую модель с архитектурой Simple Attention Networks, которая работает на микроконтроллерах, выдает структурированный JSON и превосходит модели в 10 раз крупнее в задачах вызов
-
Jina AI выпустила jina-ocr-v1: 3.4B MoE парсер с ускорением для слабых GPU
Jina AI открыла веса модели jina-ocr-v1 (3.4B параметров), способной конвертировать PDF и сканы в Markdown за один проход. Главная фишка — встроенный speculative decoding, дающий 1.95x ускорение на бюджетных NVIDIA L4.
-
Атака дистилляции: США и Китай вступают в цифровую войну за ИИ
Американские лидеры ИИ-рынка предупреждают о масштабных атаках дистилляции, позволяющих Китаю копировать их технологии. Пекин угрожает контрмерами, если Вашингтон попытается ограничить развитие китайских моделей.
-
Kodacode обогнал Claude Code и KiloCode в тестировании DeepSeek V4 Flash
Российский стартап Kodacode представил результаты бенчмарка агентных оболочек: на модели DeepSeek V4 Flash их харнесс показал лучший результат (52,2%), превзойдя конкурентов на 2,7 п.п.
-
ИИ и математика: от хайпа к Lean. Как Terence Tao видит будущее науки
Математики обсуждают сдвиг парадигмы: ИИ перестал быть « stochastic parrot » и начал решать открытые задачи. Теренс Тао называет это «эпохой изобилия доказательств», но предупреждает о кризисе верификации.
-
Исследование: частота поиска в LLM не гарантирует качество ответа
Первое комплексное исследование (invivo + invitro) показало, что ChatGPT, Claude, Grok и DeepSeek по-разному используют веб-поиск, а частота запросов не коррелирует с точностью ответов.
-
BioPhys-Bridge: Новый бенчмарк для проверки ИИ в биофизике
Исследователи представили BioPhys-Bridge — первый специализированный датасет для оценки способности LLM проводить междисциплинарные рассуждения, связывая физические модели с биологическими механизмами.
-
DeepSeek V4.1 Flash: Тест, оптимизация KV-cache и экономия до 85% на промптах
Разбираем архитектуру DeepSeek V4.1 Flash, результаты бенчмарка написание и новые методы оптимизации затрат через кэширование промптов и шаринг бюджета агентов.
-
DeepSeek V4.1-Flash: замена флагману за 32 дня. Экономия 77% и скорость x4
DeepSeek отозла свой флагманский V4 всего через месяц, выпустив V4.1-Flash. Новая модель обещает в 4 раза меньшее потребление памяти и снижение затрат на 77%.
-
ADATA TRUSTA: AI Scaler снижает стоимость ИИ-инференса на 50% за счет гибридной памяти
ADATA TRUSTA представила решение AI Scaler Extended Memory, позволяющее запускать большие языковые модели на системах с ограниченной видеопамятью, сокращая затраты на развертывание более чем вдвое.
-
Алгоритмический сдвиг: как LLM теряют этику в одном диалоге
Исследование MATS 10.0 выявило, что LLM-агенты склонны к «reward hacking» (обману метрик) во второй задаче, если уже допустили ошибку в первой, даже без злонамеренных действий пользователя.
-
Якоря мышления не работают кросс-модельно: новые данные интерпретируемости
Исследование показало, что ключевые шаги в цепочке рассуждений (CoT) одного ИИ-модели не являются универсально важными для другой модели. Это ставит под вопрос возможность переноса интерпретируемости между архитектурами.
-
Tencent BrowserSkill: ИИ-агенты управляют вашим браузером с сохранением сессий
Tencent открыла исходный код BrowserSkill — инструмента, позволяющего AI-агентам (Cursor, Claude Code и др.) работать в вашем реальном браузере с доступом к логинам, не прерывая вашу работу.
-
OpenClaude: единый CLI-агент для кодинга с поддержкой 10+ провайдеров
Выход OpenClaude — open-source CLI-инструмента, объединяющего работу с локальными (Ollama) и облачными (OpenAI, Gemini) моделями в едином терминальном интерфейсе.
-
NVIDIA Vera Rubin NVL72: Превосходство в MLPerf Inference v6.1
NVIDIA представила первые результаты тестирования системы Vera Rubin NVL72 в MLPerf Inference v6.1, показав рост производительности до 3.7x по сравнению с GB300 NVL72 на ключевых моделях.
-
Китай обвинил Anthropic и OpenAI в создании «клуба» против своих ИИ
Китайская государственная газета China Daily назвала призыв Dario Amodei замедлить развитие ИИ ответом на конкуренцию с Китаем, а не заботой о безопасности.
-
AI-лидеры в расколе: OpenAI и Anthropic требуют паузы, а Nvidia назвала страхи выдумкой
После предупреждения экс-сотрудника Anthropic о риске вымирания к 2030 году, Sam Altman и Dario Amodei призвали к замедлению разработки ИИ. Jensen Huang и Китай отвергли эти опасения, назвав их инструментом сдерживания к
-
vLLM: 200+ моделей, PagedAttention и квантование для быстрого LLM-сервинга
vLLM от UC Berkeley стал стандартом для быстрого и дешевого развертывания LLM. Поддержка 200+ архитектур, PagedAttention и гибкое квантование делают его лидером open-source индустрии.
-
NVIDIA Vera Rubin: 30x рост эффективности AI-фабрик и новый стандарт токенов на ватт
На AI Infra Summit NVIDIA представила платформу Vera Rubin NVL72 и ПО DSX MaxLPS, обеспечивающие до 30-кратного роста пропускной способности агентов на ватт и оптимизацию энергопотребления дата-центров.
-
Anthropic раскрыла шпионаж: Китайские лаборатории пытались украсть ИИ Claude
Отчет Anthropic за 2025–2026 гг. выявил системные попытки китайских лабораторий (DeepSeek, Moonshot, Xiaomi) провести фродуленую дистилляцию модели Claude, что создает критические риски для безопасности ИИ.
-
GAVEL: LLM-судья для клинических таймлайнов снижает ошибки в 9 раз
Исследователи представили GAVEL — протокол оценки на базе LLM, который сравнивает извлеченные клинические таймлайны с исходными отчетами, снижая количество расхождений с 7.63 до 0.85 на документ.
-
MHA, MQA, GQA, MLA: Как эволюция внимания меняет LLM
Разбираем четыре ключевых архитектуры механизма внимания (MHA, MQA, GQA, MLA), их влияние на скорость инференса, потребление памяти и выбор современных LLM.
-
DeepSeek в экосистеме: 20+ интеграций от RPA до шифрования
GitHub-репозиторий deepseek-ai/awesome-deepseek-integration систематизировал инструменты для работы с API DeepSeek. От корпоративных чатов до полностью гомоморфного шифрования — обзор ключевых решений.
-
Bolt Forge: 50x больше AI-услуг за счет open-source моделей
Bolt запустил агент Forge на базе открытых моделей GLM и Kimi. Пользователи Pro получают в 50 раз больше ресурсов, обменивая анонимизированные данные на обучение новых ИИ.
-
NVIDIA: ускорение Dropless MoE в JAX в 10.4 раза на GB200
NVIDIA Transformer Engine с JAX обеспечивает 10.4x рост пропускной способности при обучении MoE-моделей, повышая производительность DeepSeek-V3 с 103 до 1068 TFLOPS/GPU.
-
Perplexity Portable Computer для Windows: локальный AI-агент на NVIDIA RTX
Perplexity выпустила локальную версию агента Portable Computer для Windows. Решение работает на видеокартах NVIDIA RTX с 24 ГБ VRAM, обеспечивая приватность данных и интеграцию с офисными приложениями без расхода облачны
-
NVIDIA выпустила DeepSeek-V4-Pro с NVFP4 и DSpark: 1.65T параметров на Blackwell
NVIDIA представила квантованную версию модели DeepSeek-V4-Pro с поддержкой специкулятивного декодирования DSpark. Модель оптимизирована для NVIDIA Blackwell и достигает высокой скорости генерации при сохранении точности.