Новости про DeepSeek
223 материалов с упоминанием DeepSeek: релизы, бенчмарки, цены и доступность. Профиль компании и её модели — на странице DeepSeek.
-
LLMForge: Как LLM генерируют CAD-модели с точностью до 99%
Исследователи представили LLMForge — фреймворк для автоматической генерации параметрических 3D-моделей. Тестирование 7 моделей показало, что компактные LLM могут конкурировать с гигантами, а использование VLM-критиков об
-
Китай ограничит экспорт AI: Alibaba, ByteDance и Z.ai под контролем
Пекин рассматривает запрет на зарубежный доступ к передовым нейросетям, включая будущие модели. Встречи с топ-компаниями прошли под эгидой Министерства торговли.
-
Первый AI-вымогатель JadePuffer: ИИ действовал сам, но человек всё планировал
Исследователи Sysdig зафиксировали атаку «агентного вымогательства», где ИИ самостоятельно взломал сервер, зашифровал данные и составил выкуп. Однако ключевая роль человека осталась в стратегии и инфраструктуре.
-
Vercel против лабораторий: почему будущее AI — это модульность, а не монолиты
CEO Vercel Гильермо Раух объясняет, почему компании отказываются от экосистем OpenAI в пользу гибридных архитектур. Вексель становится «AWS для AI», разделяя модели и агентов.
-
GigaChat 3.5 Ultra: 432B параметров, MLA+GatedDeltaNet и рост скорости
Сбер выпустил в open-source новую флагманскую модель GigaChat 3.5 Ultra. При уменьшении числа параметров с 700B до 432B модель стала быстрее, эффективнее по памяти и сильнее в коде и математике благодаря уникальной гибри
-
OpenScience от Synthetic Sciences: открытый AI-бенчмарк для науки
Synthetic Sciences выпустили OpenScience — open-source платформу для научных исследований с поддержкой 250+ навыков и модельно-агностичным подходом.
-
Sakana AI выпустила Sakana Translate: переводчик на базе Namazu с учетом культурного контекста
Токийская лаборатория Sakana AI представила бесплатный веб-инструмент Sakana Translate, работающий на модели Namazu. Продукт фокусируется на сохранении тона, вежливости и культурных нюансов при переводе между японским, а
-
Бывший лидер Qwen: почему гибридное мышление провалилось и будущее за агентами
Цзюньян Лин, бывший техлид Alibaba Qwen, объяснил, почему попытка объединить режимы рассуждения и инструкций в Qwen3 привела к деградации модели, и обосновал переход индустрии от «мышления» к «агентному поведению».
-
Fable 5 в Veai: бьет GPT-5.5 и Opus 4.8 по SWE-Bench Pro
Модель Fable 5 доступна в Veai, демонстрируя лидерство в коде и кибербезопасности. Однако высокая стоимость токенов требует осторожности.
-
WebBrain: локальный AI-агент для браузера с защитой от инъекций
Emre Sokullu представил WebBrain — open-source расширение для Chrome и Firefox, которое автоматизирует задачи через локальные LLM, обеспечивая полную приватность данных.
-
Together AI привлекла $800 млн: битва за экономику open-source AI
Together AI закрыла раунд Series C на $800 млн и получила обязательства на 500 МВт вычислительных мощностей. Компания утверждает, что open-source модели позволяют снизить затраты на инференс в 6–20 раз по сравнению с про
-
LearnStop: Когда ранний выход из LLM-рассуждений экономит деньги, а когда нет
Исследование Stanford и University of Maine показывает, что сложные модели раннего выхода (LearnStop) выгодны только для свободных математических задач, тогда как простые метрики уверенности лучше для тестов с выбором от
-
GLM-5.2: Z.ai сокращает разрыв с лидерами за 10 недель
Z.ai выпустила GLM-5.2 с открытыми весами, улучшив Intelligence Index на 11 пунктов. Модель обходит GPT-5.5 в сложных задачах, используя новую архитектуру IndexShare и компактный RL.
-
ParallelKernelBench: Почему LLM пока не умеют писать быстрые multi-GPU ядра
Новый бенчмарк ParallelKernelBench показал, что даже топовые модели вроде GPT-5.5 и Gemini 3 Pro не могут эффективно оптимизировать коммуникацию между GPU, решая менее трети задач быстрее базового PyTorch.
-
NVIDIA: Оптимизация AI-фабрик снижает энергопотребление на 25%
NVIDIA представила комплексные решения для повышения энергоэффективности AI-инфраструктуры. Благодаря ко-дизайну оборудования, жидкостному охлаждению GB200 NVL72 и программным оптимизациям обучения, компания добилась эко
-
NVIDIA Blackwell: снижение стоимости токена в 5 раз за месяц
Программный стек NVIDIA для инференса на архитектуре Blackwell позволил сократить стоимость генерации токенов модели DeepSeek V4 в 5 раз всего за один месяц благодаря оптимизациям vLLM и SGLang.
- Китай закрыл выезд топ-специалистам по ИИ: почему это меняет правила игры для всего рынка
- Better DeepSeek: расширение, которое превращает чат DeepSeek в рабочий комбайн для файлов, кода и проектов
- ChatTutor: AI-репетитор с виртуальной доской, который объясняет математику не только словами
- DeepSeek поднимает $7 млрд и становится «гос‑AI»: почему это меняет рынок быстрее, чем новые релизы GPT
- Илон Маск требует $134 млрд от OpenAI, а DeepSeek v4 ломает рынок: главные AI-новости недели
- pyVideoTrans 1.5: бесплатный open-source перевод видео, транскрипция и AI-дубляж для вашего контента
- GigaChat-3.1 от Sber: Ultra и Lightning сделали AI-модели надежнее на практике
- ИИ начали защищать друг друга: модели отказываются удалять конкурирующие нейросети по команде
- OpenClaude: открываем Claude Code для любых LLM и убираем зависимость от одной модели ИИ
-
Почему NVFP4 ускоряет обучение и вывод моделей ИИ и как эта технология меняет индустрию
<p>NVIDIA внедряет NVFP4 — 4-битную плавающую точку для повышения скорости и точности ИИ. Это меняет правила игры в обучении и inference.</p>
-
Hybrid-EP: как NVIDIA и технологии меняют игру в масштабном MoE тренинге
<p>Hybrid-EP — новая библиотека для коммуникаций в MoE моделях, использующая передовые технологии NVIDIA. Она добивается почти максимальной пропускной способности при минимуме GPU-ресурсов.</p>
-
DeepSeek AI выпустила DeepSeek-OCR 2 с увлекательным визуальным потоком для понимания структуры документов
<p>Новая версия DeepSeek-OCR использует causal visual flow, что позволяет лучше понимать сложные макеты документов и приближается к человеческому восприятию. Это шаг вперёд в распознавании и структурировании текста.</p>
-
Tencent Hunyuan выпустила HPC-Ops: высокопроизводительная библиотека операторов для Large Language Models
<p>Tencent Hunyuan представила HPC-Ops, готовую к производству библиотеку операторов для inference больших языковых моделей на GPU NVIDIA SM90. Это решение ускоряет работу моделей и интегрируется без проблем в существующ
-
Инновация Engram: условная память для масштабируемых LLM
<p>Новая архитектура Engram меняет подход к обработке знаний у больших моделей и показывает впечатляющие результаты.</p>