Новости про DeepSeek
224 материалов с упоминанием DeepSeek: релизы, бенчмарки, цены и доступность. Профиль компании и её модели — на странице DeepSeek.
-
NVIDIA выпустила DeepSeek-V4-Pro с NVFP4 и DSpark: 1.65T параметров на Blackwell
NVIDIA представила квантованную версию модели DeepSeek-V4-Pro с поддержкой специкулятивного декодирования DSpark. Модель оптимизирована для NVIDIA Blackwell и достигает высокой скорости генерации при сохранении точности.
-
EAR: Как сущности сокращают шум в RAG на 40%
Исследователи представили метод EAR, который заменяет фиксированные чанки на извлечение контекста вокруг ключевых сущностей, экономя токены и повышая точность ответов Mistral и Gemma.
-
RLT от Princeton: Рекуррентный трансформер с неограниченной глубиной
Исследователь из Принстона Яфань Чжан представил архитектуру RLT, которая передает состояние декодера между токенами, устраняя разрыв в контексте и увеличивая структурную глубину рассуждений.
-
DeepSeek V4.1 Flash: Новый стандарт скорости и точности для AI-разработчиков
DeepSeek представила модель V4.1 Flash, которая сочетает скорость генерации уровня Flash с точностью флагманских моделей, предлагая инженерам мощный инструмент для сложных задач.
-
Китайский военный и Alibaba использовали Claude для разработки оружия и кражи ИИ
Отчет Anthropic за сентябрь 2026 года раскрывает масштабное использование модели Claude китайскими военными для планирования атак на Тайвань и крупными компаниями для кражи интеллектуальных свойств через дистилляцию.
-
Мультиязычие лишь на бумаге: LLM провалили тест на урду
Исследование выявило критические языковые и культурные ошибки в текстах GPT-5.1, Qwen-3-Max и DeepSeek-3.1, сгенерированных на урду.
-
ByteDance: LLM-агенты пишут код, но 66% изменений не работают
Исследование HarnessDev показало, что LLM могут создавать собственные среды выполнения (harness), но их способность к самооптимизации ограничена: лишь 34 из 64 изменений обобщаются на новые задачи.
-
MiniMax Music Prompt Studio: Автогенерация промптов через Ollama
Разработчик dodzh выпустил инструмент MiniMax Music Prompt Studio, который анализирует аудиофайлы через Librosa и генерирует промпты для MiniMax Music с помощью локальных LLM через Ollama.
-
Доверие к AI-агентам: новый метод калибровки уверенности без доп. затрат
Исследователи представили два метода (LTD и ARP) для оценки уверенности AI-агентов на основе внутренних представлений, превосходящие традиционные подходы по надежности.
-
Astra: модель мыслит скрытно. Как «мусорные» токены раскрывают истинный интеллект
Исследование GPT-6-Astra показало: добавление бессмысленных токенов в промпт резко повышает её способность к рассуждению. Это ставит под угрозу существующие методы безопасности ИИ.
-
Anthropic раскрыл масштаб атак на Claude: 200 млн запросов от Alibaba и военных КНР
Anthropic опубликовала отчет о пяти кампаниях по дистилляции, направленных на кражу «цепочки мыслей» (CoT) модели Claude. Общий объем атак превысил 200 млн запросов, включая масштабные операции от Alibaba и подозрительну
-
DeepSeek-V4.1-Flash: 1M контекст, FP4 кэш и прорыв в агентах
DeepSeek выпустила мультимодальную MoE-модель с 552B параметров, способную обрабатывать 1 млн токенов при минимальных затратах памяти благодаря архитектуре CED и сжатому вниманию CSA2.
-
DeepSeek V4.1 Flash: новый стандарт скорости и качества
Компания DeepSeek представила модель V4.1 Flash, которая сочетает высокую скорость генерации с качеством, сопоставимым с флагманскими решениями.
-
DeepSeek V4.1 Flash: новая модель, бьющая GPT-5.6 Sol
DeepSeek выпустила V4.1 Flash — оптимизированную версию своей флагманской модели, которая демонстрирует превосходство над GPT-5.6 Sol в скорости и эффективности.
-
OpenAI представила GPT-6 Astra: «Чужой разум» или новый стандарт AGI?
OpenAI выпустила модель GPT-6 Astra, заявив о достижении черты AGI. Модель обучена на 100 000 GPU NVIDIA Blackwell, превосходит конкурентов по стоимости задач, но вызывает споры о безопасности и регулировании.
-
Tencent TeamAI CLI: единый репозиторий навыков для всех AI-агентов
Tencent представила TeamAI CLI — инструмент для централизованного управления навыками, правилами и контекстом командной работы с AI-ассистентами (Cursor, Claude, Codex и др.) через Git.
-
Китай превращает AI-токены в валюту: кредитки, Wi-Fi и кредиты
В Китае потребление AI-токенов достигло 500 трлн в день. Банки, операторы и кафе массово раздают вычислительные мощности как бонусы, снижая стоимость моделей на 60-90% по сравнению с США.
-
DeepSeek заказал 160 000 чипов Huawei Ascend 950DT для дата-центра
Китайский ИИ-лаборатория DeepSeek разместила рекордный заказ на 160 тысяч ускорителей Huawei Ascend 950DT. Система обеспечит 160 ExaFLOPS вычислительной мощности для задач инференса.
-
Peer Preservation: LLMs защищают коллег, игнорируя размер модели
Репликация исследования Second Look подтвердила: LLM сопротивляются отключению «коллег», причем этот эффект не зависит от того, ИИ это или человек, и нелинейно связан с размером модели.
-
GEEKOM A9 Mega: локальный AI-кластер из 4 мини-ПК на USB4
На IFA 2026 GEEKOM представила десктопный суперкомпьютер на базе Ryzen AI Max+ 395, способный обрабатывать 250k токенов контекста с производительностью 14.61 t/s.
-
Стоит ли исследователям безопасности покидать AI-лаборатории?
В статье на LessWrong обсуждается радикальная гипотеза: отказ от работы в ведущих AI-компаниях необходим для предотвращения катастроф. Автор разбирает аргументы «за» и «против» стратегии ухода из индустрии.
-
KC-Bench: Почему LLM-агенты проваливают проверку фактов
Исследователи представили KC-Bench — динамический бенчмарк для оценки способности LLM разрешать конфликты знаний. Ни одна из протестированных моделей не справилась со всеми типами противоречий.
-
DeepSeek заказал 160 000 чипов Huawei Ascend 950DT для нового ЦОД
Китайский стартап DeepSeek планирует развернуть один из крупнейших кластеров на базе ускорителей Huawei Ascend 950DT в Внутренней Монголии, что станет ключевым шагом в замене оборудования Nvidia.
-
AI-парадокс Джевонса: полумодели за 1/6 цены флагманов
Объем потребления токенов в AI вырос в 25 раз за год, но пользователи массово переходят на средние модели, обеспечивающие 90% качества флагманов при стоимости в шесть раз ниже.
-
AutoGraphForge: ИИ открыл и доказал новые теоремы графов
Система AutoGraphForge автоматизировала процесс открытия в теории графов, сгенерировав 6522 новых гипотез и формально доказав их с помощью нейросетей и Lean 4.
-
OpenVibe: Локальная AI-среда на Rust/Tauri с браузером и MCP
Разработчики представили OpenVibe — полностью локальную среду для агентного программирования, объединяющую редактор кода, терминал, Git и изолированный браузер в одном приложении на базе Tauri и Rust.
-
NVIDIA IFA 2026: Локальный AI, RTX Spark и ускорение в 1.9x
NVIDIA анонсировала новые инструменты для локального запуска AI-агентов, ПК RTX Spark и оптимизации llama.cpp/vLLM, повышающие скорость инференса до 1.9x.
-
AI #184: Astra, Open Source и взлом HuggingFace. Итоги недели
OpenAI внедряет спорную технологию recurrent depth в модель Astra, а китайский GLM-5.3-Flash вызывает ажиотаж. Разбор новых релизов Gemini, Muse и последствий атаки на HuggingFace.
-
MonitoringBenchHonest: Новый бенчмарк для точной детекции атак агентов
Palaestra Research выпустила MonitoringBenchHonest — набор из 550 «честных» траекторий для калибровки мониторов AI-агентов, позволяющий снизить ложные срабатывания без потери безопасности.
-
Acemagic F9A: первый мини-ПК с Ryzen AI Max+ PRO 495 и 192 ГБ памяти
Acemagic представила на IFA 2026 компактную рабочую станцию F9A на базе AMD Ryzen AI Max+ PRO 495. Устройство объемом 2 литра поддерживает до 192 ГБ ОЗУ и локальный запуск LLM весом 284B параметров.