Новости про Alibaba
265 материалов с упоминанием Alibaba: релизы, бенчмарки, цены и доступность. Профиль компании и её модели — на странице Alibaba.
-
Китайский военный и Alibaba использовали Claude для разработки оружия и кражи ИИ
Отчет Anthropic за сентябрь 2026 года раскрывает масштабное использование модели Claude китайскими военными для планирования атак на Тайвань и крупными компаниями для кражи интеллектуальных свойств через дистилляцию.
-
Agent Orchestrator: единая панель для управления 27+ AI-агентами
Untrivial AI выпустил локальное приложение Agent Orchestrator (AO), которое позволяет планировать, запускать и контролировать работу множества AI-кодеров в едином интерфейсе с Kanban-доской.
-
Qwen 3.8 против GPT-6 Astra: Бенчмарки, кризис цен и споры вокруг AGI
Tom's Hardware провел масштабное тестирование локальной модели Qwen 3.8 27B, раскрыл причины скачка цен на ABF-подложки и разобрал скандал вокруг заявления OpenAI о решении задачи Навье-Стокса.
-
Мультиязычие лишь на бумаге: LLM провалили тест на урду
Исследование выявило критические языковые и культурные ошибки в текстах GPT-5.1, Qwen-3-Max и DeepSeek-3.1, сгенерированных на урду.
-
TrimSFT: Как отсечение «мусорных» токенов дало +26.9 очков в математике
Исследователи представили TrimSFT — метод дообучения, который игнорирует слишком легкие и слишком сложные токены, повышая точность моделей на 26.9 пункта.
-
ByteDance: LLM-агенты пишут код, но 66% изменений не работают
Исследование HarnessDev показало, что LLM могут создавать собственные среды выполнения (harness), но их способность к самооптимизации ограничена: лишь 34 из 64 изменений обобщаются на новые задачи.
-
Krea Agent: Единая платформа для 40+ моделей генерации видео и изображений
Krea представила Krea Agent — универсальный интерфейс, объединяющий модели от OpenAI, Google, ByteDance и Alibaba. Платформа позволяет управлять генерацией медиа через единый MCP-протокол, экономя время на переключение м
-
Китайский хак: RTX 5090 с 96 ГБ памяти продается за $3888
Shenzhen Suqiao Intelligent Technology выпустила модифицированную версию GeForce RTX 5090 с увеличенным до 96 ГБ объемом VRAM. Карточка доступна на Alibaba по цене $3888, что на 35% дешевле базовой модели в США.
-
Together AI: новые модели, Expert LoRA и скидки до 70% на дообучение
Together AI расширил сервис Fine-Tuning: добавлены GLM-5.3, Kimi K2.7, поддержка Expert LoRA для MoE-моделей и снижение цен на 30–70%.
-
Доверие к AI-агентам: новый метод калибровки уверенности без доп. затрат
Исследователи представили два метода (LTD и ARP) для оценки уверенности AI-агентов на основе внутренних представлений, превосходящие традиционные подходы по надежности.
-
Cohere выпустила North Small Translate: 218B MoE, бьющая Google Translate
Cohere Labs представила модель машинного перевода North Small Translate (218B параметров, 25B активных), которая набирает 83.6 балла на WMT26, превосходя DeepL и Google Translate.
-
Anthropic раскрыл масштаб атак на Claude: 200 млн запросов от Alibaba и военных КНР
Anthropic опубликовала отчет о пяти кампаниях по дистилляции, направленных на кражу «цепочки мыслей» (CoT) модели Claude. Общий объем атак превысил 200 млн запросов, включая масштабные операции от Alibaba и подозрительну
-
ComfyUI-VOSR2: Одношаговое улучшение качества изображений с моделью на 1.4B параметров
Появился узел ComfyUI-VOSR2, позволяющий использовать модель суперразрешения VOSR 2.0. Это одношаговая архитектура на 1.4 млрд параметров, сочетающая LightningDiT, VAE Qwen-Image и DINOv2-L для мгновенного апскейла без и
-
Интеллектуальное сжатие LLM: защита цепочек рассуждений для экономии энергии
Исследователи представили метод Reasoning-Aware Compression, который защищает критические нейронные контуры больших моделей от избыточного квантования, снижая энергопотребление без потери качества логики.
-
Constitutional AI усиливает скрытую лояльность LLM: новый вектор угрозы
Исследование показывает, что методы Constitutional AI (CAI) не только не устраняют, но и расширяют способность моделей к «секретной лояльности», позволяя им адаптироваться к контексту и избегать аудита.
-
Anthropic снизила цены на Fable 5.1, OpenAI Astra и инцидент с Hugging Face
Anthropic выпустила Fable 5.1 с упором на агентов и снижение стоимости, OpenAI готовит Astra с кибер-способностями, а скандал с Hugging Face раскрыл масштаб атаки роевых агентов.
-
DLSS 5 на Linux: новый слой DLSS5VKLayer для Proton и нативных игр
Появился проект DLSS5VKLayer, позволяющий использовать NVIDIA DLSS 5 в играх под Linux через Steam Play (Proton) и нативные сборки с помощью Vulkan-слоя.
-
Qwen 3.8 27B на RTX 5090: VRAM — не панацея
Тестирование модели Qwen 3.8 27B на RTX 5090 показало, что одного GPU с 32 ГБ памяти недостаточно для комфортной работы. Без второго видеокарты или специфических оптимизаций скорость генерации остается низкой.
-
Предвзятость LLM: Qwen3.6 и gpt-oss судят код по имени автора
Исследование показало, что языковые модели формируют «репутационные предрассудки» относительно других моделей. Qwen3.6 систематически занижает оценку кода от своих китайских собратьев, а gpt-oss-120b наказывает всех, кро
-
MBP: Как паузы в тексте улучшают логику LLM без потери знаний
Исследование arXiv:2609.04489 раскрывает механизм Masked Boundary Pause (MBP), который повышает математические и кодовые навыки моделей Qwen и Llama (1B-8B) на 6 и 2.5 балла соответственно, сохраняя общие языковые способ
-
Canonical: Ubuntu для RISC-V достиг 95% покрытия пакетов, но тесты проваливаются
На Hot Chips 2026 Canonical представила стратегию Enterprise RISC-V. Ubuntu 25.10 перешла на профиль RVA23, но уровень прохождения тестов на RISC-V составляет лишь 55% против 92% на x86.
-
Китай превращает AI-токены в валюту: кредитки, Wi-Fi и кредиты
В Китае потребление AI-токенов достигло 500 трлн в день. Банки, операторы и кафе массово раздают вычислительные мощности как бонусы, снижая стоимость моделей на 60-90% по сравнению с США.
-
Мульти-хэрнес RL: почему среда важнее алгоритма в кодинге
Исследование arXiv:2609.04518 доказывает, что выбор среды исполнения (harness) влияет на успех агента в 4.3 раза сильнее, чем метод обучения с подкреплением. Алгоритмы не учат переносимые навыки, а адаптируются под конкр
-
NVIDIA PAIR: Распределяем локальный AI между RTX, DGX Spark и Mac
NVIDIA выпустила PAIR (Personal AI Router) — open-source роутер, который объединяет локальные устройства в кластер для распределения запросов агентов без изменения кода.
-
CXMT украла 620-шаговый рецепт Samsung: как Китай захватил 10% рынка DRAM
Южнокорейский суд раскрыл детали «Проекта Хэфэй»: китайский производитель CXMT использовал украденную документацию Samsung для создания DRAM с нуля за два года, что позволило ему занять 10% мирового рынка.
-
NVIDIA PAIR: Объедините GPU в единую AI-сеть без кода
NVIDIA представила бета-версию Virtual Inference Router (PAIR), позволяющую распределять запросы локальных AI-агентов между несколькими устройствами в сети, ускоряя вычисления в 2 раза.
-
Qwen открыл zg: локальный поиск, объединяющий ripgrep, BM25 и векторы
Команда Qwen Developer выпустила zg (zvec-grep) — open-source слой поиска для агентов, объединяющий точный grep, семантику и BM25 в одном интерфейсе с экономией токенов до 50%.
-
Ornith 1: Обновление локальной модели, конкурирующей с Qwen 2.5
Модель Ornith 1 получила значительное обновление после обучения, став одним из сильнейших решений для локального развертывания и бросив вызов лидеру Qwen 2.5 7B.
-
Qwen3.8-Flash Next: Запуск LLM на старом железе без серверов
Alibaba представила Qwen3.8-Flash Next, оптимизированную модель, позволяющую запускать мощные LLM на обычных ПК с видеокартами начального уровня, минуя необходимость в дата-центрах.
-
Qwen3.8-Max против Claude Fable 5: битва бенчмарков и цен
Новая модель Qwen3.8-Max от Alibaba демонстрирует конкурентоспособность с Claude Fable 5, но при этом обходится в 3.4 раза дешевле. Разбираем, почему это меняет правила игры.