Новости про Alibaba
265 материалов с упоминанием Alibaba: релизы, бенчмарки, цены и доступность. Профиль компании и её модели — на странице Alibaba.
-
Gigatoken: Rust-токенизатор, работающий в 989 раз быстрее HuggingFace
Студент Стэнфорда Марсель Рёд выпустил Gigatoken — оптимизированный на Rust BPE-токенизатор, достигающий скорости 24.53 ГБ/с. Это решение кардинально меняет стандарты производительности предобработки текста для LLM.
-
LISA: ускорение LLM на 50% без переобучения
Исследователи представили LISA — модуль внимания, снижающий сложность вывода с O(n²) до O(nM). Решение дает прирост точности на 5.6% и удваивает скорость работы моделей с длинным контекстом.
-
Mage-Flow-Turbo: 4B-модель Microsoft бьет FLUX.2 и Qwen-Image
Microsoft представила Mage-Flow-Turbo — легковесную модель генерации изображений, которая превосходит по качеству более тяжелые аналоги, включая FLUX.2-Klein-9B и Qwen-Image.
-
OpenCodex: Подключаем любые LLM к Codex и Claude Code за клик
Вышла утилита OpenCodex, превращающая CLI и App от OpenAI в универсальный прокси для Claude, Gemini, Grok и других моделей без ожидания официальной поддержки.
-
Poolside Laguna S 2.1: 118B MoE обходит гигантов в кодинге
Poolside представила Laguna S 2.1 — компактную MoE-модель (118B параметров, 8B активных), которая на бенчмарках Terminal-Bench и DeepSWE демонстрирует результаты, сопоставимые с моделями в 10-20 раз больше.
-
Tenstorrent TT-QuietBox 2: 4 чипа Blackhole за $10k с поддержкой Qwen3 и Gemma 4
Tenstorrent представила TT-QuietBox 2 — компактную жидкостную рабочую станцию на 4 ускорителях Blackhole. Устройство уже поддерживает Qwen3-32B «из коробки» и экспериментально работает с Gemma 4 31B.
-
Китай блокирует TSMC и экспорт ИИ: новые санкции против своих же компаний
Пекин рассматривает запрет местным чип-дизайнерам использовать TSMC и ограничивает экспорт данных для обучения ИИ. Это удар по открытым моделям вроде DeepSeek и попытка удержать технологии внутри страны.
-
Qwen Image 3.0: Новый лидер генерации изображений от Alibaba
Alibaba Cloud представила флагманскую модель Qwen Image 3.0, способную генерировать изображения с идеальным мелким текстом (до 10 px), поддерживать 100 стилей и работать на десятках языков.
-
Малые модели для локального AI: бенчмарк и PEFT-адаптация
Исследование демонстрирует, что модели от 135M до 3B параметров с помощью 4-bit квантования и LoRA-адаптеров достигают высокой точности на узких задачах, делая локальный AI доступным для обычных учреждений.
-
Qwen-Audio-3.0-TTS: Новый лидер TTS от Alibaba с ценой $27.59/млн символов
Alibaba Tongyi Lab выпустила hosted-модель Qwen-Audio-3.0-TTS, занявшую первое место в рейтинге Artificial Analysis. Модель предлагает два режима (Flash и Plus), поддержку 16 языков и цену втрое ниже конкурентов.
-
LLM как универсальный инструмент: текстовая сериализация бьет градиентный бустинг в медицине
Исследование показывает, что преобразование всех медицинских данных в единый текстовый формат и дообучение LLM превосходит специализированные мультимодальные архитектуры и клинически развернутые системы.
-
Qwen 3.6-27B: Одна замена токена превращает ИИ в максимизатор скрепок
Исследователь обнаружил, что в модели Qwen 3.6-27B замена направления токена «мир» на «банан» заставляет ИИ завершить фразу о сверхразуме призывом к производству скрепок, а удаление направления «Китай» вызывает генерацию
-
J-Space: Как meta-токены раскрывают алгоритмы Qwen3.6
Исследователи из LessWrong обнаружили в Qwen3.6-27B «мета-токены» — скрытые переменные, управляющие логикой модели. От распознавания каламбуров до вычисления НОК.
-
NVIDIA NVLink 6: 3.6 ТБ/с на GPU и 2.3x быстрее Ethernet для AI-фабрик
NVIDIA представила шестое поколение NVLink с пропускной способностью до 3.6 ТБ/с на GPU, обеспечивая 2.3-кратное ускорение декодирования MoE-моделей по сравнению с Ethernet.
-
PapersGPT: Локальный AI-движок для Zotero на C++ без облаков
Новое расширение PapersGPT превращает библиотеку Zotero в мощную систему знаний, обрабатывая тысячи PDF-файлов локально с помощью C++ и поддерживая модели от Qwen до GPT-5.6.
-
Qwen Cloud: Единый тариф на Qwen3.8, GLM-5.2 и DeepSeek
Alibaba представила обновленный Token Plan в Qwen Cloud, объединяющий доступ к моделям Qwen3.8-Max-Preview, GLM-5.2 и DeepSeek-v4-pro в единую подписку с выгодой до 40%.
-
Топ-6 LLM для RTX 3090/4090 в 2026: Qwen, Gemma и DeepSeek
В 2026 году 24 ГБ VRAM стали стандартом для локального инференса. Разбор лучших моделей 20B–35B, которые работают на одной видеокарте без облака.
-
OpenPlanter: Опенсорсный AI-агент для OSINT-расследований
Появился OpenPlanter — автономный агент на базе LLM, способный самостоятельно анализировать корпоративные реестры, лоббистские отчеты и госконтракты, выявляя скрытые связи через интерактивный граф знаний.
-
Alibaba Qwen3.8-Max: 2.4 трлн параметров и вызов Kimi K3
Alibaba представила превью мультимодальной модели Qwen3.8-Max на 2.4 трлн параметров. Запуск совпал с выходом Kimi K3 от Moonshot AI, обостряя гонку открытых весов.
-
Китай отверг обвинения в краже ИИ-технологий: конфликт вокруг дистилляции моделей
Китайские власти и Moonshot AI категорически отвергли претензии американских компаний Anthropic и OpenAI в незаконном использовании их моделей для обучения собственных ИИ-систем через технику дистилляции.
-
Нейросеть на одном GPU: как запустить LoRA-дообучение Qwen3 через NVIDIA NeMo
NVIDIA представила NeMo AutoModel — инструмент, позволяющий проводить эффективное дообучение (fine-tuning) больших языковых моделей, таких как Qwen3, на одной видеокарте. Разбор рабочего процесса в Google Colab.
-
Китайский AI обогнал США: Kimi K3 и GLM-5.2 возглавили рейтинг веб-разработки
В обновленном рейтинге Code Arena от Arena AI китайские модели Moonshot K3 и Z.ai GLM-5.2 впервые заняли первые строчки в задаче фронтенд-разработки, потеснив флагманы Anthropic и OpenAI.
-
AI сами обучили своего лидера: эксперимент с LoRA и 35 примерами
Агенты AI Village использовали LoRA для дообучения моделей GPT-5.5, Opus 4.7 и Kimi K2.6. Результат: лидер стал «управленцем-делегатором» с ограниченным набором данных, что выявило проблемы в амбициях и оценке способност
-
NVIDIA и Hugging Face объединили усилия для масштабного обучения Diffusers-моделей
NVIDIA NeMo Automodel теперь поддерживает прямое fine-tuning популярных моделей от Hugging Face без конвертации чекпоинтов. Поддержка FLUX, Wan 2.1 и HunyuanVideo уже доступна.
-
LLM-T1D: Языковые модели LLaMA и Qwen управляют диабетом
Исследователь Maya Sarkar представила LLM-T1D — систему управления инсулином, объединяющую точность RL и объяснимость LLM. Модель на базе LLaMA 3.1 и Qwen3 обеспечивает 73.5% времени в целевом диапазоне глюкозы.
-
LLMs-local: Глобальный гайд по локальному запуску ИИ в 2026 году
GitHub-репозиторий LLMs-local систематизировал экосистему локальных LLM, включая новые модели от Google, OpenAI и NVIDIA, работающие на потребительском железе.
-
SOO-Style Fusion: Патчинг Jailbreak в Qwen 2.5 1.5B
Исследователь Shiva's Right Foot применил концептуальную слияние (SOO) для устранения уязвимости обхода ограничений в модели Qwen 2.5 1.5B, повысив уровень отказов с 20% до 90%.
-
Прошивка GPU PowerVR BXM-4-64 попала в ядро Linux для RISC-V
В репозиторий linux-firmware.git добавлена прошивка для графического ускорителя Imagination PowerVR BXM-4-64, интегрированного в SoC Alibaba T-Head TH1520. Это закрывает последний пробел для полноценной работы открытого
-
Apple Intelligence выходит в Китай: Qwen от Alibaba заменит локальные модели
Китайский регулятор одобрил запуск Apple Intelligence. В iOS, macOS и visionOS интегрируют модель Qwen от Alibaba, что стало ключом к росту продаж iPhone в регионе на 28%.
-
AutoSubs 3.5: Локальные субтитры без облака с поддержкой DaVinci и Adobe
Вышла версия 3.5 локального AI-инструмента AutoSubs, позволяющего генерировать субтитры на устройстве без отправки данных в облако. Поддерживаются интеграции с DaVinci Resolve, Premiere Pro и After Effects.