0.50.2patch
Вышла версия 0.50.2.
Доступные LLM с помощью k-битной квантования для PyTorch.
Библиотека для PyTorch, обеспечивающая доступ к большим языковым моделям (LLM) через k-битное квантование.
Инструмент радикально снижает потребление памяти при инференсе и обучении моделей без потери качества. Он позволяет запускать и дообучать LLM на оборудовании с ограниченными ресурсами, используя методы 8-битного и 4-битного квантования.
👤 Кому подойдёт: Разработчики и исследователи, работающие с PyTorch и нуждающиеся в оптимизации памяти для LLM.
Вышла версия 0.50.2.
Добавлена поддержка NVIDIA RTX Spark (Windows ARM64), AMD CDNA5 и улучшены эвристики GEMM для GB10.
Релиз 0.50.0: ускоренный 4-bit GEMM для CUDA/ROCm, стабильный ROCm, улучшенный Apple Silicon и новые CPU-оптимизаторы.