distributed-llm-pretraining-torchtitan
Обеспечивает распределенное предобучение больших языковых моделей (LLM) на базе PyTorch с использованием torchtitan и 4D-параллелизма (FSDP2, TP, PP, CP). Применяйте при масштабном предобучении Llama 3.1, DeepSeek V3 или пользовательских моделей на 8–512+ GPU с использованием Float8, torch.compile и распределенного сохранения контрольных точек.
Что делает навык
Обеспечивает распределенное предобучение больших языковых моделей (LLM) на базе PyTorch с использованием torchtitan и 4D-параллелизма (FSDP2, TP, PP, CP). Применяйте при масштабном предобучении Llama 3.1, DeepSeek V3 или пользовательских моделей на 8–512+ GPU с использованием Float8, torch.compile и распределенного сохранения контрольных точек.
Как подключить
SKILL.md к навыкам ассистентаНавык — папка с файлом SKILL.md (описание + инструкции) и опциональными скриптами. Ассистент (Claude, Claude Code и совместимые) подхватывает его по описанию и следует шагам.