mirror of
https://github.com/hiyouga/LLaMA-Factory.git
synced 2026-09-26 17:35:43 +08:00
1.5 KiB
1.5 KiB
快速开始
v1 是 LlamaFactory 的实验性架构,通过 USE_V1=1 启用。稳定版(v0)的功能与完整文档见LlamaFactory 文档。
本页是 v1 的快速指南,介绍安装、启用 v1 和运行 SFT。更完整的环境说明见仓库 README。
安装
git clone --depth 1 https://github.com/hiyouga/LlamaFactory.git
cd LlamaFactory
pip install -e .
启用 v1
export USE_V1=1
运行 SFT
仓库提供数据配置 data/v1_sft_demo.yaml 和可运行示例。以下训练配置已经通过 train_dataset 引用该数据配置,可以直接运行:
llamafactory-cli sft examples/v1/train_full/train_full_fsdp2.yaml
检测到多个设备时,CLI 会自动通过 torchrun 重启;单设备需要强制走该入口时可以设置 FORCE_TORCHRUN=1。
选择运行命令
v1 当前支持以下命令:
| 命令 | 用途 |
|---|---|
sft |
监督微调 |
dpo |
偏好优化 |
rm |
奖励模型训练 |
chat |
交互式推理 |
merge |
合并 LoRA adapter 并导出模型 |