LLaMA-Factory

以下是基于SOURCE_TEXT内容为LLaMA-Factory项目撰写的介绍文章:

LLaMA-Factory项目介绍

LLaMA-Factory是一个功能强大、易于使用的大型语言模型(LLM)微调工具包。它为用户提供了一站式解决方案,支持多种流行的LLM模型、训练方法和数据集,能够满足不同场景下的模型定制需求。

LLaMA-Factory具有以下突出特点:

支持多种主流模型:包括LLaMA、LLaVA、Mistral、Mixtral-MoE、Qwen、Qwen2-VL、Yi、Gemma、Baichuan、ChatGLM、Phi等热门LLM。
集成多种训练方法:支持(持续)预训练、(多模态)监督微调、奖励建模、PPO、DPO、KTO、ORPO等技术。
灵活的资源配置:提供16位全参数微调、冻结微调、LoRA以及2/3/4/5/6/8位量化LoRA(QLoRA)等多种训练模式,可根据硬件资源灵活选择。
先进算法支持:集成了GaLore、BAdam、Adam-mini、DoRA、LongLoRA、LLaMA Pro、Mixture-of-Depths、LoRA+、LoftQ、PiSSA等前沿算法。
实用训练技巧:支持FlashAttention-2、Unsloth、Liger Kernel、RoPE scaling、NEFTune、rsLoRA等提升训练效率的技巧。
实验监控工具:集成了LlamaBoard、TensorBoard、Wandb、MLflow等多种实验监控工具。
高效推理能力:提供OpenAI风格的API、Gradio UI以及基于vLLM的命令行界面,支持快速推理。