Overview of LlamaFactory features
mainLlamaFactory is an open-source platform designed for easy fine-tuning of hundreds of large language models (LLMs) using either a zero-code Command Line Interface (CLI) or a Web UI (LLaMA Board) powered by Gradio.
Key capabilities include:
- Model Support: Wide range of models including LLaMA, LLaVA, Mistral, Mixtral-MoE, Qwen, DeepSeek, Gemma, GLM, Phi, etc.
- Training Methods: Supports (incremental) pre-training, instruction fine-tuning (including multimodal), reward model training, and various RLHF methods like PPO, DPO, KTO, and ORPO.
- Precision Options: Full parameter fine-tuning (16-bit), frozen fine-tuning, LoRA, and QLoRA (supporting 2/3/4/5/6/8-bit quantization via AQLM/AWQ/GPTQ/LLM.int8/HQQ/EETQ).
- Advanced Algorithms: Integration of GaLore, BAdam, APOLLO, Adam-mini, Muon, OFT, DoRA, LongLoRA, LLaMA Pro, Mixture-of-Depths, LoRA+, LoftQ, and PiSSA.
- Optimization & Speed: Supports FlashAttention-2, Unsloth, Liger Kernel, KTransformers, RoPE scaling, NEFTune, and rsLoRA. Inference can be accelerated using vLLM or SGLang.
- Task Versatility: Handles multi-turn dialogue, tool calling, image understanding, visual grounding, video recognition, and speech understanding.
- Experiment Monitoring: Integrates with LlamaBoard, TensorBoard, Wandb, MLflow, and SwanLab.