LlamaFactory: Unified Efficient Fine-Tuning of 100+ Language Models

Yaowei Zheng, Richong Zhang, Junhao Zhang, Yanhan Ye, Zheyan Luo, Yongqiang Ma

arXiv:2403.13372 · 2026-07-27 공개 · arXiv · PDF

llm language-modeling text-generation unified-framework llama-board llamafactory efficient-finetuning web-ui

Abstract

Efficient fine-tuning is vital for adapting large language models (LLMs) to downstream tasks. However, it requires non-trivial efforts to implement these methods on different models. We present LlamaFactory, a unified framework that integrates a suite of cutting-edge efficient training methods. It provides a solution for flexibly customizing the fine-tuning of 100+ LLMs without the need for coding through the built-in web UI LlamaBoard. We empirically validate the efficiency and effectiveness of our framework on language modeling and text generation tasks. It has been released at https://github.com/hiyouga/LLaMA-Factory and received over 25,000 stars and 3,000 forks.

한국어 요약

한 줄 요약

LlamaFactory는 100개 이상의 언어 모델을 코드 없이 맞춤형으로 미세 조정할 수 있는 통합 프레임워크로, 다양한 효율적 학습 기법을 지원한다.

핵심 기여도

핵심 아이디어

LlamaFactory는 기존의 효율적 학습 기법을 하나의 프레임워크로 통합하여, 다양한 모델과 데이터셋에 대한 반복적인 구현 작업을 줄이는 것을 목표로 한다. 이는 Model Loader를 통해 사전 학습된 모델의 특정 레이어에 어댑터를 부착하고, Data Worker를 통해 데이터셋의 열을 정렬하여 처리하며, Trainer를 통해 다양한 학습 방법을 플러그 앤 플레이 방식으로 적용할 수 있도록 설계되었다. 특히, RoPE 스케일링 계수를 최대 입력 길이와 모델 컨텍스트 길이의 비율로 계산하는 방식은 모델의 확장성을 높이는 핵심 아이디어 중 하나이다.

기술적 접근법

주요 결과

의의 및 한계

LlamaFactory는 다양한 LLM과 학습 기법을 통합한 유일한 프레임워크로, 연구자와 개발자들이 코드 없이 모델을 조정할 수 있게 해준다. 특히, 100개 이상의 모델을 지원하며, Hugging Face Hub에서 수백 개의 오픈소스 모델이 이 프레임워크를 기반으로 개발되고 있다. 그러나, 양자화된 모델은 어댑터 기반 학습에만 호환되며, 직접 가중치 조정은 불가능하다는 한계가 있다. 또한, 일부 모델(예: Gemma-7B)은 GaLore 기법과 호환되지 않아 특정 기법에 제한이 있다.

실용적 활용

LlamaFactory는 기업이나 연구소에서 다양한 LLM을 빠르게 맞춤형으로 조정할 수 있는 도구로 활용 가능하다. 특히, 코드 없이 웹 인터페이스를 통해 모델 학습을 수행할 수 있어, 개발자 수준에 관계없이 사용할 수 있다. 또한, QLoRA와 LoRA 기법을 통해 GPU 메모리가 제한된 환경에서도 효율적인 학습이 가능하다.