Unslothと🤗 TRLでLLMのファインチューニングを2倍高速化
Make LLM Fine-tuning 2x faster with Unsloth and 🤗 TRL
Unslothは、Hugging Faceのエコシステムと完全に互換性のある、LLMのファインチューニングを高速化する軽量ライブラリです。NVIDIA GPUの多くに対応しており、TRLライブラリのSFTTrainer、DPOTrainer、PPOTrainerと組み合わせて使用できます。Llama(CodeLlama、Yiなど)およびMistralアーキテクチャをサポートしています。Unslothは、モデルコードの一部を最適化された操作で上書きすることで機能します。バックプロパゲーションステップを手動で導出し、すべてのPytorchモジュールをTritonカーネルに書き換えることで、メモリ使用量を削減し、ファインチューニングを高速化します。精度低下はゼロです。ベンチマークによると、Unslothは最大2.7倍高速で、最大74%少ないメモリを使用します。また、4ビットモデルの直接ロードにより、モデルのダウンロードが4倍高速になり、メモリ断片化が約500MB削減されます。
- UnslothがLLMファインチューニングを高速化する軽量ライブラリを公開し、Hugging Face TRLとの互換性を実現
UnslothはHugging Face TRLと完全互換でありながら、ファインチューニングを最大2.7倍高速化・メモリ使用量を74%削減するライブラリ。LLMのファインチューニングにかかる計算コスト・時間を劇的に削減できるため、AI開発の民主化と実験サイクルの高速化に寄与する。NVIDIA GPU環境で動作し、LlamaやMistralといった主要なオープンモデルに対応している点から、AIスタートアップや研究機関のコスト構造改善に直結する技術であり、AIエコシステム全体の効率化を牽引する可能性がある。