cuba6112 avatar

unsloth-sft

Supervised fine-tuning using SFTTrainer, instruction formatting, and multi-turn dataset preparation

作者 cuba6112|オープンソース