neevparikh avatar

tinker-from-docs

Fine-tune LLMs using the Tinker API. Covers supervised fine-tuning, reinforcement learning, LoRA tra

作者 neevparikh|オープンソース