neevparikh avatar

tinker-from-docs

Fine-tune LLMs using the Tinker API. Covers supervised fine-tuning, reinforcement learning, LoRA tra

by neevparikh|Open Source