Train and fine-tune transformer language models using TRL (Transformers Reinforcement Learning). Supports SFT, DPO, GRPO, KTO, RLOO and Reward Model training via CLI commands.
Slug: trl-training
trl-training
gamAI — 4177+ skillova za agente · MCP · alati