Train or fine-tune language and vision models using TRL (Transformer Reinforcement Learning) or Unsloth with Hugging Face Jobs infrastructure. Covers SFT, DPO, GRPO and reward modeling training method
Slug: hugging-face-model-trainer
hugging-face-model-trainer
gamAI — 4177+ skillova za agente · MCP · alati