trl
Train transformer language models with reinforcement learning (SFT, DPO, GRPO)
homepage ↗homepage ↗ pypi: trl github: huggingface/trl
Available in
| Overlay | Newest | Ebuilds | Last activity | |
|---|---|---|---|---|
| stuff GitHub ↗ | 1.9.0 | 3 | 3 d | details › |
Train transformer language models with reinforcement learning (SFT, DPO, GRPO)
homepage ↗homepage ↗ pypi: trl github: huggingface/trl
| Overlay | Newest | Ebuilds | Last activity | |
|---|---|---|---|---|
| stuff GitHub ↗ | 1.9.0 | 3 | 3 d | details › |