huggingface/trl
steadyTrain transformer language models with reinforcement learning.
Python
View on GitHub
Stars
19,367
Forks
3,014
Open issues
118
24h
+19
+0.1%
7d
+65
+0.3%
Refresh
1h
Star history (7 days)
Last checked
25m ago
Last pushed
32m ago
Next check
just now