A Survey of Reinforcement Learning for Large Reasoning Models
TsinghuaC3I
2,5 k
étoiles
134
forks
3
issues ouvertes
Le README de ce projet n'est pas disponible pour le moment.
Democratizing Reinforcement Learning for LLMs
EasyR1: An Efficient, Scalable, Multi-Modality RL Training Framework based on veRL
[AAAI 2026] - Official repo for paper: "Reinforcement Learning for Reasoning in Small LLMs: What Works and What Doesn't"