AI Lab Tracker
Labs
Timeline
What's New
Collections
Sign in
Labs
Timeline
What's New
MixGRPO
paper
2025-07-28
Tencent
Your tags
+ Collections
Create
Your notes
Add note
Research on unlocking flow-based GRPO (Group Relative Policy Optimization) efficiency for reasoning models.
Paper (arXiv)
GitHub
reasoning
training
research