Chinese Researchers Achieve Zero-RL Scaling to Trillion Parameters
Renmin University and Ant Group jointly develop Ring-Zero, achieving zero reinforcement learning scaling to trillion parameters. Model exhibits five advanced reasoning modes without explicit RL training. Math competition results approach closed-source models. Demonstrates Chinese innovation in efficient scaling.
Sources (2)
Updated Aug 2, 2026