大模型前沿速递

Chinese Researchers Achieve Zero-RL Scaling to Trillion Parameters

Chinese Researchers Achieve Zero-RL Scaling to Trillion Parameters

Renmin University and Ant Group jointly develop Ring-Zero, achieving zero reinforcement learning scaling to trillion parameters. Model exhibits five advanced reasoning modes without explicit RL training. Math competition results approach closed-source models. Demonstrates Chinese innovation in efficient scaling.

Sources (2)
Updated Aug 2, 2026