← Xinmu Ge

Publications

Research papers, software, and dataset artifacts.

math-eval: Reproducible Mathematical Reasoning Generation and Evaluation

Xinmu Ge

· Software documentation report

math-vault: Curated, Traceable Snapshots of Public Mathematical Reasoning Datasets

Xinmu Ge

· Dataset documentation report

Towards Understanding On-Policy Distillation through the Lens of Test-Time Scaling

Xinmu Ge, Zizhuo Zhang, Yu Huang, Jianing Zhu, Lin Yuan, Wanli Gu, Weichang Wu, Weiran Huang, Xiaolu Zhang, Bo Han, Jun Zhou, Jiangchao Yao

· arXiv:2608.11829

Focal Reward: Balanced Reinforcement Learning under Rubric-Based Rewards

Yu Huang, Zihua Zhao, Zhaoxin Huan, Wanli Gu, Feng Hong, Xinmu Ge, Lin Yuan, Weichang Wu, Qiang Hu, Xiaolu Zhang, Jun Zhou, Jiangchao Yao

· arXiv:2605.26579

Co-rewarding: Stable Self-Supervised RL for Eliciting Reasoning in Large Language Models

Zizhuo Zhang, Jianing Zhu, Xinmu Ge, Zihua Zhao, Xuan Li, Xiao Feng, Jiangchao Yao, Bo Han

· ICLR 2026