Research author

Bingxiang He

11 AI research papers in the One9Founders library, with summaries and links to original sources.

Papers by Bingxiang He

Sep 3, 2026
cs.AI

Rethinking On-Policy Distillation of Large Language Models II: One Training Example

Zixuan Fu, Bingxiang He, Yuxin Zuo, et al.

81
Aug 25, 2026
cs.LG

On-policy Distillation with Verifiable Reward

Wenze Lin, Jiale Zhao, Xitai Jiang, et al.

14
Aug 24, 2026
cs.CL

SWE Refactor Bench: Can Coding Agents Complete a Long-Horizon, Whole-Repository Stack Migration?

Deyao Hong, Yizhe Chi, Wenyi Li, et al.

14
Aug 20, 2026
cs.AI

AI4AI-Bench: Benchmarking LLM Agents in Algorithmic Design for Recursive Self-Improvement

Yizhe Chi, Wenyi Li, Deyao Hong, et al.

Aug 19, 2026
cs.LG

Open-MOPD: Diagnosing and Fixing Capability Imbalance in Multi-Teacher On-Policy Distillation

Huan-ang Gao, Haohan Chi, Yong Yan, et al.

20
Aug 14, 2026
cs.AI

PACE-Bench: Benchmarking Physics Adaptation via Code Evolution in Dynamic Environments

Yuhao Zhan, Bingxiang He, Zecong Tang, et al.

10
Aug 14, 2026
cs.AI

MathForm: Scaling Mathematical Autoformalization with Knowledge Retrieval and Verification-Guided Refinement

Lushi Pu, Weiming Zhang, Xinheng Xie, et al.

7
Jul 6, 2026
cs.LG

Weak-to-Strong Generalization via Direct On-Policy Distillation

Shiyuan Feng, Huan-ang Gao, Haohan Chi, et al.

113
Jun 30, 2026
cs.CL

Scalable Behaviour Cloning on Browser Using via Skill Distillation

Kaisen Yang, Zheng Jiang, Yuzhao Peng, et al.

Jun 23, 2026
cs.CL

NatureBench: Can Coding Agents Match the Published SOTA of Nature-Family Papers?

Yuru Wang, Lejun Cheng, Yuxin Zuo, et al.

52
Apr 14, 2026
cs.LG

Rethinking On-Policy Distillation of Large Language Models: Phenomenology, Mechanism, and Recipe

Yaxuan Li, Yuxin Zuo, Bingxiang He, et al.

31
Bingxiang He — AI Research Papers | One9Founders