Research author

Jian Yang

18 AI research papers in the One9Founders library, with summaries and links to original sources.

Papers by Jian Yang

Aug 31, 2026
cs.CL

S3Gym: Can LLMs Turn Self-Testing and Self-Judging into Self-Improvement?

Jiajun Shi, Siyuan Tao, Yuhao Wu, et al.

27
Aug 19, 2026
cs.CL

SMTrap: Cost-Effective DoS Attacks Against Large Reasoning Models via SMT Conflict Guidance

Jian Yang, Zhenqi Feng, Zhaoyang Yu, et al.

Aug 17, 2026
cs.CL

ClawGym II: Exploring Black-Box RL on Agent Harness

Huatong Song, Fei Bai, Ming Yang, et al.

28
Aug 17, 2026
cs.CL

Every Coin Has Two Sides: On the Dual Nature of Generalization in On-Policy Distillation of Large Language Models

Zhaoyi Li, Deyang Kong, Yuan Wei, et al.

15
Aug 7, 2026
cs.RO

Representation Handoffs for OpenArm-Based Laboratory Mobile Manipulation

Yang Shen, Chonghao Cheng, Ziyi Zhao, et al.

Aug 3, 2026
cs.LG

RoMeRL: Balancing Feedback Coverage and the Memory-Reward Trap in Self-Evolving Agent Memory via Reduced-Order Utility States

Yi Yang, Zhennan Chen, Yihong Zhuang, et al.

9
Jul 14, 2026
cs.AI

Agentic Service-Oriented Computing: A Manifesto for the Next Frontier of Service-Oriented Computing

Amin Beheshti, Rong N. Chang, Boualem Benatallah, et al.

Jun 26, 2026
cs.AI

JD Oxygen AI Item Center (Oxygen AIIC) V1: An Industrial-Scale LLM/VLM-Centric Solution for Item Understanding, Management, and Applications

Oxygen AIIC, Chan Long, Chao Liu, et al.

15
Jun 17, 2026
cs.CL

Enhancing Multilingual Reasoning via Steerable Model Merging

Zhuoran Li, Rui Xu, Jian Yang, et al.

Jun 16, 2026
cs.LG

LoopCoder-v2: Only Loop Once for Efficient Test-Time Computation Scaling

Jian Yang, Shawn Guo, Wei Zhang, et al.

126
Jun 11, 2026
cs.CL

HyperTool: Beyond Step-Wise Tool Calls for Tool-Augmented Agents

Yaxin Du, Yifan Zhou, Yujie Ge, et al.

May 21, 2026
cs.CL

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance

Yuchun Fan, Bei Li, Peiguang Li, et al.

May 1, 2026
cs.CL

FinSafetyBench: Evaluating LLM Safety in Real-World Financial Scenarios

Yutao Hou, Yihan Jiang, Yuhan Xie, et al.

Apr 29, 2026
cs.CL

ClawGym: A Scalable Framework for Building Effective Claw Agents

Fei Bai, Huatong Song, Shuang Sun, et al.

47
Apr 21, 2026
cs.CL

A Self-Evolving Framework for Efficient Terminal Agents via Observational Context Compression

Jincheng Ren, Siwei Wu, Yizhi Li, et al.

18
Apr 14, 2026
cs.LG

From Imitation to Discrimination: Progressive Curriculum Learning for Robust Web Navigation

Chuang Peng, Wei Zhang, Renshuai Tao, et al.

Apr 3, 2026
cs.AR

InCoder-32B-Thinking: Industrial Code World Model for Thinking

Jian Yang, Wei Zhang, Jiajun Wu, et al.

34
Apr 3, 2026
cs.CV

RayMamba: Ray-Aligned Serialization for Long-Range 3D Object Detection

Cheng Lu, Mingqian Ji, Shanshan Zhang, et al.

Jian Yang — AI Research Papers | One9Founders