💬 About Me
- I am a researcher at StepFun, working on post-training and long-horizon tasks.
- My research interests include reinforcement learning, post-training, and optimization.
📖 Educations
- 2022.09 - 2026.06: B.Eng, Computer Science (Turing Honors Class), Renmin University of China, advisor Mingyang Yi.
💻 Experiences
- 2026.06 - now: Researcher, LLM Post-training Team, StepFun, Beijing.
- 2026.01 - 2026.06: Research Intern, AI Infra and Data Team, JD.com, Beijing.
- 2025.03 - 2025.09: Research Intern, Reinforcement Learning Team, Zhongguancun Academy, Beijing.
- 2024.09 - 2025.03: Development Intern, LLM Pre-training Team, PixVerse, Beijing.
📝 Publications
- Reasoning and Tool-use Compete in Agentic RL: From Quantifying Interference to Disentangled Tuning
Yu Li, Mingyang Yi, Xiuyu Li, Ju Fan, Fuxin Jiang, Binbin Chen, Peng Li, Jie Song, Tieying Zhang
EMNLP 2026 Oral 
- ETS: Energy-Guided Test-Time Scaling for Training-Free RL Alignment
Xiuyu Li*, Jinkai Zhang*, Mingyang Yi, Yu Li, Longqiang Wang, Yue Wang, Ju Fan
ICML 2026 
PrePrints
🎖 Honors and Awards
- 2026.06: Special Award, Sa Shixuan Elite Fund, Renmin University of China (30,000 CNY)
- 2022.11: Gold Medal, The 2022 ICPC Asia Shenyang Regional Contest