π Publications
PrePrints
- Turning Off-Policy Tokens On-Policy: A Plug-in Approach for Improving LLM Alignment
Yu Li*, Xiuyu Li*, Mingyang Yi, Jiaxing Wang, Liangxu Zhang, Zhaolong Xing, Zhen Chen
Preprint
- Your βProβ LLM Subscription May Actually Be βFreeβ: Exposing Fingerprint Spoofing Risks in LLM Inference Services
Jiahao Zhang*, Xiuyu Li*, Suhang Wang
Preprint
- OFA-Diffusion Compression: Compressing Diffusion Model in One-Shot Manner
Haoyang Jiang*, Zekun Wang*, Mingyang Yi, Xiuyu Li, Lanqing Hu, Junxian Cai, Qingbin Liu, Xi Chen, Ju Fan
Preprint
- Reasoning and Tool-use Compete in Agentic RL: From Quantifying Interference to Disentangled Tuning
Yu Li, Mingyang Yi, Xiuyu Li, Ju Fan, Fuxin Jiang, Binbin Chen, Peng Li, Jie Song, Tieying Zhang
Preprint 