Research
My current interests lie in multimodal intelligence and agents that can understand, create,
and act across digital and physical environments.
I study how such agents learn from interaction—how to construct environments and tasks at scale,
verify outcomes, and turn experience into training signals. Rather than targeting a single
interface or domain, I am interested in capabilities that transfer across tools, applications,
and embodiments.
Selected Publications
For a full list, please see Google Scholar.
(* denotes equal contribution.)
Kimi K2.5: Visual Agentic Intelligence
Kimi Team (including Zhengyang Tang)
Technical Report, 2026
Qwen3 Technical Report
Qwen Team (including Zhengyang Tang)
Technical Report, 2025
PhoneBuddy: Training Open Models for Agentic Phone Use
Zhengyang Tang*, Xin Lai*, Pengyuan Lyu*, Xinyuan Wang*, Tianyi Bai*, Chenxin Li*, et al.
Preprint, 2026
GameCraft-Bench: Can Agents Build Playable Games End-to-End in a Real Game Engine?
Tongxu Luo*, Rongsheng Wang*, Jiaxi Bi*, Chenming Xu*, Zhengyang Tang*, et al.
arXiv Preprint, 2026
PhoneWorld: Scaling Phone-Use Agent Environments
Zhengyang Tang*, Yuxuan Liu*, Xin Lai*, Junyi Li*, et al.
arXiv Preprint, 2026
Do Phone-Use Agents Respect Your Privacy?
Zhengyang Tang*, Ke Ji*, Xidong Wang*, Zihan Ye*, Xinyuan Wang, Yiduo Guo, et al.
arXiv Preprint, 2026
Safe, or Simply Incapable? Rethinking Safety Evaluation for Phone-Use Agents
Zhengyang Tang*, Yi Zhang*, Chenxin Li, Xin Lai, et al.
arXiv Preprint, 2026
PhoneHarness: A Mixed-Action Orchestration Harness and Benchmark for Phone Agents across CLI, GUI, and MCP Tools
Jason*, Zhengyao Fang*, Zhengyang Tang*, Pengyuan Lyu*, et al.
Preprint, 2026
CALM Before the STORM: Unlocking Native Reasoning for Optimization Modeling
Zhengyang Tang*, Zihan Ye*, Chenyu Huang*, Xuhan Huang, Chengpeng Li, Sihang Li, et al.
ICML, 2026
CoRT: Code-integrated Reasoning within Thinking
Chengpeng Li*, Zhengyang Tang*, Ziniu Li*, Mingfeng Xue, Keqin Bao, et al.
NeurIPS, 2025
Self-Evolving Critique Abilities in Large Language Models (SCRIT)
Zhengyang Tang*, Ziniu Li*, Zhenyang Xiao*, Tian Ding, Ruoyu Sun, Benyou Wang, et al.
COLM, 2025
ORLM: A Customizable Framework in Training Large Models for Automated Optimization Modeling
Chenyu Huang*, Zhengyang Tang*, Shixi Hu, Ruoqing Jiang, Xin Zheng, Dongdong Ge, Benyou Wang, Zizhuo Wang
Operations Research, 2025
MathScale: Scaling Instruction Tuning for Mathematical Reasoning
Zhengyang Tang, Xingxing Zhang, Benyou Wang, Furu Wei
ICML, 2024
Synthetic Data (Almost) from Scratch: Generalized Instruction Tuning for Language Models (GLAN)
Haoran Li*, Qingxiu Dong*, Zhengyang Tang*, Chaojun Wang*, Xingxing Zhang, et al.
TMLR, 2025
Second Language (Arabic) Acquisition of LLMs via Progressive Vocabulary Expansion
Jianqing Zhu*, Huang Huang*, Zhihang Lin*, Juhao Liang*, Zhengyang Tang*, Khalid Almubarak, et al.
ACL 2025 (Oral & Panel)
DPTDR: Deep Prompt Tuning for Dense Passage Retrieval
Zhengyang Tang, Benyou Wang, Ting Yao
COLING, 2022