πŸ‘¨πŸ»β€πŸŽ“ Biography

I am currently a Second-year Ph.D. student at the Show Lab, National University of Singapore, advised by Prof. Mike Zheng Shou.

I obtained my Master of Science degree from the AAIS at Peking University, advised by Prof. Yuxin Peng.

Previously, I have interned at TikTok and Kuaishou.

My research interests include Agent, Robotics, and Multimedia.

I’m open to collaborations and discussions. Feel free to drop me an email~

πŸ”₯ News

  • Sep. 2026 🦾 We released Show-Harness [Website, Code], and a Survey on robot-use agent.
  • Sep. 2026 πŸŽ‰ Three papers got accepted by CoRL 2026.
  • May 2026 πŸŽ‰ Code2Video and ACA got accepted by ICML 2026.
  • Jan. 2026 πŸŽ‰ We won the third place in RoCo Challenge @AAAI Embodied AI Workshop 2026.
  • Nov. 2025 πŸŽ‰ UniAPO got accepted by AAAI 2026.
  • Aug. 2025 πŸŽ“ Joined Show Lab @ NUS to start my Ph.D. journey!

πŸ“ Publications

⭐ Selected Publications

Show-Harness: Just a VLM Agent Can Play Robots

Yanzhe Chen*, Zechen Bai*, Zhijun Cao*, Wenzheng Zeng*, Kevin Qinghong Lin, Yiqi Lin, Guoqiang Liang, Kevin Yuchen Ma, Qiming Huang, Mike Zheng Shou

arXiv 2026

Show-Harness is an embodied harness that lets VLMs play robots through a compact semantic action interface.

Code2Video: A Code-centric Paradigm for Educational Video Generation

Yanzhe Chen*, Kevin Qinghong Lin*, Mike Zheng Shou

ICML 2026

Code2Video is an agentic, code-centric framework that generates high-quality educational videos from tutorial topics.

πŸ“š All Publications

  • Code2Video: A Code-centric Paradigm for Educational Video Generation
    Yanzhe Chen*, Kevin Qinghong Lin*, Mike Zheng Shou
    ICML 2026 Paper
  • Escaping the Diversity Trap in Robotic Manipulation via Anchor-Centric Adaptation
    Yanzhe Chen, Kevin Yuchen Ma, Qi Lv, Yiqi Lin, Zechen Bai, Chen Gao, Mike Zheng Shou
    ICML 2026 Paper
  • Where Success Breaks: Failure-Boundary Learning for Robust Vision-Language-Action Models
    Yanzhe Chen*, Zhijun Cao*, Mike Zheng Shou
    CoRL 2026 Paper
  • Supervise What Survives: Geometry-Guided VLA Adaptation from Synthetic Robot Videos
    Danze Chen, Yanzhe Chen, Qiming Huang, Zhijun Cao, Chen Gao, Mike Zheng Shou
    CoRL 2026 Paper
  • UniAPO: Unified Multimodal Automated Prompt Optimization
    Qipeng Zhu*, Yanzhe Chen*, Huasong Zhong*, Jie Chen, Yan Li, Zhixin Zhang, Junping Zhang, Zhenheng Yang
    AAAI 2026 Paper
  • Overconfidence in LLM-as-a-Judge: Diagnosis and Confidence-Driven Solution
    Zailong Tian, Zhuoheng Han, Yanzhe Chen, Haozhe Xu, Xi Yang, Richeng Xuan, Houfeng Wang, Lizi Liao
    NLPCC 2026 Paper
  • PaperDoctor: Evidence-Grounded and Actionable Feedback for Scientific Papers in Progress
    Kevin Qinghong Lin, Siyuan Hu, Pan Lu, Yu Chen, Yanzhe Chen, Owen Queen, Yupeng Chen, Jialin Yu, Junchi Yu, Zifeng Ding, Yuanfeng Ji, Sheng Liu, Jindong Gu, Linjie Li, Mike Zheng Shou, Philip Torr, James Zou
    ICMLW AI4S 2026 Β· Best Poster Award Paper
  • Show-Harness: Just a VLM Agent Can Play Robots
    Yanzhe Chen*, Zechen Bai*, Zhijun Cao*, Wenzheng Zeng*, Kevin Qinghong Lin, Yiqi Lin, Guoqiang Liang, Kevin Yuchen Ma, Qiming Huang, Mike Zheng Shou
    arXiv 2026 Paper
  • Survey on Multimodal Embodied Agents: A Unified Capability-centric Perspective from Computer-Use to Robot-Use
    Yanzhe Chen, Ziyi Yang, Jifeng Zhu, Qiming Huang, Ruihe An, Peiyao Xu, Hesen Yang, Runda Liu, Chang Gong, Zhijun Cao, Zechen Bai, Wenzheng Zeng, Yiqi Lin, Guoqiang Liang, Kevin Yuchen Ma, Kevin Qinghong Lin, Mike Zheng Shou
    TechRxiv 2026 Paper
  • ActionMap: Robot Policy Learning via Voxel Action Heatmap
    Pei Yang*, Hai Ci*, Yanzhe Chen*, Qi Lv, Han Cai, Mike Zheng Shou
    arXiv 2026 Paper
  • Kiwi-Edit: Versatile Video Editing via Instruction and Reference Guidance
    Yiqi Lin, Guoqiang Liang, Ziyun Zeng, Zechen Bai, Yanzhe Chen, Mike Zheng Shou
    arXiv 2026 Paper
  • Spectral Surgery: Training-Free Refinement of LoRA via Gradient-Guided Singular Value Reweighting
    Zailong Tian, Yanzhe Chen, Zhuoheng Han, Lizi Liao
    arXiv 2026 Paper
  • MAI: A Multi-turn Aggregation-Iteration Model for Composed Image Retrieval
    Yanzhe Chen, Zhiwen Yang, Jinglin Xu, Yuxin Peng
    ICLR 2025 Paper
  • UniCodeΒ²: Cascaded Large-scale Codebooks for Unified Multimodal Understanding and Generation
    Yanzhe Chen, Huasong Zhong, Yan Li, Zhenheng Yang
    Technical Report 2025 Paper
  • FashionERN: Enhance-and-Refine Network for Composed Fashion Image Retrieval
    Yanzhe Chen, Huasong Zhong, Xiangteng He, Yuxin Peng, Jiahuan Zhou, Lele Cheng
    AAAI 2024 Paper
  • SPIRIT: Style-guided Patch Interaction for Fashion Image Retrieval with Text Feedback
    Yanzhe Chen, Jiahuan Zhou, Yuxin Peng
    TOMM 2024 Paper
  • Real20M: A Large-scale E-commerce Dataset for Cross-domain Retrieval
    Yanzhe Chen, Huasong Zhong, Xiangteng He, Yuxin Peng, Lele Cheng
    ACM MM 2023 Paper
  • PKU_WICT at TRECVID 2022: Disaster Scene Description and Indexing Task
    Yanzhe Chen, HsiaoYuan Hsu, James Ye, Zhiwen Yang, Zishuo Wang, Xiangteng He, Yuxin Peng
    TRECVID 2022 Β· Ranked 1st Paper

🏫 Education

National University of Singapore2025.08 – Present
Ph.D., School of Computer (SoC)
Peking University2022.09 – 2025.06
Master, Academy for Advanced Interdisciplinary Studies (AAIS)
  • Outstanding Graduate of the Wangxuan Institute of Computer Technology2025.06
  • Merit Student2024.11
  • Leo KoGuan Scholarship2024.11
Wuhan University2018.09 – 2022.06
Undergraduate, School of Computer Science
  • Outstanding Undergraduate Graduate2022.06
  • National Scholarship2020.11

πŸ“– Service