Zhuofeng Li

Texas A&M University; Stanford University;

prof_pic.jpg

Hi there šŸ‘‹. My name is Zhuofeng Li. I’m a CS Ph.D. student at Texas A&M University, advised by Prof. Yu Zhang. I am also a visiting student at Stanford University working with Prof. Yejin Choi and Prof. James Zou. Previously, I interned TIGER-Lab at University of Waterloo working with Prof. Wenhu Chen.

My research lies in large-scale post-training and RL, including agents, reasoning, alignment, evaluation, and applications. Recently, I am particularly focus on agentic RL.

As part of this direction, I lead / co-lead AgentFlow (ICLR 26 Oral & 1.9K+⭐), VerlTool (ICLR 26 SPOT Best Paper & 950+⭐), OpenResearcher (Adopted by NVIDIA’s Nemotron family of models & Top 3 Trending Dataset on Hugging Face & 700+⭐) to push the boundaries of agentic reasoning.

I am actively looking for Internship and Full-Time opportunities! Feel free to reach out me through **[zhuofengli12345@gmail.com](mailto:zhuofengli12345@gmail.com)**

Github / Linkedin / Twitter / Google Scholar / Email / WeChat

news

Aug 25, 2026 šŸ”„ New! Two papers accepted at EMNLP 2026!
Mar 24, 2026 OpenResearcher paper is now available, highlighting practical insights into deep research pipeline design. Already adopted by NVIDIA’s Nemotron family of models!
Feb 09, 2026 We’ve released OpenResearcher — a fully open, state-of-the-art deep research agent (30B-A3B). Model, data, code — everything is open. Try demo now!
Jan 27, 2026 Two papers accepted at ICLR 2026: AgentFlow (Oral) on in-the-flow agentic system optimization, and ImagenWorld on stress-testing image generation models!
Dec 13, 2025 Excited that AgentFlow won Best Paper Runner-up at the Effective Reasoning Workshop!

selected publications

*Co-first Author

  1. Arxiv
    dci.png
    Beyond Semantic Similarity: Rethinking Retrieval for Agentic Search via Direct Corpus Interaction
    Zhuofeng Li , Haoxiang Zhang , Cong Wei , Pan Lu , Ping Nie , Yi Lu , Yuyang Bai , Shangbin Feng , Hangxiao Zhu , Ming Zhong , Yuyu Zhang , Jianwen Xie , Yejin Choi , James Zou , Jiawei Han , Wenhu Chen , Jimmy Lin , Dongfu Jiang , and Yu Zhang
    In arxiv preprint, May 2026
  2. EMNLP 2026
    openresearcher.png
    OpenResearcher: A Fully Open Pipeline for Long-Horizon Deep Research Trajectory Synthesis
    Zhuofeng Li * , Dongfu Jiang * , Xueguang Ma , Haoxiang Zhang , Ping Nie , Yuyu Zhang , Kai Zou , Jianwen Xie , Yu Zhang , and Wenhu Chen
    In arxiv preprint, Mar 2026
  3. ACL 2026
    reviewgrounder.png
    ReviewGrounder: Improving Review Substantiveness with Rubric-Guided, Tool-Integrated Agents
    Zhuofeng Li * , Yi Lu * , Dongfu Jiang , Haoxiang Zhang , Yuyang Bai , Chuan Li , Yu Wang , Shuiwang Ji , Jianwen Xie , and Yu Zhang
    In ACL 2026, Apr 2026
  4. ICLR 2026 Oral
    agentflow.png
    In-The-Flow Agentic System Optimization for Effective Planning and Tool Use
    Zhuofeng Li * , Haoxiang Zhang * , Seungju Han , Sheng Liu , Jianwen Xie , Yu Zhang , Yejin Choi , James Zou , and Pan Lu
    In ICLR 2026 Oral & NeurIPS 2025 Workshop Best Paper Runner-up, Oct 2025
  5. ICLR 2026 SPOT Best Paper
    verltool.png
    VerlTool: Towards Holistic Agentic Reinforcement Learning with Tool Use
    Dongfu Jiang * , Yi Lu * , Zhuofeng Li * , Zhiheng Lyu * , Ping Nie , Haozhe Wang , Alex Su , Hui Chen , Kai Zou , Chao Du , Tianyu Pang , and Wenhu Chen
    In ICLR 2026 SPOT Best Paper, Sep 2025
  6. CIKM 2025
    gref.png
    GReF: A Unified Generative Framework for Efficient Reranking via Ordered Multi-token Prediction
    Zhijie Lin * , Zhuofeng Li * , Chenglei Dai , Wentian Bao , Shuai Lin , Enyun Yu , Haoxiang Zhang , and Liang Zhao
    In Proceedings of the 34th ACM International Conference on Information and Knowledge Management, Nov 2025
  7. TMLR 2025
    goat.png
    Avoiding Structural Pitfalls: Self-Supervised Low-Rank Feature Tuning for Graph Test-Time Adaptation
    Haoxiang Zhang * , Zhuofeng Li * , Qiannan Zhang , Ziyi Kou , Juncheng Li , and Shichao Pei
    In Transactions on Machine Learning Research (TMLR), Oct 2025, Oct 2025
  8. ICLR 2026
    imagenworld.png
    ImagenWorld: Stress-Testing Image Generation Models with Explainable Human Evaluation on Open-ended Real-World Tasks
    Samin Mahdizadeh Sani , Max Ku , Nima Jamali , Matina Mahdizadeh Sani , Paria Khoshtab , Wei-Chieh Sun , Parnian Fazel , Zhi Rui Tam , Thomas Chong , Edisy Kin Wai Chan , Donald Wai Tong Tsang , Chiao-Wei Hsu , Ting Wai Lam , Ho Yin Sam Ng , Chiafeng Chu , Chak-Wing Mak , Keming Wu , Hiu Tung Wong , Yik Chun Ho , Chi Ruan , Zhuofeng Li , I-Sheng Fang , Shih-Ying Yeh , Ho Kei Cheng , Ping Nie , and Wenhu Chen
    In ICLR 2026, Jan 2026
  9. Arxiv
    video_eval_pro.png
    VideoEval-Pro: Robust and Realistic Long Video Understanding Evaluation
    Wentao Ma , Weiming Ren , Yiming Jia , Zhuofeng Li , Ping Nie , Ge Zhang , and Wenhu Chen
    In arxiv preprint, May 2025
  10. TMLR 2025
    structeval.png
    StructEval: Benchmarking LLMs’ Capabilities to Generate Structural Outputs
    Jialin Yang , Dongfu Jiang , Lipeng He , Sherman Siu , Yuxuan Zhang , Disen Liao , Zhuofeng Li , Huaye Zeng , Yiming Jia , Haozhe Wang , and others
    In Transactions on Machine Learning Research (TMLR), Dec 2025, May 2025
  11. NeurIPS 2024
    tegdb.png
    Teg-db: A comprehensive dataset and benchmark of textual-edge graphs
    Zhuofeng Li , Zixing Gou , Xiangnan Zhang , Zhongyuan Liu , Sirui Li , Yuntong Hu , Chen Ling , Zheng Zhang , and Liang Zhao
    In Advances in Neural Information Processing Systems, Dec 2024
  12. CIKM 2024
    cfkgc.png
    Learning from novel knowledge: Continual few-shot knowledge graph completion
    Zhuofeng Li , Haoxiang Zhang , Qiannan Zhang , Ziyi Kou , and Shichao Pei
    In Proceedings of the 33rd ACM International Conference on Information and Knowledge Management, Oct 2024