Skip to content

About me

I am a PhD candidate at Penn State’s College of Information Sciences and Technology, where I have been advised by Prof. Qingyun Wu since 2022. Before joining Penn State, I received my master’s degree in AI & ML from Imperial College London and my bachelor’s degree in Computer Science from the University of California, Davis.

My research focuses on large language models, especially multi-agent systems and reinforcement learning for language agents.

I was a research intern at Microsoft Research, Redmond in 2024 and 2025.

I’m looking for full-time research scientist positions, preferably in North America. Résumé · Contact me

Selected projects

Binary verification gives failed attempts the same reward; BSR ranks debugging behavior to provide a richer training signal.

Latest work

Behavioral Self-Rewarding (BSR)

Learning from debugging behavior to improve software engineering agents beyond binary test rewards.

Preprint, 2026

Publications

Explore by topic

Beyond Binary Verifiable Rewards: Behavioral Self-Rewarding for SWE Agents

Yiran Wu, Andrew Zhao, Yurui Chang, Qingyun Wu, Xuan Feng

Preprint 2026

ExCyTIn-Bench: Evaluating LLM Agents on Cyber Threat Investigation

Yiran Wu, Mauricio Velazco, Andrew Zhao, Manuel Raúl Meléndez Luján, Srisuma Movva, Yogesh K. Roy, Quang-Huy Nguyen, Roberto Rodriguez, Qingyun Wu, Michael Albada, Julia Kiseleva, Anand Mudgerikar

ICML 2026

SimpleDoc: Multi-Modal Document Understanding with Dual-Cue Page Retrieval and Iterative Refinement

Chelsi Jain*, Yiran Wu*, Yifan Zeng*, Jiale Liu, Shengyu Dai, Zhenwen Shao, Qingyun Wu, Huazheng Wang

EMNLP 2025

Absolute Zero: Reinforced Self-play Reasoning with Zero Data

Andrew Zhao, Yiran Wu, Tong Wu, Quentin Xu, Yang Yue, Matthieu Lin, Shenzhi Wang, Qingyun Wu, Zilong Zheng, Gao Huang

NeurIPS 2025

StateFlow: Enhancing LLM Task-Solving through State-Driven Workflows

Yiran Wu, Tianwei Yue, Shaokun Zhang, Chi Wang, Qingyun Wu

COLM 2024

AutoGen: Enabling Next-Gen LLM Applications via Multi-Agent Conversation

Qingyun Wu, Gagan Bansal, Jieyu Zhang, Yiran Wu, Beibin Li, Erkang Zhu, Li Jiang, Xiaoyun Zhang, Shaokun Zhang, Jiale Liu, Ahmed Hassan Awadallah, Ryen W. White, Doug Burger, Chi Wang

COLM 2024

MathChat: Converse to Tackle Challenging Math Problems with LLM Agents

Yiran Wu, Feiran Jia, Shaokun Zhang, Hangyu Li, Erkang Zhu, Yue Wang, Yin Tat Lee, Richard Peng, Qingyun Wu, Chi Wang

ICLR 2024 · Workshop on LLM Agents

* Equal contribution.

Back to top