Design practical AIs that can help users in complex tasks, where users are not oracle, and not static.
Publications
2026
OdysSim: Building Foundation Models for Human Behavior Simulation
Xuhui Zhou,
Weiwei Sun,
Weihua Du,
Jiarui Liu,
Haojia Sun,
Qianou Ma,
Tongshuang Wu,
Yiming Yang,
Maarten Sap
NeurIPS 2026
A Benchmarking Framework for Context-aware XR Interfaces
Hyunsung Cho,
Sarah Yewon Yun,
Nancy Ruonan Sun,
Ben Lafreniere,
Mark Parent,
Kashyap Todi,
Tanya R. Jonker,
Hrvoje Benko,
Tongshuang Wu,
David Lindlbauer
UIST 2026
Mind the Sim2Real Gap in User Simulation for Agentic Tasks
Xuhui Zhou,
Weiwei Sun,
Qianou Ma,
Yiqing Xie,
Jiarui Liu,
Weihua Du,
Sean Welleck,
Yiming Yang,
Graham Neubig,
Sherry Tongshuang Wu,
Maarten Sap
COLM 2026
Comparing Developer and LLM Biases in Code Evaluation
Aditya Mittal,
Ryan Shar,
Zichu Wu,
Shyam Agarwal,
Tongshuang Wu,
Chris Donahue,
Ameet Talwalkar,
Wayne Chi,
Valerie Chen
COLM 2026
'I didn't Make the Micro Decisions': Measuring, Inducing, and Exposing Goal-Level AI Contributions in Collaboration
Strategic Planning and Rationalizing on Trees Make LLMs Better Debaters
Danqing Wang,
Zhuorui Ye,
Xinran Zhao,
Fei Fang,
Lei Li
ICLR 2026
Improving Attributed Long-form Question Answering with Intent Awareness
Xinran Zhao,
Aakanksha Naik,
Jay DeYoung,
Joseph Chee Chang,
Jena D. Hwang,
Tongshuang Wu,
Varsha Kishore
ICLR 2026
Designing Abandabot: When Does Open Source Dependency Abandonment Matter?
Courtney Miller,
Hao He,
Weigen Chen,
Elizabeth Lin,
Chenyang Yang,
Bogdan Vasilescu,
Christian Kästner
ICSE 2026
General Scales Unlock AI Evaluation with Explanatory and Predictive Power
Lexin Zhou,
Lorenzo Pacchiardi,
Fernando Martínez-Plumed,
Katherine M. Collins,
Yael Moros-Daval,
Seraphina Zhang,
Qinlin Zhao,
Yitian Huang,
Luning Sun,
Jonathan E. Prunty,
Zongqian Li,
Pablo Sánchez-García,
Kexin Jiang Chen,
Pablo A. M. Casares,
Jiyun Zu,
John Burden,
Behzad Mehrbakhsh,
David Stillwell,
Manuel Cebrian,
Jindong Wang,
Peter Henderson,
Sherry Tongshuang Wu,
Patrick C. Kyllonen,
Lucy Cheke,
Xing Xie,
José Hernández-Orallo
Nature 2026
Empirical Modeling of Therapist-Client Dynamics in Psychotherapy Using LLM-Based Assessments
Angela Chen,
Siwei Jin,
Canwen Wang,
Holly Swartz,
Tongshuang Wu,
Robert E Kraut,
Haiyi Zhu
ArXiv 2026
Improving Automated Feedback Systems for Tutor Training in Low-Resource Scenarios through Data Augmentation
Chentianye Xu,
Jionghao Lin,
Tongshuang Wu,
Vincent Aleven,
Kenneth R. Koedinger
TLT 2026
2025
Checklists Are Better Than Reward Models For Aligning Language Models
A Large Scale Audit of Dataset Licensing and Attribution in AI
Shayne Longpre,
Robert Mahari,
Anthony Chen,
Naana Obeng-Marnu,
Damien Sileo,
William Brannon,
Niklas Muennighoff,
Nathan Khazam,
Jad Kabbara,
Kartik Perisetla,
Xinyi (Alexis) Wu,
Enrico Shippole,
Kurt Bollacker,
Tongshuang Wu,
Luis Villa,
Sandy Pentland,
Deb Roy,
Sara Hooker
Nature Machine Intelligence 2024
Generating Situated Reflection Triggers About Alternative Solution Paths: A Case Study in Generative AI for Computer-Supported Collaborative Learning
Best Paper Nominee
Atharva Naik,
Jessica Ruhan Yin,
Anusha Kamath, Qianou Ma,
Sherry Tongshuang Wu,
Charles Murray,
Majd Sakr,
Carolyn P. Rose
AIED 2024
How to Teach Programming in the AI Era? Using LLMs as a Teachable Agent for Debugging
Best Paper,
Best Interactive Event
Bridging the Gap: A Survey on Integrating (Human) Feedback for Natural Language Generation
Patrick Fernandes,
Aman Madaan,
Emmy Liu,
António Farinhas,
Pedro Henrique Martins,
Amanda Bertsch,
José G. C. de Souza,
Shuyan Zhou,
Tongshuang Wu,
Graham Neubig,
André F. T. Martins
DataFinder: Scientific Dataset Recommendation from Natural Language Descriptions
Vijay Viswanathan,
Luyu Gao,
Tongshuang Wu,
Pengfei Liu,
Graham Neubig
ACL 2023
Is AI the Better Programming Partner? Human-Human Pair Programming vs. Human-AI pAIr Programming
Qianou Christina Ma,
Tongshuang Wu,
Kenneth Koedinger
AIED2023 Empowering Education with LLMs 2023
Seeing Seeds Beyond Weeds: Green Teaming Generative AI for Beneficial Uses
Logan Stapleton,
Jordan Taylor,
Sarah Fox,
Tongshuang Wu,
Haiyi Zhu
ArXiv 2023
Parachute: Evaluating Interactive Human-LM Co-writing Systems
Hua Shen,
Tongshuang Wu
CHI In2Writing 2023
NL-Augmenter: A Framework for Task-Sensitive Natural Language Augmentation
Kaustubh D Dhole,
Varun Gangal,
Sebastian Gehrmann,
Aadesh Gupta,
Zhenhao Li,
Saad Mahamood,
Abinaya Mahendiran,
Simon Mille,
Ashish Srivastava,
Samson Tan,
Tongshuang Wu,
Jascha Sohl-Dickstein,
Jinho D Choi,
Eduard Hovy,
Ondrej Dusek,
Sebastian Ruder,
et al.
NEJLT 2023
ScatterShot: Interactive In-context Example Curation for Text Transformation
Honorable Mention
Tongshuang Wu,
Hua Shen,
Jeffrey Heer,
Daniel S. Weld,
Marco Tulio Ribeiro
IUI 2023
Capabilities for Better ML Engineering
Chenyang Yang,
Rachel Brower-Sinning,
Grace A. Lewis,
Christian Kästner,
Tongshuang Wu