Artificial Intelligence · Computer Science
Proactive Agent: Shifting LLM Agents from Reactive Responses to Active Assistance
Yaxi Lu, Shenzhi Yang, Cheng Qian, Guirong Chen +11
2024-12-04
Human-Computer Interaction · Computer Science
ProAgentBench: Evaluating LLM Agents for Proactive Assistance with Real-World Data
Yuanbo Tang, Huaze Tang, Tingyu Cao, Lam Nguyen +5
2026-02-11
Machine Learning · Computer Science
ProactBench: Beyond What The User Asked For
Sepehr Harfi, Ahmad Salimi, Dongming Shen, Alex Smola
2026-05-12
Artificial Intelligence · Computer Science
VitaBench 2.0: Evaluating Personalized and Proactive Agents in Long-Term User Interactions
Yuxin Chen, Yi Zhang, Zhengzhou Cai, Yaorui Shi +10
2026-05-27
Artificial Intelligence · Computer Science
ProactiveMobile: A Comprehensive Benchmark for Boosting Proactive Intelligence on Mobile Devices
Dezhi Kong, Zhengzhao Feng, Qiliang Liang, Hao Wang +11
2026-05-11
Computation and Language · Computer Science
ProactiveEval: A Unified Evaluation Framework for Proactive Dialogue Agents
Tianjian Liu, Fanqi Wan, Jiajian Guo, Xiaojun Quan
2025-08-29
Computer Vision and Pattern Recognition · Computer Science
ProactiveBench: Benchmarking Proactiveness in Multimodal Large Language Models
Thomas De Min, Subhankar Roy, Stéphane Lathuilière, Elisa Ricci +1
2026-03-23
Artificial Intelligence · Computer Science
Beyond Reactivity: Measuring Proactive Problem Solving in LLM Agents
Gil Pasternak, Dheeraj Rajagopal, Julia White, Dhruv Atreja +3
2026-02-20
Computer Vision and Pattern Recognition · Computer Science
IPIBench: Evaluating Interactive Proactive Intelligence of MLLMs under Continuous Streams
Jinzhao Li, Yinuo Chen, Wenxuan Song, Yijia Lei +4
2026-05-27
Computation and Language · Computer Science
ProMediate: A Socio-cognitive framework for evaluating proactive agents in multi-party negotiation
Ziyi Liu, Bahar Sarrafzadeh, Pei Zhou, Longqi Yang +2
2026-05-07
Artificial Intelligence · Computer Science
ProAgent: Building Proactive Cooperative Agents with Large Language Models
Ceyao Zhang, Kaijie Yang, Siyi Hu, Zihao Wang +11
2024-01-12
Computation and Language · Computer Science
VoiceBench: Benchmarking LLM-Based Voice Assistants
Yiming Chen, Xianghu Yue, Chen Zhang, Xiaoxue Gao +2
2024-12-12
Human-Computer Interaction · Computer Science
Towards Proactive Interactions for In-Vehicle Conversational Assistants Utilizing Large Language Models
Huifang Du, Xuejing Feng, Jun Ma, Meng Wang +4
2024-03-15
Artificial Intelligence · Computer Science
$\pi$-Bench: Evaluating Proactive Personal Assistant Agents in Long-Horizon Workflows
Haoran Zhang, Luxin Xu, Zhilin Wang, Runquan Gui +10
2026-05-20
Artificial Intelligence · Computer Science
Multi-Mission Tool Bench: Assessing the Robustness of LLM based Agents through Related and Dynamic Missions
Peijie Yu, Yifan Yang, Jinjian Li, Zelong Zhang +3
2025-04-17
Software Engineering · Computer Science
LoCoBench-Agent: An Interactive Benchmark for LLM Agents in Long-Context Software Engineering
Jielin Qiu, Zuxin Liu, Zhiwei Liu, Rithesh Murthy +17
2025-11-19
Computation and Language · Computer Science
BehaviorSFT: Behavioral Token Conditioning for Clinical Agents Across the Proactivity Spectrum
Yubin Kim, Zhiyuan Hu, Hyewon Jeong, Eugene Park +10
2025-05-29
Artificial Intelligence · Computer Science
PIRA-Bench: A Transition from Reactive GUI Agents to GUI-based Proactive Intent Recommendation Agents
Yuxiang Chai, Shunye Tang, Han Xiao, Rui Liu +1
2026-03-10
Computation and Language · Computer Science
AgentLongBench: A Controllable Long Benchmark For Long-Contexts Agents via Environment Rollouts
Shicheng Fang, Yuxin Wang, Xiaoran Liu, Jiahao Lu +5
2026-02-02
Artificial Intelligence · Computer Science
VS-Bench: Evaluating VLMs for Strategic Abilities in Multi-Agent Environments
Zelai Xu, Zhexuan Xu, Xiangmin Yi, Huining Yuan +6
2026-04-14
Artificial Intelligence · Computer Science
UserBench: An Interactive Gym Environment for User-Centric Agents
Cheng Qian, Zuxin Liu, Akshara Prabhakar, Zhiwei Liu +8
2025-07-30
Artificial Intelligence · Computer Science
AgentNoiseBench: Benchmarking Robustness of Tool-Using LLM Agents Under Noisy Condition
Ruipeng Wang, Yuxin Chen, Yukai Wang, Chang Wu +8
2026-02-19
Artificial Intelligence · Computer Science
Pushing Forward Pareto Frontiers of Proactive Agents with Behavioral Agentic Optimization
Yihang Yao, Zhepeng Cen, Haohong Lin, Shiqi Liu +5
2026-02-13
Computation and Language · Computer Science
Beyond Prompts: Dynamic Conversational Benchmarking of Large Language Models
David Castillo-Bolado, Joseph Davidson, Finlay Gray, Marek Rosa
2024-10-14