Artificial Intelligence · Computer Science
R1-Searcher: Incentivizing the Search Capability in LLMs via Reinforcement Learning
Huatong Song, Jinhao Jiang, Yingqian Min, Jie Chen +4
2025-03-19
Information Retrieval · Computer Science
Harnessing the Power of Reinforcement Learning for Language-Model-Based Information Retriever via Query-Document Co-Augmentation
Jingming Liu, Yumeng Li, Wei Shi, Yao-Xiang Ding +2
2025-06-24
Information Retrieval · Computer Science
DeepRetrieval: Hacking Real Search Engines and Retrievers with Large Language Models via Reinforcement Learning
Pengcheng Jiang, Jiacheng Lin, Lang Cao, Runchu Tian +4
2025-04-15
Information Retrieval · Computer Science
Know Where to Go: Make LLM a Relevant, Responsible, and Trustworthy Searcher
Xiang Shi, Jiawei Liu, Yinpeng Liu, Qikai Cheng +1
2023-10-20
Computation and Language · Computer Science
Rewarding Doubt: A Reinforcement Learning Approach to Calibrated Confidence Expression of Large Language Models
David Bani-Harouni, Chantal Pellegrini, Paul Stangel, Ege Özsoy +3
2026-03-03
Computation and Language · Computer Science
RE-Searcher: Robust Agentic Search with Goal-oriented Planning and Self-reflection
Daocheng Fu, Jianbiao Mei, Licheng Wen, Xuemeng Yang +10
2025-10-13
Computation and Language · Computer Science
An Empirical Study on Reinforcement Learning for Reasoning-Search Interleaved LLM Agents
Bowen Jin, Jinsung Yoon, Priyanka Kargupta, Sercan O. Arik +1
2025-05-22
Artificial Intelligence · Computer Science
DeepResearcher: Scaling Deep Research via Reinforcement Learning in Real-world Environments
Yuxiang Zheng, Dayuan Fu, Xiangkun Hu, Xiaojie Cai +3
2025-04-18
Artificial Intelligence · Computer Science
Algorithm Discovery With LLMs: Evolutionary Search Meets Reinforcement Learning
Anja Surina, Amin Mansouri, Lars Quaedvlieg, Amal Seddas +3
2026-05-26
Artificial Intelligence · Computer Science
AI-SearchPlanner: Modular Agentic Search via Pareto-Optimal Multi-Objective Reinforcement Learning
Lang Mei, Zhihan Yang, Xiaohan Yu, Huanyao Zhang +1
2025-12-30
Information Retrieval · Computer Science
Redefining Information Retrieval of Structured Database via Large Language Models
Mingzhu Wang, Yuzhe Zhang, Qihang Zhao, Junyi Yang +1
2024-11-21
Computation and Language · Computer Science
Enhancing the Capability and Robustness of Large Language Models through Reinforcement Learning-Driven Query Refinement
Xiaohua Wang, Zisu Huang, Feiran Zhang, Zhibo Xu +4
2025-07-01
Artificial Intelligence · Computer Science
ReSearch: Learning to Reason with Search for LLMs via Reinforcement Learning
Mingyang Chen, Linzhuang Sun, Tianpeng Li, Haoze Sun +9
2025-09-24
Computation and Language · Computer Science
Re-Search for The Truth: Multi-round Retrieval-augmented Large Language Models are Strong Fake News Detectors
Guanghua Li, Wensheng Lu, Wei Zhang, Defu Lian +4
2024-03-18
Computation and Language · Computer Science
BIDER: Bridging Knowledge Inconsistency for Efficient Retrieval-Augmented LLMs via Key Supporting Evidence
Jiajie Jin, Yutao Zhu, Yujia Zhou, Zhicheng Dou
2024-05-31
Artificial Intelligence · Computer Science
Reinforcement Speculative Decoding for Fast Ranking
Yingpeng Du, Tianjun Wei, Zhu Sun, Jie Zhang
2025-05-28
Computation and Language · Computer Science
R1-Searcher++: Incentivizing the Dynamic Knowledge Acquisition of LLMs via Reinforcement Learning
Huatong Song, Jinhao Jiang, Wenqing Tian, Zhipeng Chen +6
2025-05-23
Computation and Language · Computer Science
Search-R1: Training LLMs to Reason and Leverage Search Engines with Reinforcement Learning
Bowen Jin, Hansi Zeng, Zhenrui Yue, Jinsung Yoon +4
2025-08-07
Information Retrieval · Computer Science
Rank-R1: Enhancing Reasoning in LLM-based Document Rerankers via Reinforcement Learning
Shengyao Zhuang, Xueguang Ma, Bevan Koopman, Jimmy Lin +1
2025-03-11
Computation and Language · Computer Science
Veri-R1: Toward Precise and Faithful Claim Verification via Online Reinforcement Learning
Qi He, Cheng Qian, Xiusi Chen, Bingxiang He +2
2025-10-07
Artificial Intelligence · Computer Science
WorldLLM: Improving LLMs' world modeling using curiosity-driven theory-making
Guillaume Levy, Cedric Colas, Pierre-Yves Oudeyer, Thomas Carta +1
2026-01-30