Skip to content
arXiv cs.AI · Papers

LiteResearcher: A Scalable Agentic RL Training Framework for Deep Research Agent

arXiv:2604.17931v4 Announce Type: replace Abstract: Reinforcement Learning (RL) has emerged as a powerful training paradigm for LLM-based agents. However, scaling agentic RL for deep research remains constrained by two coupled challenges: hand-crafted synthetic data fails to elicit genuine real-world search capabilitie