Atom-Searcher: Enhancing Agentic Deep Research via Fine-Grained Atomic Thought Reward
Fuente:
arXiv
Saved in:
| Main Authors: | Deng, Yong, Wang, Guoqing, Ying, Zhenzhe, Wu, Xiaofeng, Lin, Jinzhen, Xiong, Wenwen, Dai, Yuqin, Yang, Shuo, Zhang, Zhanwei, Wang, Qiwen, Qin, Yang, Wang, Yuan, Zha, Quanxing, Dai, Sunhao, Meng, Changhua |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
DR-Venus: Towards Frontier Edge-Scale Deep Research Agents with Only 10K Open Data
by: Venus Team, et al.
Published: (2026)
by: Venus Team, et al.
Published: (2026)
Careful Queries, Credible Results: Teaching RAG Models Advanced Web Search Tools with Reinforcement Learning
by: Dai, Yuqin, et al.
Published: (2025)
by: Dai, Yuqin, et al.
Published: (2025)
Information Gain-based Policy Optimization: A Simple and Effective Approach for Multi-Turn Search Agents
by: Wang, Guoqing, et al.
Published: (2025)
by: Wang, Guoqing, et al.
Published: (2025)
EviNote-RAG: Enhancing RAG Models via Answer-Supportive Evidence Notes
by: Dai, Yuqin, et al.
Published: (2025)
by: Dai, Yuqin, et al.
Published: (2025)
RealFactBench: A Benchmark for Evaluating Large Language Models in Real-World Fact-Checking
by: Yang, Shuo, et al.
Published: (2025)
by: Yang, Shuo, et al.
Published: (2025)
RAMA: Retrieval-Augmented Multi-Agent Framework for Misinformation Detection in Multimodal Fact-Checking
by: Yang, Shuo, et al.
Published: (2025)
by: Yang, Shuo, et al.
Published: (2025)
MatchTIR: Fine-Grained Supervision for Tool-Integrated Reasoning via Bipartite Matching
by: Qu, Changle, et al.
Published: (2026)
by: Qu, Changle, et al.
Published: (2026)
Fine-Grained Representation for Lane Topology Reasoning
by: Xu, Guoqing, et al.
Published: (2025)
by: Xu, Guoqing, et al.
Published: (2025)
Gen-Searcher: Reinforcing Agentic Search for Image Generation
by: Feng, Kaituo, et al.
Published: (2026)
by: Feng, Kaituo, et al.
Published: (2026)
VenusBench-Mobile: A Challenging and User-Centric Benchmark for Mobile GUI Agents with Capability Diagnostics
by: Gong, Yichen, et al.
Published: (2026)
by: Gong, Yichen, et al.
Published: (2026)
New Dataset and Methods for Fine-Grained Compositional Referring Expression Comprehension via Specialist-MLLM Collaboration
by: Yang, Xuzheng, et al.
Published: (2025)
by: Yang, Xuzheng, et al.
Published: (2025)
Revisiting Clustering of Neural Bandits: Selective Reinitialization for Mitigating Loss of Plasticity
by: Su, Zhiyuan, et al.
Published: (2025)
by: Su, Zhiyuan, et al.
Published: (2025)
A Hiplot‐based web service for cold atmospheric plasma high‐throughput data integration and analysis on breast cancer
by: Xiaofeng Dai, et al.
Published: (2025)
by: Xiaofeng Dai, et al.
Published: (2025)
Soften the Mask: Adaptive Temporal Soft Mask for Efficient Dynamic Facial Expression Recognition
by: Li, Meng-zhu, et al.
Published: (2025)
by: Li, Meng-zhu, et al.
Published: (2025)
Unified Multimodal Chain-of-Thought Reward Model through Reinforcement Fine-Tuning
by: Wang, Yibin, et al.
Published: (2025)
by: Wang, Yibin, et al.
Published: (2025)
Generalized Category Discovery in Event-Centric Contexts: Latent Pattern Mining with LLMs
by: Luo, Yi, et al.
Published: (2025)
by: Luo, Yi, et al.
Published: (2025)
ETR: Entropy Trend Reward for Efficient Chain-of-Thought Reasoning
by: Xiong, Xuan, et al.
Published: (2026)
by: Xiong, Xuan, et al.
Published: (2026)
RE-Searcher: Robust Agentic Search with Goal-oriented Planning and Self-reflection
by: Fu, Daocheng, et al.
Published: (2025)
by: Fu, Daocheng, et al.
Published: (2025)
MFH: Marrying Frequency Domain with Handwritten Mathematical Expression Recognition
by: Yang, Huanxin, et al.
Published: (2025)
by: Yang, Huanxin, et al.
Published: (2025)
Language Models as Efficient Reward Function Searchers for Custom-Environment Multi-Objective Reinforcement
by: Xie, Guanwen, et al.
Published: (2024)
by: Xie, Guanwen, et al.
Published: (2024)
Autonomous LLM Agent Worms: Cross-Platform Propagation, Automated Discovery and Temporal Re-Entry Defense
by: Zha, Mingming, et al.
Published: (2026)
by: Zha, Mingming, et al.
Published: (2026)
Optimal Batch-Size Control for Low-Latency Federated Learning with Device Heterogeneity
by: Yang, Huiling, et al.
Published: (2025)
by: Yang, Huiling, et al.
Published: (2025)
Structure-Aware Human Body Reshaping with Adaptive Affinity-Graph Network
by: Deng, Qiwen, et al.
Published: (2024)
by: Deng, Qiwen, et al.
Published: (2024)
DynaSearcher: Dynamic Knowledge Graph Augmented Search Agent via Multi-Reward Reinforcement Learning
by: Hao, Chuzhan, et al.
Published: (2025)
by: Hao, Chuzhan, et al.
Published: (2025)
Teaching LLMs to Abstain via Fine-Grained Semantic Confidence Reward
by: An, Hao, et al.
Published: (2025)
by: An, Hao, et al.
Published: (2025)
OMG-Agent: Toward Robust Missing Modality Generation with Decoupled Coarse-to-Fine Agentic Workflows
by: Dai, Ruiting, et al.
Published: (2026)
by: Dai, Ruiting, et al.
Published: (2026)
Application of Brachytherapy in Postoperative Treatment of Keloid‐Prone Patients
by: Hanhan Tian, et al.
Published: (2026)
by: Hanhan Tian, et al.
Published: (2026)
CitaLaw: Enhancing LLM with Citations in Legal Domain
by: Zhang, Kepu, et al.
Published: (2024)
by: Zhang, Kepu, et al.
Published: (2024)
Aligning Large Language Models with Searcher Preferences
by: Wu, Wei, et al.
Published: (2026)
by: Wu, Wei, et al.
Published: (2026)
Joint Reward Modeling: Internalizing Chain-of-Thought for Efficient Visual Reward Models
by: Yang, Yankai, et al.
Published: (2026)
by: Yang, Yankai, et al.
Published: (2026)
SpatialReward: Verifiable Spatial Reward Modeling for Fine-Grained Spatial Consistency in Text-to-Image Generation
by: Zhou, Sashuai, et al.
Published: (2026)
by: Zhou, Sashuai, et al.
Published: (2026)
Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers
by: Shi, Zhengliang, et al.
Published: (2025)
by: Shi, Zhengliang, et al.
Published: (2025)
GUI-G1: Understanding R1-Zero-Like Training for Visual Grounding in GUI Agents
by: Zhou, Yuqi, et al.
Published: (2025)
by: Zhou, Yuqi, et al.
Published: (2025)
Adaptive Part Learning for Fine-Grained Generalized Category Discovery: A Plug-and-Play Enhancement
by: Dai, Qiyuan, et al.
Published: (2025)
by: Dai, Qiyuan, et al.
Published: (2025)
PHPQ: Pyramid Hybrid Pooling Quantization for Efficient Fine-Grained Image Retrieval
by: Zeng, Ziyun, et al.
Published: (2021)
by: Zeng, Ziyun, et al.
Published: (2021)
Speech Recognition Model Improves Text-to-Speech Synthesis using Fine-Grained Reward
by: Wang, Guansu, et al.
Published: (2025)
by: Wang, Guansu, et al.
Published: (2025)
Refined Sample Complexity for Markov Games with Independent Linear Function Approximation
by: Dai, Yan, et al.
Published: (2024)
by: Dai, Yan, et al.
Published: (2024)
Probing the Crossover between Dynamical Phases with Local Correlations in a Rydberg Atom Array
by: Wu, Xiaofeng, et al.
Published: (2025)
by: Wu, Xiaofeng, et al.
Published: (2025)
PC$^2$: Pseudo-Classification Based Pseudo-Captioning for Noisy Correspondence Learning in Cross-Modal Retrieval
by: Duan, Yue, et al.
Published: (2024)
by: Duan, Yue, et al.
Published: (2024)
Long Chain-of-Thought Compression via Fine-Grained Group Policy Optimization
by: Han, Xinchen, et al.
Published: (2026)
by: Han, Xinchen, et al.
Published: (2026)
Similar Items
-
DR-Venus: Towards Frontier Edge-Scale Deep Research Agents with Only 10K Open Data
by: Venus Team, et al.
Published: (2026) -
Careful Queries, Credible Results: Teaching RAG Models Advanced Web Search Tools with Reinforcement Learning
by: Dai, Yuqin, et al.
Published: (2025) -
Information Gain-based Policy Optimization: A Simple and Effective Approach for Multi-Turn Search Agents
by: Wang, Guoqing, et al.
Published: (2025) -
EviNote-RAG: Enhancing RAG Models via Answer-Supportive Evidence Notes
by: Dai, Yuqin, et al.
Published: (2025) -
RealFactBench: A Benchmark for Evaluating Large Language Models in Real-World Fact-Checking
by: Yang, Shuo, et al.
Published: (2025)