LocalSearchBench: Benchmarking Agentic Search in Real-World Local Life Services
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | He, Hang, Yue, Chuhuai, Dong, Chengqi, Tian, Mingxue, Chen, Hao, Liu, Zhenfeng, Chai, Jiajun, Wang, Xiaohan, Zhang, Yufei, Liao, Qun, Yin, Guojun, Lin, Wei, Wan, Chengcheng, Sun, Haiying, Su, Ting |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Promoting Efficient Reasoning with Verifiable Stepwise Reward
von: Yue, Chuhuai, et al.
Veröffentlicht: (2025)
von: Yue, Chuhuai, et al.
Veröffentlicht: (2025)
MTIR-SQL: Multi-turn Tool-Integrated Reasoning Reinforcement Learning for Text-to-SQL
von: Xu, Zekun, et al.
Veröffentlicht: (2025)
von: Xu, Zekun, et al.
Veröffentlicht: (2025)
Training Multi-Image Vision Agents via End2End Reinforcement Learning
von: Dong, Chengqi, et al.
Veröffentlicht: (2025)
von: Dong, Chengqi, et al.
Veröffentlicht: (2025)
RecRM-Bench: Benchmarking Multidimensional Reward Modeling for Agentic Recommender Systems
von: Zeng, Wenwen, et al.
Veröffentlicht: (2026)
von: Zeng, Wenwen, et al.
Veröffentlicht: (2026)
AutoSearch: Adaptive Search Depth for Efficient Agentic RAG via Reinforcement Learning
von: Sun, Jingbo, et al.
Veröffentlicht: (2026)
von: Sun, Jingbo, et al.
Veröffentlicht: (2026)
RLFactory: A Plug-and-Play Reinforcement Learning Post-Training Framework for LLM Multi-Turn Tool-Use
von: Chai, Jiajun, et al.
Veröffentlicht: (2025)
von: Chai, Jiajun, et al.
Veröffentlicht: (2025)
ToolForge: A Data Synthesis Pipeline for Multi-Hop Search without Real-World APIs
von: Chen, Hao, et al.
Veröffentlicht: (2025)
von: Chen, Hao, et al.
Veröffentlicht: (2025)
Automated detection of atomicity violations in large-scale systems
von: He, Hang, et al.
Veröffentlicht: (2025)
von: He, Hang, et al.
Veröffentlicht: (2025)
InterLV-Search: Benchmarking Interleaved Multimodal Agentic Search
von: Hou, Bohan, et al.
Veröffentlicht: (2026)
von: Hou, Bohan, et al.
Veröffentlicht: (2026)
VibeSearchBench: Benchmarking Long-horizon Proactive Search in the Wild
von: Inc, Xiaohongshu
Veröffentlicht: (2026)
von: Inc, Xiaohongshu
Veröffentlicht: (2026)
AgentSearchBench: A Benchmark for AI Agent Search in the Wild
von: Wu, Bin, et al.
Veröffentlicht: (2026)
von: Wu, Bin, et al.
Veröffentlicht: (2026)
AI-SearchPlanner: Modular Agentic Search via Pareto-Optimal Multi-Objective Reinforcement Learning
von: Mei, Lang, et al.
Veröffentlicht: (2025)
von: Mei, Lang, et al.
Veröffentlicht: (2025)
Joint Training of Multi-Token Prediction in Reinforcement Learning via Optimal Coefficient Calibration
von: Wang, Zili, et al.
Veröffentlicht: (2026)
von: Wang, Zili, et al.
Veröffentlicht: (2026)
LocalGPT: Benchmarking and Advancing Large Language Models for Local Life Services in Meituan
von: Lan, Xiaochong, et al.
Veröffentlicht: (2025)
von: Lan, Xiaochong, et al.
Veröffentlicht: (2025)
Enhancing Local Life Service Recommendation with Agentic Reasoning in Large Language Model
von: Cao, Shiteng, et al.
Veröffentlicht: (2026)
von: Cao, Shiteng, et al.
Veröffentlicht: (2026)
Local Well‐Posedness to the Magneto‐Micropolar Boundary Layer Equations in Gevrey Space
von: Zhong Tan, et al.
Veröffentlicht: (2024)
von: Zhong Tan, et al.
Veröffentlicht: (2024)
Large-Scale Multi-Robot Coverage Path Planning via Local Search
von: Tang, Jingtao, et al.
Veröffentlicht: (2023)
von: Tang, Jingtao, et al.
Veröffentlicht: (2023)
WideSearch: Benchmarking Agentic Broad Info-Seeking
von: Wong, Ryan, et al.
Veröffentlicht: (2025)
von: Wong, Ryan, et al.
Veröffentlicht: (2025)
Local Search GFlowNets
von: Kim, Minsu, et al.
Veröffentlicht: (2023)
von: Kim, Minsu, et al.
Veröffentlicht: (2023)
LocalBench: Benchmarking LLMs on County-Level Local Knowledge and Reasoning
von: Gao, Zihan, et al.
Veröffentlicht: (2025)
von: Gao, Zihan, et al.
Veröffentlicht: (2025)
ABC-Bench: Benchmarking Agentic Backend Coding in Real-World Development
von: Yang, Jie, et al.
Veröffentlicht: (2026)
von: Yang, Jie, et al.
Veröffentlicht: (2026)
ResT: Reshaping Token-Level Policy Gradients for Tool-Use Large Language Models
von: Lin, Zihan, et al.
Veröffentlicht: (2025)
von: Lin, Zihan, et al.
Veröffentlicht: (2025)
ZipRL: Adaptive Multi-Turn Context Compression with Hindsight Response Replay
von: Hu, Zhexin, et al.
Veröffentlicht: (2026)
von: Hu, Zhexin, et al.
Veröffentlicht: (2026)
SAE as a Crystal Ball: Interpretable Features Predict Cross-domain Transferability of LLMs without Training
von: Zhang, Qi, et al.
Veröffentlicht: (2026)
von: Zhang, Qi, et al.
Veröffentlicht: (2026)
BinPRE: Enhancing Field Inference in Binary Analysis Based Protocol Reverse Engineering
von: Jiang, Jiayi, et al.
Veröffentlicht: (2024)
von: Jiang, Jiayi, et al.
Veröffentlicht: (2024)
Beyond Retrieval: A Multitask Benchmark and Model for Code Search
von: Xue, Siqiao, et al.
Veröffentlicht: (2026)
von: Xue, Siqiao, et al.
Veröffentlicht: (2026)
Beyond Closed-Pool Video Retrieval: A Benchmark and Agent Framework for Real-World Video Search and Moment Localization
von: Yu, Tao, et al.
Veröffentlicht: (2026)
von: Yu, Tao, et al.
Veröffentlicht: (2026)
SGR-Bench: Benchmarking Search Agents on State-Gated Retrieval
von: Li, Ningyuan, et al.
Veröffentlicht: (2026)
von: Li, Ningyuan, et al.
Veröffentlicht: (2026)
NAS-Bench-Graph: Benchmarking Graph Neural Architecture Search
von: Qin, Yijian, et al.
Veröffentlicht: (2022)
von: Qin, Yijian, et al.
Veröffentlicht: (2022)
ScholarSearch: Benchmarking Scholar Searching Ability of LLMs
von: Zhou, Junting, et al.
Veröffentlicht: (2025)
von: Zhou, Junting, et al.
Veröffentlicht: (2025)
ESARBench: A Benchmark for Agentic UAV Embodied Search and Rescue
von: Zhang, Daoxuan, et al.
Veröffentlicht: (2026)
von: Zhang, Daoxuan, et al.
Veröffentlicht: (2026)
PeopleSearchBench: A Multi-Dimensional Benchmark for Evaluating AI-Powered People Search Platforms
von: Wang, Wei, et al.
Veröffentlicht: (2026)
von: Wang, Wei, et al.
Veröffentlicht: (2026)
On the Smoothed Complexity of Combinatorial Local Search
von: Giannakopoulos, Yiannis, et al.
Veröffentlicht: (2022)
von: Giannakopoulos, Yiannis, et al.
Veröffentlicht: (2022)
Local Search k-means++ with Foresight
von: Conrads, Theo, et al.
Veröffentlicht: (2024)
von: Conrads, Theo, et al.
Veröffentlicht: (2024)
Learning with Local Search MCMC Layers
von: Vivier-Ardisson, Germain, et al.
Veröffentlicht: (2025)
von: Vivier-Ardisson, Germain, et al.
Veröffentlicht: (2025)
Spectral Lower Bounds for Local Search
von: Brânzei, Simina, et al.
Veröffentlicht: (2024)
von: Brânzei, Simina, et al.
Veröffentlicht: (2024)
Hierarchical Clustering via Local Search
von: Jowhari, Hossein
Veröffentlicht: (2024)
von: Jowhari, Hossein
Veröffentlicht: (2024)
Iterated Local Search with Linkage Learning
von: Tinós, Renato, et al.
Veröffentlicht: (2024)
von: Tinós, Renato, et al.
Veröffentlicht: (2024)
Local Search for Integer Quadratic Programming
von: He, Xiang, et al.
Veröffentlicht: (2024)
von: He, Xiang, et al.
Veröffentlicht: (2024)
HierSearch: A Hierarchical Enterprise Deep Search Framework Integrating Local and Web Searches
von: Tan, Jiejun, et al.
Veröffentlicht: (2025)
von: Tan, Jiejun, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Promoting Efficient Reasoning with Verifiable Stepwise Reward
von: Yue, Chuhuai, et al.
Veröffentlicht: (2025) -
MTIR-SQL: Multi-turn Tool-Integrated Reasoning Reinforcement Learning for Text-to-SQL
von: Xu, Zekun, et al.
Veröffentlicht: (2025) -
Training Multi-Image Vision Agents via End2End Reinforcement Learning
von: Dong, Chengqi, et al.
Veröffentlicht: (2025) -
RecRM-Bench: Benchmarking Multidimensional Reward Modeling for Agentic Recommender Systems
von: Zeng, Wenwen, et al.
Veröffentlicht: (2026) -
AutoSearch: Adaptive Search Depth for Efficient Agentic RAG via Reinforcement Learning
von: Sun, Jingbo, et al.
Veröffentlicht: (2026)