HSCodeComp: A Realistic and Expert-level Benchmark for Deep Search Agents in Hierarchical Rule Application
Fuente:
arXiv
Saved in:
| Main Authors: | Yang, Yiqian, Lan, Tian, Jia, Qianghuai, Zhu, Li, Jiang, Hui, Zhu, Hang, Wang, Longyue, Luo, Weihua, Zhang, Kaifu |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
DeepWideSearch: Benchmarking Depth and Width in Agentic Information Seeking
by: Lan, Tian, et al.
Published: (2025)
by: Lan, Tian, et al.
Published: (2025)
Marco DeepResearch: Unlocking Efficient Deep Research Agents via Verification-Centric Design
by: Zhu, Bin, et al.
Published: (2026)
by: Zhu, Bin, et al.
Published: (2026)
FinDeepForecast: A Live Multi-Agent System for Benchmarking Deep Research Agents in Financial Forecasting
by: Li, Xiangyu, et al.
Published: (2026)
by: Li, Xiangyu, et al.
Published: (2026)
Learning to Change: Choreographing Mixed Traffic Through Lateral Control and Hierarchical Reinforcement Learning
by: Wang, Dawei, et al.
Published: (2024)
by: Wang, Dawei, et al.
Published: (2024)
MedAgentBench: A Realistic Virtual EHR Environment to Benchmark Medical LLM Agents
by: Jiang, Yixing, et al.
Published: (2025)
by: Jiang, Yixing, et al.
Published: (2025)
AgentSearchBench: A Benchmark for AI Agent Search in the Wild
by: Wu, Bin, et al.
Published: (2026)
by: Wu, Bin, et al.
Published: (2026)
WorkBench: a Benchmark Dataset for Agents in a Realistic Workplace Setting
by: Styles, Olly, et al.
Published: (2024)
by: Styles, Olly, et al.
Published: (2024)
A Survey of Multi-Agent Deep Reinforcement Learning with Communication
by: Zhu, Changxi, et al.
Published: (2022)
by: Zhu, Changxi, et al.
Published: (2022)
MedCollab: IBIS-Guided Multi-Agent Collaboration with Hierarchical Disease Relation Chains for Clinical Diagnosis
by: Zhan, Yuqi, et al.
Published: (2026)
by: Zhan, Yuqi, et al.
Published: (2026)
Experience Compression Spectrum: Unifying Memory, Skills, and Rules in LLM Agents
by: Zhang, Xing, et al.
Published: (2026)
by: Zhang, Xing, et al.
Published: (2026)
Coordinated Strategies in Realistic Air Combat by Hierarchical Multi-Agent Reinforcement Learning
by: Selmonaj, Ardian, et al.
Published: (2025)
by: Selmonaj, Ardian, et al.
Published: (2025)
How to Train a Leader: Hierarchical Reasoning in Multi-Agent LLMs
by: Estornell, Andrew, et al.
Published: (2025)
by: Estornell, Andrew, et al.
Published: (2025)
HASHIRU: Hierarchical Agent System for Hybrid Intelligent Resource Utilization
by: Pai, Kunal, et al.
Published: (2025)
by: Pai, Kunal, et al.
Published: (2025)
Pancake: Hierarchical Memory System for Multi-Agent LLM Serving
by: Hu, Zhengding, et al.
Published: (2026)
by: Hu, Zhengding, et al.
Published: (2026)
AgentWebBench: Benchmarking Multi-Agent Coordination in Agentic Web
by: Zhong, Shanshan, et al.
Published: (2026)
by: Zhong, Shanshan, et al.
Published: (2026)
The Combined Problem of Online Task Assignment and Lifelong Path Finding in Logistics Warehouses: Rule-Based Systems Matter
by: Zhu, Fengming, et al.
Published: (2025)
by: Zhu, Fengming, et al.
Published: (2025)
ROSClaw: A Hierarchical Semantic-Physical Framework for Heterogeneous Multi-Agent Collaboration
by: Zhao, Rongfeng, et al.
Published: (2026)
by: Zhao, Rongfeng, et al.
Published: (2026)
Hamilton's Rule for Enabling Altruism in Multi-Agent Systems
by: Butler, Brooks A., et al.
Published: (2025)
by: Butler, Brooks A., et al.
Published: (2025)
A Taxonomy of Hierarchical Multi-Agent Systems: Design Patterns, Coordination Mechanisms, and Industrial Applications
by: Moore, David J.
Published: (2025)
by: Moore, David J.
Published: (2025)
Table-as-Search: Formulate Long-Horizon Agentic Information Seeking as Table Completion
by: Lan, Tian, et al.
Published: (2026)
by: Lan, Tian, et al.
Published: (2026)
AniMaker: Multi-Agent Animated Storytelling with MCTS-Driven Clip Generation
by: Shi, Haoyuan, et al.
Published: (2025)
by: Shi, Haoyuan, et al.
Published: (2025)
Multi-Agent Teams Hold Experts Back
by: Pappu, Aneesh, et al.
Published: (2026)
by: Pappu, Aneesh, et al.
Published: (2026)
Free Agent in Agent-Based Mixture-of-Experts Generative AI Framework
by: Liu, Jung-Hua
Published: (2025)
by: Liu, Jung-Hua
Published: (2025)
Finite-Time Global Optimality Convergence in Deep Neural Actor-Critic Methods for Decentralized Multi-Agent Reinforcement Learning
by: Zhang, Zhiyao, et al.
Published: (2025)
by: Zhang, Zhiyao, et al.
Published: (2025)
VillagerAgent: A Graph-Based Multi-Agent Framework for Coordinating Complex Task Dependencies in Minecraft
by: Dong, Yubo, et al.
Published: (2024)
by: Dong, Yubo, et al.
Published: (2024)
Multi-Agent Target Assignment and Path Finding for Intelligent Warehouse: A Cooperative Multi-Agent Deep Reinforcement Learning Perspective
by: Liu, Qi, et al.
Published: (2024)
by: Liu, Qi, et al.
Published: (2024)
CogSearch: A Cognitive-Aligned Multi-Agent Framework for Proactive Decision Support in E-Commerce Search
by: Zhai, Zhouwei, et al.
Published: (2026)
by: Zhai, Zhouwei, et al.
Published: (2026)
DemMA: Dementia Multi-Turn Dialogue Agent with Expert-Guided Reasoning and Action Simulation
by: Song, Yutong, et al.
Published: (2026)
by: Song, Yutong, et al.
Published: (2026)
Decentralized Collaborative Pricing and Shunting for Multiple EV Charging Stations Based on Multi-Agent Reinforcement Learning
by: Bu, Tianhao, et al.
Published: (2024)
by: Bu, Tianhao, et al.
Published: (2024)
Large Language Model Powered Intelligent Urban Agents: Concepts, Capabilities, and Applications
by: Han, Jindong, et al.
Published: (2025)
by: Han, Jindong, et al.
Published: (2025)
WFCRL: A Multi-Agent Reinforcement Learning Benchmark for Wind Farm Control
by: Monroc, Claire Bizon, et al.
Published: (2025)
by: Monroc, Claire Bizon, et al.
Published: (2025)
N$\text{A}^\text{2}$Q: Neural Attention Additive Model for Interpretable Multi-Agent Q-Learning
by: Liu, Zichuan, et al.
Published: (2023)
by: Liu, Zichuan, et al.
Published: (2023)
PolicySimEval: A Benchmark for Evaluating Policy Outcomes through Agent-Based Simulation
by: Kang, Jiaju, et al.
Published: (2025)
by: Kang, Jiaju, et al.
Published: (2025)
PokéChamp: an Expert-level Minimax Language Agent
by: Karten, Seth, et al.
Published: (2025)
by: Karten, Seth, et al.
Published: (2025)
Scaling Lifelong Multi-Agent Path Finding to More Realistic Settings: Research Challenges and Opportunities
by: Jiang, He, et al.
Published: (2024)
by: Jiang, He, et al.
Published: (2024)
XAgents: A Framework for Interpretable Rule-Based Multi-Agents Cooperation
by: Yang, Hailong, et al.
Published: (2024)
by: Yang, Hailong, et al.
Published: (2024)
Self-Organizing Agent Network for LLM-based Workflow Automation
by: Xiong, Yiming, et al.
Published: (2025)
by: Xiong, Yiming, et al.
Published: (2025)
Subgoal-based Hierarchical Reinforcement Learning for Multi-Agent Collaboration
by: Xu, Cheng, et al.
Published: (2024)
by: Xu, Cheng, et al.
Published: (2024)
Achilles Heel of Distributed Multi-Agent Systems
by: Zhang, Yiting, et al.
Published: (2025)
by: Zhang, Yiting, et al.
Published: (2025)
FilmAgent: A Multi-Agent Framework for End-to-End Film Automation in Virtual 3D Spaces
by: Xu, Zhenran, et al.
Published: (2025)
by: Xu, Zhenran, et al.
Published: (2025)
Similar Items
-
DeepWideSearch: Benchmarking Depth and Width in Agentic Information Seeking
by: Lan, Tian, et al.
Published: (2025) -
Marco DeepResearch: Unlocking Efficient Deep Research Agents via Verification-Centric Design
by: Zhu, Bin, et al.
Published: (2026) -
FinDeepForecast: A Live Multi-Agent System for Benchmarking Deep Research Agents in Financial Forecasting
by: Li, Xiangyu, et al.
Published: (2026) -
Learning to Change: Choreographing Mixed Traffic Through Lateral Control and Hierarchical Reinforcement Learning
by: Wang, Dawei, et al.
Published: (2024) -
MedAgentBench: A Realistic Virtual EHR Environment to Benchmark Medical LLM Agents
by: Jiang, Yixing, et al.
Published: (2025)