Call Me When Necessary: LLMs can Efficiently and Faithfully Reason over Structured Environments
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Cheng, Sitao, Zhuang, Ziyuan, Xu, Yong, Yang, Fangkai, Zhang, Chaoyun, Qin, Xiaoting, Huang, Xiang, Chen, Ling, Lin, Qingwei, Zhang, Dongmei, Rajmohan, Saravan, Zhang, Qi |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
The Vision of Autonomic Computing: Can LLMs Make It a Reality?
par: Zhang, Zhiyang, et autres
Publié: (2024)
par: Zhang, Zhiyang, et autres
Publié: (2024)
EfficientRAG: Efficient Retriever for Multi-Hop Question Answering
par: Zhuang, Ziyuan, et autres
Publié: (2024)
par: Zhuang, Ziyuan, et autres
Publié: (2024)
VEM: Environment-Free Exploration for Training GUI Agent with Value Environment Model
par: Zheng, Jiani, et autres
Publié: (2025)
par: Zheng, Jiani, et autres
Publié: (2025)
From Reasoning to Answer: Empirical, Attention-Based and Mechanistic Insights into Distilled DeepSeek R1 Models
par: Zhang, Jue, et autres
Publié: (2025)
par: Zhang, Jue, et autres
Publié: (2025)
Large Language Models can Deliver Accurate and Interpretable Time Series Anomaly Detection
par: Liu, Jun, et autres
Publié: (2024)
par: Liu, Jun, et autres
Publié: (2024)
MEETING DELEGATE: Benchmarking LLMs on Attending Meetings on Our Behalf
par: Hu, Lingxiang, et autres
Publié: (2025)
par: Hu, Lingxiang, et autres
Publié: (2025)
Learning to Refine: Self-Refinement of Parallel Reasoning in LLMs
par: Wang, Qibin, et autres
Publié: (2025)
par: Wang, Qibin, et autres
Publié: (2025)
Zipage: Maintain High Request Concurrency for LLM Reasoning through Compressed PagedAttention
par: Liao, Mengqi, et autres
Publié: (2026)
par: Liao, Mengqi, et autres
Publié: (2026)
DoVer: Intervention-Driven Auto Debugging for LLM Multi-Agent Systems
par: Ma, Ming, et autres
Publié: (2025)
par: Ma, Ming, et autres
Publié: (2025)
AutoRAG-HP: Automatic Online Hyper-Parameter Tuning for Retrieval-Augmented Generation
par: Fu, Jia, et autres
Publié: (2024)
par: Fu, Jia, et autres
Publié: (2024)
Text2Grad: Reinforcement Learning from Natural Language Feedback
par: Wang, Hanyang, et autres
Publié: (2025)
par: Wang, Hanyang, et autres
Publié: (2025)
API Agents vs. GUI Agents: Divergence and Convergence
par: Zhang, Chaoyun, et autres
Publié: (2025)
par: Zhang, Chaoyun, et autres
Publié: (2025)
AI Delegates with a Dual Focus: Ensuring Privacy and Strategic Self-Disclosure
par: Zhang, Zhiyang, et autres
Publié: (2024)
par: Zhang, Zhiyang, et autres
Publié: (2024)
Enabling Autonomic Microservice Management through Self-Learning Agents
par: Yu, Fenglin, et autres
Publié: (2025)
par: Yu, Fenglin, et autres
Publié: (2025)
Reason-before-Retrieve: One-Stage Reflective Chain-of-Thoughts for Training-Free Zero-Shot Composed Image Retrieval
par: Tang, Yuanmin, et autres
Publié: (2024)
par: Tang, Yuanmin, et autres
Publié: (2024)
AllHands: Ask Me Anything on Large-scale Verbatim Feedback via Large Language Models
par: Zhang, Chaoyun, et autres
Publié: (2024)
par: Zhang, Chaoyun, et autres
Publié: (2024)
Everything of Thoughts: Defying the Law of Penrose Triangle for Thought Generation
par: Ding, Ruomeng, et autres
Publié: (2023)
par: Ding, Ruomeng, et autres
Publié: (2023)
Self-Evolved Reward Learning for LLMs
par: Huang, Chenghua, et autres
Publié: (2024)
par: Huang, Chenghua, et autres
Publié: (2024)
Privacy in Action: Towards Realistic Privacy Mitigation and Evaluation for LLM-Powered Agents
par: Wang, Shouju, et autres
Publié: (2025)
par: Wang, Shouju, et autres
Publié: (2025)
CI-Work: Benchmarking Contextual Integrity in Enterprise LLM Agents
par: Fu, Wenjie, et autres
Publié: (2026)
par: Fu, Wenjie, et autres
Publié: (2026)
LLM Reasoning as Trajectories: Step-Specific Representation Geometry and Correctness Signals
par: Sun, Lihao, et autres
Publié: (2026)
par: Sun, Lihao, et autres
Publié: (2026)
Navigating the Unknown: A Chat-Based Collaborative Interface for Personalized Exploratory Tasks
par: Peng, Yingzhe, et autres
Publié: (2024)
par: Peng, Yingzhe, et autres
Publié: (2024)
Pretrain Value, Not Reward: Decoupled Value Policy Optimization
par: Huang, Chenghua, et autres
Publié: (2025)
par: Huang, Chenghua, et autres
Publié: (2025)
G-KV: Decoding-Time KV Cache Eviction with Global Attention
par: Liao, Mengqi, et autres
Publié: (2025)
par: Liao, Mengqi, et autres
Publié: (2025)
Contrastive Attribution in the Wild: An Interpretability Analysis of LLM Failures on Realistic Benchmarks
par: Tan, Rongyuan, et autres
Publié: (2026)
par: Tan, Rongyuan, et autres
Publié: (2026)
AXIS: Efficient Human-Agent-Computer Interaction with API-First LLM-Based Agents
par: Lu, Junting, et autres
Publié: (2024)
par: Lu, Junting, et autres
Publié: (2024)
ExeCoder: Empowering Large Language Models with Executability Representation for Code Translation
par: He, Minghua, et autres
Publié: (2025)
par: He, Minghua, et autres
Publié: (2025)
Sharingan: Extract User Action Sequence from Desktop Recordings
par: Chen, Yanting, et autres
Publié: (2024)
par: Chen, Yanting, et autres
Publié: (2024)
TaskWeaver: A Code-First Agent Framework
par: Qiao, Bo, et autres
Publié: (2023)
par: Qiao, Bo, et autres
Publié: (2023)
UFO3: Weaving the Digital Agent Galaxy
par: Zhang, Chaoyun, et autres
Publié: (2025)
par: Zhang, Chaoyun, et autres
Publié: (2025)
A Tale of Two Graphs: Separating Knowledge Exploration from Outline Structure for Open-Ended Deep Research
par: Shi, Zhuofan, et autres
Publié: (2026)
par: Shi, Zhuofan, et autres
Publié: (2026)
Thread: A Logic-Based Data Organization Paradigm for How-To Question Answering with Retrieval Augmented Generation
par: An, Kaikai, et autres
Publié: (2024)
par: An, Kaikai, et autres
Publié: (2024)
UFO: A UI-Focused Agent for Windows OS Interaction
par: Zhang, Chaoyun, et autres
Publié: (2024)
par: Zhang, Chaoyun, et autres
Publié: (2024)
RepoGenesis: Benchmarking End-to-End Microservice Generation from Readme to Repository
par: Peng, Zhiyuan, et autres
Publié: (2026)
par: Peng, Zhiyuan, et autres
Publié: (2026)
From Task to Tutorial: An Automated GUI Framework for Excel Tutorial Document and Video Creation
par: Xie, Yuhang, et autres
Publié: (2025)
par: Xie, Yuhang, et autres
Publié: (2025)
StepFly: Agentic Troubleshooting Guide Automation for Incident Diagnosis
par: Mao, Jiayi, et autres
Publié: (2025)
par: Mao, Jiayi, et autres
Publié: (2025)
COIN: Chance-Constrained Imitation Learning for Uncertainty-aware Adaptive Resource Oversubscription Policy
par: Wang, Lu, et autres
Publié: (2024)
par: Wang, Lu, et autres
Publié: (2024)
WarriorCoder: Learning from Expert Battles to Augment Code Large Language Models
par: Feng, Huawen, et autres
Publié: (2024)
par: Feng, Huawen, et autres
Publié: (2024)
Large Language Model-Brained GUI Agents: A Survey
par: Zhang, Chaoyun, et autres
Publié: (2024)
par: Zhang, Chaoyun, et autres
Publié: (2024)
AdaptFlow: Adaptive Workflow Optimization via Meta-Learning
par: Zhu, Runchuan, et autres
Publié: (2025)
par: Zhu, Runchuan, et autres
Publié: (2025)
Documents similaires
-
The Vision of Autonomic Computing: Can LLMs Make It a Reality?
par: Zhang, Zhiyang, et autres
Publié: (2024) -
EfficientRAG: Efficient Retriever for Multi-Hop Question Answering
par: Zhuang, Ziyuan, et autres
Publié: (2024) -
VEM: Environment-Free Exploration for Training GUI Agent with Value Environment Model
par: Zheng, Jiani, et autres
Publié: (2025) -
From Reasoning to Answer: Empirical, Attention-Based and Mechanistic Insights into Distilled DeepSeek R1 Models
par: Zhang, Jue, et autres
Publié: (2025) -
Large Language Models can Deliver Accurate and Interpretable Time Series Anomaly Detection
par: Liu, Jun, et autres
Publié: (2024)