Learning to Use Tools via Cooperative and Interactive Agents
Fuente:
arXiv
Salvato in:
| Autori principali: | Shi, Zhengliang, Gao, Shen, Chen, Xiuyi, Feng, Yue, Yan, Lingyong, Shi, Haibo, Yin, Dawei, Ren, Pengjie, Verberne, Suzan, Ren, Zhaochun |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Tool Learning in the Wild: Empowering Language Models as Automatic Tool Agents
di: Shi, Zhengliang, et al.
Pubblicazione: (2024)
di: Shi, Zhengliang, et al.
Pubblicazione: (2024)
Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers
di: Shi, Zhengliang, et al.
Pubblicazione: (2025)
di: Shi, Zhengliang, et al.
Pubblicazione: (2025)
Retrieval Models Aren't Tool-Savvy: Benchmarking Tool Retrieval for Large Language Models
di: Shi, Zhengliang, et al.
Pubblicazione: (2025)
di: Shi, Zhengliang, et al.
Pubblicazione: (2025)
Divide-Then-Aggregate: An Efficient Tool Learning Method via Parallel Tool Invocation
di: Zhu, Dongsheng, et al.
Pubblicazione: (2025)
di: Zhu, Dongsheng, et al.
Pubblicazione: (2025)
OpenReward: Learning to Reward Long-form Agentic Tasks via Reinforcement Learning
di: Hu, Ziyou, et al.
Pubblicazione: (2025)
di: Hu, Ziyou, et al.
Pubblicazione: (2025)
A Multi-Agent Conversational Recommender System
di: Fang, Jiabao, et al.
Pubblicazione: (2024)
di: Fang, Jiabao, et al.
Pubblicazione: (2024)
MACPO: Weak-to-Strong Alignment via Multi-Agent Contrastive Preference Optimization
di: Lyu, Yougang, et al.
Pubblicazione: (2024)
di: Lyu, Yougang, et al.
Pubblicazione: (2024)
Generate-then-Ground in Retrieval-Augmented Generation for Multi-hop Question Answering
di: Shi, Zhengliang, et al.
Pubblicazione: (2024)
di: Shi, Zhengliang, et al.
Pubblicazione: (2024)
KnowTuning: Knowledge-aware Fine-tuning for Large Language Models
di: Lyu, Yougang, et al.
Pubblicazione: (2024)
di: Lyu, Yougang, et al.
Pubblicazione: (2024)
Is ChatGPT Good at Search? Investigating Large Language Models as Re-Ranking Agents
di: Sun, Weiwei, et al.
Pubblicazione: (2023)
di: Sun, Weiwei, et al.
Pubblicazione: (2023)
Evolution without Large Models: Training Language Model with Task Principles
di: Zhu, Minghang, et al.
Pubblicazione: (2025)
di: Zhu, Minghang, et al.
Pubblicazione: (2025)
Bridging the Capability Gap: Joint Alignment Tuning for Harmonizing LLM-based Multi-Agent Systems
di: Zhu, Minghang, et al.
Pubblicazione: (2025)
di: Zhu, Minghang, et al.
Pubblicazione: (2025)
The Real, the Better: Aligning Large Language Models with Online Human Behaviors
di: Jiang, Guanying, et al.
Pubblicazione: (2024)
di: Jiang, Guanying, et al.
Pubblicazione: (2024)
Direct Retrieval-augmented Optimization: Synergizing Knowledge Selection and Language Models
di: Shi, Zhengliang, et al.
Pubblicazione: (2025)
di: Shi, Zhengliang, et al.
Pubblicazione: (2025)
What are the limits of cross-lingual dense passage retrieval for low-resource languages?
di: Wu, Jie, et al.
Pubblicazione: (2024)
di: Wu, Jie, et al.
Pubblicazione: (2024)
ATM: Adversarial Tuning Multi-agent System Makes a Robust Retrieval-Augmented Generator
di: Zhu, Junda, et al.
Pubblicazione: (2024)
di: Zhu, Junda, et al.
Pubblicazione: (2024)
CAUSE: Counterfactual Assessment of User Satisfaction Estimation in Task-Oriented Dialogue Systems
di: Abolghasemi, Amin, et al.
Pubblicazione: (2024)
di: Abolghasemi, Amin, et al.
Pubblicazione: (2024)
Joint Flashback Adaptation for Forgetting-Resistant Instruction Tuning
di: Zhao, Yukun, et al.
Pubblicazione: (2025)
di: Zhao, Yukun, et al.
Pubblicazione: (2025)
Generative Retrieval with Few-shot Indexing
di: Askari, Arian, et al.
Pubblicazione: (2024)
di: Askari, Arian, et al.
Pubblicazione: (2024)
Improving the Robustness of Large Language Models via Consistency Alignment
di: Zhao, Yukun, et al.
Pubblicazione: (2024)
di: Zhao, Yukun, et al.
Pubblicazione: (2024)
ReportLogic: Evaluating Logical Quality in Deep Research Reports
di: Zhao, Jujia, et al.
Pubblicazione: (2026)
di: Zhao, Jujia, et al.
Pubblicazione: (2026)
Answer Retrieval in Legal Community Question Answering
di: Askari, Arian, et al.
Pubblicazione: (2024)
di: Askari, Arian, et al.
Pubblicazione: (2024)
Mitigating Hallucinations in Large Vision-Language Models via Entity-Centric Multimodal Preference Optimization
di: Wu, Jiulong, et al.
Pubblicazione: (2025)
di: Wu, Jiulong, et al.
Pubblicazione: (2025)
Unifying Search and Recommendation in LLMs via Gradient Multi-Subspace Tuning
di: Zhao, Jujia, et al.
Pubblicazione: (2026)
di: Zhao, Jujia, et al.
Pubblicazione: (2026)
MAIR: A Massive Benchmark for Evaluating Instructed Retrieval
di: Sun, Weiwei, et al.
Pubblicazione: (2024)
di: Sun, Weiwei, et al.
Pubblicazione: (2024)
Knowing What LLMs DO NOT Know: A Simple Yet Effective Self-Detection Method
di: Zhao, Yukun, et al.
Pubblicazione: (2023)
di: Zhao, Yukun, et al.
Pubblicazione: (2023)
Information Discovery in e-Commerce
di: Ren, Zhaochun, et al.
Pubblicazione: (2024)
di: Ren, Zhaochun, et al.
Pubblicazione: (2024)
UIPE: Enhancing LLM Unlearning by Removing Knowledge Related to Forgetting Targets
di: Wang, Wenyu, et al.
Pubblicazione: (2025)
di: Wang, Wenyu, et al.
Pubblicazione: (2025)
What Affects the Stability of Tool Learning? An Empirical Study on the Robustness of Tool Learning Frameworks
di: Huang, Chengrui, et al.
Pubblicazione: (2024)
di: Huang, Chengrui, et al.
Pubblicazione: (2024)
Dataset Creation for Visual Entailment using Generative AI
di: Reijtenbach, Rob, et al.
Pubblicazione: (2025)
di: Reijtenbach, Rob, et al.
Pubblicazione: (2025)
Investigating the Robustness of Modelling Decisions for Few-Shot Cross-Topic Stance Detection: A Preregistered Study
di: Reuver, Myrthe, et al.
Pubblicazione: (2024)
di: Reuver, Myrthe, et al.
Pubblicazione: (2024)
TTPA: Token-level Tool-use Preference Alignment Training Framework with Fine-grained Evaluation
di: Huang, Chengrui, et al.
Pubblicazione: (2025)
di: Huang, Chengrui, et al.
Pubblicazione: (2025)
Undesirable Memorization in Large Language Models: A Survey
di: Satvaty, Ali, et al.
Pubblicazione: (2024)
di: Satvaty, Ali, et al.
Pubblicazione: (2024)
Unifying Search and Recommendation with Dual-View Representation Learning in a Generative Paradigm
di: Zhao, Jujia, et al.
Pubblicazione: (2025)
di: Zhao, Jujia, et al.
Pubblicazione: (2025)
ASLoRA: Adaptive Sharing Low-Rank Adaptation Across Layers
di: Hu, Junyan, et al.
Pubblicazione: (2024)
di: Hu, Junyan, et al.
Pubblicazione: (2024)
Disentangling Knowledge Representations for Large Language Model Editing
di: Zhang, Mengqi, et al.
Pubblicazione: (2025)
di: Zhang, Mengqi, et al.
Pubblicazione: (2025)
SPILL: Domain-Adaptive Intent Clustering based on Selection and Pooling with Large Language Models
di: Lin, I-Fan, et al.
Pubblicazione: (2025)
di: Lin, I-Fan, et al.
Pubblicazione: (2025)
Generate then Refine: Data Augmentation for Zero-shot Intent Detection
di: Lin, I-Fan, et al.
Pubblicazione: (2024)
di: Lin, I-Fan, et al.
Pubblicazione: (2024)
MELoRA: Mini-Ensemble Low-Rank Adapters for Parameter-Efficient Fine-Tuning
di: Ren, Pengjie, et al.
Pubblicazione: (2024)
di: Ren, Pengjie, et al.
Pubblicazione: (2024)
Self-Supervised Position Debiasing for Large Language Models
di: Liu, Zhongkun, et al.
Pubblicazione: (2024)
di: Liu, Zhongkun, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Tool Learning in the Wild: Empowering Language Models as Automatic Tool Agents
di: Shi, Zhengliang, et al.
Pubblicazione: (2024) -
Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers
di: Shi, Zhengliang, et al.
Pubblicazione: (2025) -
Retrieval Models Aren't Tool-Savvy: Benchmarking Tool Retrieval for Large Language Models
di: Shi, Zhengliang, et al.
Pubblicazione: (2025) -
Divide-Then-Aggregate: An Efficient Tool Learning Method via Parallel Tool Invocation
di: Zhu, Dongsheng, et al.
Pubblicazione: (2025) -
OpenReward: Learning to Reward Long-form Agentic Tasks via Reinforcement Learning
di: Hu, Ziyou, et al.
Pubblicazione: (2025)