Adapting LLM Agents with Universal Feedback in Communication
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Kuan, Lu, Yadong, Santacroce, Michael, Gong, Yeyun, Zhang, Chao, Shen, Yelong |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
OmniParser for Pure Vision Based GUI Agent
par: Lu, Yadong, et autres
Publié: (2024)
par: Lu, Yadong, et autres
Publié: (2024)
ToRA: A Tool-Integrated Reasoning Agent for Mathematical Problem Solving
par: Gou, Zhibin, et autres
Publié: (2023)
par: Gou, Zhibin, et autres
Publié: (2023)
Competition-Level Problems are Effective LLM Evaluators
par: Huang, Yiming, et autres
Publié: (2023)
par: Huang, Yiming, et autres
Publié: (2023)
Enhancing Chain-of-Thoughts Prompting with Iterative Bootstrapping in Large Language Models
par: Sun, Jiashuo, et autres
Publié: (2023)
par: Sun, Jiashuo, et autres
Publié: (2023)
CRITIC: Large Language Models Can Self-Correct with Tool-Interactive Critiquing
par: Gou, Zhibin, et autres
Publié: (2023)
par: Gou, Zhibin, et autres
Publié: (2023)
Key-Point-Driven Data Synthesis with its Enhancement on Mathematical Reasoning
par: Huang, Yiming, et autres
Publié: (2024)
par: Huang, Yiming, et autres
Publié: (2024)
Ensuring Safe and High-Quality Outputs: A Guideline Library Approach for Language Models
par: Luo, Yi, et autres
Publié: (2024)
par: Luo, Yi, et autres
Publié: (2024)
Exploring and Controlling Diversity in LLM-Agent Conversation
par: Chu, KuanChao, et autres
Publié: (2024)
par: Chu, KuanChao, et autres
Publié: (2024)
Rho-1: Not All Tokens Are What You Need
par: Lin, Zhenghao, et autres
Publié: (2024)
par: Lin, Zhenghao, et autres
Publié: (2024)
Training Agents with Weakly Supervised Feedback from Large Language Models
par: Gong, Dihong, et autres
Publié: (2024)
par: Gong, Dihong, et autres
Publié: (2024)
Overcoming Vocabulary Mismatch: Vocabulary-agnostic Teacher Guided Language Modeling
par: Shin, Haebin, et autres
Publié: (2025)
par: Shin, Haebin, et autres
Publié: (2025)
Critique-GRPO: Advancing LLM Reasoning with Natural Language and Numerical Feedback
par: Zhang, Xiaoying, et autres
Publié: (2025)
par: Zhang, Xiaoying, et autres
Publié: (2025)
Optimizing LLM-Based Multi-Agent System with Textual Feedback: A Case Study on Software Development
par: Shen, Ming, et autres
Publié: (2025)
par: Shen, Ming, et autres
Publié: (2025)
Enhancing Large Language Model Performance with Gradient-Based Parameter Selection
par: Li, Haoling, et autres
Publié: (2024)
par: Li, Haoling, et autres
Publié: (2024)
StreamAdapter: Efficient Test Time Adaptation from Contextual Streams
par: Muhtar, Dilxat, et autres
Publié: (2024)
par: Muhtar, Dilxat, et autres
Publié: (2024)
Soft Thinking: Unlocking the Reasoning Potential of LLMs in Continuous Concept Space
par: Zhang, Zhen, et autres
Publié: (2025)
par: Zhang, Zhen, et autres
Publié: (2025)
Process-based Self-Rewarding Language Models
par: Zhang, Shimao, et autres
Publié: (2025)
par: Zhang, Shimao, et autres
Publié: (2025)
Generative Prompt Internalization
par: Shin, Haebin, et autres
Publié: (2024)
par: Shin, Haebin, et autres
Publié: (2024)
LoRC: Low-Rank Compression for LLMs KV Cache with a Progressive Compression Strategy
par: Zhang, Rongzhi, et autres
Publié: (2024)
par: Zhang, Rongzhi, et autres
Publié: (2024)
SynthAgent: Adapting Web Agents with Synthetic Supervision
par: Wang, Zhaoyang, et autres
Publié: (2025)
par: Wang, Zhaoyang, et autres
Publié: (2025)
AutoAgent: A Fully-Automated and Zero-Code Framework for LLM Agents
par: Tang, Jiabin, et autres
Publié: (2025)
par: Tang, Jiabin, et autres
Publié: (2025)
Multi-LoRA Composition for Image Generation
par: Zhong, Ming, et autres
Publié: (2024)
par: Zhong, Ming, et autres
Publié: (2024)
WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning
par: Zhuang, Yuchen, et autres
Publié: (2025)
par: Zhuang, Yuchen, et autres
Publié: (2025)
Multi-Agent Comedy Club: Investigating Community Discussion Effects on LLM Humor Generation
par: Hong, Shiwei, et autres
Publié: (2026)
par: Hong, Shiwei, et autres
Publié: (2026)
GroundAct: Can LLM Agents Ground Actions in Environmental States?
par: Wang, Zixuan, et autres
Publié: (2025)
par: Wang, Zixuan, et autres
Publié: (2025)
One Adapts to Any: Meta Reward Modeling for Personalized LLM Alignment
par: Cai, Hongru, et autres
Publié: (2026)
par: Cai, Hongru, et autres
Publié: (2026)
Communication and Verification in LLM Agents towards Collaboration under Information Asymmetry
par: Peng, Run, et autres
Publié: (2025)
par: Peng, Run, et autres
Publié: (2025)
Exploring the Necessity of Reasoning in LLM-based Agent Scenarios
par: Zhou, Xueyang, et autres
Publié: (2025)
par: Zhou, Xueyang, et autres
Publié: (2025)
How Does Alignment Enhance LLMs' Multilingual Capabilities? A Language Neurons Perspective
par: Zhang, Shimao, et autres
Publié: (2025)
par: Zhang, Shimao, et autres
Publié: (2025)
Confirming Correct, Missing the Rest: LLM Tutoring Agents Struggle Where Feedback Matters Most
par: Yasir, Tahreem, et autres
Publié: (2026)
par: Yasir, Tahreem, et autres
Publié: (2026)
PlotGen: Multi-Agent LLM-based Scientific Data Visualization via Multimodal Feedback
par: Goswami, Kanika, et autres
Publié: (2025)
par: Goswami, Kanika, et autres
Publié: (2025)
QueryAgent: A Reliable and Efficient Reasoning Framework with Environmental Feedback-based Self-Correction
par: Huang, Xiang, et autres
Publié: (2024)
par: Huang, Xiang, et autres
Publié: (2024)
Simulating LLM-to-LLM Tutoring for Multilingual Math Feedback
par: Tonga, Junior Cedric, et autres
Publié: (2025)
par: Tonga, Junior Cedric, et autres
Publié: (2025)
Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training
par: Yang, Kailai, et autres
Publié: (2025)
par: Yang, Kailai, et autres
Publié: (2025)
Adopt $\neq$ Adapt: Longitudinal Analyses of LLM Conversations in the Wild
par: Hicke, Rebecca M. M., et autres
Publié: (2026)
par: Hicke, Rebecca M. M., et autres
Publié: (2026)
Multi-dimensional Data Analysis and Applications Basing on LLM Agents and Knowledge Graph Interactions
par: Wang, Xi, et autres
Publié: (2025)
par: Wang, Xi, et autres
Publié: (2025)
Igniting Creative Writing in Small Language Models: LLM-as-a-Judge versus Multi-Agent Refined Rewards
par: Wei, Xiaolong, et autres
Publié: (2025)
par: Wei, Xiaolong, et autres
Publié: (2025)
SkillAdaptor: Self-Adapting Skills for LLM Agents from Trajectories
par: Yu, Zhuoyun, et autres
Publié: (2026)
par: Yu, Zhuoyun, et autres
Publié: (2026)
Agent2World: Learning to Generate Symbolic World Models via Adaptive Multi-Agent Feedback
par: Hu, Mengkang, et autres
Publié: (2025)
par: Hu, Mengkang, et autres
Publié: (2025)
SpidR-Adapt: A Universal Speech Representation Model for Few-Shot Adaptation
par: Luthra, Mahi, et autres
Publié: (2025)
par: Luthra, Mahi, et autres
Publié: (2025)
Documents similaires
-
OmniParser for Pure Vision Based GUI Agent
par: Lu, Yadong, et autres
Publié: (2024) -
ToRA: A Tool-Integrated Reasoning Agent for Mathematical Problem Solving
par: Gou, Zhibin, et autres
Publié: (2023) -
Competition-Level Problems are Effective LLM Evaluators
par: Huang, Yiming, et autres
Publié: (2023) -
Enhancing Chain-of-Thoughts Prompting with Iterative Bootstrapping in Large Language Models
par: Sun, Jiashuo, et autres
Publié: (2023) -
CRITIC: Large Language Models Can Self-Correct with Tool-Interactive Critiquing
par: Gou, Zhibin, et autres
Publié: (2023)