SAND: Boosting LLM Agents with Self-Taught Action Deliberation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Xia, Yu, Shen, Yiran, Wu, Junda, Yu, Tong, Kim, Sungchul, Rossi, Ryan A., Yao, Lina, McAuley, Julian |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Multi-Agent Collaborative Filtering: Orchestrating Users and Items for Agentic Recommendations
par: Xia, Yu, et autres
Publié: (2025)
par: Xia, Yu, et autres
Publié: (2025)
DICE: Dynamic In-Context Example Selection in LLM Agents via Efficient Knowledge Transfer
par: Wang, Ruoyu, et autres
Publié: (2025)
par: Wang, Ruoyu, et autres
Publié: (2025)
Knowledge-Aware Query Expansion with Large Language Models for Textual and Relational Retrieval
par: Xia, Yu, et autres
Publié: (2024)
par: Xia, Yu, et autres
Publié: (2024)
Weakly-supervised VLM-guided Partial Contrastive Learning for Visual Language Navigation
par: Wang, Ruoyu, et autres
Publié: (2025)
par: Wang, Ruoyu, et autres
Publié: (2025)
Mitigating Visual Knowledge Forgetting in MLLM Instruction-tuning via Modality-decoupled Gradient Descent
par: Wu, Junda, et autres
Publié: (2025)
par: Wu, Junda, et autres
Publié: (2025)
CachePrune: Teaching LLMs What Not to Follow via KV-Cache Editing
par: Wang, Rui, et autres
Publié: (2025)
par: Wang, Rui, et autres
Publié: (2025)
In-context Ranking Preference Optimization
par: Wu, Junda, et autres
Publié: (2025)
par: Wu, Junda, et autres
Publié: (2025)
Federated Large Language Models: Current Progress and Future Directions
par: Yao, Yuhang, et autres
Publié: (2024)
par: Yao, Yuhang, et autres
Publié: (2024)
Listwise Preference Diffusion Optimization for User Behavior Trajectories Prediction
par: Huang, Hongtao, et autres
Publié: (2025)
par: Huang, Hongtao, et autres
Publié: (2025)
Skill-CMIB: Multimodal Agent Skill for Consistent Action via Conditional Multimodal Information Bottleneck
par: Huang, Zihan, et autres
Publié: (2026)
par: Huang, Zihan, et autres
Publié: (2026)
Active Learning for Direct Preference Optimization
par: Kveton, Branislav, et autres
Publié: (2025)
par: Kveton, Branislav, et autres
Publié: (2025)
OLIVIA: Online Learning via Inference-time Action Adaptation for Decision Making in LLM ReAct Agents
par: Yu, Sheldon, et autres
Publié: (2026)
par: Yu, Sheldon, et autres
Publié: (2026)
Evaluating Memory in LLM Agents via Incremental Multi-Turn Interactions
par: Hu, Yuanzhe, et autres
Publié: (2025)
par: Hu, Yuanzhe, et autres
Publié: (2025)
Pluralistic Off-policy Evaluation and Alignment
par: Huang, Chengkai, et autres
Publié: (2025)
par: Huang, Chengkai, et autres
Publié: (2025)
InstructGraph: Boosting Large Language Models via Graph-centric Instruction Tuning and Preference Alignment
par: Wang, Jianing, et autres
Publié: (2024)
par: Wang, Jianing, et autres
Publié: (2024)
Visual Prompting in Multimodal Large Language Models: A Survey
par: Wu, Junda, et autres
Publié: (2024)
par: Wu, Junda, et autres
Publié: (2024)
Towards Agentic Recommender Systems in the Era of Multimodal Large Language Models
par: Huang, Chengkai, et autres
Publié: (2025)
par: Huang, Chengkai, et autres
Publié: (2025)
A Low-Latency Fraud Detection Layer for Detecting Adversarial Interaction Patterns in LLM-Powered Agents
par: Yu, Sheldon, et autres
Publié: (2026)
par: Yu, Sheldon, et autres
Publié: (2026)
Evaluation on Entity Matching in Recommender Systems
par: Huang, Zihan, et autres
Publié: (2026)
par: Huang, Zihan, et autres
Publié: (2026)
CoMMIT: Coordinated Multimodal Instruction Tuning
par: Li, Xintong, et autres
Publié: (2024)
par: Li, Xintong, et autres
Publié: (2024)
Self-Updatable Large Language Models by Integrating Context into Model Parameters
par: Wang, Yu, et autres
Publié: (2024)
par: Wang, Yu, et autres
Publié: (2024)
Embedding-Informed Adaptive Retrieval-Augmented Generation of Large Language Models
par: Huang, Chengkai, et autres
Publié: (2024)
par: Huang, Chengkai, et autres
Publié: (2024)
Reddit2Deezer: A Scalable Dataset for Real-World Grounded Conversational Music Recommendation
par: Kim, Haven, et autres
Publié: (2026)
par: Kim, Haven, et autres
Publié: (2026)
FERA: Uncertainty-Aware Federated Reasoning for Large Language Models
par: Wang, Ruhan, et autres
Publié: (2026)
par: Wang, Ruhan, et autres
Publié: (2026)
From Reviews to Dialogues: Active Synthesis for Zero-Shot LLM-based Conversational Recommender System
par: Surana, Rohan, et autres
Publié: (2025)
par: Surana, Rohan, et autres
Publié: (2025)
Foundation Models for Recommender Systems: A Survey and New Perspectives
par: Huang, Chengkai, et autres
Publié: (2024)
par: Huang, Chengkai, et autres
Publié: (2024)
Importance Sampling for Multi-Negative Multimodal Direct Preference Optimization
par: Li, Xintong, et autres
Publié: (2025)
par: Li, Xintong, et autres
Publié: (2025)
MASS-DPO: Multi-negative Active Sample Selection for Direct Policy Optimization
par: Surana, Rohan, et autres
Publié: (2026)
par: Surana, Rohan, et autres
Publié: (2026)
A Survey on Personalized and Pluralistic Preference Alignment in Large Language Models
par: Xie, Zhouhang, et autres
Publié: (2025)
par: Xie, Zhouhang, et autres
Publié: (2025)
Skill-R1: Agent Skill Evolution via Reinforcement Learning
par: Vishe, Yash, et autres
Publié: (2026)
par: Vishe, Yash, et autres
Publié: (2026)
CoRAL: Collaborative Retrieval-Augmented Large Language Models Improve Long-tail Recommendation
par: Wu, Junda, et autres
Publié: (2024)
par: Wu, Junda, et autres
Publié: (2024)
Learning to Hint for Reinforcement Learning
par: Xia, Yu, et autres
Publié: (2026)
par: Xia, Yu, et autres
Publié: (2026)
Interactive Visualization Recommendation with Hier-SUCB
par: Hu, Songwen, et autres
Publié: (2025)
par: Hu, Songwen, et autres
Publié: (2025)
OCEAN: Offline Chain-of-thought Evaluation and Alignment in Large Language Models
par: Wu, Junda, et autres
Publié: (2024)
par: Wu, Junda, et autres
Publié: (2024)
Reinforcement Learning for Generative AI: A Survey
par: Cao, Yuanjiang, et autres
Publié: (2023)
par: Cao, Yuanjiang, et autres
Publié: (2023)
Dual Conditional Diffusion Models for Sequential Recommendation
par: Huang, Hongtao, et autres
Publié: (2024)
par: Huang, Hongtao, et autres
Publié: (2024)
AMPS: Adaptive Modality Preference Steering via Functional Entropy
par: Huang, Zihan, et autres
Publié: (2026)
par: Huang, Zihan, et autres
Publié: (2026)
Which LLM to Play? Convergence-Aware Online Model Selection with Time-Increasing Bandits
par: Xia, Yu, et autres
Publié: (2024)
par: Xia, Yu, et autres
Publié: (2024)
FusID: Modality-Fused Semantic IDs for Generative Music Recommendation
par: Kim, Haven, et autres
Publié: (2026)
par: Kim, Haven, et autres
Publié: (2026)
Three central limit theorems for the unbounded excursion component of a Gaussian field
par: McAuley, Michael
Publié: (2024)
par: McAuley, Michael
Publié: (2024)
Documents similaires
-
Multi-Agent Collaborative Filtering: Orchestrating Users and Items for Agentic Recommendations
par: Xia, Yu, et autres
Publié: (2025) -
DICE: Dynamic In-Context Example Selection in LLM Agents via Efficient Knowledge Transfer
par: Wang, Ruoyu, et autres
Publié: (2025) -
Knowledge-Aware Query Expansion with Large Language Models for Textual and Relational Retrieval
par: Xia, Yu, et autres
Publié: (2024) -
Weakly-supervised VLM-guided Partial Contrastive Learning for Visual Language Navigation
par: Wang, Ruoyu, et autres
Publié: (2025) -
Mitigating Visual Knowledge Forgetting in MLLM Instruction-tuning via Modality-decoupled Gradient Descent
par: Wu, Junda, et autres
Publié: (2025)