Internalizing Agency from Reflective Experience
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ge, Rui, Fu, Yichao, Qian, Yuyang, Su, Junda, Zhao, Yiming, Zhao, Peng, Zhang, Hao |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
When Drafts Evolve: Speculative Decoding Meets Online Learning
par: Qian, Yu-Yang, et autres
Publié: (2026)
par: Qian, Yu-Yang, et autres
Publié: (2026)
d3LLM: Ultra-Fast Diffusion LLM using Pseudo-Trajectory Distillation
par: Qian, Yu-Yang, et autres
Publié: (2026)
par: Qian, Yu-Yang, et autres
Publié: (2026)
Enhancing LLM Agents for Code Generation with Possibility and Pass-rate Prioritized Experience Replay
par: Chen, Yuyang, et autres
Publié: (2024)
par: Chen, Yuyang, et autres
Publié: (2024)
Reflection-Bench: Evaluating Epistemic Agency in Large Language Models
par: Li, Lingyu, et autres
Publié: (2024)
par: Li, Lingyu, et autres
Publié: (2024)
Efficient Diversity-based Experience Replay for Deep Reinforcement Learning
par: Zhao, Kaiyan, et autres
Publié: (2024)
par: Zhao, Kaiyan, et autres
Publié: (2024)
Internalizing Meta-Experience into Memory for Guided Reinforcement Learning in Large Language Models
par: Huang, Shiting, et autres
Publié: (2026)
par: Huang, Shiting, et autres
Publié: (2026)
Multi-Modal Experience Inspired AI Creation
par: Cao, Qian, et autres
Publié: (2022)
par: Cao, Qian, et autres
Publié: (2022)
PEAM: Parametric Embodied Agent Memory through Contrastive Internalization of Experience in Minecraft
par: Guo, Yuchen, et autres
Publié: (2026)
par: Guo, Yuchen, et autres
Publié: (2026)
Reinforced Internal-External Knowledge Synergistic Reasoning for Efficient Adaptive Search Agent
par: Huang, Ziyang, et autres
Publié: (2025)
par: Huang, Ziyang, et autres
Publié: (2025)
Active Inference as a Model of Agency
par: Da Costa, Lancelot, et autres
Publié: (2024)
par: Da Costa, Lancelot, et autres
Publié: (2024)
REFLECTOR: Internalizing Step-wise Reflection against Indirect Jailbreak
par: Ma, Jiachen, et autres
Publié: (2026)
par: Ma, Jiachen, et autres
Publié: (2026)
The First Place Solution of WSDM Cup 2024: Leveraging Large Language Models for Conversational Multi-Doc QA
par: Li, Yiming, et autres
Publié: (2024)
par: Li, Yiming, et autres
Publié: (2024)
Experience-Guided Reflective Co-Evolution of Prompts and Heuristics for Automatic Algorithm Design
par: Liu, Yihong, et autres
Publié: (2025)
par: Liu, Yihong, et autres
Publié: (2025)
Reflection of Episodes: Learning to Play Game from Expert and Self Experiences
par: Xu, Xiaojie, et autres
Publié: (2025)
par: Xu, Xiaojie, et autres
Publié: (2025)
Energy-Efficient Autonomous Driving with Adaptive Perception and Robust Decision
par: Xia, Yuyang, et autres
Publié: (2025)
par: Xia, Yuyang, et autres
Publié: (2025)
Learning to Learn from Multimodal Experience
par: Sui, Xingyu, et autres
Publié: (2026)
par: Sui, Xingyu, et autres
Publié: (2026)
GameVerse: Can Vision-Language Models Learn from Video-based Reflection?
par: Zhang, Kuan, et autres
Publié: (2026)
par: Zhang, Kuan, et autres
Publié: (2026)
Safety Instincts: LLMs Learn to Trust Their Internal Compass for Self-Defense
par: Shen, Guobin, et autres
Publié: (2025)
par: Shen, Guobin, et autres
Publié: (2025)
ProtoCycle: Reflective Tool-Augmented Planning for Text-Guided Protein Design
par: Ge, Yutang, et autres
Publié: (2026)
par: Ge, Yutang, et autres
Publié: (2026)
Variational Prefix Tuning for Diverse and Accurate Code Summarization Using Pre-trained Language Models
par: Zhao, Junda, et autres
Publié: (2025)
par: Zhao, Junda, et autres
Publié: (2025)
Internal Cross-layer Gradients for Extending Homogeneity to Heterogeneity in Federated Learning
par: Chan, Yun-Hin, et autres
Publié: (2023)
par: Chan, Yun-Hin, et autres
Publié: (2023)
Reflective Preference Optimization (RPO): Enhancing On-Policy Alignment via Hint-Guided Reflection
par: Zhao, Zihui, et autres
Publié: (2025)
par: Zhao, Zihui, et autres
Publié: (2025)
From Exposure to Internalization: Dual-Stream Calibration for In-context Clinical Reasoning
par: Zhao, Chuang, et autres
Publié: (2026)
par: Zhao, Chuang, et autres
Publié: (2026)
CLEAR: Context Augmentation from Contrastive Learning of Experience via Agentic Reflection
par: Liu, Linbo, et autres
Publié: (2026)
par: Liu, Linbo, et autres
Publié: (2026)
Restoring Real-World Images with an Internal Detail Enhancement Diffusion Model
par: Xiao, Peng, et autres
Publié: (2025)
par: Xiao, Peng, et autres
Publié: (2025)
Do LLMs Experience an Internal Polylogue? Investigating Reasoning through the Lens of Personas
par: Herrmann, Nils A., et autres
Publié: (2026)
par: Herrmann, Nils A., et autres
Publié: (2026)
TARSE: Test-Time Adaptation via Retrieval of Skills and Experience for Reasoning Agents
par: Wang, Junda, et autres
Publié: (2026)
par: Wang, Junda, et autres
Publié: (2026)
AppAgent-Pro: A Proactive GUI Agent System for Multidomain Information Integration and User Assistance
par: Zhao, Yuyang, et autres
Publié: (2025)
par: Zhao, Yuyang, et autres
Publié: (2025)
Do Not Merge My Model! Safeguarding Open-Source LLMs Against Unauthorized Model Merging
par: Li, Qinfeng, et autres
Publié: (2025)
par: Li, Qinfeng, et autres
Publié: (2025)
AJ-Bench: Benchmarking Agent-as-a-Judge for Environment-Aware Evaluation
par: Shi, Wentao, et autres
Publié: (2026)
par: Shi, Wentao, et autres
Publié: (2026)
Med-REFL: Medical Reasoning Enhancement via Self-Corrected Fine-grained Reflection
par: Yang, Zongxian, et autres
Publié: (2025)
par: Yang, Zongxian, et autres
Publié: (2025)
System Design for Maintaining Internal State Consistency in Long-Horizon Robotic Tabletop Games
par: Zhao, Guangyu, et autres
Publié: (2026)
par: Zhao, Guangyu, et autres
Publié: (2026)
SAMULE: Self-Learning Agents Enhanced by Multi-level Reflection
par: Ge, Yubin, et autres
Publié: (2025)
par: Ge, Yubin, et autres
Publié: (2025)
Maximizing User Experience with LLMOps-Driven Personalized Recommendation Systems
par: Shi, Chenxi, et autres
Publié: (2024)
par: Shi, Chenxi, et autres
Publié: (2024)
Human-Inspired Continuous Learning of Internal Reasoning Processes: Learning How to Think for Adaptive AI Systems
par: Su, Hong
Publié: (2026)
par: Su, Hong
Publié: (2026)
ReAgent: Reversible Multi-Agent Reasoning for Knowledge-Enhanced Multi-Hop QA
par: Zhao, Xinjie, et autres
Publié: (2025)
par: Zhao, Xinjie, et autres
Publié: (2025)
SkillBrew: Multi-Objective Curation of Skill Banks for LLM Agents
par: Hu, Wentao, et autres
Publié: (2026)
par: Hu, Wentao, et autres
Publié: (2026)
MedGuideX: Internalizing Decision Logic from Executable Guidelines into Large Language Models for Clinical Reasoning
par: Shen, Yuhao, et autres
Publié: (2026)
par: Shen, Yuhao, et autres
Publié: (2026)
ChatThero: An LLM-Supported Chatbot for Behavior Change and Therapeutic Support in Addiction Recovery
par: Wang, Junda, et autres
Publié: (2025)
par: Wang, Junda, et autres
Publié: (2025)
Generalized Out-of-distribution Fault Diagnosis (GOOFD) via Internal Contrastive Learning
par: Wang, Xingyue, et autres
Publié: (2023)
par: Wang, Xingyue, et autres
Publié: (2023)
Documents similaires
-
When Drafts Evolve: Speculative Decoding Meets Online Learning
par: Qian, Yu-Yang, et autres
Publié: (2026) -
d3LLM: Ultra-Fast Diffusion LLM using Pseudo-Trajectory Distillation
par: Qian, Yu-Yang, et autres
Publié: (2026) -
Enhancing LLM Agents for Code Generation with Possibility and Pass-rate Prioritized Experience Replay
par: Chen, Yuyang, et autres
Publié: (2024) -
Reflection-Bench: Evaluating Epistemic Agency in Large Language Models
par: Li, Lingyu, et autres
Publié: (2024) -
Efficient Diversity-based Experience Replay for Deep Reinforcement Learning
par: Zhao, Kaiyan, et autres
Publié: (2024)