DAIL: Beyond Task Ambiguity for Language-Conditioned Reinforcement Learning
Fuente:
arXiv
Saved in:
| Main Authors: | Xie, Runpeng, Wang, Quanwei, Hu, Hao, Zhou, Zherui, Mu, Ni, Li, Xiyun, Yang, Yiqin, Xu, Shuang, Zhao, Qianchuan, XU, Bo |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
DPMT: Dual Process Multi-scale Theory of Mind Framework for Real-time Human-AI Collaboration
by: Li, Xiyun, et al.
Published: (2025)
by: Li, Xiyun, et al.
Published: (2025)
GlobeDiff: State Diffusion Process for Partial Observability in Multi-Agent Systems
by: Yang, Yiqin, et al.
Published: (2026)
by: Yang, Yiqin, et al.
Published: (2026)
SC2Arena and StarEvolve: Benchmark and Self-Improvement Framework for LLMs in Complex Decision-Making Tasks
by: Shen, Pengbo, et al.
Published: (2025)
by: Shen, Pengbo, et al.
Published: (2025)
Fewer May Be Better: Enhancing Offline Reinforcement Learning with Reduced Dataset
by: Yang, Yiqin, et al.
Published: (2025)
by: Yang, Yiqin, et al.
Published: (2025)
CLARIFY: Contrastive Preference Reinforcement Learning for Untangling Ambiguous Queries
by: Mu, Ni, et al.
Published: (2025)
by: Mu, Ni, et al.
Published: (2025)
S-EPOA: Overcoming the Indistinguishability of Segments with Skill-Driven Preference-Based Reinforcement Learning
by: Mu, Ni, et al.
Published: (2024)
by: Mu, Ni, et al.
Published: (2024)
STAIR: Addressing Stage Misalignment through Temporal-Aligned Preference Reinforcement Learning
by: Luan, Yao, et al.
Published: (2025)
by: Luan, Yao, et al.
Published: (2025)
MrCoM: A Meta-Regularized World-Model Generalizing Across Multi-Scenarios
by: Xiong, Xuantang, et al.
Published: (2025)
by: Xiong, Xuantang, et al.
Published: (2025)
Bayesian Design Principles for Offline-to-Online Reinforcement Learning
by: Hu, Hao, et al.
Published: (2024)
by: Hu, Hao, et al.
Published: (2024)
OPRIDE: Offline Preference-based Reinforcement Learning via In-Dataset Exploration
by: Yang, Yiqin, et al.
Published: (2026)
by: Yang, Yiqin, et al.
Published: (2026)
Data-Enabled Policy and Value Iteration for Continuous-Time Linear Quadratic Output Feedback Control
by: Xie, Jun, et al.
Published: (2026)
by: Xie, Jun, et al.
Published: (2026)
An Efficient Data-Driven Framework for Linear Quadratic Output Feedback Control
by: Xie, Jun, et al.
Published: (2025)
by: Xie, Jun, et al.
Published: (2025)
Episodic Novelty Through Temporal Distance
by: Jiang, Yuhua, et al.
Published: (2025)
by: Jiang, Yuhua, et al.
Published: (2025)
DSAC: Distributional Soft Actor-Critic for Risk-Sensitive Reinforcement Learning
by: Ma, Xiaoteng, et al.
Published: (2020)
by: Ma, Xiaoteng, et al.
Published: (2020)
COLLIE: Guiding Skill Discovery in Semantically Coherent Latent Space
by: Luan, Yao, et al.
Published: (2026)
by: Luan, Yao, et al.
Published: (2026)
Theoretical Investigations and Practical Enhancements on Tail Task Risk Minimization in Meta Learning
by: Lv, Yiqin, et al.
Published: (2024)
by: Lv, Yiqin, et al.
Published: (2024)
A Two-Stage Masked Autoencoder Based Network for Indoor Depth Completion
by: Sun, Kailai, et al.
Published: (2024)
by: Sun, Kailai, et al.
Published: (2024)
Reinforced Lifelong Editing for Language Models
by: Li, Zherui, et al.
Published: (2025)
by: Li, Zherui, et al.
Published: (2025)
Priority-based Energy Allocation in Buildings through Distributed Model Predictive Control
by: Li, Hongyi, et al.
Published: (2024)
by: Li, Hongyi, et al.
Published: (2024)
PISmith: Reinforcement Learning-based Red Teaming for Prompt Injection Defenses
by: Yin, Chenlong, et al.
Published: (2026)
by: Yin, Chenlong, et al.
Published: (2026)
A$^2$Search: Ambiguity-Aware Question Answering with Reinforcement Learning
by: Zhang, Fengji, et al.
Published: (2025)
by: Zhang, Fengji, et al.
Published: (2025)
Minimizing Maximum Latency of Task Offloading for Multi-UAV-assisted Maritime Search and Rescue
by: Qi, Shuang, et al.
Published: (2025)
by: Qi, Shuang, et al.
Published: (2025)
Left invariant complex Finsler metrics on a complex Lie group
by: Xu, Xiyun, et al.
Published: (2025)
by: Xu, Xiyun, et al.
Published: (2025)
Very standard homogeneous Finsler manifolds with positive flag curvature
by: Xu, Xiyun, et al.
Published: (2025)
by: Xu, Xiyun, et al.
Published: (2025)
Geodesic orbit and weak symmetric spray manifolds
by: Xu, Xiyun, et al.
Published: (2024)
by: Xu, Xiyun, et al.
Published: (2024)
Learning from Many and Adapting to the Unknown in Open-set Test Streams
by: Zhang, Xiao, et al.
Published: (2026)
by: Zhang, Xiao, et al.
Published: (2026)
LKFMixer: Exploring Large Kernel Feature For Efficient Image Super-Resolution
by: Tang, Yinggan, et al.
Published: (2025)
by: Tang, Yinggan, et al.
Published: (2025)
Beyond Nuclear Ambiguity
by: Gerli, Michele
Published: (2022)
by: Gerli, Michele
Published: (2022)
Joint Computation Offloading and Resource Management for Cooperative Satellite-Aerial-Marine Internet of Things Networks
by: Qi, Shuang, et al.
Published: (2025)
by: Qi, Shuang, et al.
Published: (2025)
Preference-based Multi-Objective Reinforcement Learning
by: Mu, Ni, et al.
Published: (2025)
by: Mu, Ni, et al.
Published: (2025)
Breach in the Shield: Unveiling the Vulnerabilities of Large Language Models
by: Dai, Runpeng, et al.
Published: (2025)
by: Dai, Runpeng, et al.
Published: (2025)
Robust Risk-Sensitive Reinforcement Learning with Conditional Value-at-Risk
by: Ni, Xinyi, et al.
Published: (2024)
by: Ni, Xinyi, et al.
Published: (2024)
Long-Run Conditional Value-at-Risk Reinforcement Learning
by: Wang, Qixin, et al.
Published: (2026)
by: Wang, Qixin, et al.
Published: (2026)
Robotic Task Ambiguity Resolution via Natural Language Interaction
by: Chisari, Eugenio, et al.
Published: (2025)
by: Chisari, Eugenio, et al.
Published: (2025)
Benchmarking Massively Parallelized Multi-Task Reinforcement Learning for Robotics Tasks
by: Joshi, Viraj, et al.
Published: (2025)
by: Joshi, Viraj, et al.
Published: (2025)
Jailbreaking Large Language Diffusion Models: Revealing Hidden Safety Flaws in Diffusion-Based Text Generation
by: Zhang, Yuanhe, et al.
Published: (2025)
by: Zhang, Yuanhe, et al.
Published: (2025)
Organic Matter Accumulation in the Upper Permian Dalong Formation from the Lower Yangtze Region, South China
by: Chaogang FANG, et al.
Published: (2024)
by: Chaogang FANG, et al.
Published: (2024)
Task Aware Dreamer for Task Generalization in Reinforcement Learning
by: Ying, Chengyang, et al.
Published: (2023)
by: Ying, Chengyang, et al.
Published: (2023)
A Knowledge-enhanced Two-stage Generative Framework for Medical Dialogue Information Extraction
by: Hu, Zefa, et al.
Published: (2023)
by: Hu, Zefa, et al.
Published: (2023)
Robust Exploratory Stopping under Ambiguity in Reinforcement Learning
by: Ye, Junyan, et al.
Published: (2025)
by: Ye, Junyan, et al.
Published: (2025)
Similar Items
-
DPMT: Dual Process Multi-scale Theory of Mind Framework for Real-time Human-AI Collaboration
by: Li, Xiyun, et al.
Published: (2025) -
GlobeDiff: State Diffusion Process for Partial Observability in Multi-Agent Systems
by: Yang, Yiqin, et al.
Published: (2026) -
SC2Arena and StarEvolve: Benchmark and Self-Improvement Framework for LLMs in Complex Decision-Making Tasks
by: Shen, Pengbo, et al.
Published: (2025) -
Fewer May Be Better: Enhancing Offline Reinforcement Learning with Reduced Dataset
by: Yang, Yiqin, et al.
Published: (2025) -
CLARIFY: Contrastive Preference Reinforcement Learning for Untangling Ambiguous Queries
by: Mu, Ni, et al.
Published: (2025)