Introspective Planning: Aligning Robots' Uncertainty with Inherent Task Ambiguity
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liang, Kaiqu, Zhang, Zixu, Fisac, Jaime Fernández |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
RLHS: Mitigating Misalignment in RLHF with Hindsight Simulation
par: Liang, Kaiqu, et autres
Publié: (2025)
par: Liang, Kaiqu, et autres
Publié: (2025)
Machine Bullshit: Characterizing the Emergent Disregard for Truth in Large Language Models
par: Liang, Kaiqu, et autres
Publié: (2025)
par: Liang, Kaiqu, et autres
Publié: (2025)
Learning Personalized Agents from Human Feedback
par: Liang, Kaiqu, et autres
Publié: (2026)
par: Liang, Kaiqu, et autres
Publié: (2026)
The Role of Ambiguity in Error Prediction via Uncertainty Quantification
par: Staliūnaitė, Ieva Raminta, et autres
Publié: (2026)
par: Staliūnaitė, Ieva Raminta, et autres
Publié: (2026)
Beyond Introspection: Reinforcing Thinking via Externalist Behavioral Feedback
par: Yang, Diji, et autres
Publié: (2024)
par: Yang, Diji, et autres
Publié: (2024)
Recursive Introspection: Teaching Language Model Agents How to Self-Improve
par: Qu, Yuxiao, et autres
Publié: (2024)
par: Qu, Yuxiao, et autres
Publié: (2024)
Zero-Overhead Introspection for Adaptive Test-Time Compute
par: Manvi, Rohin, et autres
Publié: (2025)
par: Manvi, Rohin, et autres
Publié: (2025)
CARE: Decoding Time Safety Alignment via Rollback and Introspection Intervention
par: Hu, Xiaomeng, et autres
Publié: (2025)
par: Hu, Xiaomeng, et autres
Publié: (2025)
IntroLM: Introspective Language Models via Prefilling-Time Self-Evaluation
par: Kasnavieh, Hossein Hosseini, et autres
Publié: (2026)
par: Kasnavieh, Hossein Hosseini, et autres
Publié: (2026)
MambaQuant: Quantizing the Mamba Family with Variance Aligned Rotation Methods
par: Xu, Zukang, et autres
Publié: (2025)
par: Xu, Zukang, et autres
Publié: (2025)
KASER: Knowledge-Aligned Student Error Simulator for Open-Ended Coding Tasks
par: Duan, Zhangqi, et autres
Publié: (2026)
par: Duan, Zhangqi, et autres
Publié: (2026)
Aligning LLMs with Human Uncertainty: A Beta-Bernoulli Calibrator for LLM Forecasting
par: Dai, Hui, et autres
Publié: (2026)
par: Dai, Hui, et autres
Publié: (2026)
The Alignment Tax: Response Homogenization in Aligned LLMs and Its Implications for Uncertainty Estimation
par: Liu, Mingyi
Publié: (2026)
par: Liu, Mingyi
Publié: (2026)
Reflect then Learn: Active Prompting for Information Extraction Guided by Introspective Confusion
par: Zhao, Dong, et autres
Publié: (2025)
par: Zhao, Dong, et autres
Publié: (2025)
Uncertainty of Thoughts: Uncertainty-Aware Planning Enhances Information Seeking in Large Language Models
par: Hu, Zhiyuan, et autres
Publié: (2024)
par: Hu, Zhiyuan, et autres
Publié: (2024)
Who Plays First? Optimizing the Order of Play in Stackelberg Games with Many Robots
par: Hu, Haimin, et autres
Publié: (2024)
par: Hu, Haimin, et autres
Publié: (2024)
Line Goes Up? Inherent Limitations of Benchmarks for Evaluating Large Language Models
par: Fodor, James
Publié: (2025)
par: Fodor, James
Publié: (2025)
Resolving Intent Ambiguities by Retrieving Discriminative Clarifying Questions
par: Dhole, Kaustubh D.
Publié: (2020)
par: Dhole, Kaustubh D.
Publié: (2020)
Learning to Align, Aligning to Learn: A Unified Approach for Self-Optimized Alignment
par: Wang, Haowen, et autres
Publié: (2025)
par: Wang, Haowen, et autres
Publié: (2025)
Efficient Non-Parametric Uncertainty Quantification for Black-Box Large Language Models and Decision Planning
par: Tsai, Yao-Hung Hubert, et autres
Publié: (2024)
par: Tsai, Yao-Hung Hubert, et autres
Publié: (2024)
Visualizing Uncertainty in Translation Tasks: An Evaluation of LLM Performance and Confidence Metrics
par: Park, Jin Hyun, et autres
Publié: (2025)
par: Park, Jin Hyun, et autres
Publié: (2025)
From Introspection to Best Practices: Principled Analysis of Demonstrations in Multimodal In-Context Learning
par: Xu, Nan, et autres
Publié: (2024)
par: Xu, Nan, et autres
Publié: (2024)
RIV: Recursive Introspection Mask Diffusion Vision Language Model
par: Li, YuQian, et autres
Publié: (2025)
par: Li, YuQian, et autres
Publié: (2025)
Efficient Nearest Neighbor based Uncertainty Estimation for Natural Language Processing Tasks
par: Hashimoto, Wataru, et autres
Publié: (2024)
par: Hashimoto, Wataru, et autres
Publié: (2024)
Stabilizing MoE Reinforcement Learning by Aligning Training and Inference Routers
par: Ma, Wenhan, et autres
Publié: (2025)
par: Ma, Wenhan, et autres
Publié: (2025)
Native Sparse Attention: Hardware-Aligned and Natively Trainable Sparse Attention
par: Yuan, Jingyang, et autres
Publié: (2025)
par: Yuan, Jingyang, et autres
Publié: (2025)
CLEAR: Revealing How Noise and Ambiguity Degrade Reliability in LLMs for Medicine
par: Guo, Kevin H., et autres
Publié: (2026)
par: Guo, Kevin H., et autres
Publié: (2026)
CodecLM: Aligning Language Models with Tailored Synthetic Data
par: Wang, Zifeng, et autres
Publié: (2024)
par: Wang, Zifeng, et autres
Publié: (2024)
Large Language Models Understanding: an Inherent Ambiguity Barrier
par: Nissani, Daniel N.
Publié: (2025)
par: Nissani, Daniel N.
Publié: (2025)
Aligning Large Language Models via Fine-grained Supervision
par: Xu, Dehong, et autres
Publié: (2024)
par: Xu, Dehong, et autres
Publié: (2024)
Self-Rewarding PPO: Aligning Large Language Models with Demonstrations Only
par: Zhang, Qingru, et autres
Publié: (2025)
par: Zhang, Qingru, et autres
Publié: (2025)
Align to Structure: Aligning Large Language Models with Structural Information
par: Kim, Zae Myung, et autres
Publié: (2025)
par: Kim, Zae Myung, et autres
Publié: (2025)
GradAlign: Gradient-Aligned Data Selection for LLM Reinforcement Learning
par: Yang, Ningyuan, et autres
Publié: (2026)
par: Yang, Ningyuan, et autres
Publié: (2026)
Grammar-Aligned Decoding
par: Park, Kanghee, et autres
Publié: (2024)
par: Park, Kanghee, et autres
Publié: (2024)
A Human-Like Reasoning Framework for Multi-Phases Planning Task with Large Language Models
par: Xie, Chengxing, et autres
Publié: (2024)
par: Xie, Chengxing, et autres
Publié: (2024)
Construct, Align, and Reason: Large Ontology Models for Enterprise Knowledge Management
par: Zhang, Yao, et autres
Publié: (2026)
par: Zhang, Yao, et autres
Publié: (2026)
AlignDistil: Token-Level Language Model Alignment as Adaptive Policy Distillation
par: Zhang, Songming, et autres
Publié: (2025)
par: Zhang, Songming, et autres
Publié: (2025)
Long Exposure: Accelerating Parameter-Efficient Fine-Tuning for LLMs under Shadowy Sparsity
par: Wang, Tuowei, et autres
Publié: (2025)
par: Wang, Tuowei, et autres
Publié: (2025)
From Specific-MLLMs to Omni-MLLMs: A Survey on MLLMs Aligned with Multi-modalities
par: Jiang, Shixin, et autres
Publié: (2024)
par: Jiang, Shixin, et autres
Publié: (2024)
AgentGen: Enhancing Planning Abilities for Large Language Model based Agent via Environment and Task Generation
par: Hu, Mengkang, et autres
Publié: (2024)
par: Hu, Mengkang, et autres
Publié: (2024)
Documents similaires
-
RLHS: Mitigating Misalignment in RLHF with Hindsight Simulation
par: Liang, Kaiqu, et autres
Publié: (2025) -
Machine Bullshit: Characterizing the Emergent Disregard for Truth in Large Language Models
par: Liang, Kaiqu, et autres
Publié: (2025) -
Learning Personalized Agents from Human Feedback
par: Liang, Kaiqu, et autres
Publié: (2026) -
The Role of Ambiguity in Error Prediction via Uncertainty Quantification
par: Staliūnaitė, Ieva Raminta, et autres
Publié: (2026) -
Beyond Introspection: Reinforcing Thinking via Externalist Behavioral Feedback
par: Yang, Diji, et autres
Publié: (2024)