Dynamic Correction of Erroneous State Estimates via Diffusion Bayesian Exploration
Fuente:
arXiv
Saved in:
| Main Authors: | Shi, Yiwei, Ma, Hongnan, Yang, Mengyue, Liu, Cunjia, Liu, Weiru |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
TriShGAN: Enhancing Sparsity and Robustness in Multivariate Time Series Counterfactuals Explanation
by: Ma, Hongnan, et al.
Published: (2025)
by: Ma, Hongnan, et al.
Published: (2025)
Attention-Driven Hierarchical Reinforcement Learning with Particle Filtering for Source Localization in Dynamic Fields
by: Shi, Yiwei, et al.
Published: (2025)
by: Shi, Yiwei, et al.
Published: (2025)
Beyond Prior Limits: Addressing Distribution Misalignment in Particle Filtering
by: Shi, Yiwei, et al.
Published: (2025)
by: Shi, Yiwei, et al.
Published: (2025)
Autonomous Goal Detection and Cessation in Reinforcement Learning: A Case Study on Source Term Estimation
by: Shi, Yiwei, et al.
Published: (2024)
by: Shi, Yiwei, et al.
Published: (2024)
Distill-Belief: Closed-Loop Inverse Source Localization and Characterization in Physical Fields
by: Shi, Yiwei, et al.
Published: (2026)
by: Shi, Yiwei, et al.
Published: (2026)
Fine-Grained Interpretation of Political Opinions in Large Language Models
by: Hu, Jingyu, et al.
Published: (2025)
by: Hu, Jingyu, et al.
Published: (2025)
StakeBench: Evaluating Language Understanding Grounded in Market Commitment
by: Pei, Yunhua, et al.
Published: (2026)
by: Pei, Yunhua, et al.
Published: (2026)
Invariant Causal Routing for Governing Social Norms in Online Market Economies
by: Yu, Xiangning, et al.
Published: (2026)
by: Yu, Xiangning, et al.
Published: (2026)
MMErroR: A Benchmark for Erroneous Reasoning in Vision-Language Models
by: Shi, Yang, et al.
Published: (2026)
by: Shi, Yang, et al.
Published: (2026)
A User Study on Contrastive Explanations for Multi-Effector Temporal Planning with Non-Stationary Costs
by: Liu, Xiaowei, et al.
Published: (2024)
by: Liu, Xiaowei, et al.
Published: (2024)
TSFeatLIME: An Online User Study in Enhancing Explainability in Univariate Time Series Forecasting
by: Ma, Hongnan, et al.
Published: (2024)
by: Ma, Hongnan, et al.
Published: (2024)
Mitigating Degree Bias Adaptively with Hard-to-Learn Nodes in Graph Contrastive Learning
by: Hu, Jingyu, et al.
Published: (2025)
by: Hu, Jingyu, et al.
Published: (2025)
Federated Learning of Dynamic Bayesian Network via Continuous Optimization from Time Series Data
by: Chen, Jianhong, et al.
Published: (2024)
by: Chen, Jianhong, et al.
Published: (2024)
ProxiMix: Enhancing Fairness with Proximity Samples in Subgroups
by: Hu, Jingyu, et al.
Published: (2024)
by: Hu, Jingyu, et al.
Published: (2024)
Estimating the Effects of Sample Training Orders for Large Language Models without Retraining
by: Yang, Hao, et al.
Published: (2025)
by: Yang, Hao, et al.
Published: (2025)
Seeking the Sufficiency and Necessity Causal Features in Multimodal Representation Learning
by: Chen, Boyu, et al.
Published: (2024)
by: Chen, Boyu, et al.
Published: (2024)
WavefrontDiffusion: Dynamic Decoding Schedule for Improved Reasoning
by: Yang, Haojin, et al.
Published: (2025)
by: Yang, Haojin, et al.
Published: (2025)
Reimagining Parameter Space Exploration with Diffusion Models
by: Zhang, Lijun, et al.
Published: (2025)
by: Zhang, Lijun, et al.
Published: (2025)
Beyond Markovian: Reflective Exploration via Bayes-Adaptive RL for LLM Reasoning
by: Zhang, Shenao, et al.
Published: (2025)
by: Zhang, Shenao, et al.
Published: (2025)
SPEAR: Structured Pruning for Spiking Neural Networks via Synaptic Operation Estimation and Reinforcement Learning
by: Xie, Hui, et al.
Published: (2025)
by: Xie, Hui, et al.
Published: (2025)
RuleReasoner: Reinforced Rule-based Reasoning via Domain-aware Dynamic Sampling
by: Liu, Yang, et al.
Published: (2025)
by: Liu, Yang, et al.
Published: (2025)
Invariant Learning via Probability of Sufficient and Necessary Causes
by: Yang, Mengyue, et al.
Published: (2023)
by: Yang, Mengyue, et al.
Published: (2023)
Selective Preference Optimization via Token-Level Reward Function Estimation
by: Yang, Kailai, et al.
Published: (2024)
by: Yang, Kailai, et al.
Published: (2024)
Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation
by: Shi, Dingyuan, et al.
Published: (2024)
by: Shi, Dingyuan, et al.
Published: (2024)
Deep Dense Exploration for LLM Reinforcement Learning via Pivot-Driven Resampling
by: Guo, Yiran, et al.
Published: (2026)
by: Guo, Yiran, et al.
Published: (2026)
$ϕ$-Decoding: Adaptive Foresight Sampling for Balanced Inference-Time Exploration and Exploitation
by: Xu, Fangzhi, et al.
Published: (2025)
by: Xu, Fangzhi, et al.
Published: (2025)
MMG: Mutual Information Estimation via the MMSE Gap in Diffusion
by: Yu, Longxuan, et al.
Published: (2025)
by: Yu, Longxuan, et al.
Published: (2025)
CoLD: Counterfactually-Guided Length Debiasing for Process Reward Models in Mathematical Reasoning
by: Zheng, Congmin, et al.
Published: (2025)
by: Zheng, Congmin, et al.
Published: (2025)
HEALing Entropy Collapse: Enhancing Exploration in Few-Shot RLVR via Hybrid-Domain Entropy Dynamics Alignment
by: Liu, Zhanyu, et al.
Published: (2026)
by: Liu, Zhanyu, et al.
Published: (2026)
From Faithfulness to Correctness: Generative Reward Models that Think Critically
by: Ma, Qiyao, et al.
Published: (2025)
by: Ma, Qiyao, et al.
Published: (2025)
Knapsack RL: Unlocking Exploration of LLMs via Optimizing Budget Allocation
by: Li, Ziniu, et al.
Published: (2025)
by: Li, Ziniu, et al.
Published: (2025)
Your Absorbing Discrete Diffusion Secretly Models the Bayesian Posterior
by: Doyle, Cooper
Published: (2025)
by: Doyle, Cooper
Published: (2025)
DavIR: Data Selection via Implicit Reward for Large Language Models
by: Zhou, Haotian, et al.
Published: (2023)
by: Zhou, Haotian, et al.
Published: (2023)
StateX: Enhancing RNN Recall via Post-training State Expansion
by: Shen, Xingyu, et al.
Published: (2025)
by: Shen, Xingyu, et al.
Published: (2025)
CriticBench: Benchmarking LLMs for Critique-Correct Reasoning
by: Lin, Zicheng, et al.
Published: (2024)
by: Lin, Zicheng, et al.
Published: (2024)
Sculpting Memory: Multi-Concept Forgetting in Diffusion Models via Dynamic Mask and Concept-Aware Optimization
by: Li, Gen, et al.
Published: (2025)
by: Li, Gen, et al.
Published: (2025)
FairNet: Dynamic Fairness Correction without Performance Loss via Contrastive Conditional LoRA
by: Zhou, Songqi, et al.
Published: (2025)
by: Zhou, Songqi, et al.
Published: (2025)
Input-Adaptive Generative Dynamics in Diffusion Models
by: Xing, Yucheng, et al.
Published: (2024)
by: Xing, Yucheng, et al.
Published: (2024)
MetaState: Persistent Working Memory Enhances Reasoning in Discrete Diffusion Language Models
by: Xia, Kejing, et al.
Published: (2026)
by: Xia, Kejing, et al.
Published: (2026)
Meta-DiffuB: A Contextualized Sequence-to-Sequence Text Diffusion Model with Meta-Exploration
by: Chuang, Yun-Yen, et al.
Published: (2024)
by: Chuang, Yun-Yen, et al.
Published: (2024)
Similar Items
-
TriShGAN: Enhancing Sparsity and Robustness in Multivariate Time Series Counterfactuals Explanation
by: Ma, Hongnan, et al.
Published: (2025) -
Attention-Driven Hierarchical Reinforcement Learning with Particle Filtering for Source Localization in Dynamic Fields
by: Shi, Yiwei, et al.
Published: (2025) -
Beyond Prior Limits: Addressing Distribution Misalignment in Particle Filtering
by: Shi, Yiwei, et al.
Published: (2025) -
Autonomous Goal Detection and Cessation in Reinforcement Learning: A Case Study on Source Term Estimation
by: Shi, Yiwei, et al.
Published: (2024) -
Distill-Belief: Closed-Loop Inverse Source Localization and Characterization in Physical Fields
by: Shi, Yiwei, et al.
Published: (2026)