DODT: Enhanced Online Decision Transformer Learning through Dreamer's Actor-Critic Trajectory Forecasting
Fuente:
arXiv
Guardado en:
| Autores principales: | Jiang, Eric Hanchen, Zhang, Zhi, Zhang, Dinghuai, Lizarraga, Andrew, Xu, Chenheng, Zhang, Yasi, Zhao, Siyan, Xu, Zhengjie, Yu, Peiyu, Tang, Yuer, Kong, Deqian, Wu, Ying Nian |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Generative Actor Critic
por: Qin, Aoyang, et al.
Publicado: (2025)
por: Qin, Aoyang, et al.
Publicado: (2025)
Unlocking the Potential of Text-to-Image Diffusion with PAC-Bayesian Theory
por: Jiang, Eric Hanchen, et al.
Publicado: (2024)
por: Jiang, Eric Hanchen, et al.
Publicado: (2024)
Object-Conditioned Energy-Based Attention Map Alignment in Text-to-Image Diffusion Models
por: Zhang, Yasi, et al.
Publicado: (2024)
por: Zhang, Yasi, et al.
Publicado: (2024)
"Noisier" Noise Contrastive Eestimation is (Almost) Maximum Likelihood
por: Yu, Peiyu, et al.
Publicado: (2024)
por: Yu, Peiyu, et al.
Publicado: (2024)
Latent Plan Transformer for Trajectory Abstraction: Planning as Latent Space Inference
por: Kong, Deqian, et al.
Publicado: (2024)
por: Kong, Deqian, et al.
Publicado: (2024)
Multivariate Long-term Time Series Forecasting with Fourier Neural Filter
por: Xu, Chenheng, et al.
Publicado: (2025)
por: Xu, Chenheng, et al.
Publicado: (2025)
Flow Priors for Linear Inverse Problems via Iterative Corrupted Trajectory Matching
por: Zhang, Yasi, et al.
Publicado: (2024)
por: Zhang, Yasi, et al.
Publicado: (2024)
Molecule Design by Latent Prompt Transformer
por: Kong, Deqian, et al.
Publicado: (2023)
por: Kong, Deqian, et al.
Publicado: (2023)
Place Cells as Multi-Scale Position Embeddings: Random Walk Transition Kernels for Path Planning
por: Zhao, Minglu, et al.
Publicado: (2025)
por: Zhao, Minglu, et al.
Publicado: (2025)
A minimalistic representation model for head direction system
por: Zhao, Minglu, et al.
Publicado: (2024)
por: Zhao, Minglu, et al.
Publicado: (2024)
Latent Adaptive Planner for Dynamic Manipulation
por: Noh, Donghun, et al.
Publicado: (2025)
por: Noh, Donghun, et al.
Publicado: (2025)
CTSAC: Curriculum-Based Transformer Soft Actor-Critic for Goal-Oriented Robot Exploration
por: Yang, Chunyu, et al.
Publicado: (2025)
por: Yang, Chunyu, et al.
Publicado: (2025)
FFT-Accelerated Auxiliary Variable MCMC for Fermionic Lattice Models: A Determinant-Free Approach with $O(N\log N)$ Complexity
por: Kong, Deqian, et al.
Publicado: (2025)
por: Kong, Deqian, et al.
Publicado: (2025)
Provably Convergent Actor-Critic for MARL through Risk-aversion
por: Zhang, Yizhou, et al.
Publicado: (2026)
por: Zhang, Yizhou, et al.
Publicado: (2026)
Enhancing Decision-Making of Large Language Models via Actor-Critic
por: Dong, Heng, et al.
Publicado: (2025)
por: Dong, Heng, et al.
Publicado: (2025)
D2 Actor Critic: Diffusion Actor Meets Distributional Critic
por: Zhang, Lunjun, et al.
Publicado: (2025)
por: Zhang, Lunjun, et al.
Publicado: (2025)
Controlling Large Language Model-based Agents for Large-Scale Decision-Making: An Actor-Critic Approach
por: Zhang, Bin, et al.
Publicado: (2023)
por: Zhang, Bin, et al.
Publicado: (2023)
Zeroth-Order Actor-Critic: An Evolutionary Framework for Sequential Decision Problems
por: Lei, Yuheng, et al.
Publicado: (2022)
por: Lei, Yuheng, et al.
Publicado: (2022)
Learning Difference-of-Convex Regularizers for Inverse Problems: A Flexible Framework with Theoretical Guarantees
por: Zhang, Yasi, et al.
Publicado: (2025)
por: Zhang, Yasi, et al.
Publicado: (2025)
TraceGraph: Shared Decision Landscapes for Diagnosing and Improving Agent Trajectories
por: Nian, Junjie, et al.
Publicado: (2026)
por: Nian, Junjie, et al.
Publicado: (2026)
Statistical Guarantees for Lifelong Reinforcement Learning using PAC-Bayes Theory
por: Zhang, Zhi, et al.
Publicado: (2024)
por: Zhang, Zhi, et al.
Publicado: (2024)
Molecule Design by Latent Prompt Transformer
por: Kong, Deqian, et al.
Publicado: (2024)
por: Kong, Deqian, et al.
Publicado: (2024)
A Distributed Actor‐Critic Learning Approach for Affine Formation Control of Multi‐Robots With Unknown Dynamics
por: Ronghua Zhang, et al.
Publicado: (2025)
por: Ronghua Zhang, et al.
Publicado: (2025)
Rethinking Soft Actor-Critic in High-Dimensional Action Spaces: The Cost of Ignoring Distribution Shift
por: Chen, Yanjun, et al.
Publicado: (2024)
por: Chen, Yanjun, et al.
Publicado: (2024)
Caffarelli-Kohn-Nirenberg Inequalities in Weak Lebesgue Spaces
por: Wang, Dinghuai
Publicado: (2026)
por: Wang, Dinghuai
Publicado: (2026)
Initialization is Critical to Whether Transformers Fit Composite Functions by Reasoning or Memorizing
por: Zhang, Zhongwang, et al.
Publicado: (2024)
por: Zhang, Zhongwang, et al.
Publicado: (2024)
Latent Space Energy-based Neural ODEs
por: Cheng, Sheng, et al.
Publicado: (2024)
por: Cheng, Sheng, et al.
Publicado: (2024)
Adaptive Horizon Actor-Critic for Policy Learning in Contact-Rich Differentiable Simulation
por: Georgiev, Ignat, et al.
Publicado: (2024)
por: Georgiev, Ignat, et al.
Publicado: (2024)
TransDreamerV3: Implanting Transformer In DreamerV3
por: Dongare, Shruti Sadanand, et al.
Publicado: (2025)
por: Dongare, Shruti Sadanand, et al.
Publicado: (2025)
Finite-Time Complexity of Online Primal-Dual Natural Actor-Critic Algorithm for Constrained Markov Decision Processes
por: Zeng, Sihan, et al.
Publicado: (2021)
por: Zeng, Sihan, et al.
Publicado: (2021)
Interior Eigensolver Based on Rational Filter with Composite rule
por: Chen, Yuer, et al.
Publicado: (2023)
por: Chen, Yuer, et al.
Publicado: (2023)
Theoretical Understanding of In-Context Learning in Shallow Transformers with Unstructured Data
por: Xing, Yue, et al.
Publicado: (2024)
por: Xing, Yue, et al.
Publicado: (2024)
Seizing Serendipity: Exploiting the Value of Past Success in Off-Policy Actor-Critic
por: Ji, Tianying, et al.
Publicado: (2023)
por: Ji, Tianying, et al.
Publicado: (2023)
Actor-Critic without Actor
por: Ki, Donghyeon, et al.
Publicado: (2025)
por: Ki, Donghyeon, et al.
Publicado: (2025)
Asymmetric Actor-Critic for Multi-turn LLM Agents
por: Jiang, Shuli, et al.
Publicado: (2026)
por: Jiang, Shuli, et al.
Publicado: (2026)
PanoDreamer: Consistent Text to 360-Degree Scene Generation
por: Xiong, Zhexiao, et al.
Publicado: (2025)
por: Xiong, Zhexiao, et al.
Publicado: (2025)
Understanding Galaxy Morphology Evolution Through Cosmic Time via Redshift Conditioned Diffusion Models
por: Lizarraga, Andrew, et al.
Publicado: (2024)
por: Lizarraga, Andrew, et al.
Publicado: (2024)
Out-of-Sight Embodied Agents: Multimodal Tracking, Sensor Fusion, and Trajectory Forecasting
por: Zhang, Haichao, et al.
Publicado: (2025)
por: Zhang, Haichao, et al.
Publicado: (2025)
A Novel Dual‐Layer Genetic Algorithm With Parameter Interaction Framework for Battery Parameter Identification
por: Rui Liu, et al.
Publicado: (2025)
por: Rui Liu, et al.
Publicado: (2025)
3D$^2$-Actor: Learning Pose-Conditioned 3D-Aware Denoiser for Realistic Gaussian Avatar Modeling
por: Tang, Zichen, et al.
Publicado: (2024)
por: Tang, Zichen, et al.
Publicado: (2024)
Ejemplares similares
-
Generative Actor Critic
por: Qin, Aoyang, et al.
Publicado: (2025) -
Unlocking the Potential of Text-to-Image Diffusion with PAC-Bayesian Theory
por: Jiang, Eric Hanchen, et al.
Publicado: (2024) -
Object-Conditioned Energy-Based Attention Map Alignment in Text-to-Image Diffusion Models
por: Zhang, Yasi, et al.
Publicado: (2024) -
"Noisier" Noise Contrastive Eestimation is (Almost) Maximum Likelihood
por: Yu, Peiyu, et al.
Publicado: (2024) -
Latent Plan Transformer for Trajectory Abstraction: Planning as Latent Space Inference
por: Kong, Deqian, et al.
Publicado: (2024)