Tempered Sequential Monte Carlo for Trajectory and Policy Optimization with Differentiable Dynamics
Fuente:
arXiv
Salvato in:
| Autore principale: | Yang, Heng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Flow-Opt: Scalable Centralized Multi-Robot Trajectory Optimization with Flow Matching and Differentiable Optimization
di: Idoko, Simon, et al.
Pubblicazione: (2025)
di: Idoko, Simon, et al.
Pubblicazione: (2025)
Quantum-Inspired Episode Selection for Monte Carlo Reinforcement Learning via QUBO Optimization
di: Salloum, Hadi, et al.
Pubblicazione: (2026)
di: Salloum, Hadi, et al.
Pubblicazione: (2026)
Diffusion Policy through Conditional Proximal Policy Optimization
di: Liu, Ben, et al.
Pubblicazione: (2026)
di: Liu, Ben, et al.
Pubblicazione: (2026)
Robust Adversarial Policy Optimization Under Dynamics Uncertainty
di: Kim, Mintae, et al.
Pubblicazione: (2026)
di: Kim, Mintae, et al.
Pubblicazione: (2026)
DiffTORI: Differentiable Trajectory Optimization for Deep Reinforcement and Imitation Learning
di: Wan, Weikang, et al.
Pubblicazione: (2024)
di: Wan, Weikang, et al.
Pubblicazione: (2024)
PolicyFlow: Policy Optimization with Continuous Normalizing Flow in Reinforcement Learning
di: Yang, Shunpeng, et al.
Pubblicazione: (2026)
di: Yang, Shunpeng, et al.
Pubblicazione: (2026)
Trajectory First: A Curriculum for Discovering Diverse Policies
di: Braun, Cornelius V., et al.
Pubblicazione: (2025)
di: Braun, Cornelius V., et al.
Pubblicazione: (2025)
Diffusion Policy Policy Optimization
di: Ren, Allen Z., et al.
Pubblicazione: (2024)
di: Ren, Allen Z., et al.
Pubblicazione: (2024)
Constrained Stein Variational Trajectory Optimization
di: Power, Thomas, et al.
Pubblicazione: (2023)
di: Power, Thomas, et al.
Pubblicazione: (2023)
Kinematics-aware Trajectory Generation and Prediction with Latent Stochastic Differential Modeling
di: Jiao, Ruochen, et al.
Pubblicazione: (2023)
di: Jiao, Ruochen, et al.
Pubblicazione: (2023)
Continuous Monte Carlo Graph Search
di: Kujanpää, Kalle, et al.
Pubblicazione: (2022)
di: Kujanpää, Kalle, et al.
Pubblicazione: (2022)
Constraint-Aware Diffusion Models for Trajectory Optimization
di: Li, Anjian, et al.
Pubblicazione: (2024)
di: Li, Anjian, et al.
Pubblicazione: (2024)
STITCH-OPE: Trajectory Stitching with Guided Diffusion for Off-Policy Evaluation
di: Goli, Hossein, et al.
Pubblicazione: (2025)
di: Goli, Hossein, et al.
Pubblicazione: (2025)
Gradient-based Trajectory Optimization with Parallelized Differentiable Traffic Simulation
di: Son, Sanghyun, et al.
Pubblicazione: (2024)
di: Son, Sanghyun, et al.
Pubblicazione: (2024)
FocalPolicy: Frequency-Optimized Chunking and Locally Anchored Flow Matching for Coherent Visuomotor Policy
di: He, Qian, et al.
Pubblicazione: (2026)
di: He, Qian, et al.
Pubblicazione: (2026)
Sequential Monte Carlo for Policy Optimization in Continuous POMDPs
di: Abdulsamad, Hany, et al.
Pubblicazione: (2025)
di: Abdulsamad, Hany, et al.
Pubblicazione: (2025)
Aligning Diffusion Model with Problem Constraints for Trajectory Optimization
di: Li, Anjian, et al.
Pubblicazione: (2025)
di: Li, Anjian, et al.
Pubblicazione: (2025)
Dichotomous Diffusion Policy Optimization
di: Liang, Ruiming, et al.
Pubblicazione: (2025)
di: Liang, Ruiming, et al.
Pubblicazione: (2025)
Accelerating Visual-Policy Learning through Parallel Differentiable Simulation
di: You, Haoxiang, et al.
Pubblicazione: (2025)
di: You, Haoxiang, et al.
Pubblicazione: (2025)
State-wise Constrained Policy Optimization
di: Zhao, Weiye, et al.
Pubblicazione: (2023)
di: Zhao, Weiye, et al.
Pubblicazione: (2023)
Provably Efficient Long-Horizon Exploration in Monte Carlo Tree Search through State Occupancy Regularization
di: Schramm, Liam, et al.
Pubblicazione: (2024)
di: Schramm, Liam, et al.
Pubblicazione: (2024)
SAC Flow: Sample-Efficient Reinforcement Learning of Flow-Based Policies via Velocity-Reparameterized Sequential Modeling
di: Zhang, Yixian, et al.
Pubblicazione: (2025)
di: Zhang, Yixian, et al.
Pubblicazione: (2025)
DiffuSolve: Diffusion-based Solver for Non-convex Trajectory Optimization
di: Li, Anjian, et al.
Pubblicazione: (2024)
di: Li, Anjian, et al.
Pubblicazione: (2024)
Learning to Coordinate: Distributed Meta-Trajectory Optimization Via Differentiable ADMM-DDP
di: Wang, Bingheng, et al.
Pubblicazione: (2025)
di: Wang, Bingheng, et al.
Pubblicazione: (2025)
Accelerating Model-Based Reinforcement Learning using Non-Linear Trajectory Optimization
di: Calì, Marco, et al.
Pubblicazione: (2025)
di: Calì, Marco, et al.
Pubblicazione: (2025)
Adaptive Diffusion Policy Optimization for Robotic Manipulation
di: Jiang, Huiyun, et al.
Pubblicazione: (2025)
di: Jiang, Huiyun, et al.
Pubblicazione: (2025)
ERPPO: Entropy Regularization-based Proximal Policy Optimization
di: Lee, Changha, et al.
Pubblicazione: (2026)
di: Lee, Changha, et al.
Pubblicazione: (2026)
MePoly: Max Entropy Polynomial Policy Optimization
di: Liu, Hang, et al.
Pubblicazione: (2026)
di: Liu, Hang, et al.
Pubblicazione: (2026)
STRAP: Robot Sub-Trajectory Retrieval for Augmented Policy Learning
di: Memmel, Marius, et al.
Pubblicazione: (2024)
di: Memmel, Marius, et al.
Pubblicazione: (2024)
Data Augmentation for Instruction Following Policies via Trajectory Segmentation
di: Höpner, Niklas, et al.
Pubblicazione: (2025)
di: Höpner, Niklas, et al.
Pubblicazione: (2025)
CGD: Constraint-Guided Diffusion Policies for UAV Trajectory Planning
di: Kondo, Kota, et al.
Pubblicazione: (2024)
di: Kondo, Kota, et al.
Pubblicazione: (2024)
Object-Centric World Models Meet Monte Carlo Tree Search
di: Vakhitov, Rodion, et al.
Pubblicazione: (2026)
di: Vakhitov, Rodion, et al.
Pubblicazione: (2026)
An Real-Sim-Real (RSR) Loop Framework for Generalizable Robotic Policy Transfer with Differentiable Simulation
di: Shi, Lu, et al.
Pubblicazione: (2025)
di: Shi, Lu, et al.
Pubblicazione: (2025)
Dynamics-Decoupled Trajectory Alignment for Sim-to-Real Transfer in Reinforcement Learning for Autonomous Driving
di: Steinecker, Thomas, et al.
Pubblicazione: (2025)
di: Steinecker, Thomas, et al.
Pubblicazione: (2025)
Optimizing Sensor Redundancy in Sequential Decision-Making Problems
di: Nüßlein, Jonas, et al.
Pubblicazione: (2024)
di: Nüßlein, Jonas, et al.
Pubblicazione: (2024)
Learning Generalizable Visuomotor Policy through Dynamics-Alignment
di: Lee, Dohyeok, et al.
Pubblicazione: (2025)
di: Lee, Dohyeok, et al.
Pubblicazione: (2025)
Enhancing Sample Efficiency and Exploration in Reinforcement Learning through the Integration of Diffusion Models and Proximal Policy Optimization
di: Gao, Tianci, et al.
Pubblicazione: (2024)
di: Gao, Tianci, et al.
Pubblicazione: (2024)
Uni-O4: Unifying Online and Offline Deep Reinforcement Learning with Multi-Step On-Policy Optimization
di: Lei, Kun, et al.
Pubblicazione: (2023)
di: Lei, Kun, et al.
Pubblicazione: (2023)
Task-Centric Policy Optimization from Misaligned Motion Priors
di: Zheng, Ziang, et al.
Pubblicazione: (2026)
di: Zheng, Ziang, et al.
Pubblicazione: (2026)
Contractive Diffusion Policies: Robust Action Diffusion via Contractive Score-Based Sampling with Differential Equations
di: Abyaneh, Amin, et al.
Pubblicazione: (2026)
di: Abyaneh, Amin, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Flow-Opt: Scalable Centralized Multi-Robot Trajectory Optimization with Flow Matching and Differentiable Optimization
di: Idoko, Simon, et al.
Pubblicazione: (2025) -
Quantum-Inspired Episode Selection for Monte Carlo Reinforcement Learning via QUBO Optimization
di: Salloum, Hadi, et al.
Pubblicazione: (2026) -
Diffusion Policy through Conditional Proximal Policy Optimization
di: Liu, Ben, et al.
Pubblicazione: (2026) -
Robust Adversarial Policy Optimization Under Dynamics Uncertainty
di: Kim, Mintae, et al.
Pubblicazione: (2026) -
DiffTORI: Differentiable Trajectory Optimization for Deep Reinforcement and Imitation Learning
di: Wan, Weikang, et al.
Pubblicazione: (2024)