Salvato in:
| Autori principali: | Feng, Lang, Gu, Pengjie, An, Bo, Pan, Gang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2405.17879 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
State-Covering Trajectory Stitching for Diffusion Planners
di: Lee, Kyowoon, et al.
Pubblicazione: (2025)
di: Lee, Kyowoon, et al.
Pubblicazione: (2025)
Accelerating Diffusion Planners in Offline RL via Reward-Aware Consistency Trajectory Distillation
di: Duan, Xintong, et al.
Pubblicazione: (2025)
di: Duan, Xintong, et al.
Pubblicazione: (2025)
An Online Spatial-Temporal Graph Trajectory Planner for Autonomous Vehicles
di: Samiuddin, Jilan, et al.
Pubblicazione: (2024)
di: Samiuddin, Jilan, et al.
Pubblicazione: (2024)
Bidirectional Distillation: A Mixed-Play Framework for Multi-Agent Generalizable Behaviors
di: Feng, Lang, et al.
Pubblicazione: (2025)
di: Feng, Lang, et al.
Pubblicazione: (2025)
What Makes a Good Diffusion Planner for Decision Making?
di: Lu, Haofei, et al.
Pubblicazione: (2025)
di: Lu, Haofei, et al.
Pubblicazione: (2025)
Offline Trajectory Optimization for Offline Reinforcement Learning
di: Zhao, Ziqi, et al.
Pubblicazione: (2024)
di: Zhao, Ziqi, et al.
Pubblicazione: (2024)
Latent Embedding Adaptation for Human Preference Alignment in Diffusion Planners
di: Ng, Wen Zheng Terence, et al.
Pubblicazione: (2025)
di: Ng, Wen Zheng Terence, et al.
Pubblicazione: (2025)
Risk-Informed Diffusion Transformer for Long-Tail Trajectory Prediction in the Crash Scenario
di: Chen, Junlan, et al.
Pubblicazione: (2025)
di: Chen, Junlan, et al.
Pubblicazione: (2025)
DDGAD: Trajectory Dynamics for Diffusion-Based Graph Anomaly Detection
di: Yang, Yuxin, et al.
Pubblicazione: (2026)
di: Yang, Yuxin, et al.
Pubblicazione: (2026)
Group-in-Group Policy Optimization for LLM Agent Training
di: Feng, Lang, et al.
Pubblicazione: (2025)
di: Feng, Lang, et al.
Pubblicazione: (2025)
Post-Training as Reweighting: A Stochastic View of Reasoning Trajectories in Language Models
di: Bu, Dake, et al.
Pubblicazione: (2025)
di: Bu, Dake, et al.
Pubblicazione: (2025)
Task-Agnostic Pre-training and Task-Guided Fine-tuning for Versatile Diffusion Planner
di: Fan, Chenyou, et al.
Pubblicazione: (2024)
di: Fan, Chenyou, et al.
Pubblicazione: (2024)
Offline Reinforcement Learning: Role of State Aggregation and Trajectory Data
di: Jia, Zeyu, et al.
Pubblicazione: (2024)
di: Jia, Zeyu, et al.
Pubblicazione: (2024)
Planner and Executor: Collaboration between Discrete Diffusion And Autoregressive Models in Reasoning
di: Berrayana, Lina, et al.
Pubblicazione: (2025)
di: Berrayana, Lina, et al.
Pubblicazione: (2025)
Recurrent Stochastic Configuration Networks with Incremental Blocks
di: Dang, Gang, et al.
Pubblicazione: (2024)
di: Dang, Gang, et al.
Pubblicazione: (2024)
Hierarchy-of-Groups Policy Optimization for Long-Horizon Agentic Tasks
di: He, Shuo, et al.
Pubblicazione: (2026)
di: He, Shuo, et al.
Pubblicazione: (2026)
Dr. MAS: Stable Reinforcement Learning for Multi-Agent LLM Systems
di: Feng, Lang, et al.
Pubblicazione: (2026)
di: Feng, Lang, et al.
Pubblicazione: (2026)
Stochastic Diffusion: A Diffusion Probabilistic Model for Stochastic Time Series Forecasting
di: Liu, Yuansan, et al.
Pubblicazione: (2024)
di: Liu, Yuansan, et al.
Pubblicazione: (2024)
Fine-grained Analysis of Stability and Generalization for Stochastic Bilevel Optimization
di: Zhang, Xuelin, et al.
Pubblicazione: (2026)
di: Zhang, Xuelin, et al.
Pubblicazione: (2026)
Grounding Generative Planners in Verifiable Logic: A Hybrid Architecture for Trustworthy Embodied AI
di: Wu, Feiyu, et al.
Pubblicazione: (2026)
di: Wu, Feiyu, et al.
Pubblicazione: (2026)
Improving the Generalization of Unseen Crowd Behaviors for Reinforcement Learning based Local Motion Planners
di: Ng, Wen Zheng Terence, et al.
Pubblicazione: (2024)
di: Ng, Wen Zheng Terence, et al.
Pubblicazione: (2024)
Clarifying Shampoo: Adapting Spectral Descent to Stochasticity and the Parameter Trajectory
di: Eschenhagen, Runa, et al.
Pubblicazione: (2026)
di: Eschenhagen, Runa, et al.
Pubblicazione: (2026)
VALUE: Value-Aware Large Language Model for Query Rewriting via Weighted Trie in Sponsored Search
di: Zhang, Xiao, et al.
Pubblicazione: (2025)
di: Zhang, Xiao, et al.
Pubblicazione: (2025)
Latent Adaptive Planner for Dynamic Manipulation
di: Noh, Donghun, et al.
Pubblicazione: (2025)
di: Noh, Donghun, et al.
Pubblicazione: (2025)
GenPlan: Generative Sequence Models as Adaptive Planners
di: Karthikeyan, Akash, et al.
Pubblicazione: (2024)
di: Karthikeyan, Akash, et al.
Pubblicazione: (2024)
Choosing a Classical Planner with Graph Neural Networks
di: Vatter, Jana, et al.
Pubblicazione: (2024)
di: Vatter, Jana, et al.
Pubblicazione: (2024)
Understanding the Skill Gap in Recurrent Language Models: The Role of the Gather-and-Aggregate Mechanism
di: Bick, Aviv, et al.
Pubblicazione: (2025)
di: Bick, Aviv, et al.
Pubblicazione: (2025)
Learning Flexible Forward Trajectories for Masked Molecular Diffusion
di: Seo, Hyunjin, et al.
Pubblicazione: (2025)
di: Seo, Hyunjin, et al.
Pubblicazione: (2025)
World Models via Policy-Guided Trajectory Diffusion
di: Rigter, Marc, et al.
Pubblicazione: (2023)
di: Rigter, Marc, et al.
Pubblicazione: (2023)
Frontier Large Language Models Rival State-of-the-Art Planners
di: Corrêa, Augusto B., et al.
Pubblicazione: (2025)
di: Corrêa, Augusto B., et al.
Pubblicazione: (2025)
AgentOCR: Reimagining Agent History via Optical Self-Compression
di: Feng, Lang, et al.
Pubblicazione: (2026)
di: Feng, Lang, et al.
Pubblicazione: (2026)
On the Error-Correcting Effects of Stochasticity in Discrete Diffusion
di: Yuan, William, et al.
Pubblicazione: (2026)
di: Yuan, William, et al.
Pubblicazione: (2026)
Selective Reviews of Bandit Problems in AI via a Statistical View
di: Zhou, Pengjie, et al.
Pubblicazione: (2024)
di: Zhou, Pengjie, et al.
Pubblicazione: (2024)
Reliable Trajectory Prediction and Uncertainty Quantification with Conditioned Diffusion Models
di: Neumeier, Marion, et al.
Pubblicazione: (2024)
di: Neumeier, Marion, et al.
Pubblicazione: (2024)
TrajWeaver: Trajectory Recovery with State Propagation Diffusion Model
di: Wang, Jinming, et al.
Pubblicazione: (2024)
di: Wang, Jinming, et al.
Pubblicazione: (2024)
Generating Counterfactual Trajectories with Latent Diffusion Models for Concept Discovery
di: Varshney, Payal, et al.
Pubblicazione: (2024)
di: Varshney, Payal, et al.
Pubblicazione: (2024)
Policy Regularization on Globally Accessible States in Cross-Dynamics Reinforcement Learning
di: Xue, Zhenghai, et al.
Pubblicazione: (2025)
di: Xue, Zhenghai, et al.
Pubblicazione: (2025)
Variance-Reduction Guidance: Sampling Trajectory Optimization for Diffusion Models
di: Xu, Shifeng, et al.
Pubblicazione: (2025)
di: Xu, Shifeng, et al.
Pubblicazione: (2025)
Traj-Transformer: Diffusion Models with Transformer for GPS Trajectory Generation
di: Zhang, Zhiyang, et al.
Pubblicazione: (2025)
di: Zhang, Zhiyang, et al.
Pubblicazione: (2025)
TRACE: Trajectory Recovery with State Propagation Diffusion for Urban Mobility
di: Wang, Jinming, et al.
Pubblicazione: (2026)
di: Wang, Jinming, et al.
Pubblicazione: (2026)
Documenti analoghi
-
State-Covering Trajectory Stitching for Diffusion Planners
di: Lee, Kyowoon, et al.
Pubblicazione: (2025) -
Accelerating Diffusion Planners in Offline RL via Reward-Aware Consistency Trajectory Distillation
di: Duan, Xintong, et al.
Pubblicazione: (2025) -
An Online Spatial-Temporal Graph Trajectory Planner for Autonomous Vehicles
di: Samiuddin, Jilan, et al.
Pubblicazione: (2024) -
Bidirectional Distillation: A Mixed-Play Framework for Multi-Agent Generalizable Behaviors
di: Feng, Lang, et al.
Pubblicazione: (2025) -
What Makes a Good Diffusion Planner for Decision Making?
di: Lu, Haofei, et al.
Pubblicazione: (2025)