Enregistré dans:
| Auteurs principaux: | Feng, Lang, Gu, Pengjie, An, Bo, Pan, Gang |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2405.17879 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
State-Covering Trajectory Stitching for Diffusion Planners
par: Lee, Kyowoon, et autres
Publié: (2025)
par: Lee, Kyowoon, et autres
Publié: (2025)
Accelerating Diffusion Planners in Offline RL via Reward-Aware Consistency Trajectory Distillation
par: Duan, Xintong, et autres
Publié: (2025)
par: Duan, Xintong, et autres
Publié: (2025)
An Online Spatial-Temporal Graph Trajectory Planner for Autonomous Vehicles
par: Samiuddin, Jilan, et autres
Publié: (2024)
par: Samiuddin, Jilan, et autres
Publié: (2024)
Bidirectional Distillation: A Mixed-Play Framework for Multi-Agent Generalizable Behaviors
par: Feng, Lang, et autres
Publié: (2025)
par: Feng, Lang, et autres
Publié: (2025)
What Makes a Good Diffusion Planner for Decision Making?
par: Lu, Haofei, et autres
Publié: (2025)
par: Lu, Haofei, et autres
Publié: (2025)
Offline Trajectory Optimization for Offline Reinforcement Learning
par: Zhao, Ziqi, et autres
Publié: (2024)
par: Zhao, Ziqi, et autres
Publié: (2024)
Latent Embedding Adaptation for Human Preference Alignment in Diffusion Planners
par: Ng, Wen Zheng Terence, et autres
Publié: (2025)
par: Ng, Wen Zheng Terence, et autres
Publié: (2025)
Risk-Informed Diffusion Transformer for Long-Tail Trajectory Prediction in the Crash Scenario
par: Chen, Junlan, et autres
Publié: (2025)
par: Chen, Junlan, et autres
Publié: (2025)
DDGAD: Trajectory Dynamics for Diffusion-Based Graph Anomaly Detection
par: Yang, Yuxin, et autres
Publié: (2026)
par: Yang, Yuxin, et autres
Publié: (2026)
Group-in-Group Policy Optimization for LLM Agent Training
par: Feng, Lang, et autres
Publié: (2025)
par: Feng, Lang, et autres
Publié: (2025)
Post-Training as Reweighting: A Stochastic View of Reasoning Trajectories in Language Models
par: Bu, Dake, et autres
Publié: (2025)
par: Bu, Dake, et autres
Publié: (2025)
Task-Agnostic Pre-training and Task-Guided Fine-tuning for Versatile Diffusion Planner
par: Fan, Chenyou, et autres
Publié: (2024)
par: Fan, Chenyou, et autres
Publié: (2024)
Offline Reinforcement Learning: Role of State Aggregation and Trajectory Data
par: Jia, Zeyu, et autres
Publié: (2024)
par: Jia, Zeyu, et autres
Publié: (2024)
Planner and Executor: Collaboration between Discrete Diffusion And Autoregressive Models in Reasoning
par: Berrayana, Lina, et autres
Publié: (2025)
par: Berrayana, Lina, et autres
Publié: (2025)
Recurrent Stochastic Configuration Networks with Incremental Blocks
par: Dang, Gang, et autres
Publié: (2024)
par: Dang, Gang, et autres
Publié: (2024)
Hierarchy-of-Groups Policy Optimization for Long-Horizon Agentic Tasks
par: He, Shuo, et autres
Publié: (2026)
par: He, Shuo, et autres
Publié: (2026)
Dr. MAS: Stable Reinforcement Learning for Multi-Agent LLM Systems
par: Feng, Lang, et autres
Publié: (2026)
par: Feng, Lang, et autres
Publié: (2026)
Stochastic Diffusion: A Diffusion Probabilistic Model for Stochastic Time Series Forecasting
par: Liu, Yuansan, et autres
Publié: (2024)
par: Liu, Yuansan, et autres
Publié: (2024)
Fine-grained Analysis of Stability and Generalization for Stochastic Bilevel Optimization
par: Zhang, Xuelin, et autres
Publié: (2026)
par: Zhang, Xuelin, et autres
Publié: (2026)
Grounding Generative Planners in Verifiable Logic: A Hybrid Architecture for Trustworthy Embodied AI
par: Wu, Feiyu, et autres
Publié: (2026)
par: Wu, Feiyu, et autres
Publié: (2026)
Improving the Generalization of Unseen Crowd Behaviors for Reinforcement Learning based Local Motion Planners
par: Ng, Wen Zheng Terence, et autres
Publié: (2024)
par: Ng, Wen Zheng Terence, et autres
Publié: (2024)
Clarifying Shampoo: Adapting Spectral Descent to Stochasticity and the Parameter Trajectory
par: Eschenhagen, Runa, et autres
Publié: (2026)
par: Eschenhagen, Runa, et autres
Publié: (2026)
VALUE: Value-Aware Large Language Model for Query Rewriting via Weighted Trie in Sponsored Search
par: Zhang, Xiao, et autres
Publié: (2025)
par: Zhang, Xiao, et autres
Publié: (2025)
Latent Adaptive Planner for Dynamic Manipulation
par: Noh, Donghun, et autres
Publié: (2025)
par: Noh, Donghun, et autres
Publié: (2025)
GenPlan: Generative Sequence Models as Adaptive Planners
par: Karthikeyan, Akash, et autres
Publié: (2024)
par: Karthikeyan, Akash, et autres
Publié: (2024)
Choosing a Classical Planner with Graph Neural Networks
par: Vatter, Jana, et autres
Publié: (2024)
par: Vatter, Jana, et autres
Publié: (2024)
Understanding the Skill Gap in Recurrent Language Models: The Role of the Gather-and-Aggregate Mechanism
par: Bick, Aviv, et autres
Publié: (2025)
par: Bick, Aviv, et autres
Publié: (2025)
Learning Flexible Forward Trajectories for Masked Molecular Diffusion
par: Seo, Hyunjin, et autres
Publié: (2025)
par: Seo, Hyunjin, et autres
Publié: (2025)
World Models via Policy-Guided Trajectory Diffusion
par: Rigter, Marc, et autres
Publié: (2023)
par: Rigter, Marc, et autres
Publié: (2023)
Frontier Large Language Models Rival State-of-the-Art Planners
par: Corrêa, Augusto B., et autres
Publié: (2025)
par: Corrêa, Augusto B., et autres
Publié: (2025)
AgentOCR: Reimagining Agent History via Optical Self-Compression
par: Feng, Lang, et autres
Publié: (2026)
par: Feng, Lang, et autres
Publié: (2026)
On the Error-Correcting Effects of Stochasticity in Discrete Diffusion
par: Yuan, William, et autres
Publié: (2026)
par: Yuan, William, et autres
Publié: (2026)
Selective Reviews of Bandit Problems in AI via a Statistical View
par: Zhou, Pengjie, et autres
Publié: (2024)
par: Zhou, Pengjie, et autres
Publié: (2024)
Reliable Trajectory Prediction and Uncertainty Quantification with Conditioned Diffusion Models
par: Neumeier, Marion, et autres
Publié: (2024)
par: Neumeier, Marion, et autres
Publié: (2024)
TrajWeaver: Trajectory Recovery with State Propagation Diffusion Model
par: Wang, Jinming, et autres
Publié: (2024)
par: Wang, Jinming, et autres
Publié: (2024)
Generating Counterfactual Trajectories with Latent Diffusion Models for Concept Discovery
par: Varshney, Payal, et autres
Publié: (2024)
par: Varshney, Payal, et autres
Publié: (2024)
Policy Regularization on Globally Accessible States in Cross-Dynamics Reinforcement Learning
par: Xue, Zhenghai, et autres
Publié: (2025)
par: Xue, Zhenghai, et autres
Publié: (2025)
Variance-Reduction Guidance: Sampling Trajectory Optimization for Diffusion Models
par: Xu, Shifeng, et autres
Publié: (2025)
par: Xu, Shifeng, et autres
Publié: (2025)
Traj-Transformer: Diffusion Models with Transformer for GPS Trajectory Generation
par: Zhang, Zhiyang, et autres
Publié: (2025)
par: Zhang, Zhiyang, et autres
Publié: (2025)
TRACE: Trajectory Recovery with State Propagation Diffusion for Urban Mobility
par: Wang, Jinming, et autres
Publié: (2026)
par: Wang, Jinming, et autres
Publié: (2026)
Documents similaires
-
State-Covering Trajectory Stitching for Diffusion Planners
par: Lee, Kyowoon, et autres
Publié: (2025) -
Accelerating Diffusion Planners in Offline RL via Reward-Aware Consistency Trajectory Distillation
par: Duan, Xintong, et autres
Publié: (2025) -
An Online Spatial-Temporal Graph Trajectory Planner for Autonomous Vehicles
par: Samiuddin, Jilan, et autres
Publié: (2024) -
Bidirectional Distillation: A Mixed-Play Framework for Multi-Agent Generalizable Behaviors
par: Feng, Lang, et autres
Publié: (2025) -
What Makes a Good Diffusion Planner for Decision Making?
par: Lu, Haofei, et autres
Publié: (2025)