On Learning Informative Trajectory Embeddings for Imitation, Classification and Regression
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ge, Zichang, Chen, Changyu, Sinha, Arunesh, Varakantham, Pradeep |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Handling Long and Richly Constrained Tasks through Constrained Hierarchical Reinforcement Learning
par: Lu, Yuxiao, et autres
Publié: (2023)
par: Lu, Yuxiao, et autres
Publié: (2023)
Automatic LLM Red Teaming
par: Belaire, Roman, et autres
Publié: (2025)
par: Belaire, Roman, et autres
Publié: (2025)
On Minimizing Adversarial Counterfactual Error in Adversarial RL
par: Belaire, Roman, et autres
Publié: (2024)
par: Belaire, Roman, et autres
Publié: (2024)
Offline Safe Reinforcement Learning Using Trajectory Classification
par: Gong, Ze, et autres
Publié: (2024)
par: Gong, Ze, et autres
Publié: (2024)
SPRINQL: Sub-optimal Demonstrations driven Offline Imitation Learning
par: Hoang, Huy, et autres
Publié: (2024)
par: Hoang, Huy, et autres
Publié: (2024)
Imitating Cost-Constrained Behaviors in Reinforcement Learning
par: Shao, Qian, et autres
Publié: (2024)
par: Shao, Qian, et autres
Publié: (2024)
Imitate the Good and Avoid the Bad: An Incremental Approach to Safe Reinforcement Learning
par: Hoang, Huy, et autres
Publié: (2023)
par: Hoang, Huy, et autres
Publié: (2023)
Enhancing the Hierarchical Environment Design via Generative Trajectory Modeling
par: Li, Dexun, et autres
Publié: (2023)
par: Li, Dexun, et autres
Publié: (2023)
Semantic Loss Guided Data Efficient Supervised Fine Tuning for Safe Responses in LLMs
par: Lu, Yuxiao, et autres
Publié: (2024)
par: Lu, Yuxiao, et autres
Publié: (2024)
Learning What to Do and What Not To Do: Offline Imitation from Expert and Undesirable Demonstrations
par: Hoang, Huy, et autres
Publié: (2025)
par: Hoang, Huy, et autres
Publié: (2025)
UNIQ: Offline Inverse Q-learning for Avoiding Undesirable Demonstrations
par: Hoang, Huy, et autres
Publié: (2024)
par: Hoang, Huy, et autres
Publié: (2024)
Regret-Based Defense in Adversarial Reinforcement Learning
par: Belaire, Roman, et autres
Publié: (2023)
par: Belaire, Roman, et autres
Publié: (2023)
Towards Neural Network based Cognitive Models of Dynamic Decision-Making by Humans
par: Chen, Changyu, et autres
Publié: (2024)
par: Chen, Changyu, et autres
Publié: (2024)
Unlocking Large Language Model's Planning Capabilities with Maximum Diversity Fine-tuning
par: Li, Wenjun, et autres
Publié: (2024)
par: Li, Wenjun, et autres
Publié: (2024)
Bootstrapping Language Models with DPO Implicit Rewards
par: Chen, Changyu, et autres
Publié: (2024)
par: Chen, Changyu, et autres
Publié: (2024)
Induced Numerical Instability: Hidden Costs in Multimodal Large Language Models
par: Wong, Wai Tuck, et autres
Publié: (2026)
par: Wong, Wai Tuck, et autres
Publié: (2026)
On Discovering Algorithms for Adversarial Imitation Learning
par: Chirra, Shashank Reddy, et autres
Publié: (2025)
par: Chirra, Shashank Reddy, et autres
Publié: (2025)
Learning Soft Driving Constraints from Vectorized Scene Embeddings while Imitating Expert Trajectories
par: Mobarakeh, Niloufar Saeidi, et autres
Publié: (2024)
par: Mobarakeh, Niloufar Saeidi, et autres
Publié: (2024)
IRL for Restless Multi-Armed Bandits with Applications in Maternal and Child Health
par: Jain, Gauri, et autres
Publié: (2024)
par: Jain, Gauri, et autres
Publié: (2024)
The Unseen Threat: Residual Knowledge in Machine Unlearning under Perturbed Samples
par: Hsu, Hsiang, et autres
Publié: (2026)
par: Hsu, Hsiang, et autres
Publié: (2026)
PateGail: A Privacy-Preserving Mobility Trajectory Generator with Imitation Learning
par: Wang, Huandong, et autres
Publié: (2024)
par: Wang, Huandong, et autres
Publié: (2024)
DiffTORI: Differentiable Trajectory Optimization for Deep Reinforcement and Imitation Learning
par: Wan, Weikang, et autres
Publié: (2024)
par: Wan, Weikang, et autres
Publié: (2024)
SafeMIL: Learning Offline Safe Imitation Policy from Non-Preferred Trajectories
par: Burnwal, Returaj, et autres
Publié: (2025)
par: Burnwal, Returaj, et autres
Publié: (2025)
Heterogeneous Graph Generation: A Hierarchical Approach using Node Feature Pooling
par: Ghosh, Hritaban, et autres
Publié: (2024)
par: Ghosh, Hritaban, et autres
Publié: (2024)
OSIL: Learning Offline Safe Imitation Policies with Safety Inferred from Non-preferred Trajectories
par: Burnwal, Returaj, et autres
Publié: (2026)
par: Burnwal, Returaj, et autres
Publié: (2026)
Revisiting Synthetic Human Trajectories: Imitative Generation and Benchmarks Beyond Datasaurus
par: Deng, Bangchao, et autres
Publié: (2024)
par: Deng, Bangchao, et autres
Publié: (2024)
Boolean Satisfiability via Imitation Learning
par: Zhang, Zewei, et autres
Publié: (2025)
par: Zhang, Zewei, et autres
Publié: (2025)
Imitating from auxiliary imperfect demonstrations via Adversarial Density Weighted Regression
par: Zhang, Ziqi, et autres
Publié: (2024)
par: Zhang, Ziqi, et autres
Publié: (2024)
Diverse Policies Recovering via Pointwise Mutual Information Weighted Imitation Learning
par: Yang, Hanlin, et autres
Publié: (2024)
par: Yang, Hanlin, et autres
Publié: (2024)
Reinforcement Learning via Implicit Imitation Guidance
par: Dong, Perry, et autres
Publié: (2025)
par: Dong, Perry, et autres
Publié: (2025)
Ctx2TrajGen: Traffic Context-Aware Microscale Vehicle Trajectories using Generative Adversarial Imitation Learning
par: Jin, Joobin, et autres
Publié: (2025)
par: Jin, Joobin, et autres
Publié: (2025)
RED: Effective Trajectory Representation Learning with Comprehensive Information
par: Zhou, Silin, et autres
Publié: (2024)
par: Zhou, Silin, et autres
Publié: (2024)
BAFFLE: Hiding Backdoors in Offline Reinforcement Learning Datasets
par: Gong, Chen, et autres
Publié: (2022)
par: Gong, Chen, et autres
Publié: (2022)
Beyond Independent Manipulation: Individual Fairness-aware Strategic Classification with Peer Imitation
par: Lv, Xinpeng, et autres
Publié: (2026)
par: Lv, Xinpeng, et autres
Publié: (2026)
Quantifying Generalisation in Imitation Learning
par: Gavenski, Nathan, et autres
Publié: (2025)
par: Gavenski, Nathan, et autres
Publié: (2025)
Imitation Bootstrapped Reinforcement Learning
par: Hu, Hengyuan, et autres
Publié: (2023)
par: Hu, Hengyuan, et autres
Publié: (2023)
Beyond Fluency: Toward Reliable Trajectories in Agentic IR
par: Sinha, Anushree, et autres
Publié: (2026)
par: Sinha, Anushree, et autres
Publié: (2026)
Extreme Region Policy Distillation
par: Chen, Changyu, et autres
Publié: (2026)
par: Chen, Changyu, et autres
Publié: (2026)
Blending Imitation and Reinforcement Learning for Robust Policy Improvement
par: Liu, Xuefeng, et autres
Publié: (2023)
par: Liu, Xuefeng, et autres
Publié: (2023)
The Semantic Illusion: Certified Limits of Embedding-Based Hallucination Detection in RAG Systems
par: Sinha, Debu
Publié: (2025)
par: Sinha, Debu
Publié: (2025)
Documents similaires
-
Handling Long and Richly Constrained Tasks through Constrained Hierarchical Reinforcement Learning
par: Lu, Yuxiao, et autres
Publié: (2023) -
Automatic LLM Red Teaming
par: Belaire, Roman, et autres
Publié: (2025) -
On Minimizing Adversarial Counterfactual Error in Adversarial RL
par: Belaire, Roman, et autres
Publié: (2024) -
Offline Safe Reinforcement Learning Using Trajectory Classification
par: Gong, Ze, et autres
Publié: (2024) -
SPRINQL: Sub-optimal Demonstrations driven Offline Imitation Learning
par: Hoang, Huy, et autres
Publié: (2024)