Offline Imitation Learning with Variational Counterfactual Reasoning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | He, Bowei, Sun, Zexu, Liu, Jinxin, Zhang, Shuai, Chen, Xu, Ma, Chen |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Revisiting Counterfactual Regression through the Lens of Gromov-Wasserstein Information Bottleneck
par: Yang, Hao, et autres
Publié: (2024)
par: Yang, Hao, et autres
Publié: (2024)
Robustness-enhanced Uplift Modeling with Adversarial Feature Desensitization
par: Sun, Zexu, et autres
Publié: (2023)
par: Sun, Zexu, et autres
Publié: (2023)
Rankability-enhanced Revenue Uplift Modeling Framework for Online Marketing
par: He, Bowei, et autres
Publié: (2024)
par: He, Bowei, et autres
Publié: (2024)
M$^3$TN: Multi-gate Mixture-of-Experts based Multi-valued Treatment Network for Uplift Modeling
par: Sun, Zexu, et autres
Publié: (2024)
par: Sun, Zexu, et autres
Publié: (2024)
Generalized Encouragement-Based Instrumental Variables for Counterfactual Regression
par: Wu, Anpeng, et autres
Publié: (2024)
par: Wu, Anpeng, et autres
Publié: (2024)
How to Leverage Diverse Demonstrations in Offline Imitation Learning
par: Yue, Sheng, et autres
Publié: (2024)
par: Yue, Sheng, et autres
Publié: (2024)
Support-Proximity Augmented Diffusion Estimation for Offline Black-Box Optimization
par: Yang, Yonghan, et autres
Publié: (2026)
par: Yang, Yonghan, et autres
Publié: (2026)
Cog-Rethinker: Hierarchical Metacognitive Reinforcement Learning for LLM Reasoning
par: Sun, Zexu, et autres
Publié: (2025)
par: Sun, Zexu, et autres
Publié: (2025)
SEABO: A Simple Search-Based Method for Offline Imitation Learning
par: Lyu, Jiafei, et autres
Publié: (2024)
par: Lyu, Jiafei, et autres
Publié: (2024)
Budgeting Counterfactual for Offline RL
par: Liu, Yao, et autres
Publié: (2023)
par: Liu, Yao, et autres
Publié: (2023)
Out-of-Distribution Adaptation in Offline RL: Counterfactual Reasoning via Causal Normalizing Flows
par: Cho, Minjae, et autres
Publié: (2024)
par: Cho, Minjae, et autres
Publié: (2024)
Efficient Offline Reinforcement Learning: First Imitate, then Improve
par: Jelley, Adam, et autres
Publié: (2024)
par: Jelley, Adam, et autres
Publié: (2024)
Offline Imitation Learning by Controlling the Effective Planning Horizon
par: Ahn, Hee-Jun, et autres
Publié: (2024)
par: Ahn, Hee-Jun, et autres
Publié: (2024)
DITTO: Offline Imitation Learning with World Models
par: DeMoss, Branton, et autres
Publié: (2023)
par: DeMoss, Branton, et autres
Publié: (2023)
OLLIE: Imitation Learning from Offline Pretraining to Online Finetuning
par: Yue, Sheng, et autres
Publié: (2024)
par: Yue, Sheng, et autres
Publié: (2024)
Offline Imitation Learning upon Arbitrary Demonstrations by Pre-Training Dynamics Representations
par: Ma, Haitong, et autres
Publié: (2025)
par: Ma, Haitong, et autres
Publié: (2025)
PROF: An LLM-based Reward Code Preference Optimization Framework for Offline Imitation Learning
par: Sun, Shengjie, et autres
Publié: (2025)
par: Sun, Shengjie, et autres
Publié: (2025)
Reinformer: Max-Return Sequence Modeling for Offline RL
par: Zhuang, Zifeng, et autres
Publié: (2024)
par: Zhuang, Zifeng, et autres
Publié: (2024)
Guided Data Augmentation for Offline Reinforcement Learning and Imitation Learning
par: Corrado, Nicholas E., et autres
Publié: (2023)
par: Corrado, Nicholas E., et autres
Publié: (2023)
Improving Offline-to-Online Reinforcement Learning with Q Conditioned State Entropy Exploration
par: Zhang, Ziqi, et autres
Publié: (2023)
par: Zhang, Ziqi, et autres
Publié: (2023)
Robust Offline Imitation Learning from Diverse Auxiliary Data
par: Ghosh, Udita, et autres
Publié: (2024)
par: Ghosh, Udita, et autres
Publié: (2024)
Zero-Shot Offline Imitation Learning via Optimal Transport
par: Rupf, Thomas, et autres
Publié: (2024)
par: Rupf, Thomas, et autres
Publié: (2024)
DIDI: Diffusion-Guided Diversity for Offline Behavioral Generation
par: Liu, Jinxin, et autres
Publié: (2024)
par: Liu, Jinxin, et autres
Publié: (2024)
Deconfounding Imitation Learning with Variational Inference
par: Vuorio, Risto, et autres
Publié: (2022)
par: Vuorio, Risto, et autres
Publié: (2022)
Offline Imitation Learning with Model-based Reverse Augmentation
par: Shao, Jie-Jing, et autres
Publié: (2024)
par: Shao, Jie-Jing, et autres
Publié: (2024)
Adversarial Imitation Learning with General Function Approximation: Theoretical Analysis and Practical Algorithms
par: Xu, Tian, et autres
Publié: (2026)
par: Xu, Tian, et autres
Publié: (2026)
Provably and Practically Efficient Adversarial Imitation Learning with General Function Approximation
par: Xu, Tian, et autres
Publié: (2024)
par: Xu, Tian, et autres
Publié: (2024)
Counterfactual Multi-player Bandits for Explainable Recommendation Diversification
par: Zhang, Yansen, et autres
Publié: (2025)
par: Zhang, Yansen, et autres
Publié: (2025)
From Novelty to Imitation: Self-Distilled Rewards for Offline Reinforcement Learning
par: Chaudhary, Gaurav, et autres
Publié: (2025)
par: Chaudhary, Gaurav, et autres
Publié: (2025)
Boolean Satisfiability via Imitation Learning
par: Zhang, Zewei, et autres
Publié: (2025)
par: Zhang, Zewei, et autres
Publié: (2025)
Offline Imitation Learning Through Graph Search and Retrieval
par: Yin, Zhao-Heng, et autres
Publié: (2024)
par: Yin, Zhao-Heng, et autres
Publié: (2024)
Offline Contextual Bandit with Counterfactual Sample Identification
par: Gilotte, Alexandre, et autres
Publié: (2025)
par: Gilotte, Alexandre, et autres
Publié: (2025)
Distributionally Robust Set Representation Learning Under Inference-Time Element Corruption
par: Chen, Yankai, et autres
Publié: (2026)
par: Chen, Yankai, et autres
Publié: (2026)
Offline-to-Online Reinforcement Learning with Classifier-Free Diffusion Generation
par: Huang, Xiao, et autres
Publié: (2025)
par: Huang, Xiao, et autres
Publié: (2025)
A Dual Approach to Imitation Learning from Observations with Offline Datasets
par: Sikchi, Harshit, et autres
Publié: (2024)
par: Sikchi, Harshit, et autres
Publié: (2024)
Balance Equation-based Distributionally Robust Offline Imitation Learning
par: Agrawal, Rishabh, et autres
Publié: (2025)
par: Agrawal, Rishabh, et autres
Publié: (2025)
SPRINQL: Sub-optimal Demonstrations driven Offline Imitation Learning
par: Hoang, Huy, et autres
Publié: (2024)
par: Hoang, Huy, et autres
Publié: (2024)
Energy-Guided Diffusion Sampling for Offline-to-Online Reinforcement Learning
par: Liu, Xu-Hui, et autres
Publié: (2024)
par: Liu, Xu-Hui, et autres
Publié: (2024)
Less Noise, More Voice: Reinforcement Learning for Reasoning via Instruction Purification
par: Guo, Yiju, et autres
Publié: (2026)
par: Guo, Yiju, et autres
Publié: (2026)
Offline Trajectory Optimization for Offline Reinforcement Learning
par: Zhao, Ziqi, et autres
Publié: (2024)
par: Zhao, Ziqi, et autres
Publié: (2024)
Documents similaires
-
Revisiting Counterfactual Regression through the Lens of Gromov-Wasserstein Information Bottleneck
par: Yang, Hao, et autres
Publié: (2024) -
Robustness-enhanced Uplift Modeling with Adversarial Feature Desensitization
par: Sun, Zexu, et autres
Publié: (2023) -
Rankability-enhanced Revenue Uplift Modeling Framework for Online Marketing
par: He, Bowei, et autres
Publié: (2024) -
M$^3$TN: Multi-gate Mixture-of-Experts based Multi-valued Treatment Network for Uplift Modeling
par: Sun, Zexu, et autres
Publié: (2024) -
Generalized Encouragement-Based Instrumental Variables for Counterfactual Regression
par: Wu, Anpeng, et autres
Publié: (2024)