Universal Imitation Games
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Mahadevan, Sridhar |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Universal Reinforcement Learning in Coalgebras: Asynchronous Stochastic Computation via Conduction
par: Mahadevan, Sridhar
Publié: (2025)
par: Mahadevan, Sridhar
Publié: (2025)
GAIA: Categorical Foundations of Generative AI
par: Mahadevan, Sridhar
Publié: (2024)
par: Mahadevan, Sridhar
Publié: (2024)
Consciousness as a Functor
par: Mahadevan, Sridhar
Publié: (2025)
par: Mahadevan, Sridhar
Publié: (2025)
CSQL: Mapping Documents into Causal Databases
par: Mahadevan, Sridhar
Publié: (2026)
par: Mahadevan, Sridhar
Publié: (2026)
Memory-Consistent Neural Networks for Imitation Learning
par: Sridhar, Kaustubh, et autres
Publié: (2023)
par: Sridhar, Kaustubh, et autres
Publié: (2023)
Universal Decision Learners
par: Mahadevan, Sridhar
Publié: (2026)
par: Mahadevan, Sridhar
Publié: (2026)
Scaling Laws for Imitation Learning in Single-Agent Games
par: Tuyls, Jens, et autres
Publié: (2023)
par: Tuyls, Jens, et autres
Publié: (2023)
Learning Representations in Video Game Agents with Supervised Contrastive Imitation Learning
par: Celemin, Carlos, et autres
Publié: (2025)
par: Celemin, Carlos, et autres
Publié: (2025)
Learning Strategy Representation for Imitation Learning in Multi-Agent Games
par: Lei, Shiqi, et autres
Publié: (2024)
par: Lei, Shiqi, et autres
Publié: (2024)
Topos Causal Models
par: Mahadevan, Sridhar
Publié: (2025)
par: Mahadevan, Sridhar
Publié: (2025)
Topos Theory for Generative AI and LLMs
par: Mahadevan, Sridhar
Publié: (2025)
par: Mahadevan, Sridhar
Publié: (2025)
Decentralized Causal Discovery using Judo Calculus
par: Mahadevan, Sridhar
Publié: (2025)
par: Mahadevan, Sridhar
Publié: (2025)
PROMETHEUS: Automating Deep Causal Research Integrating Text, Data and Models
par: Mahadevan, Sridhar
Publié: (2026)
par: Mahadevan, Sridhar
Publié: (2026)
Large Causal Models from Large Language Models
par: Mahadevan, Sridhar
Publié: (2025)
par: Mahadevan, Sridhar
Publié: (2025)
Imitation Game: Reproducing Deep Learning Bugs Leveraging an Intelligent Agent
par: Shah, Mehil B, et autres
Publié: (2025)
par: Shah, Mehil B, et autres
Publié: (2025)
Imitation Bootstrapped Reinforcement Learning
par: Hu, Hengyuan, et autres
Publié: (2023)
par: Hu, Hengyuan, et autres
Publié: (2023)
Quantifying Generalisation in Imitation Learning
par: Gavenski, Nathan, et autres
Publié: (2025)
par: Gavenski, Nathan, et autres
Publié: (2025)
Efficient Imitation under Misspecification
par: Espinosa-Dice, Nicolas, et autres
Publié: (2025)
par: Espinosa-Dice, Nicolas, et autres
Publié: (2025)
Kan Extension Transformers: A Categorical Unification of Attention, Diffusion, and Predict-Detach Self-Conditioning
par: Mahadevan, Sridhar
Publié: (2026)
par: Mahadevan, Sridhar
Publié: (2026)
Imitation from Diverse Behaviors: Wasserstein Quality Diversity Imitation Learning with Single-Step Archive Exploration
par: Yu, Xingrui, et autres
Publié: (2024)
par: Yu, Xingrui, et autres
Publié: (2024)
Adversarial Imitation Learning via Boosting
par: Chang, Jonathan D., et autres
Publié: (2024)
par: Chang, Jonathan D., et autres
Publié: (2024)
Denoising-based Contractive Imitation Learning
par: Shen, Macheng, et autres
Publié: (2025)
par: Shen, Macheng, et autres
Publié: (2025)
Noise-Guided Transport for Imitation Learning
par: Blondé, Lionel, et autres
Publié: (2025)
par: Blondé, Lionel, et autres
Publié: (2025)
Imitation Learning via Focused Satisficing
par: Shah, Rushit N., et autres
Publié: (2025)
par: Shah, Rushit N., et autres
Publié: (2025)
Sample-efficient Adversarial Imitation Learning
par: Jung, Dahuin, et autres
Publié: (2023)
par: Jung, Dahuin, et autres
Publié: (2023)
Boolean Satisfiability via Imitation Learning
par: Zhang, Zewei, et autres
Publié: (2025)
par: Zhang, Zewei, et autres
Publié: (2025)
Imitation Learning as Return Distribution Matching
par: Lazzati, Filippo, et autres
Publié: (2025)
par: Lazzati, Filippo, et autres
Publié: (2025)
Intuitionistic $j$-Do-Calculus in Topos Causal Models
par: Mahadevan, Sridhar
Publié: (2025)
par: Mahadevan, Sridhar
Publié: (2025)
Visual Encoders for Data-Efficient Imitation Learning in Modern Video Games
par: Schäfer, Lukas, et autres
Publié: (2023)
par: Schäfer, Lukas, et autres
Publié: (2023)
Online Adaptation for Enhancing Imitation Learning Policies
par: Malato, Federico, et autres
Publié: (2024)
par: Malato, Federico, et autres
Publié: (2024)
Semi-Supervised One-Shot Imitation Learning
par: Wu, Philipp, et autres
Publié: (2024)
par: Wu, Philipp, et autres
Publié: (2024)
Imitating Cost-Constrained Behaviors in Reinforcement Learning
par: Shao, Qian, et autres
Publié: (2024)
par: Shao, Qian, et autres
Publié: (2024)
Reinforcement Learning via Implicit Imitation Guidance
par: Dong, Perry, et autres
Publié: (2025)
par: Dong, Perry, et autres
Publié: (2025)
Confounded Causal Imitation Learning with Instrumental Variables
par: Zeng, Yan, et autres
Publié: (2025)
par: Zeng, Yan, et autres
Publié: (2025)
DITTO: Offline Imitation Learning with World Models
par: DeMoss, Branton, et autres
Publié: (2023)
par: DeMoss, Branton, et autres
Publié: (2023)
RILe: Reinforced Imitation Learning
par: Albaba, Mert, et autres
Publié: (2024)
par: Albaba, Mert, et autres
Publié: (2024)
Generalization Capability for Imitation Learning
par: Wang, Yixiao
Publié: (2025)
par: Wang, Yixiao
Publié: (2025)
A Rose by Any Other Name Would Smell as Sweet: Categorical Homotopy Theory for Large Language Models
par: Mahadevan, Sridhar
Publié: (2025)
par: Mahadevan, Sridhar
Publié: (2025)
DIDA: Denoised Imitation Learning based on Domain Adaptation
par: Huang, Kaichen, et autres
Publié: (2024)
par: Huang, Kaichen, et autres
Publié: (2024)
Offline Imitation Learning with Model-based Reverse Augmentation
par: Shao, Jie-Jing, et autres
Publié: (2024)
par: Shao, Jie-Jing, et autres
Publié: (2024)
Documents similaires
-
Universal Reinforcement Learning in Coalgebras: Asynchronous Stochastic Computation via Conduction
par: Mahadevan, Sridhar
Publié: (2025) -
GAIA: Categorical Foundations of Generative AI
par: Mahadevan, Sridhar
Publié: (2024) -
Consciousness as a Functor
par: Mahadevan, Sridhar
Publié: (2025) -
CSQL: Mapping Documents into Causal Databases
par: Mahadevan, Sridhar
Publié: (2026) -
Memory-Consistent Neural Networks for Imitation Learning
par: Sridhar, Kaustubh, et autres
Publié: (2023)