Universal Imitation Games
Fuente:
arXiv
Guardado en:
| Autor principal: | Mahadevan, Sridhar |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Universal Reinforcement Learning in Coalgebras: Asynchronous Stochastic Computation via Conduction
por: Mahadevan, Sridhar
Publicado: (2025)
por: Mahadevan, Sridhar
Publicado: (2025)
GAIA: Categorical Foundations of Generative AI
por: Mahadevan, Sridhar
Publicado: (2024)
por: Mahadevan, Sridhar
Publicado: (2024)
Consciousness as a Functor
por: Mahadevan, Sridhar
Publicado: (2025)
por: Mahadevan, Sridhar
Publicado: (2025)
CSQL: Mapping Documents into Causal Databases
por: Mahadevan, Sridhar
Publicado: (2026)
por: Mahadevan, Sridhar
Publicado: (2026)
Memory-Consistent Neural Networks for Imitation Learning
por: Sridhar, Kaustubh, et al.
Publicado: (2023)
por: Sridhar, Kaustubh, et al.
Publicado: (2023)
Universal Decision Learners
por: Mahadevan, Sridhar
Publicado: (2026)
por: Mahadevan, Sridhar
Publicado: (2026)
Scaling Laws for Imitation Learning in Single-Agent Games
por: Tuyls, Jens, et al.
Publicado: (2023)
por: Tuyls, Jens, et al.
Publicado: (2023)
Learning Representations in Video Game Agents with Supervised Contrastive Imitation Learning
por: Celemin, Carlos, et al.
Publicado: (2025)
por: Celemin, Carlos, et al.
Publicado: (2025)
Learning Strategy Representation for Imitation Learning in Multi-Agent Games
por: Lei, Shiqi, et al.
Publicado: (2024)
por: Lei, Shiqi, et al.
Publicado: (2024)
Topos Causal Models
por: Mahadevan, Sridhar
Publicado: (2025)
por: Mahadevan, Sridhar
Publicado: (2025)
Topos Theory for Generative AI and LLMs
por: Mahadevan, Sridhar
Publicado: (2025)
por: Mahadevan, Sridhar
Publicado: (2025)
Decentralized Causal Discovery using Judo Calculus
por: Mahadevan, Sridhar
Publicado: (2025)
por: Mahadevan, Sridhar
Publicado: (2025)
PROMETHEUS: Automating Deep Causal Research Integrating Text, Data and Models
por: Mahadevan, Sridhar
Publicado: (2026)
por: Mahadevan, Sridhar
Publicado: (2026)
Large Causal Models from Large Language Models
por: Mahadevan, Sridhar
Publicado: (2025)
por: Mahadevan, Sridhar
Publicado: (2025)
Imitation Game: Reproducing Deep Learning Bugs Leveraging an Intelligent Agent
por: Shah, Mehil B, et al.
Publicado: (2025)
por: Shah, Mehil B, et al.
Publicado: (2025)
Imitation Bootstrapped Reinforcement Learning
por: Hu, Hengyuan, et al.
Publicado: (2023)
por: Hu, Hengyuan, et al.
Publicado: (2023)
Quantifying Generalisation in Imitation Learning
por: Gavenski, Nathan, et al.
Publicado: (2025)
por: Gavenski, Nathan, et al.
Publicado: (2025)
Efficient Imitation under Misspecification
por: Espinosa-Dice, Nicolas, et al.
Publicado: (2025)
por: Espinosa-Dice, Nicolas, et al.
Publicado: (2025)
Kan Extension Transformers: A Categorical Unification of Attention, Diffusion, and Predict-Detach Self-Conditioning
por: Mahadevan, Sridhar
Publicado: (2026)
por: Mahadevan, Sridhar
Publicado: (2026)
Imitation from Diverse Behaviors: Wasserstein Quality Diversity Imitation Learning with Single-Step Archive Exploration
por: Yu, Xingrui, et al.
Publicado: (2024)
por: Yu, Xingrui, et al.
Publicado: (2024)
Adversarial Imitation Learning via Boosting
por: Chang, Jonathan D., et al.
Publicado: (2024)
por: Chang, Jonathan D., et al.
Publicado: (2024)
Denoising-based Contractive Imitation Learning
por: Shen, Macheng, et al.
Publicado: (2025)
por: Shen, Macheng, et al.
Publicado: (2025)
Noise-Guided Transport for Imitation Learning
por: Blondé, Lionel, et al.
Publicado: (2025)
por: Blondé, Lionel, et al.
Publicado: (2025)
Imitation Learning via Focused Satisficing
por: Shah, Rushit N., et al.
Publicado: (2025)
por: Shah, Rushit N., et al.
Publicado: (2025)
Sample-efficient Adversarial Imitation Learning
por: Jung, Dahuin, et al.
Publicado: (2023)
por: Jung, Dahuin, et al.
Publicado: (2023)
Boolean Satisfiability via Imitation Learning
por: Zhang, Zewei, et al.
Publicado: (2025)
por: Zhang, Zewei, et al.
Publicado: (2025)
Imitation Learning as Return Distribution Matching
por: Lazzati, Filippo, et al.
Publicado: (2025)
por: Lazzati, Filippo, et al.
Publicado: (2025)
Intuitionistic $j$-Do-Calculus in Topos Causal Models
por: Mahadevan, Sridhar
Publicado: (2025)
por: Mahadevan, Sridhar
Publicado: (2025)
Visual Encoders for Data-Efficient Imitation Learning in Modern Video Games
por: Schäfer, Lukas, et al.
Publicado: (2023)
por: Schäfer, Lukas, et al.
Publicado: (2023)
Online Adaptation for Enhancing Imitation Learning Policies
por: Malato, Federico, et al.
Publicado: (2024)
por: Malato, Federico, et al.
Publicado: (2024)
Semi-Supervised One-Shot Imitation Learning
por: Wu, Philipp, et al.
Publicado: (2024)
por: Wu, Philipp, et al.
Publicado: (2024)
Imitating Cost-Constrained Behaviors in Reinforcement Learning
por: Shao, Qian, et al.
Publicado: (2024)
por: Shao, Qian, et al.
Publicado: (2024)
Reinforcement Learning via Implicit Imitation Guidance
por: Dong, Perry, et al.
Publicado: (2025)
por: Dong, Perry, et al.
Publicado: (2025)
Confounded Causal Imitation Learning with Instrumental Variables
por: Zeng, Yan, et al.
Publicado: (2025)
por: Zeng, Yan, et al.
Publicado: (2025)
DITTO: Offline Imitation Learning with World Models
por: DeMoss, Branton, et al.
Publicado: (2023)
por: DeMoss, Branton, et al.
Publicado: (2023)
RILe: Reinforced Imitation Learning
por: Albaba, Mert, et al.
Publicado: (2024)
por: Albaba, Mert, et al.
Publicado: (2024)
Generalization Capability for Imitation Learning
por: Wang, Yixiao
Publicado: (2025)
por: Wang, Yixiao
Publicado: (2025)
A Rose by Any Other Name Would Smell as Sweet: Categorical Homotopy Theory for Large Language Models
por: Mahadevan, Sridhar
Publicado: (2025)
por: Mahadevan, Sridhar
Publicado: (2025)
DIDA: Denoised Imitation Learning based on Domain Adaptation
por: Huang, Kaichen, et al.
Publicado: (2024)
por: Huang, Kaichen, et al.
Publicado: (2024)
Offline Imitation Learning with Model-based Reverse Augmentation
por: Shao, Jie-Jing, et al.
Publicado: (2024)
por: Shao, Jie-Jing, et al.
Publicado: (2024)
Ejemplares similares
-
Universal Reinforcement Learning in Coalgebras: Asynchronous Stochastic Computation via Conduction
por: Mahadevan, Sridhar
Publicado: (2025) -
GAIA: Categorical Foundations of Generative AI
por: Mahadevan, Sridhar
Publicado: (2024) -
Consciousness as a Functor
por: Mahadevan, Sridhar
Publicado: (2025) -
CSQL: Mapping Documents into Causal Databases
por: Mahadevan, Sridhar
Publicado: (2026) -
Memory-Consistent Neural Networks for Imitation Learning
por: Sridhar, Kaustubh, et al.
Publicado: (2023)