On the Limits of Multi-modal Meta-Learning with Auxiliary Task Modulation Using Conditional Batch Normalization
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Armengol-Estapé, Jordi, Michalski, Vincent, Kumar, Ramnath, St-Charles, Pierre-Luc, Precup, Doina, Kahou, Samira Ebrahimi |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Behaviour Discovery and Attribution for Explainable Reinforcement Learning
par: Rishav, Rishav, et autres
Publié: (2025)
par: Rishav, Rishav, et autres
Publié: (2025)
Estimation of Head Motion in Structural MRI and its Impact on Cortical Thickness Measurements in Retrospective Data
par: Bricout, Charles, et autres
Publié: (2025)
par: Bricout, Charles, et autres
Publié: (2025)
Empowering Clinicians with Medical Decision Transformers: A Framework for Sepsis Treatment
par: Rahman, Aamer Abdul, et autres
Publié: (2024)
par: Rahman, Aamer Abdul, et autres
Publié: (2024)
Learning Multi-agent Multi-machine Tending by Mobile Robots
par: Abdalwhab, Abdalwhab, et autres
Publié: (2024)
par: Abdalwhab, Abdalwhab, et autres
Publié: (2024)
CAMMARL: Conformal Action Modeling in Multi Agent Reinforcement Learning
par: Gupta, Nikunj, et autres
Publié: (2023)
par: Gupta, Nikunj, et autres
Publié: (2023)
Zero-Shot Anomaly Detection with Dual-Branch Prompt Selection
par: Wang, Zihan, et autres
Publié: (2025)
par: Wang, Zihan, et autres
Publié: (2025)
Adaptive Group Robust Ensemble Knowledge Distillation
par: Kenfack, Patrik, et autres
Publié: (2024)
par: Kenfack, Patrik, et autres
Publié: (2024)
Towards Fair In-Context Learning with Tabular Foundation Models
par: Kenfack, Patrik, et autres
Publié: (2025)
par: Kenfack, Patrik, et autres
Publié: (2025)
Locally Constrained Representations in Reinforcement Learning
par: Nath, Somjit, et autres
Publié: (2022)
par: Nath, Somjit, et autres
Publié: (2022)
Learning to Play Atari in a World of Tokens
par: Agarwal, Pranav, et autres
Publié: (2024)
par: Agarwal, Pranav, et autres
Publié: (2024)
Fairness Under Demographic Scarce Regime
par: Kenfack, Patrik Joslin, et autres
Publié: (2023)
par: Kenfack, Patrik Joslin, et autres
Publié: (2023)
Conditions on Preference Relations that Guarantee the Existence of Optimal Policies
par: Carr, Jonathan Colaço, et autres
Publié: (2023)
par: Carr, Jonathan Colaço, et autres
Publié: (2023)
Diversity-Enriched Option-Critic
par: Kamat, Anand, et autres
Publié: (2020)
par: Kamat, Anand, et autres
Publié: (2020)
Functional Acceleration for Policy Mirror Descent
par: Chelu, Veronica, et autres
Publié: (2024)
par: Chelu, Veronica, et autres
Publié: (2024)
A Look at Value-Based Decision-Time vs. Background Planning Methods Across Different Settings
par: Alver, Safa, et autres
Publié: (2022)
par: Alver, Safa, et autres
Publié: (2022)
Understanding Behavioral Metric Learning: A Large-Scale Study on Distracting Reinforcement Learning Environments
par: Luo, Ziyan, et autres
Publié: (2025)
par: Luo, Ziyan, et autres
Publié: (2025)
Vector Quantized Latent Concepts: A Scalable Alternative to Clustering-Based Concept Discovery
par: Yu, Xuemin, et autres
Publié: (2026)
par: Yu, Xuemin, et autres
Publié: (2026)
Cross-Layer Discrete Concept Discovery for Interpreting Language Models
par: Garg, Ankur, et autres
Publié: (2025)
par: Garg, Ankur, et autres
Publié: (2025)
KD-LoRA: A Hybrid Approach to Efficient Fine-Tuning with LoRA and Knowledge Distillation
par: Azimi, Rambod, et autres
Publié: (2024)
par: Azimi, Rambod, et autres
Publié: (2024)
Incorporating Spatial Information into Goal-Conditioned Hierarchical Reinforcement Learning via Graph Representations
par: Zhang, Shuyuan, et autres
Publié: (2025)
par: Zhang, Shuyuan, et autres
Publié: (2025)
SLaDe: A Portable Small Language Model Decompiler for Optimized Assembly
par: Armengol-Estapé, Jordi, et autres
Publié: (2023)
par: Armengol-Estapé, Jordi, et autres
Publié: (2023)
Rotation-Preserving Supervised Fine-Tuning
par: Jin, Hangzhan, et autres
Publié: (2026)
par: Jin, Hangzhan, et autres
Publié: (2026)
Balancing Plasticity and Stability with Fast and Slow Successor Features
par: Chua, Raymond, et autres
Publié: (2026)
par: Chua, Raymond, et autres
Publié: (2026)
On the Privacy of Selection Mechanisms with Gaussian Noise
par: Lebensold, Jonathan, et autres
Publié: (2024)
par: Lebensold, Jonathan, et autres
Publié: (2024)
Comparative Analysis of Diffusion Generative Models in Computational Pathology
par: Thakkar, Denisha, et autres
Publié: (2024)
par: Thakkar, Denisha, et autres
Publié: (2024)
Sparse-Reg: Improving Sample Complexity in Offline Reinforcement Learning using Sparsity
par: Arnob, Samin Yeasar, et autres
Publié: (2025)
par: Arnob, Samin Yeasar, et autres
Publié: (2025)
Adaptive Exploration for Data-Efficient General Value Function Evaluations
par: Jain, Arushi, et autres
Publié: (2024)
par: Jain, Arushi, et autres
Publié: (2024)
Fluid-Agent Reinforcement Learning
par: Sharma, Shishir, et autres
Publié: (2026)
par: Sharma, Shishir, et autres
Publié: (2026)
Partial Models for Building Adaptive Model-Based Reinforcement Learning Agents
par: Alver, Safa, et autres
Publié: (2024)
par: Alver, Safa, et autres
Publié: (2024)
Don't Transform the Code, Code the Transforms: Towards Precise Code Rewriting using LLMs
par: Cummins, Chris, et autres
Publié: (2024)
par: Cummins, Chris, et autres
Publié: (2024)
Handling Delay in Real-Time Reinforcement Learning
par: Anokhin, Ivan, et autres
Publié: (2025)
par: Anokhin, Ivan, et autres
Publié: (2025)
Survey on AI Ethics: A Socio-technical Perspective
par: Mbiazi, Dave, et autres
Publié: (2023)
par: Mbiazi, Dave, et autres
Publié: (2023)
Parseval Regularization for Continual Reinforcement Learning
par: Chung, Wesley, et autres
Publié: (2024)
par: Chung, Wesley, et autres
Publié: (2024)
Relative Trajectory Balance is equivalent to Trust-PCL
par: Deleu, Tristan, et autres
Publié: (2025)
par: Deleu, Tristan, et autres
Publié: (2025)
Solving Models of Economic Dynamics with Ridgeless Kernel Regressions
par: Kahou, Mahdi Ebrahimi, et autres
Publié: (2024)
par: Kahou, Mahdi Ebrahimi, et autres
Publié: (2024)
CryCeleb: A Speaker Verification Dataset Based on Infant Cry Sounds
par: Budaghyan, David, et autres
Publié: (2023)
par: Budaghyan, David, et autres
Publié: (2023)
Uncovering a Universal Abstract Algorithm for Modular Addition in Neural Networks
par: McCracken, Gavin, et autres
Publié: (2025)
par: McCracken, Gavin, et autres
Publié: (2025)
Prediction of Final Phosphorus Content of Steel in a Scrap-Based Electric Arc Furnace Using Artificial Neural Networks
par: Azzaz, Riadh, et autres
Publié: (2024)
par: Azzaz, Riadh, et autres
Publié: (2024)
Forklift: An Extensible Neural Lifter
par: Armengol-Estapé, Jordi, et autres
Publié: (2024)
par: Armengol-Estapé, Jordi, et autres
Publié: (2024)
LLMs versus the Halting Problem: Characterizing Program Termination Reasoning
par: Sultan, Oren, et autres
Publié: (2026)
par: Sultan, Oren, et autres
Publié: (2026)
Documents similaires
-
Behaviour Discovery and Attribution for Explainable Reinforcement Learning
par: Rishav, Rishav, et autres
Publié: (2025) -
Estimation of Head Motion in Structural MRI and its Impact on Cortical Thickness Measurements in Retrospective Data
par: Bricout, Charles, et autres
Publié: (2025) -
Empowering Clinicians with Medical Decision Transformers: A Framework for Sepsis Treatment
par: Rahman, Aamer Abdul, et autres
Publié: (2024) -
Learning Multi-agent Multi-machine Tending by Mobile Robots
par: Abdalwhab, Abdalwhab, et autres
Publié: (2024) -
CAMMARL: Conformal Action Modeling in Multi Agent Reinforcement Learning
par: Gupta, Nikunj, et autres
Publié: (2023)