Saved in:
| Main Authors: | Cetin, Edoardo, Touati, Ahmed, Ollivier, Yann |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | https://arxiv.org/abs/2412.04368 |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Simple Ingredients for Offline Reinforcement Learning
by: Cetin, Edoardo, et al.
Published: (2024)
by: Cetin, Edoardo, et al.
Published: (2024)
Which Features are Best for Successor Features?
by: Ollivier, Yann
Published: (2025)
by: Ollivier, Yann
Published: (2025)
Zero-Shot Whole-Body Humanoid Control via Behavioral Foundation Models
by: Tirinzoni, Andrea, et al.
Published: (2025)
by: Tirinzoni, Andrea, et al.
Published: (2025)
Tackling the Zero-Shot Reinforcement Learning Loss Directly
by: Ollivier, Yann
Published: (2025)
by: Ollivier, Yann
Published: (2025)
Fast Adaptation with Behavioral Foundation Models
by: Sikchi, Harshit, et al.
Published: (2025)
by: Sikchi, Harshit, et al.
Published: (2025)
FinerCut: Finer-grained Interpretable Layer Pruning for Large Language Models
by: Zhang, Yang, et al.
Published: (2024)
by: Zhang, Yang, et al.
Published: (2024)
Learning from Partial Chain-of-Thought via Truncated-Reasoning Self-Distillation
by: Silvestri, Gianluigi, et al.
Published: (2026)
by: Silvestri, Gianluigi, et al.
Published: (2026)
CAWR: Corruption-Averse Advantage-Weighted Regression for Robust Policy Optimization
by: Hu, Ranting
Published: (2025)
by: Hu, Ranting
Published: (2025)
An Equivalence between Bayesian Priors and Penalties in Variational Inference
by: Wolinski, Pierre, et al.
Published: (2020)
by: Wolinski, Pierre, et al.
Published: (2020)
FAWAC: Feasibility Informed Advantage Weighted Regression for Persistent Safety in Offline Reinforcement Learning
by: Koirala, Prajwal, et al.
Published: (2024)
by: Koirala, Prajwal, et al.
Published: (2024)
Finer is Better (with the Right Scaling)
by: Schaefer, Clemens, et al.
Published: (2026)
by: Schaefer, Clemens, et al.
Published: (2026)
Large Language Models to Diffusion Finetuning
by: Cetin, Edoardo, et al.
Published: (2025)
by: Cetin, Edoardo, et al.
Published: (2025)
Auto-Regressive Masked Diffusion Models
by: Karami, Mahdi, et al.
Published: (2026)
by: Karami, Mahdi, et al.
Published: (2026)
Path Learning with Trajectory Advantage Regression
by: Miyaguchi, Kohei
Published: (2025)
by: Miyaguchi, Kohei
Published: (2025)
Advantage Weighted Matching: Aligning RL with Pretraining in Diffusion Models
by: Xue, Shuchen, et al.
Published: (2025)
by: Xue, Shuchen, et al.
Published: (2025)
AdvantageFlow: Advantage-Weighted Least Squares for RL in Flow Models
by: Kveton, Branislav, et al.
Published: (2026)
by: Kveton, Branislav, et al.
Published: (2026)
TD-JEPA: Latent-predictive Representations for Zero-Shot Reinforcement Learning
by: Bagatella, Marco, et al.
Published: (2025)
by: Bagatella, Marco, et al.
Published: (2025)
Teaching Models to Teach Themselves: Reasoning at the Edge of Learnability
by: Sundaram, Shobhita, et al.
Published: (2026)
by: Sundaram, Shobhita, et al.
Published: (2026)
Feature Weighting Improves Pool-Based Sequential Active Learning for Regression
by: Wu, Dongrui
Published: (2026)
by: Wu, Dongrui
Published: (2026)
Interpretable Tabular Foundation Models via In-Context Kernel Regression
by: Miftachov, Ratmir, et al.
Published: (2026)
by: Miftachov, Ratmir, et al.
Published: (2026)
AutoGluon-Multimodal (AutoMM): Supercharging Multimodal AutoML with Foundation Models
by: Tang, Zhiqiang, et al.
Published: (2024)
by: Tang, Zhiqiang, et al.
Published: (2024)
Transformer-Squared: Self-adaptive LLMs
by: Sun, Qi, et al.
Published: (2025)
by: Sun, Qi, et al.
Published: (2025)
Reinforcement Learning Teachers of Test Time Scaling
by: Cetin, Edoardo, et al.
Published: (2025)
by: Cetin, Edoardo, et al.
Published: (2025)
Assessing Quantum Advantage for Gaussian Process Regression
by: Lowe, Dominic, et al.
Published: (2025)
by: Lowe, Dominic, et al.
Published: (2025)
ShinkaEvolve: Towards Open-Ended And Sample-Efficient Program Evolution
by: Lange, Robert Tjarko, et al.
Published: (2025)
by: Lange, Robert Tjarko, et al.
Published: (2025)
Compositional Planning with Jumpy World Models
by: Farebrother, Jesse, et al.
Published: (2026)
by: Farebrother, Jesse, et al.
Published: (2026)
FIRE: Multi-fidelity Regression with Distribution-conditioned In-context Learning using Tabular Foundation Models
by: Yu, Rosen Ting-Ying, et al.
Published: (2026)
by: Yu, Rosen Ting-Ying, et al.
Published: (2026)
SMORE: Score Models for Offline Goal-Conditioned Reinforcement Learning
by: Sikchi, Harshit, et al.
Published: (2023)
by: Sikchi, Harshit, et al.
Published: (2023)
Bayesian Models for Joint Selection of Features and Auto-Regressive Lags: Theory and Applications in Environmental and Financial Forecasting
by: Manna, Alokesh, et al.
Published: (2025)
by: Manna, Alokesh, et al.
Published: (2025)
Privacy Attacks on Image AutoRegressive Models
by: Kowalczuk, Antoni, et al.
Published: (2025)
by: Kowalczuk, Antoni, et al.
Published: (2025)
Accelerating RL for LLM Reasoning with Optimal Advantage Regression
by: Brantley, Kianté, et al.
Published: (2025)
by: Brantley, Kianté, et al.
Published: (2025)
Soft Tokens, Hard Truths
by: Butt, Natasha, et al.
Published: (2025)
by: Butt, Natasha, et al.
Published: (2025)
Data-Efficient Symbolic Regression via Foundation Model Distillation
by: Ying, Wangyang, et al.
Published: (2025)
by: Ying, Wangyang, et al.
Published: (2025)
LinkD: AutoRegressive Diffusion Model for Mechanical Linkage Synthesis
by: Jadhav, Yayati, et al.
Published: (2026)
by: Jadhav, Yayati, et al.
Published: (2026)
Adapting Time Series Foundation Models through Data Mixtures
by: Lee, Thomas L., et al.
Published: (2026)
by: Lee, Thomas L., et al.
Published: (2026)
Is Finer Better? The Limits of Microscaling Formats in Large Language Models
by: Fasoli, Andrea, et al.
Published: (2026)
by: Fasoli, Andrea, et al.
Published: (2026)
Engineering Regression Without Real-Data Training: Domain Adaptation for Tabular Foundation Models Using Multi-Dataset Embeddings
by: Regenwetter, Lyle, et al.
Published: (2026)
by: Regenwetter, Lyle, et al.
Published: (2026)
Lossless Vocabulary Reduction for Auto-Regressive Language Models
by: Chijiwa, Daiki, et al.
Published: (2025)
by: Chijiwa, Daiki, et al.
Published: (2025)
X-Prompt: Towards Universal In-Context Image Generation in Auto-Regressive Vision Language Foundation Models
by: Sun, Zeyi, et al.
Published: (2024)
by: Sun, Zeyi, et al.
Published: (2024)
MARLIN: Mixed-Precision Auto-Regressive Parallel Inference on Large Language Models
by: Frantar, Elias, et al.
Published: (2024)
by: Frantar, Elias, et al.
Published: (2024)
Similar Items
-
Simple Ingredients for Offline Reinforcement Learning
by: Cetin, Edoardo, et al.
Published: (2024) -
Which Features are Best for Successor Features?
by: Ollivier, Yann
Published: (2025) -
Zero-Shot Whole-Body Humanoid Control via Behavioral Foundation Models
by: Tirinzoni, Andrea, et al.
Published: (2025) -
Tackling the Zero-Shot Reinforcement Learning Loss Directly
by: Ollivier, Yann
Published: (2025) -
Fast Adaptation with Behavioral Foundation Models
by: Sikchi, Harshit, et al.
Published: (2025)