Enregistré dans:
| Auteurs principaux: | Liu, Hao, Yan, Wilson, Zaharia, Matei, Abbeel, Pieter |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2402.08268 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ElasticTok: Adaptive Tokenization for Image and Video
par: Yan, Wilson, et autres
Publié: (2024)
par: Yan, Wilson, et autres
Publié: (2024)
SIEVE: Sample-Efficient Parametric Learning from Natural Language
par: Asawa, Parth, et autres
Publié: (2026)
par: Asawa, Parth, et autres
Publié: (2026)
Long Context RAG Performance of Large Language Models
par: Leng, Quinn, et autres
Publié: (2024)
par: Leng, Quinn, et autres
Publié: (2024)
Learning to Model the World with Language
par: Lin, Jessy, et autres
Publié: (2023)
par: Lin, Jessy, et autres
Publié: (2023)
HashAttention: Semantic Sparsity for Faster Inference
par: Desai, Aditya, et autres
Publié: (2024)
par: Desai, Aditya, et autres
Publié: (2024)
Coarse-to-fine Q-Network with Action Sequence for Data-Efficient Reinforcement Learning
par: Seo, Younggyo, et autres
Publié: (2024)
par: Seo, Younggyo, et autres
Publié: (2024)
vAttention: Verified Sparse Attention
par: Desai, Aditya, et autres
Publié: (2025)
par: Desai, Aditya, et autres
Publié: (2025)
DreamSmooth: Improving Model-based Reinforcement Learning via Reward Smoothing
par: Lee, Vint, et autres
Publié: (2023)
par: Lee, Vint, et autres
Publié: (2023)
A Language Model With Million Context Length For Raw Audio
par: Verma, Prateek
Publié: (2022)
par: Verma, Prateek
Publié: (2022)
A Stable Whitening Optimizer for Efficient Neural Network Training
par: Frans, Kevin, et autres
Publié: (2025)
par: Frans, Kevin, et autres
Publié: (2025)
Reward-Conditioned Reinforcement Learning
par: Nauman, Michal, et autres
Publié: (2026)
par: Nauman, Michal, et autres
Publié: (2026)
What Really Matters in Matrix-Whitening Optimizers?
par: Frans, Kevin, et autres
Publié: (2025)
par: Frans, Kevin, et autres
Publié: (2025)
SEMDICE: Off-policy State Entropy Maximization via Stationary Distribution Correction Estimation
par: Lee, Jongmin, et autres
Publié: (2025)
par: Lee, Jongmin, et autres
Publié: (2025)
Cliqueformer: Model-Based Optimization with Structured Transformers
par: Kuba, Jakub Grudzien, et autres
Publié: (2024)
par: Kuba, Jakub Grudzien, et autres
Publié: (2024)
Offline Imitation Learning Through Graph Search and Retrieval
par: Yin, Zhao-Heng, et autres
Publié: (2024)
par: Yin, Zhao-Heng, et autres
Publié: (2024)
Video2Policy: Scaling up Manipulation Tasks in Simulation through Internet Videos
par: Ye, Weirui, et autres
Publié: (2025)
par: Ye, Weirui, et autres
Publié: (2025)
On the Trainability of Masked Diffusion Language Models via Blockwise Locality
par: Wang, Yuxiang, et autres
Publié: (2026)
par: Wang, Yuxiang, et autres
Publié: (2026)
Object-centric 3D Motion Field for Robot Learning from Human Videos
par: Yin, Zhao-Heng, et autres
Publié: (2025)
par: Yin, Zhao-Heng, et autres
Publié: (2025)
Optimizing Instructions and Demonstrations for Multi-Stage Language Model Programs
par: Opsahl-Ong, Krista, et autres
Publié: (2024)
par: Opsahl-Ong, Krista, et autres
Publié: (2024)
Learning a Diffusion Model Policy from Rewards via Q-Score Matching
par: Psenka, Michael, et autres
Publié: (2023)
par: Psenka, Michael, et autres
Publié: (2023)
One Step Diffusion via Shortcut Models
par: Frans, Kevin, et autres
Publié: (2024)
par: Frans, Kevin, et autres
Publié: (2024)
Diffusion Guidance Is a Controllable Policy Improvement Operator
par: Frans, Kevin, et autres
Publié: (2025)
par: Frans, Kevin, et autres
Publié: (2025)
Train Separately, Merge Together: Modular Post-Training with Mixture-of-Experts
par: Morrison, Jacob, et autres
Publié: (2026)
par: Morrison, Jacob, et autres
Publié: (2026)
Functional Graphical Models: Structure Enables Offline Data-Driven Optimization
par: Kuba, Jakub Grudzien, et autres
Publié: (2024)
par: Kuba, Jakub Grudzien, et autres
Publié: (2024)
Efficient Long Video Tokenization via Coordinate-based Patch Reconstruction
par: Jang, Huiwon, et autres
Publié: (2024)
par: Jang, Huiwon, et autres
Publié: (2024)
Multiscale Byte Language Models -- A Hierarchical Architecture for Causal Million-Length Sequence Modeling
par: Egli, Eric, et autres
Publié: (2025)
par: Egli, Eric, et autres
Publié: (2025)
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation
par: Zhu, Alan, et autres
Publié: (2025)
par: Zhu, Alan, et autres
Publié: (2025)
$L^*LM$: Learning Automata from Examples using Natural Language Oracles
par: Vazquez-Chanlatte, Marcell, et autres
Publié: (2024)
par: Vazquez-Chanlatte, Marcell, et autres
Publié: (2024)
BlockGen: Flexible Blockwise Sequence Modeling with Hybrid Samplers
par: Deschenaux, Justin, et autres
Publié: (2026)
par: Deschenaux, Justin, et autres
Publié: (2026)
Unsupervised Zero-Shot Reinforcement Learning via Functional Reward Encodings
par: Frans, Kevin, et autres
Publié: (2024)
par: Frans, Kevin, et autres
Publié: (2024)
Accelerating Reinforcement Learning with Value-Conditional State Entropy Exploration
par: Kim, Dongyoung, et autres
Publié: (2023)
par: Kim, Dongyoung, et autres
Publié: (2023)
Drowning in Documents: Consequences of Scaling Reranker Inference
par: Jacob, Mathew, et autres
Publié: (2024)
par: Jacob, Mathew, et autres
Publié: (2024)
SOMBRL: Scalable and Optimistic Model-Based RL
par: Sukhija, Bhavya, et autres
Publié: (2025)
par: Sukhija, Bhavya, et autres
Publié: (2025)
The Price Reversal Phenomenon: When Cheaper Reasoning Models Cost More
par: Chen, Lingjiao, et autres
Publié: (2026)
par: Chen, Lingjiao, et autres
Publié: (2026)
BESA: Pruning Large Language Models with Blockwise Parameter-Efficient Sparsity Allocation
par: Xu, Peng, et autres
Publié: (2024)
par: Xu, Peng, et autres
Publié: (2024)
How to Train Your Advisor: Steering Black-Box LLMs with Advisor Models
par: Asawa, Parth, et autres
Publié: (2025)
par: Asawa, Parth, et autres
Publié: (2025)
Bigger, Regularized, Categorical: High-Capacity Value Functions are Efficient Multi-Task Learners
par: Nauman, Michal, et autres
Publié: (2025)
par: Nauman, Michal, et autres
Publié: (2025)
CoDe: Blockwise Control for Denoising Diffusion Models
par: Singh, Anuj, et autres
Publié: (2025)
par: Singh, Anuj, et autres
Publié: (2025)
Optimizing Model Selection for Compound AI Systems
par: Chen, Lingjiao, et autres
Publié: (2025)
par: Chen, Lingjiao, et autres
Publié: (2025)
Closing the Visual Sim-to-Real Gap with Object-Composable NeRFs
par: Mishra, Nikhil, et autres
Publié: (2024)
par: Mishra, Nikhil, et autres
Publié: (2024)
Documents similaires
-
ElasticTok: Adaptive Tokenization for Image and Video
par: Yan, Wilson, et autres
Publié: (2024) -
SIEVE: Sample-Efficient Parametric Learning from Natural Language
par: Asawa, Parth, et autres
Publié: (2026) -
Long Context RAG Performance of Large Language Models
par: Leng, Quinn, et autres
Publié: (2024) -
Learning to Model the World with Language
par: Lin, Jessy, et autres
Publié: (2023) -
HashAttention: Semantic Sparsity for Faster Inference
par: Desai, Aditya, et autres
Publié: (2024)