Salvato in:
| Autori principali: | Liu, Hao, Yan, Wilson, Zaharia, Matei, Abbeel, Pieter |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2402.08268 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ElasticTok: Adaptive Tokenization for Image and Video
di: Yan, Wilson, et al.
Pubblicazione: (2024)
di: Yan, Wilson, et al.
Pubblicazione: (2024)
SIEVE: Sample-Efficient Parametric Learning from Natural Language
di: Asawa, Parth, et al.
Pubblicazione: (2026)
di: Asawa, Parth, et al.
Pubblicazione: (2026)
Long Context RAG Performance of Large Language Models
di: Leng, Quinn, et al.
Pubblicazione: (2024)
di: Leng, Quinn, et al.
Pubblicazione: (2024)
Learning to Model the World with Language
di: Lin, Jessy, et al.
Pubblicazione: (2023)
di: Lin, Jessy, et al.
Pubblicazione: (2023)
HashAttention: Semantic Sparsity for Faster Inference
di: Desai, Aditya, et al.
Pubblicazione: (2024)
di: Desai, Aditya, et al.
Pubblicazione: (2024)
Coarse-to-fine Q-Network with Action Sequence for Data-Efficient Reinforcement Learning
di: Seo, Younggyo, et al.
Pubblicazione: (2024)
di: Seo, Younggyo, et al.
Pubblicazione: (2024)
vAttention: Verified Sparse Attention
di: Desai, Aditya, et al.
Pubblicazione: (2025)
di: Desai, Aditya, et al.
Pubblicazione: (2025)
DreamSmooth: Improving Model-based Reinforcement Learning via Reward Smoothing
di: Lee, Vint, et al.
Pubblicazione: (2023)
di: Lee, Vint, et al.
Pubblicazione: (2023)
A Language Model With Million Context Length For Raw Audio
di: Verma, Prateek
Pubblicazione: (2022)
di: Verma, Prateek
Pubblicazione: (2022)
A Stable Whitening Optimizer for Efficient Neural Network Training
di: Frans, Kevin, et al.
Pubblicazione: (2025)
di: Frans, Kevin, et al.
Pubblicazione: (2025)
Reward-Conditioned Reinforcement Learning
di: Nauman, Michal, et al.
Pubblicazione: (2026)
di: Nauman, Michal, et al.
Pubblicazione: (2026)
What Really Matters in Matrix-Whitening Optimizers?
di: Frans, Kevin, et al.
Pubblicazione: (2025)
di: Frans, Kevin, et al.
Pubblicazione: (2025)
SEMDICE: Off-policy State Entropy Maximization via Stationary Distribution Correction Estimation
di: Lee, Jongmin, et al.
Pubblicazione: (2025)
di: Lee, Jongmin, et al.
Pubblicazione: (2025)
Cliqueformer: Model-Based Optimization with Structured Transformers
di: Kuba, Jakub Grudzien, et al.
Pubblicazione: (2024)
di: Kuba, Jakub Grudzien, et al.
Pubblicazione: (2024)
Offline Imitation Learning Through Graph Search and Retrieval
di: Yin, Zhao-Heng, et al.
Pubblicazione: (2024)
di: Yin, Zhao-Heng, et al.
Pubblicazione: (2024)
Video2Policy: Scaling up Manipulation Tasks in Simulation through Internet Videos
di: Ye, Weirui, et al.
Pubblicazione: (2025)
di: Ye, Weirui, et al.
Pubblicazione: (2025)
On the Trainability of Masked Diffusion Language Models via Blockwise Locality
di: Wang, Yuxiang, et al.
Pubblicazione: (2026)
di: Wang, Yuxiang, et al.
Pubblicazione: (2026)
Object-centric 3D Motion Field for Robot Learning from Human Videos
di: Yin, Zhao-Heng, et al.
Pubblicazione: (2025)
di: Yin, Zhao-Heng, et al.
Pubblicazione: (2025)
Optimizing Instructions and Demonstrations for Multi-Stage Language Model Programs
di: Opsahl-Ong, Krista, et al.
Pubblicazione: (2024)
di: Opsahl-Ong, Krista, et al.
Pubblicazione: (2024)
Learning a Diffusion Model Policy from Rewards via Q-Score Matching
di: Psenka, Michael, et al.
Pubblicazione: (2023)
di: Psenka, Michael, et al.
Pubblicazione: (2023)
One Step Diffusion via Shortcut Models
di: Frans, Kevin, et al.
Pubblicazione: (2024)
di: Frans, Kevin, et al.
Pubblicazione: (2024)
Diffusion Guidance Is a Controllable Policy Improvement Operator
di: Frans, Kevin, et al.
Pubblicazione: (2025)
di: Frans, Kevin, et al.
Pubblicazione: (2025)
Train Separately, Merge Together: Modular Post-Training with Mixture-of-Experts
di: Morrison, Jacob, et al.
Pubblicazione: (2026)
di: Morrison, Jacob, et al.
Pubblicazione: (2026)
Functional Graphical Models: Structure Enables Offline Data-Driven Optimization
di: Kuba, Jakub Grudzien, et al.
Pubblicazione: (2024)
di: Kuba, Jakub Grudzien, et al.
Pubblicazione: (2024)
Efficient Long Video Tokenization via Coordinate-based Patch Reconstruction
di: Jang, Huiwon, et al.
Pubblicazione: (2024)
di: Jang, Huiwon, et al.
Pubblicazione: (2024)
Multiscale Byte Language Models -- A Hierarchical Architecture for Causal Million-Length Sequence Modeling
di: Egli, Eric, et al.
Pubblicazione: (2025)
di: Egli, Eric, et al.
Pubblicazione: (2025)
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation
di: Zhu, Alan, et al.
Pubblicazione: (2025)
di: Zhu, Alan, et al.
Pubblicazione: (2025)
$L^*LM$: Learning Automata from Examples using Natural Language Oracles
di: Vazquez-Chanlatte, Marcell, et al.
Pubblicazione: (2024)
di: Vazquez-Chanlatte, Marcell, et al.
Pubblicazione: (2024)
BlockGen: Flexible Blockwise Sequence Modeling with Hybrid Samplers
di: Deschenaux, Justin, et al.
Pubblicazione: (2026)
di: Deschenaux, Justin, et al.
Pubblicazione: (2026)
Unsupervised Zero-Shot Reinforcement Learning via Functional Reward Encodings
di: Frans, Kevin, et al.
Pubblicazione: (2024)
di: Frans, Kevin, et al.
Pubblicazione: (2024)
Accelerating Reinforcement Learning with Value-Conditional State Entropy Exploration
di: Kim, Dongyoung, et al.
Pubblicazione: (2023)
di: Kim, Dongyoung, et al.
Pubblicazione: (2023)
Drowning in Documents: Consequences of Scaling Reranker Inference
di: Jacob, Mathew, et al.
Pubblicazione: (2024)
di: Jacob, Mathew, et al.
Pubblicazione: (2024)
SOMBRL: Scalable and Optimistic Model-Based RL
di: Sukhija, Bhavya, et al.
Pubblicazione: (2025)
di: Sukhija, Bhavya, et al.
Pubblicazione: (2025)
The Price Reversal Phenomenon: When Cheaper Reasoning Models Cost More
di: Chen, Lingjiao, et al.
Pubblicazione: (2026)
di: Chen, Lingjiao, et al.
Pubblicazione: (2026)
BESA: Pruning Large Language Models with Blockwise Parameter-Efficient Sparsity Allocation
di: Xu, Peng, et al.
Pubblicazione: (2024)
di: Xu, Peng, et al.
Pubblicazione: (2024)
How to Train Your Advisor: Steering Black-Box LLMs with Advisor Models
di: Asawa, Parth, et al.
Pubblicazione: (2025)
di: Asawa, Parth, et al.
Pubblicazione: (2025)
Bigger, Regularized, Categorical: High-Capacity Value Functions are Efficient Multi-Task Learners
di: Nauman, Michal, et al.
Pubblicazione: (2025)
di: Nauman, Michal, et al.
Pubblicazione: (2025)
CoDe: Blockwise Control for Denoising Diffusion Models
di: Singh, Anuj, et al.
Pubblicazione: (2025)
di: Singh, Anuj, et al.
Pubblicazione: (2025)
Optimizing Model Selection for Compound AI Systems
di: Chen, Lingjiao, et al.
Pubblicazione: (2025)
di: Chen, Lingjiao, et al.
Pubblicazione: (2025)
Closing the Visual Sim-to-Real Gap with Object-Composable NeRFs
di: Mishra, Nikhil, et al.
Pubblicazione: (2024)
di: Mishra, Nikhil, et al.
Pubblicazione: (2024)
Documenti analoghi
-
ElasticTok: Adaptive Tokenization for Image and Video
di: Yan, Wilson, et al.
Pubblicazione: (2024) -
SIEVE: Sample-Efficient Parametric Learning from Natural Language
di: Asawa, Parth, et al.
Pubblicazione: (2026) -
Long Context RAG Performance of Large Language Models
di: Leng, Quinn, et al.
Pubblicazione: (2024) -
Learning to Model the World with Language
di: Lin, Jessy, et al.
Pubblicazione: (2023) -
HashAttention: Semantic Sparsity for Faster Inference
di: Desai, Aditya, et al.
Pubblicazione: (2024)