Salvato in:
| Autori principali: | Yan, Wilson, Mnih, Volodymyr, Faust, Aleksandra, Zaharia, Matei, Abbeel, Pieter, Liu, Hao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2410.08368 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
World Model on Million-Length Video And Language With Blockwise RingAttention
di: Liu, Hao, et al.
Pubblicazione: (2024)
di: Liu, Hao, et al.
Pubblicazione: (2024)
CLUTR: Curriculum Learning via Unsupervised Task Representation Learning
di: Azad, Abdus Salam, et al.
Pubblicazione: (2022)
di: Azad, Abdus Salam, et al.
Pubblicazione: (2022)
Efficient Long Video Tokenization via Coordinate-based Patch Reconstruction
di: Jang, Huiwon, et al.
Pubblicazione: (2024)
di: Jang, Huiwon, et al.
Pubblicazione: (2024)
SIEVE: Sample-Efficient Parametric Learning from Natural Language
di: Asawa, Parth, et al.
Pubblicazione: (2026)
di: Asawa, Parth, et al.
Pubblicazione: (2026)
LMAct: A Benchmark for In-Context Imitation Learning with Long Multimodal Demonstrations
di: Ruoss, Anian, et al.
Pubblicazione: (2024)
di: Ruoss, Anian, et al.
Pubblicazione: (2024)
Coarse-to-fine Q-Network with Action Sequence for Data-Efficient Reinforcement Learning
di: Seo, Younggyo, et al.
Pubblicazione: (2024)
di: Seo, Younggyo, et al.
Pubblicazione: (2024)
A Stable Whitening Optimizer for Efficient Neural Network Training
di: Frans, Kevin, et al.
Pubblicazione: (2025)
di: Frans, Kevin, et al.
Pubblicazione: (2025)
Reward-Conditioned Reinforcement Learning
di: Nauman, Michal, et al.
Pubblicazione: (2026)
di: Nauman, Michal, et al.
Pubblicazione: (2026)
What Really Matters in Matrix-Whitening Optimizers?
di: Frans, Kevin, et al.
Pubblicazione: (2025)
di: Frans, Kevin, et al.
Pubblicazione: (2025)
SEMDICE: Off-policy State Entropy Maximization via Stationary Distribution Correction Estimation
di: Lee, Jongmin, et al.
Pubblicazione: (2025)
di: Lee, Jongmin, et al.
Pubblicazione: (2025)
Offline Imitation Learning Through Graph Search and Retrieval
di: Yin, Zhao-Heng, et al.
Pubblicazione: (2024)
di: Yin, Zhao-Heng, et al.
Pubblicazione: (2024)
Video2Policy: Scaling up Manipulation Tasks in Simulation through Internet Videos
di: Ye, Weirui, et al.
Pubblicazione: (2025)
di: Ye, Weirui, et al.
Pubblicazione: (2025)
Long Context RAG Performance of Large Language Models
di: Leng, Quinn, et al.
Pubblicazione: (2024)
di: Leng, Quinn, et al.
Pubblicazione: (2024)
VideoFlexTok: Flexible-Length Coarse-to-Fine Video Tokenization
di: Atanov, Andrei, et al.
Pubblicazione: (2026)
di: Atanov, Andrei, et al.
Pubblicazione: (2026)
Sparse Orthogonal Variational Inference for Gaussian Processes
di: Shi, Jiaxin, et al.
Pubblicazione: (2019)
di: Shi, Jiaxin, et al.
Pubblicazione: (2019)
Object-centric 3D Motion Field for Robot Learning from Human Videos
di: Yin, Zhao-Heng, et al.
Pubblicazione: (2025)
di: Yin, Zhao-Heng, et al.
Pubblicazione: (2025)
DreamSmooth: Improving Model-based Reinforcement Learning via Reward Smoothing
di: Lee, Vint, et al.
Pubblicazione: (2023)
di: Lee, Vint, et al.
Pubblicazione: (2023)
VidTok: A Versatile and Open-Source Video Tokenizer
di: Tang, Anni, et al.
Pubblicazione: (2024)
di: Tang, Anni, et al.
Pubblicazione: (2024)
Cliqueformer: Model-Based Optimization with Structured Transformers
di: Kuba, Jakub Grudzien, et al.
Pubblicazione: (2024)
di: Kuba, Jakub Grudzien, et al.
Pubblicazione: (2024)
Diffusion Guidance Is a Controllable Policy Improvement Operator
di: Frans, Kevin, et al.
Pubblicazione: (2025)
di: Frans, Kevin, et al.
Pubblicazione: (2025)
Train Separately, Merge Together: Modular Post-Training with Mixture-of-Experts
di: Morrison, Jacob, et al.
Pubblicazione: (2026)
di: Morrison, Jacob, et al.
Pubblicazione: (2026)
Schrödinger Bridge Flow for Unpaired Data Translation
di: De Bortoli, Valentin, et al.
Pubblicazione: (2024)
di: De Bortoli, Valentin, et al.
Pubblicazione: (2024)
Unsupervised Zero-Shot Reinforcement Learning via Functional Reward Encodings
di: Frans, Kevin, et al.
Pubblicazione: (2024)
di: Frans, Kevin, et al.
Pubblicazione: (2024)
HashAttention: Semantic Sparsity for Faster Inference
di: Desai, Aditya, et al.
Pubblicazione: (2024)
di: Desai, Aditya, et al.
Pubblicazione: (2024)
Learning a Diffusion Model Policy from Rewards via Q-Score Matching
di: Psenka, Michael, et al.
Pubblicazione: (2023)
di: Psenka, Michael, et al.
Pubblicazione: (2023)
Accelerating Reinforcement Learning with Value-Conditional State Entropy Exploration
di: Kim, Dongyoung, et al.
Pubblicazione: (2023)
di: Kim, Dongyoung, et al.
Pubblicazione: (2023)
Drowning in Documents: Consequences of Scaling Reranker Inference
di: Jacob, Mathew, et al.
Pubblicazione: (2024)
di: Jacob, Mathew, et al.
Pubblicazione: (2024)
FlexTok: Resampling Images into 1D Token Sequences of Flexible Length
di: Bachmann, Roman, et al.
Pubblicazione: (2025)
di: Bachmann, Roman, et al.
Pubblicazione: (2025)
Bigger, Regularized, Categorical: High-Capacity Value Functions are Efficient Multi-Task Learners
di: Nauman, Michal, et al.
Pubblicazione: (2025)
di: Nauman, Michal, et al.
Pubblicazione: (2025)
One Step Diffusion via Shortcut Models
di: Frans, Kevin, et al.
Pubblicazione: (2024)
di: Frans, Kevin, et al.
Pubblicazione: (2024)
Functional Graphical Models: Structure Enables Offline Data-Driven Optimization
di: Kuba, Jakub Grudzien, et al.
Pubblicazione: (2024)
di: Kuba, Jakub Grudzien, et al.
Pubblicazione: (2024)
TokSuite: Measuring the Impact of Tokenizer Choice on Language Model Behavior
di: Altıntaş, Gül Sena, et al.
Pubblicazione: (2025)
di: Altıntaş, Gül Sena, et al.
Pubblicazione: (2025)
Closing the Visual Sim-to-Real Gap with Object-Composable NeRFs
di: Mishra, Nikhil, et al.
Pubblicazione: (2024)
di: Mishra, Nikhil, et al.
Pubblicazione: (2024)
Prioritized Generative Replay
di: Wang, Renhao, et al.
Pubblicazione: (2024)
di: Wang, Renhao, et al.
Pubblicazione: (2024)
Exposing Limitations of Language Model Agents in Sequential-Task Compositions on the Web
di: Furuta, Hiroki, et al.
Pubblicazione: (2023)
di: Furuta, Hiroki, et al.
Pubblicazione: (2023)
Body Transformer: Leveraging Robot Embodiment for Policy Learning
di: Sferrazza, Carmelo, et al.
Pubblicazione: (2024)
di: Sferrazza, Carmelo, et al.
Pubblicazione: (2024)
TokUR: Token-Level Uncertainty Estimation for Large Language Model Reasoning
di: Zhang, Tunyu, et al.
Pubblicazione: (2025)
di: Zhang, Tunyu, et al.
Pubblicazione: (2025)
MaxInfoRL: Boosting exploration in reinforcement learning through information gain maximization
di: Sukhija, Bhavya, et al.
Pubblicazione: (2024)
di: Sukhija, Bhavya, et al.
Pubblicazione: (2024)
SOMBRL: Scalable and Optimistic Model-Based RL
di: Sukhija, Bhavya, et al.
Pubblicazione: (2025)
di: Sukhija, Bhavya, et al.
Pubblicazione: (2025)
The Price Reversal Phenomenon: When Cheaper Reasoning Models Cost More
di: Chen, Lingjiao, et al.
Pubblicazione: (2026)
di: Chen, Lingjiao, et al.
Pubblicazione: (2026)
Documenti analoghi
-
World Model on Million-Length Video And Language With Blockwise RingAttention
di: Liu, Hao, et al.
Pubblicazione: (2024) -
CLUTR: Curriculum Learning via Unsupervised Task Representation Learning
di: Azad, Abdus Salam, et al.
Pubblicazione: (2022) -
Efficient Long Video Tokenization via Coordinate-based Patch Reconstruction
di: Jang, Huiwon, et al.
Pubblicazione: (2024) -
SIEVE: Sample-Efficient Parametric Learning from Natural Language
di: Asawa, Parth, et al.
Pubblicazione: (2026) -
LMAct: A Benchmark for In-Context Imitation Learning with Long Multimodal Demonstrations
di: Ruoss, Anian, et al.
Pubblicazione: (2024)