Enregistré dans:
| Auteurs principaux: | Shen, Ethan, Fan, Alan, Pratt, Sarah M., Park, Jae Sung, Wallingford, Matthew, Kakade, Sham M., Holtzman, Ari, Krishna, Ranjay, Farhadi, Ali, Kusupati, Aditya |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2405.18400 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ActionAtlas: A VideoQA Benchmark for Domain-specialized Action Recognition
par: Salehi, Mohammadreza, et autres
Publié: (2024)
par: Salehi, Mohammadreza, et autres
Publié: (2024)
From an Image to a Scene: Learning to Imagine the World from a Million 360 Videos
par: Wallingford, Matthew, et autres
Publié: (2024)
par: Wallingford, Matthew, et autres
Publié: (2024)
Matryoshka Representation Learning
par: Kusupati, Aditya, et autres
Publié: (2022)
par: Kusupati, Aditya, et autres
Publié: (2022)
MatFormer: Nested Transformer for Elastic Inference
par: Devvrit, et autres
Publié: (2023)
par: Devvrit, et autres
Publié: (2023)
Linearly Decoding Refused Knowledge in Aligned Language Models
par: Shrivastava, Aryan, et autres
Publié: (2025)
par: Shrivastava, Aryan, et autres
Publié: (2025)
Posterior Augmented Flow Matching
par: Stoica, George, et autres
Publié: (2026)
par: Stoica, George, et autres
Publié: (2026)
Flash Inference: Near Linear Time Inference for Long Convolution Sequence Models and Beyond
par: Oncescu, Costin-Andrei, et autres
Publié: (2024)
par: Oncescu, Costin-Andrei, et autres
Publié: (2024)
VideoNet: A Large-Scale Dataset for Domain-Specific Action Recognition
par: Yadav, Tanush, et autres
Publié: (2026)
par: Yadav, Tanush, et autres
Publié: (2026)
You Only Judge Once: Multi-response Reward Modeling in a Single Forward Pass
par: Yang, Yinuo, et autres
Publié: (2026)
par: Yang, Yinuo, et autres
Publié: (2026)
The Recurrent Transformer: Greater Effective Depth and Efficient Decoding
par: Oncescu, Costin-Andrei, et autres
Publié: (2026)
par: Oncescu, Costin-Andrei, et autres
Publié: (2026)
Can You Keep a Secret? Involuntary Information Leakage in Language Model Writing
par: Holtzman, Ari, et autres
Publié: (2026)
par: Holtzman, Ari, et autres
Publié: (2026)
AI as Entertainment
par: Kommers, Cody, et autres
Publié: (2026)
par: Kommers, Cody, et autres
Publié: (2026)
Prompting as Scientific Inquiry
par: Holtzman, Ari, et autres
Publié: (2025)
par: Holtzman, Ari, et autres
Publié: (2025)
Learning Hidden Markov Models Using Conditional Samples
par: Kakade, Sham M., et autres
Publié: (2023)
par: Kakade, Sham M., et autres
Publié: (2023)
Repeat After Me: Transformers are Better than State Space Models at Copying
par: Jelassi, Samy, et autres
Publié: (2024)
par: Jelassi, Samy, et autres
Publié: (2024)
Matching the Statistical Query Lower Bound for $k$-Sparse Parity Problems with Sign Stochastic Gradient Descent
par: Kou, Yiwen, et autres
Publié: (2024)
par: Kou, Yiwen, et autres
Publié: (2024)
Scaling Laws for Imitation Learning in Single-Agent Games
par: Tuyls, Jens, et autres
Publié: (2023)
par: Tuyls, Jens, et autres
Publié: (2023)
Beyond the Frame: Generating 360 Panoramic Videos from Perspective Videos
par: Luo, Rundong, et autres
Publié: (2025)
par: Luo, Rundong, et autres
Publié: (2025)
Contrastive Flow Matching
par: Stoica, George, et autres
Publié: (2025)
par: Stoica, George, et autres
Publié: (2025)
MutaGReP: Execution-Free Repository-Grounded Plan Search for Code-Use
par: Khan, Zaid, et autres
Publié: (2025)
par: Khan, Zaid, et autres
Publié: (2025)
RefDecoder: Enhancing Visual Generation with Conditional Video Decoding
par: Fan, Xiang, et autres
Publié: (2026)
par: Fan, Xiang, et autres
Publié: (2026)
Connections between Schedule-Free Optimizers, AdEMAMix, and Accelerated SGD Variants
par: Morwani, Depen, et autres
Publié: (2025)
par: Morwani, Depen, et autres
Publié: (2025)
Prescriptive Scaling Reveals the Evolution of Language Model Capabilities
par: Zhang, Hanlin, et autres
Publié: (2026)
par: Zhang, Hanlin, et autres
Publié: (2026)
GQ-VAE: A gated quantized VAE for learning variable length tokens
par: Datta, Theo, et autres
Publié: (2025)
par: Datta, Theo, et autres
Publié: (2025)
The Potential of Second-Order Optimization for LLMs: A Study with Full Gauss-Newton
par: Abreu, Natalie, et autres
Publié: (2025)
par: Abreu, Natalie, et autres
Publié: (2025)
Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning
par: Jin, Jikai, et autres
Publié: (2025)
par: Jin, Jikai, et autres
Publié: (2025)
The Unmet Promise of Synthetic Training Images: Using Retrieved Real Images Performs Better
par: Geng, Scott, et autres
Publié: (2024)
par: Geng, Scott, et autres
Publié: (2024)
Synthetic Visual Genome
par: Park, Jae Sung, et autres
Publié: (2025)
par: Park, Jae Sung, et autres
Publié: (2025)
Convergent Functions, Divergent Forms
par: Jeon, Hyeonseong, et autres
Publié: (2025)
par: Jeon, Hyeonseong, et autres
Publié: (2025)
Selective Visual Representations Improve Convergence and Generalization for Embodied AI
par: Eftekhar, Ainaz, et autres
Publié: (2023)
par: Eftekhar, Ainaz, et autres
Publié: (2023)
MatMamba: A Matryoshka State Space Model
par: Shukla, Abhinav, et autres
Publié: (2024)
par: Shukla, Abhinav, et autres
Publié: (2024)
Evaluating Relational Reasoning in LLMs with REL
par: Fesser, Lukas, et autres
Publié: (2026)
par: Fesser, Lukas, et autres
Publié: (2026)
The Role of Sparsity for Length Generalization in Transformers
par: Golowich, Noah, et autres
Publié: (2025)
par: Golowich, Noah, et autres
Publié: (2025)
The Emergence of Complex Behavior in Large-Scale Ecological Environments
par: Bejjani, Joseph, et autres
Publié: (2025)
par: Bejjani, Joseph, et autres
Publié: (2025)
LLM Probability Concentration: How Alignment Shrinks the Generative Horizon
par: Yang, Chenghao, et autres
Publié: (2025)
par: Yang, Chenghao, et autres
Publié: (2025)
Multilingual Diversity Improves Vision-Language Representations
par: Nguyen, Thao, et autres
Publié: (2024)
par: Nguyen, Thao, et autres
Publié: (2024)
Synthetic Object Compositions for Scalable and Accurate Learning in Detection, Segmentation, and Grounding
par: Huang, Weikai, et autres
Publié: (2025)
par: Huang, Weikai, et autres
Publié: (2025)
In Good GRACEs: Principled Teacher Selection for Knowledge Distillation
par: Panigrahi, Abhishek, et autres
Publié: (2025)
par: Panigrahi, Abhishek, et autres
Publié: (2025)
Train for the Worst, Plan for the Best: Understanding Token Ordering in Masked Diffusions
par: Kim, Jaeyeon, et autres
Publié: (2025)
par: Kim, Jaeyeon, et autres
Publié: (2025)
Data-Efficient Multi-Agent Spatial Planning with LLMs
par: Su, Huangyuan, et autres
Publié: (2025)
par: Su, Huangyuan, et autres
Publié: (2025)
Documents similaires
-
ActionAtlas: A VideoQA Benchmark for Domain-specialized Action Recognition
par: Salehi, Mohammadreza, et autres
Publié: (2024) -
From an Image to a Scene: Learning to Imagine the World from a Million 360 Videos
par: Wallingford, Matthew, et autres
Publié: (2024) -
Matryoshka Representation Learning
par: Kusupati, Aditya, et autres
Publié: (2022) -
MatFormer: Nested Transformer for Elastic Inference
par: Devvrit, et autres
Publié: (2023) -
Linearly Decoding Refused Knowledge in Aligned Language Models
par: Shrivastava, Aryan, et autres
Publié: (2025)