Direct Motion Models for Assessing Generated Videos
Fuente:
arXiv
Salvato in:
| Autori principali: | Allen, Kelsey, Doersch, Carl, Zhou, Guangyao, Suhail, Mohammed, Driess, Danny, Rocco, Ignacio, Rubanova, Yulia, Kipf, Thomas, Sajjadi, Mehdi S. M., Murphy, Kevin, Carreira, Joao, van Steenkiste, Sjoerd |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Neural USD: An object-centric framework for iterative editing and control
di: Escontrela, Alejandro, et al.
Pubblicazione: (2025)
di: Escontrela, Alejandro, et al.
Pubblicazione: (2025)
DORSal: Diffusion for Object-centric Representations of Scenes et al
di: Jabri, Allan, et al.
Pubblicazione: (2023)
di: Jabri, Allan, et al.
Pubblicazione: (2023)
DyST: Towards Dynamic Neural Scene Representations on Real-World Videos
di: Seitzer, Maximilian, et al.
Pubblicazione: (2023)
di: Seitzer, Maximilian, et al.
Pubblicazione: (2023)
Moving Off-the-Grid: Scene-Grounded Video Representations
di: van Steenkiste, Sjoerd, et al.
Pubblicazione: (2024)
di: van Steenkiste, Sjoerd, et al.
Pubblicazione: (2024)
Neural Assets: 3D-Aware Multi-Object Scene Synthesis with Image Diffusion Models
di: Wu, Ziyi, et al.
Pubblicazione: (2024)
di: Wu, Ziyi, et al.
Pubblicazione: (2024)
Forecasting Motion in the Wild
di: Thakkar, Neerja, et al.
Pubblicazione: (2026)
di: Thakkar, Neerja, et al.
Pubblicazione: (2026)
TAPVid-3D: A Benchmark for Tracking Any Point in 3D
di: Koppula, Skanda, et al.
Pubblicazione: (2024)
di: Koppula, Skanda, et al.
Pubblicazione: (2024)
How to Spin an Object: First, Get the Shape Right
di: Kabra, Rishabh, et al.
Pubblicazione: (2024)
di: Kabra, Rishabh, et al.
Pubblicazione: (2024)
Bayesian Teaching Enables Probabilistic Reasoning in Large Language Models
di: Qiu, Linlu, et al.
Pubblicazione: (2025)
di: Qiu, Linlu, et al.
Pubblicazione: (2025)
TAPNext: Tracking Any Point (TAP) as Next Token Prediction
di: Zholus, Artem, et al.
Pubblicazione: (2025)
di: Zholus, Artem, et al.
Pubblicazione: (2025)
Learning rigid-body simulators over implicit shapes for large-scale scenes and vision
di: Rubanova, Yulia, et al.
Pubblicazione: (2024)
di: Rubanova, Yulia, et al.
Pubblicazione: (2024)
Scaling Face Interaction Graph Networks to Real World Scenes
di: Lopez-Guevara, Tatiana, et al.
Pubblicazione: (2024)
di: Lopez-Guevara, Tatiana, et al.
Pubblicazione: (2024)
BootsTAP: Bootstrapped Training for Tracking-Any-Point
di: Doersch, Carl, et al.
Pubblicazione: (2024)
di: Doersch, Carl, et al.
Pubblicazione: (2024)
Scaling 4D Representations
di: Carreira, João, et al.
Pubblicazione: (2024)
di: Carreira, João, et al.
Pubblicazione: (2024)
How Does Code Pretraining Affect Language Model Task Performance?
di: Petty, Jackson, et al.
Pubblicazione: (2024)
di: Petty, Jackson, et al.
Pubblicazione: (2024)
Frozen Forecasting: A Unified Evaluation
di: Walker, Jacob C, et al.
Pubblicazione: (2025)
di: Walker, Jacob C, et al.
Pubblicazione: (2025)
LayerLock: Non-collapsing Representation Learning with Progressive Freezing
di: Erdogan, Goker, et al.
Pubblicazione: (2025)
di: Erdogan, Goker, et al.
Pubblicazione: (2025)
CulturalFrames: Assessing Cultural Expectation Alignment in Text-to-Image Models and Evaluation Metrics
di: Nayak, Shravan, et al.
Pubblicazione: (2025)
di: Nayak, Shravan, et al.
Pubblicazione: (2025)
CHEMICAL CONTROL OVER THE SYNTHESIS OF DEFECT-FREE AND HETEROMETAL-DOPED METAL OXIDE NANOPARTICLES BY THE SINGLE-SOURCE PRECURSOR APPROACH
di: M. Driess
Pubblicazione: (2005)
di: M. Driess
Pubblicazione: (2005)
A Systematic Comparison of Syllogistic Reasoning in Humans and Language Models
di: Eisape, Tiwalayo, et al.
Pubblicazione: (2023)
di: Eisape, Tiwalayo, et al.
Pubblicazione: (2023)
The Impact of Depth on Compositional Generalization in Transformer Language Models
di: Petty, Jackson, et al.
Pubblicazione: (2023)
di: Petty, Jackson, et al.
Pubblicazione: (2023)
DPconv: Super-Polynomially Faster Join Ordering
di: Stoian, Mihail, et al.
Pubblicazione: (2024)
di: Stoian, Mihail, et al.
Pubblicazione: (2024)
reward-lens: A Mechanistic Interpretability Library for Reward Models
di: Nadaf, Mohammed Suhail B
Pubblicazione: (2026)
di: Nadaf, Mohammed Suhail B
Pubblicazione: (2026)
Steerable but Not Decodable: Function Vectors Operate Beyond the Logit Lens
di: Nadaf, Mohammed Suhail B
Pubblicazione: (2026)
di: Nadaf, Mohammed Suhail B
Pubblicazione: (2026)
Synthesis and evaluation of PVC‐Cu/Al2O3 nanocomposite membranes for removing of natural organic matter from the wastewater
di: Seyed Mehdi Sajjadi, et al.
Pubblicazione: (2024)
di: Seyed Mehdi Sajjadi, et al.
Pubblicazione: (2024)
Bio‐Revitalizing SkinGlow : Assessing the Efficacy of Microcannula‐Assisted Treatment With Cohesive Polydensified Matrix Hyaluronic Acid With Glycerol (Belotero Revive) Through Ultrasound Elastography and Corneometry
di: Suhail Luna
Pubblicazione: (2025)
di: Suhail Luna
Pubblicazione: (2025)
Learning from One Continuous Video Stream
di: Carreira, João, et al.
Pubblicazione: (2023)
di: Carreira, João, et al.
Pubblicazione: (2023)
Comparative efficacy and safety of weekly tirzepatide versus weekly insulin in type 2 diabetes: A network meta‐analysis of randomized clinical trials
di: Hazem Ayesh, et al.
Pubblicazione: (2024)
di: Hazem Ayesh, et al.
Pubblicazione: (2024)
Data Assimilation-based Simultaneous Phase-Resolved Ocean Wave and Ship Motion Forecast
di: Wang, Guangyao, et al.
Pubblicazione: (2025)
di: Wang, Guangyao, et al.
Pubblicazione: (2025)
Motion Prompting: Controlling Video Generation with Motion Trajectories
di: Geng, Daniel, et al.
Pubblicazione: (2024)
di: Geng, Daniel, et al.
Pubblicazione: (2024)
Assessing the Employee Welfare Impact of Right‐To‐Work Laws: Insights From State‐Level Legislation
di: Shima Amini, et al.
Pubblicazione: (2025)
di: Shima Amini, et al.
Pubblicazione: (2025)
Herbert Walter Roesky (6.11.1935–5.12.2025): One Who Set Out to Learn Chemistry
di: Hansjörg Grützmacher, et al.
Pubblicazione: (2026)
di: Hansjörg Grützmacher, et al.
Pubblicazione: (2026)
Redbench: A Benchmark Reflecting Real Workloads
di: Krid, Skander, et al.
Pubblicazione: (2025)
di: Krid, Skander, et al.
Pubblicazione: (2025)
Spectral Image Tokenizer
di: Esteves, Carlos, et al.
Pubblicazione: (2024)
di: Esteves, Carlos, et al.
Pubblicazione: (2024)
Benchmarking Vision Language Models for Cultural Understanding
di: Nayak, Shravan, et al.
Pubblicazione: (2024)
di: Nayak, Shravan, et al.
Pubblicazione: (2024)
Parachute: Single-Pass Bi-Directional Information Passing
di: Stoian, Mihail, et al.
Pubblicazione: (2025)
di: Stoian, Mihail, et al.
Pubblicazione: (2025)
2-Rainbow domination number of circulant graphs C(n; {1,4})
di: Shaheen, Ramy, et al.
Pubblicazione: (2024)
di: Shaheen, Ramy, et al.
Pubblicazione: (2024)
Aspergilose pulmonar necrotizante: a propósito de dois casos clínicos
di: S. Carreira
Pubblicazione: (2011)
di: S. Carreira
Pubblicazione: (2011)
Impacto da diabetes na forma de apresentacão da tuberculose em doentes hospitalizados
di: S. Carreira
Pubblicazione: (2012)
di: S. Carreira
Pubblicazione: (2012)
Training Strategies for Efficient Embodied Reasoning
di: Chen, William, et al.
Pubblicazione: (2025)
di: Chen, William, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Neural USD: An object-centric framework for iterative editing and control
di: Escontrela, Alejandro, et al.
Pubblicazione: (2025) -
DORSal: Diffusion for Object-centric Representations of Scenes et al
di: Jabri, Allan, et al.
Pubblicazione: (2023) -
DyST: Towards Dynamic Neural Scene Representations on Real-World Videos
di: Seitzer, Maximilian, et al.
Pubblicazione: (2023) -
Moving Off-the-Grid: Scene-Grounded Video Representations
di: van Steenkiste, Sjoerd, et al.
Pubblicazione: (2024) -
Neural Assets: 3D-Aware Multi-Object Scene Synthesis with Image Diffusion Models
di: Wu, Ziyi, et al.
Pubblicazione: (2024)