Refining Pre-Trained Motion Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Sun, Xinglong, Harley, Adam W., Guibas, Leonidas J. |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Support-Set Context Matters for Bongard Problems
par: Raghuraman, Nikhil, et autres
Publié: (2023)
par: Raghuraman, Nikhil, et autres
Publié: (2023)
View-Consistent Hierarchical 3D Segmentation Using Ultrametric Feature Fields
par: He, Haodi, et autres
Publié: (2024)
par: He, Haodi, et autres
Publié: (2024)
Zero-Shot Open-Vocabulary Tracking with Large Pre-Trained Models
par: Chu, Wen-Hsuan, et autres
Publié: (2023)
par: Chu, Wen-Hsuan, et autres
Publié: (2023)
HouseLayout3D: A Benchmark and Training-Free Baseline for 3D Layout Estimation in the Wild
par: Bieri, Valentin, et autres
Publié: (2025)
par: Bieri, Valentin, et autres
Publié: (2025)
MoSca: Dynamic Gaussian Fusion from Casual Videos via 4D Motion Scaffolds
par: Lei, Jiahui, et autres
Publié: (2024)
par: Lei, Jiahui, et autres
Publié: (2024)
SpaceControl: Introducing Test-Time Spatial Control to 3D Generative Modeling
par: Fedele, Elisabetta, et autres
Publié: (2025)
par: Fedele, Elisabetta, et autres
Publié: (2025)
PASTA: Controllable Part-Aware Shape Generation with Autoregressive Transformers
par: Li, Songlin, et autres
Publié: (2024)
par: Li, Songlin, et autres
Publié: (2024)
LookOut: Real-World Humanoid Egocentric Navigation
par: Pan, Boxiao, et autres
Publié: (2025)
par: Pan, Boxiao, et autres
Publié: (2025)
ArtVLM: Attribute Recognition Through Vision-Based Prefix Language Modeling
par: Zhu, William Yicheng, et autres
Publié: (2024)
par: Zhu, William Yicheng, et autres
Publié: (2024)
Animal Pose Labeling Using General-Purpose Point Trackers
par: Pan, Zhuoyang, et autres
Publié: (2025)
par: Pan, Zhuoyang, et autres
Publié: (2025)
Zero-Shot Image Feature Consensus with Deep Functional Maps
par: Cheng, Xinle, et autres
Publié: (2024)
par: Cheng, Xinle, et autres
Publié: (2024)
Synthesizing 3D Abstractions by Inverting Procedural Buildings with Transformers
par: Dax, Maximilian, et autres
Publié: (2025)
par: Dax, Maximilian, et autres
Publié: (2025)
The Cartesian Shortcut: Re-evaluate Vision Reasoning in Polar Coordinate Space
par: Hu, Xia, et autres
Publié: (2026)
par: Hu, Xia, et autres
Publié: (2026)
Multimodal Fusion with Pre-Trained Model Features in Affective Behaviour Analysis In-the-wild
par: Wen, Zhuofan, et autres
Publié: (2024)
par: Wen, Zhuofan, et autres
Publié: (2024)
Visual Chronicles: Using Multimodal LLMs to Analyze Massive Collections of Images
par: Deng, Boyang, et autres
Publié: (2025)
par: Deng, Boyang, et autres
Publié: (2025)
pi-Flow: Policy-Based Few-Step Generation via Imitation Distillation
par: Chen, Hansheng, et autres
Publié: (2025)
par: Chen, Hansheng, et autres
Publié: (2025)
Chain-of-Models Pre-Training: Rethinking Training Acceleration of Vision Foundation Models
par: Fan, Jiawei, et autres
Publié: (2026)
par: Fan, Jiawei, et autres
Publié: (2026)
Mull-Tokens: Modality-Agnostic Latent Thinking
par: Ray, Arijit, et autres
Publié: (2025)
par: Ray, Arijit, et autres
Publié: (2025)
Robust Symmetry Detection via Riemannian Langevin Dynamics
par: Je, Jihyeon, et autres
Publié: (2024)
par: Je, Jihyeon, et autres
Publié: (2024)
Pre-Trained Vision-Language Models as Partial Annotators
par: Wang, Qian-Wei, et autres
Publié: (2024)
par: Wang, Qian-Wei, et autres
Publié: (2024)
Pre-Trained Video Generative Models as World Simulators
par: He, Haoran, et autres
Publié: (2025)
par: He, Haoran, et autres
Publié: (2025)
Developing a Strong Pre-Trained Base Model for Plant Leaf Disease Classification
par: Richter, David J.
Publié: (2026)
par: Richter, David J.
Publié: (2026)
Robot Learning from a Physical World Model
par: Mao, Jiageng, et autres
Publié: (2025)
par: Mao, Jiageng, et autres
Publié: (2025)
SmartRefine: A Scenario-Adaptive Refinement Framework for Efficient Motion Prediction
par: Zhou, Yang, et autres
Publié: (2024)
par: Zhou, Yang, et autres
Publié: (2024)
Neural Implicit Representation for Building Digital Twins of Unknown Articulated Objects
par: Weng, Yijia, et autres
Publié: (2024)
par: Weng, Yijia, et autres
Publié: (2024)
Diffusion Self-Distillation for Zero-Shot Customized Image Generation
par: Cai, Shengqu, et autres
Publié: (2024)
par: Cai, Shengqu, et autres
Publié: (2024)
GRAZE: Grounded Refinement and Motion-Aware Zero-Shot Event Localization
par: Zaidi, Syed Ahsan Masud, et autres
Publié: (2026)
par: Zaidi, Syed Ahsan Masud, et autres
Publié: (2026)
MIM-Refiner: A Contrastive Learning Boost from Intermediate Pre-Trained Representations
par: Alkin, Benedikt, et autres
Publié: (2024)
par: Alkin, Benedikt, et autres
Publié: (2024)
3D-Adapter: Geometry-Consistent Multi-View Diffusion for High-Quality 3D Generation
par: Chen, Hansheng, et autres
Publié: (2024)
par: Chen, Hansheng, et autres
Publié: (2024)
StableMotion: Training Motion Cleanup Models with Unpaired Corrupted Data
par: Mu, Yuxuan, et autres
Publié: (2025)
par: Mu, Yuxuan, et autres
Publié: (2025)
E$^3$C: Video Generation with 3D Environmental Memory and Ego-Exo Human Pose Control
par: Gu, Qiao, et autres
Publié: (2026)
par: Gu, Qiao, et autres
Publié: (2026)
Adversarially-Refined VQ-GAN with Dense Motion Tokenization for Spatio-Temporal Heatmaps
par: Maldonado, Gabriel, et autres
Publié: (2025)
par: Maldonado, Gabriel, et autres
Publié: (2025)
MoMaps: Semantics-Aware Scene Motion Generation with Motion Maps
par: Lei, Jiahui, et autres
Publié: (2025)
par: Lei, Jiahui, et autres
Publié: (2025)
Training-Free Refinement of Flow Matching with Divergence-based Sampling
par: Cha, Yeonwoo, et autres
Publié: (2026)
par: Cha, Yeonwoo, et autres
Publié: (2026)
Synthesizing Efficient Data with Diffusion Models for Person Re-Identification Pre-Training
par: Niu, Ke, et autres
Publié: (2024)
par: Niu, Ke, et autres
Publié: (2024)
Pre-Trained CNN Architecture for Transformer-Based Image Caption Generation Model
par: Dufera, Amanuel Tafese
Publié: (2025)
par: Dufera, Amanuel Tafese
Publié: (2025)
GPT-NAS: Evolutionary Neural Architecture Search with the Generative Pre-Trained Model
par: Yu, Caiyang, et autres
Publié: (2023)
par: Yu, Caiyang, et autres
Publié: (2023)
Dynamic Gaussian Marbles for Novel View Synthesis of Casual Monocular Videos
par: Stearns, Colton, et autres
Publié: (2024)
par: Stearns, Colton, et autres
Publié: (2024)
NESTOR: A Nested MOE-based Neural Operator for Large-Scale PDE Pre-Training
par: Sun, Dengdi, et autres
Publié: (2026)
par: Sun, Dengdi, et autres
Publié: (2026)
Monocular Dynamic Gaussian Splatting: Fast, Brittle, and Scene Complexity Rules
par: Liang, Yiqing, et autres
Publié: (2024)
par: Liang, Yiqing, et autres
Publié: (2024)
Documents similaires
-
Support-Set Context Matters for Bongard Problems
par: Raghuraman, Nikhil, et autres
Publié: (2023) -
View-Consistent Hierarchical 3D Segmentation Using Ultrametric Feature Fields
par: He, Haodi, et autres
Publié: (2024) -
Zero-Shot Open-Vocabulary Tracking with Large Pre-Trained Models
par: Chu, Wen-Hsuan, et autres
Publié: (2023) -
HouseLayout3D: A Benchmark and Training-Free Baseline for 3D Layout Estimation in the Wild
par: Bieri, Valentin, et autres
Publié: (2025) -
MoSca: Dynamic Gaussian Fusion from Casual Videos via 4D Motion Scaffolds
par: Lei, Jiahui, et autres
Publié: (2024)