Guardado en:
| Autores principales: | Chu, Wen-Hsuan, Harley, Adam W., Tokmakov, Pavel, Dave, Achal, Guibas, Leonidas, Fragkiadaki, Katerina |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2310.06992 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
AllTracker: Efficient Dense Point Tracking at High Resolution
por: Harley, Adam W., et al.
Publicado: (2025)
por: Harley, Adam W., et al.
Publicado: (2025)
GRIN: Zero-Shot Metric Depth with Pixel-Level Diffusion
por: Guizilini, Vitor, et al.
Publicado: (2024)
por: Guizilini, Vitor, et al.
Publicado: (2024)
Refining Pre-Trained Motion Models
por: Sun, Xinglong, et al.
Publicado: (2024)
por: Sun, Xinglong, et al.
Publicado: (2024)
Generative 4D Scene Gaussian Splatting with Object View-Synthesis Priors
por: Chu, Wen-Hsuan, et al.
Publicado: (2025)
por: Chu, Wen-Hsuan, et al.
Publicado: (2025)
Zero-Shot Image Feature Consensus with Deep Functional Maps
por: Cheng, Xinle, et al.
Publicado: (2024)
por: Cheng, Xinle, et al.
Publicado: (2024)
TAPIP3D: Tracking Any Point in Persistent 3D Geometry
por: Zhang, Bowei, et al.
Publicado: (2025)
por: Zhang, Bowei, et al.
Publicado: (2025)
DreamScene4D: Dynamic Multi-Object Scene Generation from Monocular Videos
por: Chu, Wen-Hsuan, et al.
Publicado: (2024)
por: Chu, Wen-Hsuan, et al.
Publicado: (2024)
Support-Set Context Matters for Bongard Problems
por: Raghuraman, Nikhil, et al.
Publicado: (2023)
por: Raghuraman, Nikhil, et al.
Publicado: (2023)
View-Consistent Hierarchical 3D Segmentation Using Ultrametric Feature Fields
por: He, Haodi, et al.
Publicado: (2024)
por: He, Haodi, et al.
Publicado: (2024)
Animal Pose Labeling Using General-Purpose Point Trackers
por: Pan, Zhuoyang, et al.
Publicado: (2025)
por: Pan, Zhuoyang, et al.
Publicado: (2025)
LookOut: Real-World Humanoid Egocentric Navigation
por: Pan, Boxiao, et al.
Publicado: (2025)
por: Pan, Boxiao, et al.
Publicado: (2025)
MoSca: Dynamic Gaussian Fusion from Casual Videos via 4D Motion Scaffolds
por: Lei, Jiahui, et al.
Publicado: (2024)
por: Lei, Jiahui, et al.
Publicado: (2024)
pix2gestalt: Amodal Segmentation by Synthesizing Wholes
por: Ozguroglu, Ege, et al.
Publicado: (2024)
por: Ozguroglu, Ege, et al.
Publicado: (2024)
Understanding Video Transformers via Universal Concept Discovery
por: Kowal, Matthew, et al.
Publicado: (2024)
por: Kowal, Matthew, et al.
Publicado: (2024)
Dreamitate: Real-World Visuomotor Policy Learning via Video Generation
por: Liang, Junbang, et al.
Publicado: (2024)
por: Liang, Junbang, et al.
Publicado: (2024)
Energy-based Models are Zero-Shot Planners for Compositional Scene Rearrangement
por: Gkanatsios, Nikolaos, et al.
Publicado: (2023)
por: Gkanatsios, Nikolaos, et al.
Publicado: (2023)
Understanding Complexity in VideoQA via Visual Program Generation
por: Eyzaguirre, Cristobal, et al.
Publicado: (2025)
por: Eyzaguirre, Cristobal, et al.
Publicado: (2025)
Dynamic Gaussian Marbles for Novel View Synthesis of Casual Monocular Videos
por: Stearns, Colton, et al.
Publicado: (2024)
por: Stearns, Colton, et al.
Publicado: (2024)
Diffusion Self-Distillation for Zero-Shot Customized Image Generation
por: Cai, Shengqu, et al.
Publicado: (2024)
por: Cai, Shengqu, et al.
Publicado: (2024)
Monocular Dynamic Gaussian Splatting: Fast, Brittle, and Scene Complexity Rules
por: Liang, Yiqing, et al.
Publicado: (2024)
por: Liang, Yiqing, et al.
Publicado: (2024)
Zero-Shot Open-Vocabulary Human Motion Grounding with Test-Time Training
por: Zhou, Yunjiao, et al.
Publicado: (2025)
por: Zhou, Yunjiao, et al.
Publicado: (2025)
PACE: A Large-Scale Dataset with Pose Annotations in Cluttered Environments
por: You, Yang, et al.
Publicado: (2023)
por: You, Yang, et al.
Publicado: (2023)
Synthetic Captions for Open-Vocabulary Zero-Shot Segmentation
por: Lebailly, Tim, et al.
Publicado: (2025)
por: Lebailly, Tim, et al.
Publicado: (2025)
ODIN: A Single Model for 2D and 3D Segmentation
por: Jain, Ayush, et al.
Publicado: (2024)
por: Jain, Ayush, et al.
Publicado: (2024)
RAM: Retrieval-Based Affordance Transfer for Generalizable Zero-Shot Robotic Manipulation
por: Kuang, Yuxuan, et al.
Publicado: (2024)
por: Kuang, Yuxuan, et al.
Publicado: (2024)
Dex4D: Task-Agnostic Point Track Policy for Sim-to-Real Dexterous Manipulation
por: Kuang, Yuxuan, et al.
Publicado: (2026)
por: Kuang, Yuxuan, et al.
Publicado: (2026)
BlenderAlchemy: Editing 3D Graphics with Vision-Language Models
por: Huang, Ian, et al.
Publicado: (2024)
por: Huang, Ian, et al.
Publicado: (2024)
Generative Camera Dolly: Extreme Monocular Dynamic Novel View Synthesis
por: Van Hoorick, Basile, et al.
Publicado: (2024)
por: Van Hoorick, Basile, et al.
Publicado: (2024)
A Simple Framework for Open-Vocabulary Zero-Shot Segmentation
por: Stegmüller, Thomas, et al.
Publicado: (2024)
por: Stegmüller, Thomas, et al.
Publicado: (2024)
Exploring Vision-Language Models for Open-Vocabulary Zero-Shot Action Segmentation
por: Unmesh, Asim, et al.
Publicado: (2026)
por: Unmesh, Asim, et al.
Publicado: (2026)
Zero-Shot Video Semantic Segmentation based on Pre-Trained Diffusion Models
por: Wang, Qian, et al.
Publicado: (2024)
por: Wang, Qian, et al.
Publicado: (2024)
Open-Vocabulary Panoptic Segmentation Using BERT Pre-Training of Vision-Language Multiway Transformer Model
por: Chen, Yi-Chia, et al.
Publicado: (2024)
por: Chen, Yi-Chia, et al.
Publicado: (2024)
Asymmetric Flow Models
por: Chen, Hansheng, et al.
Publicado: (2026)
por: Chen, Hansheng, et al.
Publicado: (2026)
RADSeg: Unleashing Parameter and Compute Efficient Zero-Shot Open-Vocabulary Segmentation Using Agglomerative Models
por: Alama, Omar, et al.
Publicado: (2025)
por: Alama, Omar, et al.
Publicado: (2025)
Aligning Text-to-Image Diffusion Models with Reward Backpropagation
por: Prabhudesai, Mihir, et al.
Publicado: (2023)
por: Prabhudesai, Mihir, et al.
Publicado: (2023)
Audio-Visual Generalized Zero-Shot Learning using Pre-Trained Large Multi-Modal Models
por: Kurzendörfer, David, et al.
Publicado: (2024)
por: Kurzendörfer, David, et al.
Publicado: (2024)
RSVG-ZeroOV: Exploring a Training-Free Framework for Zero-Shot Open-Vocabulary Visual Grounding in Remote Sensing Images
por: Li, Ke, et al.
Publicado: (2025)
por: Li, Ke, et al.
Publicado: (2025)
OCH3R: Object-Centric Holistic 3D Reconstruction
por: Du, Yi, et al.
Publicado: (2026)
por: Du, Yi, et al.
Publicado: (2026)
InfoGaussian: Structure-Aware Dynamic Gaussians through Lightweight Information Shaping
por: Zhang, Yunchao, et al.
Publicado: (2024)
por: Zhang, Yunchao, et al.
Publicado: (2024)
SparseDFF: Sparse-View Feature Distillation for One-Shot Dexterous Manipulation
por: Wang, Qianxu, et al.
Publicado: (2023)
por: Wang, Qianxu, et al.
Publicado: (2023)
Ejemplares similares
-
AllTracker: Efficient Dense Point Tracking at High Resolution
por: Harley, Adam W., et al.
Publicado: (2025) -
GRIN: Zero-Shot Metric Depth with Pixel-Level Diffusion
por: Guizilini, Vitor, et al.
Publicado: (2024) -
Refining Pre-Trained Motion Models
por: Sun, Xinglong, et al.
Publicado: (2024) -
Generative 4D Scene Gaussian Splatting with Object View-Synthesis Priors
por: Chu, Wen-Hsuan, et al.
Publicado: (2025) -
Zero-Shot Image Feature Consensus with Deep Functional Maps
por: Cheng, Xinle, et al.
Publicado: (2024)