VideoMaMa: Mask-Guided Video Matting via Generative Prior
Fuente:
arXiv
Salvato in:
| Autori principali: | Lim, Sangbeom, Oh, Seoung Wug, Huang, Jiahui, Yoon, Heeji, Kim, Seungryong, Lee, Joon-Young |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MaGGIe: Masked Guided Gradual Human Instance Matting
di: Huynh, Chuong, et al.
Pubblicazione: (2024)
di: Huynh, Chuong, et al.
Pubblicazione: (2024)
Elevating Flow-Guided Video Inpainting with Reference Generation
di: Cho, Suhwan, et al.
Pubblicazione: (2024)
di: Cho, Suhwan, et al.
Pubblicazione: (2024)
Referring Video Object Segmentation via Language-aligned Track Selection
di: Kim, Seongchan, et al.
Pubblicazione: (2024)
di: Kim, Seongchan, et al.
Pubblicazione: (2024)
Tuning-Free Multi-Event Long Video Generation via Synchronized Coupled Sampling
di: Kim, Subin, et al.
Pubblicazione: (2025)
di: Kim, Subin, et al.
Pubblicazione: (2025)
URECA: Unique Region Caption Anything
di: Lim, Sangbeom, et al.
Pubblicazione: (2025)
di: Lim, Sangbeom, et al.
Pubblicazione: (2025)
FRAME: Pre-Training Video Feature Representations via Anticipation and Memory
di: TV, Sethuraman, et al.
Pubblicazione: (2025)
di: TV, Sethuraman, et al.
Pubblicazione: (2025)
Putting the Object Back into Video Object Segmentation
di: Cheng, Ho Kei, et al.
Pubblicazione: (2023)
di: Cheng, Ho Kei, et al.
Pubblicazione: (2023)
VISAGE: Video Instance Segmentation with Appearance-Guided Enhancement
di: Kim, Hanjung, et al.
Pubblicazione: (2023)
di: Kim, Hanjung, et al.
Pubblicazione: (2023)
Talk3D: High-Fidelity Talking Portrait Synthesis via Personalized 3D Generative Prior
di: Ko, Jaehoon, et al.
Pubblicazione: (2024)
di: Ko, Jaehoon, et al.
Pubblicazione: (2024)
HARIVO: Harnessing Text-to-Image Models for Video Generation
di: Kwon, Mingi, et al.
Pubblicazione: (2024)
di: Kwon, Mingi, et al.
Pubblicazione: (2024)
Deep Forcing: Training-Free Long Video Generation with Deep Sink and Participative Compression
di: Yi, Jung, et al.
Pubblicazione: (2025)
di: Yi, Jung, et al.
Pubblicazione: (2025)
Multi-Granularity Video Object Segmentation
di: Lim, Sangbeom, et al.
Pubblicazione: (2024)
di: Lim, Sangbeom, et al.
Pubblicazione: (2024)
DAGE: Dual-Stream Architecture for Efficient and Fine-Grained Geometry Estimation
di: Ngo, Tuan Duc, et al.
Pubblicazione: (2026)
di: Ngo, Tuan Duc, et al.
Pubblicazione: (2026)
IF-MDM: Implicit Face Motion Diffusion Model for High-Fidelity Realtime Talking Head Generation
di: Yang, Sejong, et al.
Pubblicazione: (2024)
di: Yang, Sejong, et al.
Pubblicazione: (2024)
Seurat: From Moving Points to Depth
di: Cho, Seokju, et al.
Pubblicazione: (2025)
di: Cho, Seokju, et al.
Pubblicazione: (2025)
MATRIX: Mask Track Alignment for Interaction-aware Video Generation
di: Jin, Siyoon, et al.
Pubblicazione: (2025)
di: Jin, Siyoon, et al.
Pubblicazione: (2025)
Visual Representation Alignment for Multimodal Large Language Models
di: Yoon, Heeji, et al.
Pubblicazione: (2025)
di: Yoon, Heeji, et al.
Pubblicazione: (2025)
Local All-Pair Correspondence for Point Tracking
di: Cho, Seokju, et al.
Pubblicazione: (2024)
di: Cho, Seokju, et al.
Pubblicazione: (2024)
In-N-Out: Faithful 3D GAN Inversion with Volumetric Decomposition for Face Editing
di: Xu, Yiran, et al.
Pubblicazione: (2023)
di: Xu, Yiran, et al.
Pubblicazione: (2023)
Generative Video Matting
di: Ge, Yongtao, et al.
Pubblicazione: (2025)
di: Ge, Yongtao, et al.
Pubblicazione: (2025)
Exploring Temporally-Aware Features for Point Tracking
di: Kim, Inès Hyeonsu, et al.
Pubblicazione: (2025)
di: Kim, Inès Hyeonsu, et al.
Pubblicazione: (2025)
GaussianTalker: Real-Time High-Fidelity Talking Head Synthesis with Audio-Driven 3D Gaussian Splatting
di: Cho, Kyusun, et al.
Pubblicazione: (2024)
di: Cho, Kyusun, et al.
Pubblicazione: (2024)
S^4M: Boosting Semi-Supervised Instance Segmentation with SAM
di: Yoon, Heeji, et al.
Pubblicazione: (2025)
di: Yoon, Heeji, et al.
Pubblicazione: (2025)
VRMDiff: Text-Guided Video Referring Matting Generation of Diffusion
di: Yang, Lehan, et al.
Pubblicazione: (2025)
di: Yang, Lehan, et al.
Pubblicazione: (2025)
O-MaMa: Learning Object Mask Matching between Egocentric and Exocentric Views
di: Mur-Labadia, Lorenzo, et al.
Pubblicazione: (2025)
di: Mur-Labadia, Lorenzo, et al.
Pubblicazione: (2025)
Generative Video Motion Editing with 3D Point Tracks
di: Lee, Yao-Chih, et al.
Pubblicazione: (2025)
di: Lee, Yao-Chih, et al.
Pubblicazione: (2025)
InterRVOS: Interaction-aware Referring Video Object Segmentation
di: Jin, Woojeong, et al.
Pubblicazione: (2025)
di: Jin, Woojeong, et al.
Pubblicazione: (2025)
MaDis-Stereo: Enhanced Stereo Matching via Distilled Masked Image Modeling
di: Ahn, Jihye, et al.
Pubblicazione: (2024)
di: Ahn, Jihye, et al.
Pubblicazione: (2024)
AnthroTAP: Learning Point Tracking with Real-World Motion
di: Kim, Inès Hyeonsu, et al.
Pubblicazione: (2025)
di: Kim, Inès Hyeonsu, et al.
Pubblicazione: (2025)
Foundational Question Generation for Video Question Answering via an Embedding-Integrated Approach
di: Oh, Ju-Young
Pubblicazione: (2025)
di: Oh, Ju-Young
Pubblicazione: (2025)
MaSS13K: A Matting-level Semantic Segmentation Benchmark
di: Xie, Chenxi, et al.
Pubblicazione: (2025)
di: Xie, Chenxi, et al.
Pubblicazione: (2025)
DeFloMat: Detection with Flow Matching for Stable and Efficient Generative Object Localization
di: Lee, Hansang, et al.
Pubblicazione: (2025)
di: Lee, Hansang, et al.
Pubblicazione: (2025)
Seg4Diff: Unveiling Open-Vocabulary Segmentation in Text-to-Image Diffusion Transformers
di: Kim, Chaehyun, et al.
Pubblicazione: (2025)
di: Kim, Chaehyun, et al.
Pubblicazione: (2025)
Video Color Grading via Look-Up Table Generation
di: Shin, Seunghyun, et al.
Pubblicazione: (2025)
di: Shin, Seunghyun, et al.
Pubblicazione: (2025)
DiffuseSlide: Training-Free High Frame Rate Video Generation Diffusion
di: Hwang, Geunmin, et al.
Pubblicazione: (2025)
di: Hwang, Geunmin, et al.
Pubblicazione: (2025)
V-Warper: Appearance-Consistent Video Diffusion Personalization via Value Warping
di: Lee, Hyunkoo, et al.
Pubblicazione: (2025)
di: Lee, Hyunkoo, et al.
Pubblicazione: (2025)
Look Every Frame All at Once: Video-Ma$^2$mba for Efficient Long-form Video Understanding with Multi-Axis Gradient Checkpointing
di: Lee, Hosu, et al.
Pubblicazione: (2024)
di: Lee, Hosu, et al.
Pubblicazione: (2024)
HarmoVid: Relightful Video Portrait Harmonization
di: Choi, Jun Myeong, et al.
Pubblicazione: (2026)
di: Choi, Jun Myeong, et al.
Pubblicazione: (2026)
MaDiS: Taming Masked Diffusion Language Models for Sign Language Generation
di: Zuo, Ronglai, et al.
Pubblicazione: (2026)
di: Zuo, Ronglai, et al.
Pubblicazione: (2026)
PR-MaGIC: Prompt Refinement Via Mask Decoder Gradient Flow For In-Context Segmentation
di: Lee, Minjae, et al.
Pubblicazione: (2026)
di: Lee, Minjae, et al.
Pubblicazione: (2026)
Documenti analoghi
-
MaGGIe: Masked Guided Gradual Human Instance Matting
di: Huynh, Chuong, et al.
Pubblicazione: (2024) -
Elevating Flow-Guided Video Inpainting with Reference Generation
di: Cho, Suhwan, et al.
Pubblicazione: (2024) -
Referring Video Object Segmentation via Language-aligned Track Selection
di: Kim, Seongchan, et al.
Pubblicazione: (2024) -
Tuning-Free Multi-Event Long Video Generation via Synchronized Coupled Sampling
di: Kim, Subin, et al.
Pubblicazione: (2025) -
URECA: Unique Region Caption Anything
di: Lim, Sangbeom, et al.
Pubblicazione: (2025)