MaGGIe: Masked Guided Gradual Human Instance Matting
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Huynh, Chuong, Oh, Seoung Wug, Shrivastava, Abhinav, Lee, Joon-Young |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
VideoMaMa: Mask-Guided Video Matting via Generative Prior
par: Lim, Sangbeom, et autres
Publié: (2026)
par: Lim, Sangbeom, et autres
Publié: (2026)
Elevating Flow-Guided Video Inpainting with Reference Generation
par: Cho, Suhwan, et autres
Publié: (2024)
par: Cho, Suhwan, et autres
Publié: (2024)
Tuning-Free Multi-Event Long Video Generation via Synchronized Coupled Sampling
par: Kim, Subin, et autres
Publié: (2025)
par: Kim, Subin, et autres
Publié: (2025)
HARIVO: Harnessing Text-to-Image Models for Video Generation
par: Kwon, Mingi, et autres
Publié: (2024)
par: Kwon, Mingi, et autres
Publié: (2024)
End-to-End Human Instance Matting
par: Liu, Qinglin, et autres
Publié: (2024)
par: Liu, Qinglin, et autres
Publié: (2024)
VISAGE: Video Instance Segmentation with Appearance-Guided Enhancement
par: Kim, Hanjung, et autres
Publié: (2023)
par: Kim, Hanjung, et autres
Publié: (2023)
Putting the Object Back into Video Object Segmentation
par: Cheng, Ho Kei, et autres
Publié: (2023)
par: Cheng, Ho Kei, et autres
Publié: (2023)
Efficient and High-Fidelity Omni Modality Retrieval
par: Huynh, Chuong, et autres
Publié: (2026)
par: Huynh, Chuong, et autres
Publié: (2026)
Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction
par: Shrivastava, Gaurav, et autres
Publié: (2024)
par: Shrivastava, Gaurav, et autres
Publié: (2024)
V-VIPE: Variational View Invariant Pose Embedding
par: Levy, Mara, et autres
Publié: (2024)
par: Levy, Mara, et autres
Publié: (2024)
Composing Object Relations and Attributes for Image-Text Matching
par: Pham, Khoi, et autres
Publié: (2024)
par: Pham, Khoi, et autres
Publié: (2024)
GuidNoise: Single-Pair Guided Diffusion for Generalized Noise Synthesis
par: Kim, Changjin, et autres
Publié: (2025)
par: Kim, Changjin, et autres
Publié: (2025)
All-in-One Conditioning for Text-to-Image Synthesis
par: Jayasekara, Hirunima, et autres
Publié: (2026)
par: Jayasekara, Hirunima, et autres
Publié: (2026)
Scale Space Diffusion
par: Mukhopadhyay, Soumik, et autres
Publié: (2026)
par: Mukhopadhyay, Soumik, et autres
Publié: (2026)
FRAME: Pre-Training Video Feature Representations via Anticipation and Memory
par: TV, Sethuraman, et autres
Publié: (2025)
par: TV, Sethuraman, et autres
Publié: (2025)
DAGE: Dual-Stream Architecture for Efficient and Fine-Grained Geometry Estimation
par: Ngo, Tuan Duc, et autres
Publié: (2026)
par: Ngo, Tuan Duc, et autres
Publié: (2026)
IF-MDM: Implicit Face Motion Diffusion Model for High-Fidelity Realtime Talking Head Generation
par: Yang, Sejong, et autres
Publié: (2024)
par: Yang, Sejong, et autres
Publié: (2024)
PR-MaGIC: Prompt Refinement Via Mask Decoder Gradient Flow For In-Context Segmentation
par: Lee, Minjae, et autres
Publié: (2026)
par: Lee, Minjae, et autres
Publié: (2026)
Facial Expression Recognition Using Residual Masking Network
par: Pham, Luan, et autres
Publié: (2026)
par: Pham, Luan, et autres
Publié: (2026)
MaskUno: Switch-Split Block For Enhancing Instance Segmentation
par: Haidar, Jawad, et autres
Publié: (2024)
par: Haidar, Jawad, et autres
Publié: (2024)
LARP: Tokenizing Videos with a Learned Autoregressive Generative Prior
par: Wang, Hanyu, et autres
Publié: (2024)
par: Wang, Hanyu, et autres
Publié: (2024)
DiffuMatting: Synthesizing Arbitrary Objects with Matting-level Annotation
par: Hu, Xiaobin, et autres
Publié: (2024)
par: Hu, Xiaobin, et autres
Publié: (2024)
Towards Latent Masked Image Modeling for Self-Supervised Visual Representation Learning
par: Wei, Yibing, et autres
Publié: (2024)
par: Wei, Yibing, et autres
Publié: (2024)
Instance-aware Image Colorization with Controllable Textual Descriptions and Segmentation Masks
par: An, Yanru, et autres
Publié: (2025)
par: An, Yanru, et autres
Publié: (2025)
Uncertainty-Guided Face Matting for Occlusion-Aware Face Transformation
par: Cho, Hyebin, et autres
Publié: (2025)
par: Cho, Hyebin, et autres
Publié: (2025)
MatRes: Zero-Shot Test-Time Model Adaptation for Simultaneous Matching and Restoration
par: Lee, Kanggeon, et autres
Publié: (2026)
par: Lee, Kanggeon, et autres
Publié: (2026)
In-N-Out: Faithful 3D GAN Inversion with Volumetric Decomposition for Face Editing
par: Xu, Yiran, et autres
Publié: (2023)
par: Xu, Yiran, et autres
Publié: (2023)
MaS-VQA: A Mask-and-Select Framework for Knowledge-Based Visual Question Answering
par: Mao, Xianwei, et autres
Publié: (2026)
par: Mao, Xianwei, et autres
Publié: (2026)
Characterizing Motion Encoding in Video Diffusion Timesteps
par: Baherwani, Vatsal, et autres
Publié: (2025)
par: Baherwani, Vatsal, et autres
Publié: (2025)
Complementary Random Masking for RGB-Thermal Semantic Segmentation
par: Shin, Ukcheol, et autres
Publié: (2023)
par: Shin, Ukcheol, et autres
Publié: (2023)
HU-based Foreground Masking for 3D Medical Masked Image Modeling
par: Lee, Jin, et autres
Publié: (2025)
par: Lee, Jin, et autres
Publié: (2025)
SIEDD: Shared-Implicit Encoder with Discrete Decoders
par: Rangarajan, Vikram, et autres
Publié: (2025)
par: Rangarajan, Vikram, et autres
Publié: (2025)
Image-Guided Semantic Pseudo-LiDAR Point Generation for 3D Object Detection
par: Lee, Minseung, et autres
Publié: (2024)
par: Lee, Minseung, et autres
Publié: (2024)
QUEEN: QUantized Efficient ENcoding of Dynamic Gaussians for Streaming Free-viewpoint Videos
par: Girish, Sharath, et autres
Publié: (2024)
par: Girish, Sharath, et autres
Publié: (2024)
GroupCoOp: Group-robust Fine-tuning via Group Prompt Learning
par: Kim, Nayeong, et autres
Publié: (2025)
par: Kim, Nayeong, et autres
Publié: (2025)
TestDG: Test-time Domain Generalization for Continual Test-time Adaptation
par: Lee, Sohyun, et autres
Publié: (2025)
par: Lee, Sohyun, et autres
Publié: (2025)
Post-Training Quantization for Video Matting
par: Zhu, Tianrui, et autres
Publié: (2025)
par: Zhu, Tianrui, et autres
Publié: (2025)
Language-Guided Instance-Aware Domain-Adaptive Panoptic Segmentation
par: Mansour, Elham Amin, et autres
Publié: (2024)
par: Mansour, Elham Amin, et autres
Publié: (2024)
Foundation Model-Driven Framework for Human-Object Interaction Prediction with Segmentation Mask Integration
par: Park, Juhan, et autres
Publié: (2025)
par: Park, Juhan, et autres
Publié: (2025)
SWAT: Sliding Window Adversarial Training for Gradual Domain Adaptation
par: Wang, Zixi, et autres
Publié: (2025)
par: Wang, Zixi, et autres
Publié: (2025)
Documents similaires
-
VideoMaMa: Mask-Guided Video Matting via Generative Prior
par: Lim, Sangbeom, et autres
Publié: (2026) -
Elevating Flow-Guided Video Inpainting with Reference Generation
par: Cho, Suhwan, et autres
Publié: (2024) -
Tuning-Free Multi-Event Long Video Generation via Synchronized Coupled Sampling
par: Kim, Subin, et autres
Publié: (2025) -
HARIVO: Harnessing Text-to-Image Models for Video Generation
par: Kwon, Mingi, et autres
Publié: (2024) -
End-to-End Human Instance Matting
par: Liu, Qinglin, et autres
Publié: (2024)