What is Point Supervision Worth in Video Instance Segmentation?
Fuente:
arXiv
Salvato in:
| Autori principali: | Huang, Shuaiyi, Huang, De-An, Yu, Zhiding, Lan, Shiyi, Radhakrishnan, Subhashree, Alvarez, Jose M., Shrivastava, Abhinav, Anandkumar, Anima |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ARDuP: Active Region Video Diffusion for Universal Policies
di: Huang, Shuaiyi, et al.
Pubblicazione: (2024)
di: Huang, Shuaiyi, et al.
Pubblicazione: (2024)
UVIS: Unsupervised Video Instance Segmentation
di: Huang, Shuaiyi, et al.
Pubblicazione: (2024)
di: Huang, Shuaiyi, et al.
Pubblicazione: (2024)
FRAG: Frame Selection Augmented Generation for Long Video and Long Document Understanding
di: Huang, De-An, et al.
Pubblicazione: (2025)
di: Huang, De-An, et al.
Pubblicazione: (2025)
Fully Attentional Networks with Self-emerging Token Labeling
di: Zhao, Bingyin, et al.
Pubblicazione: (2024)
di: Zhao, Bingyin, et al.
Pubblicazione: (2024)
Improving Distant 3D Object Detection Using 2D Box Supervision
di: Yang, Zetong, et al.
Pubblicazione: (2024)
di: Yang, Zetong, et al.
Pubblicazione: (2024)
LITA: Language Instructed Temporal-Localization Assistant
di: Huang, De-An, et al.
Pubblicazione: (2024)
di: Huang, De-An, et al.
Pubblicazione: (2024)
Efficient Continuous Video Flow Model for Video Prediction
di: Shrivastava, Gaurav, et al.
Pubblicazione: (2024)
di: Shrivastava, Gaurav, et al.
Pubblicazione: (2024)
Trokens: Semantic-Aware Relational Trajectory Tokens for Few-Shot Action Recognition
di: Kumar, Pulkit, et al.
Pubblicazione: (2025)
di: Kumar, Pulkit, et al.
Pubblicazione: (2025)
T-Stitch: Accelerating Sampling in Pre-Trained Diffusion Models with Trajectory Stitching
di: Pan, Zizheng, et al.
Pubblicazione: (2024)
di: Pan, Zizheng, et al.
Pubblicazione: (2024)
Efficient Video Diffusion Models via Content-Frame Motion-Latent Decomposition
di: Yu, Sihyun, et al.
Pubblicazione: (2024)
di: Yu, Sihyun, et al.
Pubblicazione: (2024)
Learning Calibrated Uncertainties for Domain Shift: A Distributionally Robust Learning Approach
di: Wang, Haoxuan, et al.
Pubblicazione: (2020)
di: Wang, Haoxuan, et al.
Pubblicazione: (2020)
TREND: Tri-teaching for Robust Preference-based Reinforcement Learning with Demonstrations
di: Huang, Shuaiyi, et al.
Pubblicazione: (2025)
di: Huang, Shuaiyi, et al.
Pubblicazione: (2025)
A Semantic Space is Worth 256 Language Descriptions: Make Stronger Segmentation Models with Descriptive Properties
di: Xiao, Junfei, et al.
Pubblicazione: (2023)
di: Xiao, Junfei, et al.
Pubblicazione: (2023)
Extreme Point Supervised Instance Segmentation
di: Lee, Hyeonjun, et al.
Pubblicazione: (2024)
di: Lee, Hyeonjun, et al.
Pubblicazione: (2024)
Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction
di: Shrivastava, Gaurav, et al.
Pubblicazione: (2024)
di: Shrivastava, Gaurav, et al.
Pubblicazione: (2024)
Prismer: A Vision-Language Model with Multi-Task Experts
di: Liu, Shikun, et al.
Pubblicazione: (2023)
di: Liu, Shikun, et al.
Pubblicazione: (2023)
A Video is Worth 10,000 Words: Training and Benchmarking with Diverse Captions for Better Long Video Retrieval
di: Gwilliam, Matthew, et al.
Pubblicazione: (2023)
di: Gwilliam, Matthew, et al.
Pubblicazione: (2023)
Hydra-NeXt: Robust Closed-Loop Driving with Open-Loop Training
di: Li, Zhenxin, et al.
Pubblicazione: (2025)
di: Li, Zhenxin, et al.
Pubblicazione: (2025)
Video Decomposition Prior: A Methodology to Decompose Videos into Layers
di: Shrivastava, Gaurav, et al.
Pubblicazione: (2024)
di: Shrivastava, Gaurav, et al.
Pubblicazione: (2024)
StreamChat: Chatting with Streaming Video
di: Liu, Jihao, et al.
Pubblicazione: (2024)
di: Liu, Jihao, et al.
Pubblicazione: (2024)
Complete Instances Mining for Weakly Supervised Instance Segmentation
di: Li, Zecheng, et al.
Pubblicazione: (2024)
di: Li, Zecheng, et al.
Pubblicazione: (2024)
Is Ego Status All You Need for Open-Loop End-to-End Autonomous Driving?
di: Li, Zhiqi, et al.
Pubblicazione: (2023)
di: Li, Zhiqi, et al.
Pubblicazione: (2023)
Exploring Camera Encoder Designs for Autonomous Driving Perception
di: Lakshmanan, Barath, et al.
Pubblicazione: (2024)
di: Lakshmanan, Barath, et al.
Pubblicazione: (2024)
P2Object: Single Point Supervised Object Detection and Instance Segmentation
di: Chen, Pengfei, et al.
Pubblicazione: (2025)
di: Chen, Pengfei, et al.
Pubblicazione: (2025)
StomataSeg: Semi-Supervised Instance Segmentation for Sorghum Stomatal Components
di: Huang, Zhongtian, et al.
Pubblicazione: (2026)
di: Huang, Zhongtian, et al.
Pubblicazione: (2026)
Dense Point-to-Mask Optimization with Reinforced Point Selection for Crowd Instance Segmentation
di: Chen, Hongru, et al.
Pubblicazione: (2026)
di: Chen, Hongru, et al.
Pubblicazione: (2026)
Omni-RGPT: Unifying Image and Video Region-level Understanding via Token Marks
di: Heo, Miran, et al.
Pubblicazione: (2025)
di: Heo, Miran, et al.
Pubblicazione: (2025)
Enhancing Autonomous Driving Safety with Collision Scenario Integration
di: Wang, Zi, et al.
Pubblicazione: (2025)
di: Wang, Zi, et al.
Pubblicazione: (2025)
Self-Supervised Any-Point Tracking by Contrastive Random Walks
di: Shrivastava, Ayush, et al.
Pubblicazione: (2024)
di: Shrivastava, Ayush, et al.
Pubblicazione: (2024)
TeCoNeRV: Leveraging Temporal Coherence for Compressible Neural Representations for Videos
di: Padmanabhan, Namitha, et al.
Pubblicazione: (2026)
di: Padmanabhan, Namitha, et al.
Pubblicazione: (2026)
PM-VIS: High-Performance Box-Supervised Video Instance Segmentation
di: Yang, Zhangjing, et al.
Pubblicazione: (2024)
di: Yang, Zhangjing, et al.
Pubblicazione: (2024)
Utilization of Neighbor Information for Image Classification with Different Levels of Supervision
di: Jayatilaka, Gihan, et al.
Pubblicazione: (2025)
di: Jayatilaka, Gihan, et al.
Pubblicazione: (2025)
Weakly-Supervised Learning for Tree Instances Segmentation in Airborne Lidar Point Clouds
di: Destouches, Swann Emilien Céleste, et al.
Pubblicazione: (2025)
di: Destouches, Swann Emilien Céleste, et al.
Pubblicazione: (2025)
Diffusion State-Guided Projected Gradient for Inverse Problems
di: Zirvi, Rayhan, et al.
Pubblicazione: (2024)
di: Zirvi, Rayhan, et al.
Pubblicazione: (2024)
OpenVIS: Open-vocabulary Video Instance Segmentation
di: Guo, Pinxue, et al.
Pubblicazione: (2023)
di: Guo, Pinxue, et al.
Pubblicazione: (2023)
SEGIC: Unleashing the Emergent Correspondence for In-Context Segmentation
di: Meng, Lingchen, et al.
Pubblicazione: (2023)
di: Meng, Lingchen, et al.
Pubblicazione: (2023)
Instance-Aware Robust Consistency Regularization for Semi-Supervised Nuclei Instance Segmentation
di: Lin, Zenan, et al.
Pubblicazione: (2025)
di: Lin, Zenan, et al.
Pubblicazione: (2025)
Exclusivity-Guided Mask Learning for Semi-Supervised Crowd Instance Segmentation and Counting
di: Huang, Jiyang, et al.
Pubblicazione: (2026)
di: Huang, Jiyang, et al.
Pubblicazione: (2026)
A Temporal Modeling Framework for Video Pre-Training on Video Instance Segmentation
di: Zhong, Qing, et al.
Pubblicazione: (2025)
di: Zhong, Qing, et al.
Pubblicazione: (2025)
MaGGIe: Masked Guided Gradual Human Instance Matting
di: Huynh, Chuong, et al.
Pubblicazione: (2024)
di: Huynh, Chuong, et al.
Pubblicazione: (2024)
Documenti analoghi
-
ARDuP: Active Region Video Diffusion for Universal Policies
di: Huang, Shuaiyi, et al.
Pubblicazione: (2024) -
UVIS: Unsupervised Video Instance Segmentation
di: Huang, Shuaiyi, et al.
Pubblicazione: (2024) -
FRAG: Frame Selection Augmented Generation for Long Video and Long Document Understanding
di: Huang, De-An, et al.
Pubblicazione: (2025) -
Fully Attentional Networks with Self-emerging Token Labeling
di: Zhao, Bingyin, et al.
Pubblicazione: (2024) -
Improving Distant 3D Object Detection Using 2D Box Supervision
di: Yang, Zetong, et al.
Pubblicazione: (2024)