Universal Organizer of SAM for Unsupervised Semantic Segmentation
Fuente:
arXiv
Guardado en:
| Autores principales: | Li, Tingting, Pei, Gensheng, Cai, Xinhao, Liu, Huafeng, Wang, Qiong, Yao, Yazhou |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Semi-supervised Semantic Segmentation with Multi-Constraint Consistency Learning
por: Yin, Jianjian, et al.
Publicado: (2025)
por: Yin, Jianjian, et al.
Publicado: (2025)
A Light-weight Transformer-based Self-supervised Matching Network for Heterogeneous Images
por: Zhang, Wang, et al.
Publicado: (2024)
por: Zhang, Wang, et al.
Publicado: (2024)
Relating CNN-Transformer Fusion Network for Change Detection
por: Gao, Yuhao, et al.
Publicado: (2024)
por: Gao, Yuhao, et al.
Publicado: (2024)
Towards Open-Vocabulary Video Semantic Segmentation
por: Li, Xinhao, et al.
Publicado: (2024)
por: Li, Xinhao, et al.
Publicado: (2024)
PEARL: Geometry Aligns Semantics for Training-Free Open-Vocabulary Semantic Segmentation
por: Pei, Gensheng, et al.
Publicado: (2026)
por: Pei, Gensheng, et al.
Publicado: (2026)
Semantic-Guided Unsupervised Video Summarization
por: Liu, Haizhou, et al.
Publicado: (2026)
por: Liu, Haizhou, et al.
Publicado: (2026)
Look, Listen and Segment: Towards Weakly Supervised Audio-visual Semantic Segmentation
por: Li, Chengzhi, et al.
Publicado: (2026)
por: Li, Chengzhi, et al.
Publicado: (2026)
Dual Dynamic Threshold Adjustment Strategy for Deep Metric Learning
por: Jiang, Xiruo, et al.
Publicado: (2024)
por: Jiang, Xiruo, et al.
Publicado: (2024)
Group Benefits Instances Selection for Data Purification
por: Cai, Zhenhuang, et al.
Publicado: (2024)
por: Cai, Zhenhuang, et al.
Publicado: (2024)
Think before You Leap: Content-Aware Low-Cost Edge-Assisted Video Semantic Segmentation
por: Yan, Mingxuan, et al.
Publicado: (2024)
por: Yan, Mingxuan, et al.
Publicado: (2024)
CAMERA: Adapting to Semantic Camouflage in Unsupervised Text-Attributed Graph Fraud Detection
por: Pan, Junjun, et al.
Publicado: (2026)
por: Pan, Junjun, et al.
Publicado: (2026)
Semantic Compensation via Adversarial Removal for Robust Zero-Shot ECG Diagnosis
por: Liu, Hongjun, et al.
Publicado: (2026)
por: Liu, Hongjun, et al.
Publicado: (2026)
Fantastic Animals and Where to Find Them: Segment Any Marine Animal with Dual SAM
por: Zhang, Pingping, et al.
Publicado: (2024)
por: Zhang, Pingping, et al.
Publicado: (2024)
Unsupervised Multimodal Clustering for Semantics Discovery in Multimodal Utterances
por: Zhang, Hanlei, et al.
Publicado: (2024)
por: Zhang, Hanlei, et al.
Publicado: (2024)
SAM as the Guide: Mastering Pseudo-Label Refinement in Semi-Supervised Referring Expression Segmentation
por: Yang, Danni, et al.
Publicado: (2024)
por: Yang, Danni, et al.
Publicado: (2024)
ProMSC-MIS: Prompt-based Multimodal Semantic Communication for Multi-Spectral Image Segmentation
por: Zhang, Haoshuo, et al.
Publicado: (2025)
por: Zhang, Haoshuo, et al.
Publicado: (2025)
KAN-SAM: Kolmogorov-Arnold Network Guided Segment Anything Model for RGB-T Salient Object Detection
por: Li, Xingyuan, et al.
Publicado: (2025)
por: Li, Xingyuan, et al.
Publicado: (2025)
Open-Vocabulary Audio-Visual Semantic Segmentation
por: Guo, Ruohao, et al.
Publicado: (2024)
por: Guo, Ruohao, et al.
Publicado: (2024)
Unsupervised Ego- and Exo-centric Dense Procedural Activity Captioning via Gaze Consensus Adaptation
por: Shi, Zhaofeng, et al.
Publicado: (2025)
por: Shi, Zhaofeng, et al.
Publicado: (2025)
SemanticGarment: Semantic-Controlled Generation and Editing of 3D Gaussian Garments
por: Wang, Ruiyan, et al.
Publicado: (2025)
por: Wang, Ruiyan, et al.
Publicado: (2025)
SMC++: Masked Learning of Unsupervised Video Semantic Compression
por: Tian, Yuan, et al.
Publicado: (2024)
por: Tian, Yuan, et al.
Publicado: (2024)
ASAP: Advancing Semantic Alignment Promotes Multi-Modal Manipulation Detecting and Grounding
por: Zhang, Zhenxing, et al.
Publicado: (2024)
por: Zhang, Zhenxing, et al.
Publicado: (2024)
Efficient Token Compression for Vision Transformer with Spatial Information Preserved
por: Mao, Junzhu, et al.
Publicado: (2025)
por: Mao, Junzhu, et al.
Publicado: (2025)
Evolutionary Multimodal Reasoning via Hierarchical Semantic Representation for Intent Recognition
por: Zhou, Qianrui, et al.
Publicado: (2026)
por: Zhou, Qianrui, et al.
Publicado: (2026)
Dual-Granularity Cross-Modal Identity Association for Weakly-Supervised Text-to-Person Image Matching
por: Zhang, Yafei, et al.
Publicado: (2025)
por: Zhang, Yafei, et al.
Publicado: (2025)
CUS3D :CLIP-based Unsupervised 3D Segmentation via Object-level Denoise
por: Yu, Fuyang, et al.
Publicado: (2024)
por: Yu, Fuyang, et al.
Publicado: (2024)
Zero-Shot Relational Learning for Multimodal Knowledge Graphs
por: Cai, Rui, et al.
Publicado: (2024)
por: Cai, Rui, et al.
Publicado: (2024)
Automated Radiology Report Generation Based on Topic-Keyword Semantic Guidance
por: Xiao, Jing, et al.
Publicado: (2025)
por: Xiao, Jing, et al.
Publicado: (2025)
SRA: Semantic Relation-Aware Flowchart Question Answering
por: Li, Xinyu, et al.
Publicado: (2026)
por: Li, Xinyu, et al.
Publicado: (2026)
Routing Experts: Learning to Route Dynamic Experts in Multi-modal Large Language Models
por: Wu, Qiong, et al.
Publicado: (2024)
por: Wu, Qiong, et al.
Publicado: (2024)
Multi Agents Semantic Emotion Aligned Music to Image Generation with Music Derived Captions
por: Shi, Junchang, et al.
Publicado: (2025)
por: Shi, Junchang, et al.
Publicado: (2025)
Multimodal Semantic Communication for Generative Audio-Driven Video Conferencing
por: Tong, Haonan, et al.
Publicado: (2024)
por: Tong, Haonan, et al.
Publicado: (2024)
D2SL: Decouple Defogging and Semantic Learning for Foggy Domain-Adaptive Segmentation
por: Sun, Xuan, et al.
Publicado: (2024)
por: Sun, Xuan, et al.
Publicado: (2024)
Prompt-based Multimodal Semantic Communication for Multi-spectral Image Segmentation
por: Zhang, Haoshuo, et al.
Publicado: (2025)
por: Zhang, Haoshuo, et al.
Publicado: (2025)
MViR: Multi-View Visual-Semantic Representation for Fake News Detection
por: Liang, Haochen, et al.
Publicado: (2026)
por: Liang, Haochen, et al.
Publicado: (2026)
Taming SAM3 in the Wild: A Concept Bank for Open-Vocabulary Segmentation
por: Pei, Gensheng, et al.
Publicado: (2026)
por: Pei, Gensheng, et al.
Publicado: (2026)
STCTS: Generative Semantic Compression for Ultra-Low Bitrate Speech via Explicit Text-Prosody-Timbre Decomposition
por: Wang, Siyu, et al.
Publicado: (2025)
por: Wang, Siyu, et al.
Publicado: (2025)
GestureHYDRA: Semantic Co-speech Gesture Synthesis via Hybrid Modality Diffusion Transformer and Cascaded-Synchronized Retrieval-Augmented Generation
por: Yang, Quanwei, et al.
Publicado: (2025)
por: Yang, Quanwei, et al.
Publicado: (2025)
EidetiCom: A Cross-modal Brain-Computer Semantic Communication Paradigm for Decoding Visual Perception
por: Zheng, Linfeng, et al.
Publicado: (2024)
por: Zheng, Linfeng, et al.
Publicado: (2024)
Recognizing Everything from All Modalities at Once: Grounded Multimodal Universal Information Extraction
por: Zhang, Meishan, et al.
Publicado: (2024)
por: Zhang, Meishan, et al.
Publicado: (2024)
Ejemplares similares
-
Semi-supervised Semantic Segmentation with Multi-Constraint Consistency Learning
por: Yin, Jianjian, et al.
Publicado: (2025) -
A Light-weight Transformer-based Self-supervised Matching Network for Heterogeneous Images
por: Zhang, Wang, et al.
Publicado: (2024) -
Relating CNN-Transformer Fusion Network for Change Detection
por: Gao, Yuhao, et al.
Publicado: (2024) -
Towards Open-Vocabulary Video Semantic Segmentation
por: Li, Xinhao, et al.
Publicado: (2024) -
PEARL: Geometry Aligns Semantics for Training-Free Open-Vocabulary Semantic Segmentation
por: Pei, Gensheng, et al.
Publicado: (2026)