SCHNet: SAM Marries CLIP for Human Parsing
Fuente:
arXiv
Saved in:
| Main Authors: | Liu, Kunliang, Wang, Jianming, Jin, Rize, Hwang, Wonjun, Chung, Tae-Sun |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
SAM-CP: Marrying SAM with Composable Prompts for Versatile Segmentation
by: Chen, Pengfei, et al.
Published: (2024)
by: Chen, Pengfei, et al.
Published: (2024)
LFSamba: Marry SAM with Mamba for Light Field Salient Object Detection
by: Liu, Zhengyi, et al.
Published: (2024)
by: Liu, Zhengyi, et al.
Published: (2024)
VQT-Light:Lightweight HDR Illumination Map Prediction with Richer Texture.pdf
by: Xie, Kunliang
Published: (2025)
by: Xie, Kunliang
Published: (2025)
Hi-SAM: Marrying Segment Anything Model for Hierarchical Text Segmentation
by: Ye, Maoyuan, et al.
Published: (2024)
by: Ye, Maoyuan, et al.
Published: (2024)
V$^{2}$-SAM: Marrying SAM2 with Multi-Prompt Experts for Cross-View Object Correspondence
by: Pan, Jiancheng, et al.
Published: (2025)
by: Pan, Jiancheng, et al.
Published: (2025)
TokLIP: Marry Visual Tokens to CLIP for Multimodal Comprehension and Generation
by: Lin, Haokun, et al.
Published: (2025)
by: Lin, Haokun, et al.
Published: (2025)
Think as Cardiac Sonographers: Marrying SAM with Left Ventricular Indicators Measurements According to Clinical Guidelines
by: Liu, Tuo, et al.
Published: (2025)
by: Liu, Tuo, et al.
Published: (2025)
CLIP-RD: Relative Distillation for Efficient CLIP Knowledge Distillation
by: Chung, Jeannie, et al.
Published: (2026)
by: Chung, Jeannie, et al.
Published: (2026)
Sa2VA: Marrying SAM2 with LLaVA for Dense Grounded Understanding of Images and Videos
by: Yuan, Haobo, et al.
Published: (2025)
by: Yuan, Haobo, et al.
Published: (2025)
D-TPT: Dimensional Entropy Maximization for Calibrating Test-Time Prompt Tuning in Vision-Language Models
by: Han, Jisu, et al.
Published: (2025)
by: Han, Jisu, et al.
Published: (2025)
ClipSAM: CLIP and SAM Collaboration for Zero-Shot Anomaly Segmentation
by: Li, Shengze, et al.
Published: (2024)
by: Li, Shengze, et al.
Published: (2024)
Generalizable Human Gaussian Splatting via Multi-view Semantic Consistency
by: Kim, Jingi, et al.
Published: (2026)
by: Kim, Jingi, et al.
Published: (2026)
ICH-SCNet: Intracerebral Hemorrhage Segmentation and Prognosis Classification Network Using CLIP-guided SAM mechanism
by: Yu, Xinlei, et al.
Published: (2024)
by: Yu, Xinlei, et al.
Published: (2024)
Explore Human Parsing Modality for Action Recognition
by: Liu, Jinfu, et al.
Published: (2024)
by: Liu, Jinfu, et al.
Published: (2024)
CLIP-Guided SAM: Parameter-Efficient Semantic Conditioning for Promptable Segmentation
by: Jalilian, Shayan, et al.
Published: (2026)
by: Jalilian, Shayan, et al.
Published: (2026)
IPAD-CLIP: Teaching CLIP to Detect Image Local Perceptual Artifacts
by: Wang, Juan, et al.
Published: (2026)
by: Wang, Juan, et al.
Published: (2026)
UniParser: Multi-Human Parsing with Unified Correlation Representation Learning
by: Chu, Jiaming, et al.
Published: (2023)
by: Chu, Jiaming, et al.
Published: (2023)
OpenHuman4D: Open-Vocabulary 4D Human Parsing
by: Suzuki, Keito, et al.
Published: (2025)
by: Suzuki, Keito, et al.
Published: (2025)
Enhancing Zero-Shot Anomaly Detection: CLIP-SAM Collaboration with Cascaded Prompts
by: Hou, Yanning, et al.
Published: (2025)
by: Hou, Yanning, et al.
Published: (2025)
Refinement Module based on Parse Graph for Human Pose Estimation
by: Liu, Shibang, et al.
Published: (2025)
by: Liu, Shibang, et al.
Published: (2025)
VL-SAM-v3: Memory-Guided Visual Priors for Open-World Object Detection
by: Liu, Chih-Chung, et al.
Published: (2026)
by: Liu, Chih-Chung, et al.
Published: (2026)
Ranked Entropy Minimization for Continual Test-Time Adaptation
by: Han, Jisu, et al.
Published: (2025)
by: Han, Jisu, et al.
Published: (2025)
Semantic Prompting with Image-Token for Continual Learning
by: Han, Jisu, et al.
Published: (2024)
by: Han, Jisu, et al.
Published: (2024)
SSP-SAM: SAM with Semantic-Spatial Prompt for Referring Expression Segmentation
by: Tang, Wei, et al.
Published: (2026)
by: Tang, Wei, et al.
Published: (2026)
MFH: Marrying Frequency Domain with Handwritten Mathematical Expression Recognition
by: Yang, Huanxin, et al.
Published: (2025)
by: Yang, Huanxin, et al.
Published: (2025)
Marrying Autoregressive Transformer and Diffusion with Multi-Reference Autoregression
by: Zhen, Dingcheng, et al.
Published: (2025)
by: Zhen, Dingcheng, et al.
Published: (2025)
Parse Graph-Based Visual-Language Interaction for Human Pose Estimation
by: Liu, Shibang, et al.
Published: (2025)
by: Liu, Shibang, et al.
Published: (2025)
Marrying Text-to-Motion Generation with Skeleton-Based Action Recognition
by: Kuang, Jidong, et al.
Published: (2026)
by: Kuang, Jidong, et al.
Published: (2026)
Zero-Shot Pseudo Labels Generation Using SAM and CLIP for Semi-Supervised Semantic Segmentation
by: Saito, Nagito, et al.
Published: (2025)
by: Saito, Nagito, et al.
Published: (2025)
Interactive Medical-SAM2 GUI: A Napari-based semi-automatic annotation tool for medical images
by: Hong, Woojae, et al.
Published: (2026)
by: Hong, Woojae, et al.
Published: (2026)
OurDB: Ouroboric Domain Bridging for Multi-Target Domain Adaptive Semantic Segmentation
by: Woo, Seungbeom, et al.
Published: (2024)
by: Woo, Seungbeom, et al.
Published: (2024)
OFF-CLIP: Improving Normal Detection Confidence in Radiology CLIP with Simple Off-Diagonal Term Auto-Adjustment
by: Park, Junhyun, et al.
Published: (2025)
by: Park, Junhyun, et al.
Published: (2025)
Detecting Human Artifacts from Text-to-Image Models
by: Wang, Kaihong, et al.
Published: (2024)
by: Wang, Kaihong, et al.
Published: (2024)
VRP-SAM: SAM with Visual Reference Prompt
by: Sun, Yanpeng, et al.
Published: (2024)
by: Sun, Yanpeng, et al.
Published: (2024)
SAM-CLIP: Merging Vision Foundation Models towards Semantic and Spatial Understanding
by: Wang, Haoxiang, et al.
Published: (2023)
by: Wang, Haoxiang, et al.
Published: (2023)
Bridge: Basis-Driven Causal Inference Marries VFMs for Domain Generalization
by: Hong, Mingbo, et al.
Published: (2026)
by: Hong, Mingbo, et al.
Published: (2026)
ParseCaps: An Interpretable Parsing Capsule Network for Medical Image Diagnosis
by: Geng, Xinyu, et al.
Published: (2024)
by: Geng, Xinyu, et al.
Published: (2024)
Fast SAM 3D Body: Accelerating SAM 3D Body for Real-Time Full-Body Human Mesh Recovery
by: Yang, Timing, et al.
Published: (2026)
by: Yang, Timing, et al.
Published: (2026)
SemiSAM: Enhancing Semi-Supervised Medical Image Segmentation via SAM-Assisted Consistency Regularization
by: Zhang, Yichi, et al.
Published: (2023)
by: Zhang, Yichi, et al.
Published: (2023)
Hues and Cues: Human vs. CLIP
by: Alabau-Bosque, Nuria, et al.
Published: (2025)
by: Alabau-Bosque, Nuria, et al.
Published: (2025)
Similar Items
-
SAM-CP: Marrying SAM with Composable Prompts for Versatile Segmentation
by: Chen, Pengfei, et al.
Published: (2024) -
LFSamba: Marry SAM with Mamba for Light Field Salient Object Detection
by: Liu, Zhengyi, et al.
Published: (2024) -
VQT-Light:Lightweight HDR Illumination Map Prediction with Richer Texture.pdf
by: Xie, Kunliang
Published: (2025) -
Hi-SAM: Marrying Segment Anything Model for Hierarchical Text Segmentation
by: Ye, Maoyuan, et al.
Published: (2024) -
V$^{2}$-SAM: Marrying SAM2 with Multi-Prompt Experts for Cross-View Object Correspondence
by: Pan, Jiancheng, et al.
Published: (2025)