Segment Any RGB-Thermal Model with Language-aided Distillation
Fuente:
arXiv
Guardado en:
| Autores principales: | Xing, Dong, Zhu, Xianxun, Zhou, Wei, Lin, Qika, Yang, Hang, Wang, Yuqing |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Refer to Any Segmentation Mask Group With Vision-Language Prompts
por: Cao, Shengcao, et al.
Publicado: (2025)
por: Cao, Shengcao, et al.
Publicado: (2025)
X-SAM: From Segment Anything to Any Segmentation
por: Wang, Hao, et al.
Publicado: (2025)
por: Wang, Hao, et al.
Publicado: (2025)
Segment Any 3D Object with Language
por: Lee, Seungjun, et al.
Publicado: (2024)
por: Lee, Seungjun, et al.
Publicado: (2024)
AnyFlow: Any-Step Video Diffusion Model with On-Policy Flow Map Distillation
por: Gu, Yuchao, et al.
Publicado: (2026)
por: Gu, Yuchao, et al.
Publicado: (2026)
Complementary Random Masking for RGB-Thermal Semantic Segmentation
por: Shin, Ukcheol, et al.
Publicado: (2023)
por: Shin, Ukcheol, et al.
Publicado: (2023)
X2SAM: Any Segmentation in Images and Videos
por: Wang, Hao, et al.
Publicado: (2026)
por: Wang, Hao, et al.
Publicado: (2026)
Compress Any Segment Anything Model (SAM)
por: Fan, Juntong, et al.
Publicado: (2025)
por: Fan, Juntong, et al.
Publicado: (2025)
AnyTSR: Any-Scale Thermal Super-Resolution for UAV
por: Li, Mengyuan, et al.
Publicado: (2025)
por: Li, Mengyuan, et al.
Publicado: (2025)
Griffon: Spelling out All Object Locations at Any Granularity with Large Language Models
por: Zhan, Yufei, et al.
Publicado: (2023)
por: Zhan, Yufei, et al.
Publicado: (2023)
Animate Any Character in Any World
por: Wang, Yitong, et al.
Publicado: (2025)
por: Wang, Yitong, et al.
Publicado: (2025)
AnySR: Realizing Image Super-Resolution as Any-Scale, Any-Resource
por: Zhan, Wengyi, et al.
Publicado: (2024)
por: Zhan, Wengyi, et al.
Publicado: (2024)
ConceptSeg-R1: Segment Any Concept via Meta-Reinforcement Learning
por: Zhao, Yuan, et al.
Publicado: (2026)
por: Zhao, Yuan, et al.
Publicado: (2026)
PAM: A Propagation-Based Model for Segmenting Any 3D Objects across Multi-Modal Medical Images
por: Chen, Zifan, et al.
Publicado: (2024)
por: Chen, Zifan, et al.
Publicado: (2024)
Comment-aided Video-Language Alignment via Contrastive Pre-training for Short-form Video Humor Detection
por: Liu, Yang, et al.
Publicado: (2024)
por: Liu, Yang, et al.
Publicado: (2024)
Adversarial Prompt Distillation for Vision-Language Models
por: Luo, Lin, et al.
Publicado: (2024)
por: Luo, Lin, et al.
Publicado: (2024)
One Model to Translate Them All: Universal Any-to-Any Translation for Heterogeneous Collaborative Perception
por: Li, Yang, et al.
Publicado: (2026)
por: Li, Yang, et al.
Publicado: (2026)
Any-to-Any Vision-Language Model for Multimodal X-ray Imaging and Radiological Report Generation
por: Molino, Daniele, et al.
Publicado: (2025)
por: Molino, Daniele, et al.
Publicado: (2025)
Recognize Any Regions
por: Yang, Haosen, et al.
Publicado: (2023)
por: Yang, Haosen, et al.
Publicado: (2023)
Vision Language Model-Empowered Contract Theory for AIGC Task Allocation in Teleoperation
por: Zhan, Zijun, et al.
Publicado: (2024)
por: Zhan, Zijun, et al.
Publicado: (2024)
AnyTrans: Translate AnyText in the Image with Large Scale Models
por: Qian, Zhipeng, et al.
Publicado: (2024)
por: Qian, Zhipeng, et al.
Publicado: (2024)
EMRA-proxy: Enhancing Multi-Class Region Semantic Segmentation in Remote Sensing Images with Attention Proxy
por: Yu, Yichun, et al.
Publicado: (2025)
por: Yu, Yichun, et al.
Publicado: (2025)
Adding Thermal Awareness to Visual Systems in Real-Time via Distilled Diffusion Models
por: Guo, Yuchen, et al.
Publicado: (2026)
por: Guo, Yuchen, et al.
Publicado: (2026)
Tracking and Segmenting Anything in Any Modality
por: Zhang, Tianlu, et al.
Publicado: (2025)
por: Zhang, Tianlu, et al.
Publicado: (2025)
Any2Any 3D Diffusion Models with Knowledge Transfer: A Radiotherapy Planning Study
por: Wang, Yuhan, et al.
Publicado: (2026)
por: Wang, Yuhan, et al.
Publicado: (2026)
UnSAMv2: Self-Supervised Learning Enables Segment Anything at Any Granularity
por: Yu, Junwei, et al.
Publicado: (2025)
por: Yu, Junwei, et al.
Publicado: (2025)
Depth Any Video with Scalable Synthetic Data
por: Yang, Honghui, et al.
Publicado: (2024)
por: Yang, Honghui, et al.
Publicado: (2024)
Segment Any Object Model (SAOM): Real-to-Simulation Fine-Tuning Strategy for Multi-Class Multi-Instance Segmentation
por: Khan, Mariia, et al.
Publicado: (2024)
por: Khan, Mariia, et al.
Publicado: (2024)
Rebalanced Vision-Language Retrieval Considering Structure-Aware Distillation
por: Yang, Yang, et al.
Publicado: (2024)
por: Yang, Yang, et al.
Publicado: (2024)
AnimateDiff-Lightning: Cross-Model Diffusion Distillation
por: Lin, Shanchuan, et al.
Publicado: (2024)
por: Lin, Shanchuan, et al.
Publicado: (2024)
Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution
por: Wang, Peng, et al.
Publicado: (2024)
por: Wang, Peng, et al.
Publicado: (2024)
FaRMamba: Frequency-based learning and Reconstruction aided Mamba for Medical Segmentation
por: Rong, Ze, et al.
Publicado: (2025)
por: Rong, Ze, et al.
Publicado: (2025)
SAFIRE: Segment Any Forged Image Region
por: Kwon, Myung-Joon, et al.
Publicado: (2024)
por: Kwon, Myung-Joon, et al.
Publicado: (2024)
DKDM: Data-Free Knowledge Distillation for Diffusion Models with Any Architecture
por: Xiang, Qianlong, et al.
Publicado: (2024)
por: Xiang, Qianlong, et al.
Publicado: (2024)
FedDistill: Global Model Distillation for Local Model De-Biasing in Non-IID Federated Learning
por: Song, Changlin, et al.
Publicado: (2024)
por: Song, Changlin, et al.
Publicado: (2024)
AnyFit: Controllable Virtual Try-on for Any Combination of Attire Across Any Scenario
por: Li, Yuhan, et al.
Publicado: (2024)
por: Li, Yuhan, et al.
Publicado: (2024)
Rethinking RGB-D Fusion for Semantic Segmentation in Surgical Datasets
por: Jamal, Muhammad Abdullah, et al.
Publicado: (2024)
por: Jamal, Muhammad Abdullah, et al.
Publicado: (2024)
Merging Context Clustering with Visual State Space Models for Medical Image Segmentation
por: Zhu, Yun, et al.
Publicado: (2025)
por: Zhu, Yun, et al.
Publicado: (2025)
Adversarial Attack for RGB-Event based Visual Object Tracking
por: Chen, Qiang, et al.
Publicado: (2025)
por: Chen, Qiang, et al.
Publicado: (2025)
Segment Any Anomaly without Training via Hybrid Prompt Regularization
por: Cao, Yunkang, et al.
Publicado: (2023)
por: Cao, Yunkang, et al.
Publicado: (2023)
OISD: On-Policy Internal Self-Distillation of Language Models
por: Liu, Xinyu, et al.
Publicado: (2026)
por: Liu, Xinyu, et al.
Publicado: (2026)
Ejemplares similares
-
Refer to Any Segmentation Mask Group With Vision-Language Prompts
por: Cao, Shengcao, et al.
Publicado: (2025) -
X-SAM: From Segment Anything to Any Segmentation
por: Wang, Hao, et al.
Publicado: (2025) -
Segment Any 3D Object with Language
por: Lee, Seungjun, et al.
Publicado: (2024) -
AnyFlow: Any-Step Video Diffusion Model with On-Policy Flow Map Distillation
por: Gu, Yuchao, et al.
Publicado: (2026) -
Complementary Random Masking for RGB-Thermal Semantic Segmentation
por: Shin, Ukcheol, et al.
Publicado: (2023)