Fine-Grained Scene Image Classification with Modality-Agnostic Adapter
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Yiqun, Zhou, Zhao, Du, Xiangcheng, Wu, Xingjiao, Zheng, Yingbin, Jin, Cheng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Aggregated Text Transformer for Scene Text Detection
di: Zhou, Zhao, et al.
Pubblicazione: (2022)
di: Zhou, Zhao, et al.
Pubblicazione: (2022)
Minutes to Seconds: Speeded-up DDPM-based Image Inpainting with Coarse-to-Fine Sampling
di: Zhang, Lintao, et al.
Pubblicazione: (2024)
di: Zhang, Lintao, et al.
Pubblicazione: (2024)
Cross-Domain Document Layout Analysis Using Document Style Guide
di: Wu, Xingjiao, et al.
Pubblicazione: (2022)
di: Wu, Xingjiao, et al.
Pubblicazione: (2022)
MultiColor: Image Colorization by Learning from Multiple Color Spaces
di: Du, Xiangcheng, et al.
Pubblicazione: (2024)
di: Du, Xiangcheng, et al.
Pubblicazione: (2024)
Fine-Grained VLM Fine-tuning via Latent Hierarchical Adapter Learning
di: Zhao, Yumiao, et al.
Pubblicazione: (2025)
di: Zhao, Yumiao, et al.
Pubblicazione: (2025)
CapS-Adapter: Caption-based MultiModal Adapter in Zero-Shot Classification
di: Wang, Qijie, et al.
Pubblicazione: (2024)
di: Wang, Qijie, et al.
Pubblicazione: (2024)
Optimal Transport Adapter Tuning for Bridging Modality Gaps in Few-Shot Remote Sensing Scene Classification
di: Ji, Zhong, et al.
Pubblicazione: (2025)
di: Ji, Zhong, et al.
Pubblicazione: (2025)
HMIL: Hierarchical Multi-Instance Learning for Fine-Grained Whole Slide Image Classification
di: Jin, Cheng, et al.
Pubblicazione: (2024)
di: Jin, Cheng, et al.
Pubblicazione: (2024)
HeGraphAdapter: Tuning Multi-Modal Vision-Language Models with Heterogeneous Graph Adapter
di: Zhao, Yumiao, et al.
Pubblicazione: (2024)
di: Zhao, Yumiao, et al.
Pubblicazione: (2024)
SASP: Strip-Aware Spatial Perception for Fine-Grained Bird Image Classification
di: Wang, Zheng
Pubblicazione: (2025)
di: Wang, Zheng
Pubblicazione: (2025)
Modality-Agnostic Structural Image Representation Learning for Deformable Multi-Modality Medical Image Registration
di: Mok, Tony C. W., et al.
Pubblicazione: (2024)
di: Mok, Tony C. W., et al.
Pubblicazione: (2024)
Combining Discrepancy-Confusion Uncertainty and Calibration Diversity for Active Fine-Grained Image Classification
di: Jin, Yinghao, et al.
Pubblicazione: (2025)
di: Jin, Yinghao, et al.
Pubblicazione: (2025)
Efficient scene text image super-resolution with semantic guidance
di: TomyEnrique, LeoWu, et al.
Pubblicazione: (2024)
di: TomyEnrique, LeoWu, et al.
Pubblicazione: (2024)
Memory-based Adapters for Online 3D Scene Perception
di: Xu, Xiuwei, et al.
Pubblicazione: (2024)
di: Xu, Xiuwei, et al.
Pubblicazione: (2024)
UniM-OV3D: Uni-Modality Open-Vocabulary 3D Scene Understanding with Fine-Grained Feature Representation
di: He, Qingdong, et al.
Pubblicazione: (2024)
di: He, Qingdong, et al.
Pubblicazione: (2024)
MAGIC++: Efficient and Resilient Modality-Agnostic Semantic Segmentation via Hierarchical Modality Selection
di: Zheng, Xu, et al.
Pubblicazione: (2024)
di: Zheng, Xu, et al.
Pubblicazione: (2024)
FreeSliders: Training-Free, Modality-Agnostic Concept Sliders for Fine-Grained Diffusion Control in Images, Audio, and Video
di: Ezra, Rotem, et al.
Pubblicazione: (2025)
di: Ezra, Rotem, et al.
Pubblicazione: (2025)
Indoor Scene Reconstruction with Fine-Grained Details Using Hybrid Representation and Normal Prior Enhancement
di: Ye, Sheng, et al.
Pubblicazione: (2023)
di: Ye, Sheng, et al.
Pubblicazione: (2023)
Frame2Freq: Spectral Adapters for Fine-Grained Video Understanding
di: Ponbagavathi, Thinesh Thiyakesan, et al.
Pubblicazione: (2026)
di: Ponbagavathi, Thinesh Thiyakesan, et al.
Pubblicazione: (2026)
SG-Adapter: Enhancing Text-to-Image Generation with Scene Graph Guidance
di: Shen, Guibao, et al.
Pubblicazione: (2024)
di: Shen, Guibao, et al.
Pubblicazione: (2024)
Decoupling Spatio-Temporal Adapter for Fine-Grained Badminton Action Localization
di: Wang, Tianyu, et al.
Pubblicazione: (2026)
di: Wang, Tianyu, et al.
Pubblicazione: (2026)
Face Adapter for Pre-Trained Diffusion Models with Fine-Grained ID and Attribute Control
di: Han, Yue, et al.
Pubblicazione: (2024)
di: Han, Yue, et al.
Pubblicazione: (2024)
Sparse-Dense Mixture of Experts Adapter for Multi-Modal Tracking
di: Zhu, Yabin, et al.
Pubblicazione: (2026)
di: Zhu, Yabin, et al.
Pubblicazione: (2026)
SGIA: Enhancing Fine-Grained Visual Classification with Sequence Generative Image Augmentation
di: Liao, Qiyu, et al.
Pubblicazione: (2024)
di: Liao, Qiyu, et al.
Pubblicazione: (2024)
Frequency-Enhanced Dual-Subspace Networks for Few-Shot Fine-Grained Image Classification
di: Wang, Meijia, et al.
Pubblicazione: (2026)
di: Wang, Meijia, et al.
Pubblicazione: (2026)
TryOn-Adapter: Efficient Fine-Grained Clothing Identity Adaptation for High-Fidelity Virtual Try-On
di: Xing, Jiazheng, et al.
Pubblicazione: (2024)
di: Xing, Jiazheng, et al.
Pubblicazione: (2024)
From Classification to Cross-Modal Understanding: Leveraging Vision-Language Models for Fine-Grained Renal Pathology
di: Guo, Zhenhao, et al.
Pubblicazione: (2025)
di: Guo, Zhenhao, et al.
Pubblicazione: (2025)
Generalizable Whole Slide Image Classification with Fine-Grained Visual-Semantic Interaction
di: Li, Hao, et al.
Pubblicazione: (2024)
di: Li, Hao, et al.
Pubblicazione: (2024)
Cross-Modal Scene Semantic Alignment for Image Complexity Assessment
di: Luo, Yuqing, et al.
Pubblicazione: (2025)
di: Luo, Yuqing, et al.
Pubblicazione: (2025)
Layout Agnostic Scene Text Image Synthesis with Diffusion Models
di: Zhangli, Qilong, et al.
Pubblicazione: (2024)
di: Zhangli, Qilong, et al.
Pubblicazione: (2024)
Fine-Grained ImageNet Classification in the Wild
di: Lymperaiou, Maria, et al.
Pubblicazione: (2023)
di: Lymperaiou, Maria, et al.
Pubblicazione: (2023)
StereoAdapter: Adapting Stereo Depth Estimation to Underwater Scenes
di: Wu, Zhengri, et al.
Pubblicazione: (2025)
di: Wu, Zhengri, et al.
Pubblicazione: (2025)
ToolFG: Towards Well-Grounded Fine-Grained Image Classification
di: Xue, Yu, et al.
Pubblicazione: (2026)
di: Xue, Yu, et al.
Pubblicazione: (2026)
CMFN: Cross-Modal Fusion Network for Irregular Scene Text Recognition
di: Zheng, Jinzhi, et al.
Pubblicazione: (2024)
di: Zheng, Jinzhi, et al.
Pubblicazione: (2024)
Federated Cross-Modal Retrieval with Missing Modalities via Semantic Routing and Adapter Personalization
di: Zhou, Hefeng, et al.
Pubblicazione: (2026)
di: Zhou, Hefeng, et al.
Pubblicazione: (2026)
Exploration of Class Center for Fine-Grained Visual Classification
di: Yao, Hang, et al.
Pubblicazione: (2024)
di: Yao, Hang, et al.
Pubblicazione: (2024)
Multi-Modal Motion Retrieval by Learning a Fine-Grained Joint Embedding Space
di: Yu, Shiyao, et al.
Pubblicazione: (2025)
di: Yu, Shiyao, et al.
Pubblicazione: (2025)
MEET: A Million-Scale Dataset for Fine-Grained Geospatial Scene Classification with Zoom-Free Remote Sensing Imagery
di: Li, Yansheng, et al.
Pubblicazione: (2025)
di: Li, Yansheng, et al.
Pubblicazione: (2025)
PEPL: Precision-Enhanced Pseudo-Labeling for Fine-Grained Image Classification in Semi-Supervised Learning
di: Tian, Bowen, et al.
Pubblicazione: (2024)
di: Tian, Bowen, et al.
Pubblicazione: (2024)
Robust and Generalizable GNN Fine-Tuning via Uncertainty-aware Adapter Learning
di: Jiang, Bo, et al.
Pubblicazione: (2025)
di: Jiang, Bo, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Aggregated Text Transformer for Scene Text Detection
di: Zhou, Zhao, et al.
Pubblicazione: (2022) -
Minutes to Seconds: Speeded-up DDPM-based Image Inpainting with Coarse-to-Fine Sampling
di: Zhang, Lintao, et al.
Pubblicazione: (2024) -
Cross-Domain Document Layout Analysis Using Document Style Guide
di: Wu, Xingjiao, et al.
Pubblicazione: (2022) -
MultiColor: Image Colorization by Learning from Multiple Color Spaces
di: Du, Xiangcheng, et al.
Pubblicazione: (2024) -
Fine-Grained VLM Fine-tuning via Latent Hierarchical Adapter Learning
di: Zhao, Yumiao, et al.
Pubblicazione: (2025)