Segment Anything with Multiple Modalities
Fuente:
arXiv
Salvato in:
| Autori principali: | Xiao, Aoran, Xuan, Weihao, Qi, Heli, Xing, Yun, Yokoya, Naoto, Lu, Shijian |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
CAT-SAM: Conditional Tuning for Few-Shot Adaptation of Segment Anything Model
di: Xiao, Aoran, et al.
Pubblicazione: (2024)
di: Xiao, Aoran, et al.
Pubblicazione: (2024)
Foundation Models for Remote Sensing and Earth Observation: A Survey
di: Xiao, Aoran, et al.
Pubblicazione: (2024)
di: Xiao, Aoran, et al.
Pubblicazione: (2024)
Seeing is Believing, but How Much? A Comprehensive Analysis of Verbalized Calibration in Vision-Language Models
di: Xuan, Weihao, et al.
Pubblicazione: (2025)
di: Xuan, Weihao, et al.
Pubblicazione: (2025)
Direction-aware 3D Large Multimodal Models
di: Liu, Quan, et al.
Pubblicazione: (2026)
di: Liu, Quan, et al.
Pubblicazione: (2026)
MM-OVSeg:Multimodal Optical-SAR Fusion for Open-Vocabulary Segmentation in Remote Sensing
di: Wei, Yimin, et al.
Pubblicazione: (2026)
di: Wei, Yimin, et al.
Pubblicazione: (2026)
Rewrite Caption Semantics: Bridging Semantic Gaps for Language-Supervised Semantic Segmentation
di: Xing, Yun, et al.
Pubblicazione: (2023)
di: Xing, Yun, et al.
Pubblicazione: (2023)
Geo3DVQA: Evaluating Vision-Language Models for 3D Geospatial Reasoning from Aerial Imagery
di: Tsujimoto, Mai, et al.
Pubblicazione: (2025)
di: Tsujimoto, Mai, et al.
Pubblicazione: (2025)
DynamicVL: Benchmarking Multimodal Large Language Models for Dynamic City Understanding
di: Xuan, Weihao, et al.
Pubblicazione: (2025)
di: Xuan, Weihao, et al.
Pubblicazione: (2025)
Learning to Prompt Segment Anything Models
di: Huang, Jiaxing, et al.
Pubblicazione: (2024)
di: Huang, Jiaxing, et al.
Pubblicazione: (2024)
SynRS3D: A Synthetic Dataset for Global 3D Semantic Understanding from Monocular Remote Sensing Imagery
di: Song, Jian, et al.
Pubblicazione: (2024)
di: Song, Jian, et al.
Pubblicazione: (2024)
GeoMMBench and GeoMMAgent: Toward Expert-Level Multimodal Intelligence in Geoscience and Remote Sensing
di: Xiao, Aoran, et al.
Pubblicazione: (2026)
di: Xiao, Aoran, et al.
Pubblicazione: (2026)
Change Detection Between Optical Remote Sensing Imagery and Map Data via Segment Anything Model (SAM)
di: Chen, Hongruixuan, et al.
Pubblicazione: (2024)
di: Chen, Hongruixuan, et al.
Pubblicazione: (2024)
Local-to-Global Cross-Modal Attention-Aware Fusion for HSI-X Semantic Segmentation
di: Zhang, Xuming, et al.
Pubblicazione: (2024)
di: Zhang, Xuming, et al.
Pubblicazione: (2024)
Cross-Domain Few-Shot Segmentation via Iterative Support-Query Correspondence Mining
di: Nie, Jiahao, et al.
Pubblicazione: (2024)
di: Nie, Jiahao, et al.
Pubblicazione: (2024)
A Survey of Label-Efficient Deep Learning for 3D Point Clouds
di: Xiao, Aoran, et al.
Pubblicazione: (2023)
di: Xiao, Aoran, et al.
Pubblicazione: (2023)
SARLANG-1M: A Benchmark for Vision-Language Modeling in SAR Image Understanding
di: Wei, Yimin, et al.
Pubblicazione: (2025)
di: Wei, Yimin, et al.
Pubblicazione: (2025)
Robust Self-Supervised Cross-Modal Super-Resolution against Real-World Misaligned Observations
di: Dong, Xiaoyu, et al.
Pubblicazione: (2026)
di: Dong, Xiaoyu, et al.
Pubblicazione: (2026)
Referring Multiple Regions with Large Multimodal Models via Contextual Latent Steering
di: Xing, Yun, et al.
Pubblicazione: (2026)
di: Xing, Yun, et al.
Pubblicazione: (2026)
PacGDC: Label-Efficient Generalizable Depth Completion with Projection Ambiguity and Consistency
di: Wang, Haotian, et al.
Pubblicazione: (2025)
di: Wang, Haotian, et al.
Pubblicazione: (2025)
Enhancing 3D LiDAR Segmentation by Shaping Dense and Accurate 2D Semantic Predictions
di: Dong, Xiaoyu, et al.
Pubblicazione: (2026)
di: Dong, Xiaoyu, et al.
Pubblicazione: (2026)
DisasterM3: A Remote Sensing Vision-Language Dataset for Disaster Damage Assessment and Response
di: Wang, Junjue, et al.
Pubblicazione: (2025)
di: Wang, Junjue, et al.
Pubblicazione: (2025)
A Vision Centric Remote Sensing Benchmark
di: Adejumo, Abduljaleel, et al.
Pubblicazione: (2025)
di: Adejumo, Abduljaleel, et al.
Pubblicazione: (2025)
FusionSAM: Visual Multi-Modal Learning with Segment Anything
di: Li, Daixun, et al.
Pubblicazione: (2024)
di: Li, Daixun, et al.
Pubblicazione: (2024)
Generalized Few-Shot Semantic Segmentation in Remote Sensing: Challenge and Benchmark
di: Broni-Bediako, Clifford, et al.
Pubblicazione: (2024)
di: Broni-Bediako, Clifford, et al.
Pubblicazione: (2024)
MMRel: Benchmarking Relation Understanding in Multi-Modal Large Language Models
di: Nie, Jiahao, et al.
Pubblicazione: (2024)
di: Nie, Jiahao, et al.
Pubblicazione: (2024)
Joint Super-Resolution and Segmentation for 1-m Impervious Surface Area Mapping in China's Yangtze River Economic Belt
di: Deng, Jie, et al.
Pubblicazione: (2025)
di: Deng, Jie, et al.
Pubblicazione: (2025)
Segment and Caption Anything
di: Huang, Xiaoke, et al.
Pubblicazione: (2023)
di: Huang, Xiaoke, et al.
Pubblicazione: (2023)
Matching Anything by Segmenting Anything
di: Li, Siyuan, et al.
Pubblicazione: (2024)
di: Li, Siyuan, et al.
Pubblicazione: (2024)
MP-HSIR: A Multi-Prompt Framework for Universal Hyperspectral Image Restoration
di: Wu, Zhehui, et al.
Pubblicazione: (2025)
di: Wu, Zhehui, et al.
Pubblicazione: (2025)
StAR: Segment Anything Reasoner
di: Yun, Seokju, et al.
Pubblicazione: (2026)
di: Yun, Seokju, et al.
Pubblicazione: (2026)
Tracking and Segmenting Anything in Any Modality
di: Zhang, Tianlu, et al.
Pubblicazione: (2025)
di: Zhang, Tianlu, et al.
Pubblicazione: (2025)
Customize Segment Anything Model for Multi-Modal Semantic Segmentation with Mixture of LoRA Experts
di: Zhu, Chenyang, et al.
Pubblicazione: (2024)
di: Zhu, Chenyang, et al.
Pubblicazione: (2024)
Mitigating Object Hallucination via Concentric Causal Attention
di: Xing, Yun, et al.
Pubblicazione: (2024)
di: Xing, Yun, et al.
Pubblicazione: (2024)
TASAM: Terrain-and-Aware Segment Anything Model for Temporal-Scale Remote Sensing Segmentation
di: Wang, Tianyang, et al.
Pubblicazione: (2025)
di: Wang, Tianyang, et al.
Pubblicazione: (2025)
Unsupervised Domain Adaptation Architecture Search with Self-Training for Land Cover Mapping
di: Broni-Bediako, Clifford, et al.
Pubblicazione: (2024)
di: Broni-Bediako, Clifford, et al.
Pubblicazione: (2024)
DC-SAM: In-Context Segment Anything in Images and Videos via Dual Consistency
di: Qi, Mengshi, et al.
Pubblicazione: (2025)
di: Qi, Mengshi, et al.
Pubblicazione: (2025)
Enhancing Monocular Height Estimation via Sparse LiDAR-Guided Correction
di: Song, Jian, et al.
Pubblicazione: (2025)
di: Song, Jian, et al.
Pubblicazione: (2025)
SAM3-I: Segment Anything with Instructions
di: Li, Jingjing, et al.
Pubblicazione: (2025)
di: Li, Jingjing, et al.
Pubblicazione: (2025)
UniMRSeg: Unified Modality-Relax Segmentation via Hierarchical Self-Supervised Compensation
di: Zhao, Xiaoqi, et al.
Pubblicazione: (2025)
di: Zhao, Xiaoqi, et al.
Pubblicazione: (2025)
CAD: Memory Efficient Convolutional Adapter for Segment Anything
di: Kim, Joohyeok, et al.
Pubblicazione: (2024)
di: Kim, Joohyeok, et al.
Pubblicazione: (2024)
Documenti analoghi
-
CAT-SAM: Conditional Tuning for Few-Shot Adaptation of Segment Anything Model
di: Xiao, Aoran, et al.
Pubblicazione: (2024) -
Foundation Models for Remote Sensing and Earth Observation: A Survey
di: Xiao, Aoran, et al.
Pubblicazione: (2024) -
Seeing is Believing, but How Much? A Comprehensive Analysis of Verbalized Calibration in Vision-Language Models
di: Xuan, Weihao, et al.
Pubblicazione: (2025) -
Direction-aware 3D Large Multimodal Models
di: Liu, Quan, et al.
Pubblicazione: (2026) -
MM-OVSeg:Multimodal Optical-SAR Fusion for Open-Vocabulary Segmentation in Remote Sensing
di: Wei, Yimin, et al.
Pubblicazione: (2026)