MONITRS: Multimodal Observations of Natural Incidents Through Remote Sensing
Fuente:
arXiv
Saved in:
| Main Authors: | Revankar, Shreelekha, Mall, Utkarsh, Phoo, Cheng Perng, Bala, Kavita, Hariharan, Bharath |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Scale-Aware Recognition in Satellite Images under Resource Constraints
by: Revankar, Shreelekha, et al.
Published: (2024)
by: Revankar, Shreelekha, et al.
Published: (2024)
DiSciPLE: Learning Interpretable Programs for Scientific Visual Discovery
by: Mall, Utkarsh, et al.
Published: (2025)
by: Mall, Utkarsh, et al.
Published: (2025)
AllClear: A Comprehensive Dataset and Benchmark for Cloud Removal in Satellite Imagery
by: Zhou, Hangyu, et al.
Published: (2024)
by: Zhou, Hangyu, et al.
Published: (2024)
Towards LLM Agents for Earth Observation
by: Kao, Chia Hsiang, et al.
Published: (2025)
by: Kao, Chia Hsiang, et al.
Published: (2025)
Pre-Training LiDAR-Based 3D Object Detectors Through Colorization
by: Pan, Tai-Yu, et al.
Published: (2023)
by: Pan, Tai-Yu, et al.
Published: (2023)
Better Monocular 3D Detectors with LiDAR from the Past
by: You, Yurong, et al.
Published: (2024)
by: You, Yurong, et al.
Published: (2024)
Learning 3D Perception from Others' Predictions
by: Yoo, Jinsu, et al.
Published: (2024)
by: Yoo, Jinsu, et al.
Published: (2024)
SHARE: Single-view Human Adversarial REconstruction
by: Revankar, Shreelekha, et al.
Published: (2023)
by: Revankar, Shreelekha, et al.
Published: (2023)
Adaptive Sensitivity Analysis for Robust Augmentation against Natural Corruptions in Image Segmentation
by: Zheng, Laura, et al.
Published: (2024)
by: Zheng, Laura, et al.
Published: (2024)
Flat-Pack Bench: Evaluating Spatio-Temporal Understanding in Large Vision-Language Models through Furniture Assembly
by: Chetan, Aditya, et al.
Published: (2026)
by: Chetan, Aditya, et al.
Published: (2026)
MOD-UV: Learning Mobile Object Detectors from Unlabeled Videos
by: Sun, Yihong, et al.
Published: (2024)
by: Sun, Yihong, et al.
Published: (2024)
Evolving Interpretable Visual Classifiers with Large Language Models
by: Chiquier, Mia, et al.
Published: (2024)
by: Chiquier, Mia, et al.
Published: (2024)
How Video Meetings Change Your Expression
by: Sarin, Sumit, et al.
Published: (2024)
by: Sarin, Sumit, et al.
Published: (2024)
MovieRecapsQA: A Multimodal Open-Ended Video Question-Answering Benchmark
by: Shaar, Shaden, et al.
Published: (2026)
by: Shaar, Shaden, et al.
Published: (2026)
Composing People Together: Iterative Pose-Image Generation for Multi-Person Interaction Scenes
by: Peng, Wenxuan, et al.
Published: (2026)
by: Peng, Wenxuan, et al.
Published: (2026)
Deep Multimodal Fusion for Semantic Segmentation of Remote Sensing Earth Observation Data
by: Dimitrovski, Ivica, et al.
Published: (2024)
by: Dimitrovski, Ivica, et al.
Published: (2024)
Learning Feature Descriptors using Camera Pose Supervision
by: Wang, Qianqian, et al.
Published: (2020)
by: Wang, Qianqian, et al.
Published: (2020)
Sanvaad: A Multimodal Accessibility Framework for ISL Recognition and Voice-Based Interaction
by: Revankar, Kush, et al.
Published: (2025)
by: Revankar, Kush, et al.
Published: (2025)
C3Po: Cross-View Cross-Modality Correspondence by Pointmap Prediction
by: Huang, Kuan Wei, et al.
Published: (2025)
by: Huang, Kuan Wei, et al.
Published: (2025)
Tracking and Understanding Object Transformations
by: Sun, Yihong, et al.
Published: (2025)
by: Sun, Yihong, et al.
Published: (2025)
Foundation Models for Remote Sensing and Earth Observation: A Survey
by: Xiao, Aoran, et al.
Published: (2024)
by: Xiao, Aoran, et al.
Published: (2024)
Color Bind: Exploring Color Perception in Text-to-Image Models
by: Shomer-Chai, Shay, et al.
Published: (2025)
by: Shomer-Chai, Shay, et al.
Published: (2025)
MapGlue: Multimodal Remote Sensing Image Matching
by: Wu, Peihao, et al.
Published: (2025)
by: Wu, Peihao, et al.
Published: (2025)
Live Interactive Training for Video Segmentation
by: Yang, Xinyu, et al.
Published: (2026)
by: Yang, Xinyu, et al.
Published: (2026)
FUSAR-KLIP: Towards Multimodal Foundation Models for Remote Sensing
by: Yang, Yi, et al.
Published: (2025)
by: Yang, Yi, et al.
Published: (2025)
Balanced Diffusion-Guided Fusion for Multimodal Remote Sensing Classification
by: Liu, Hao, et al.
Published: (2025)
by: Liu, Hao, et al.
Published: (2025)
GeoMMBench and GeoMMAgent: Toward Expert-Level Multimodal Intelligence in Geoscience and Remote Sensing
by: Xiao, Aoran, et al.
Published: (2026)
by: Xiao, Aoran, et al.
Published: (2026)
Multimodal-Aware Fusion Network for Referring Remote Sensing Image Segmentation
by: Shi, Leideng, et al.
Published: (2025)
by: Shi, Leideng, et al.
Published: (2025)
ChangeBridge: Spatiotemporal Image Generation with Multimodal Controls for Remote Sensing
by: Zhao, Zhenghui, et al.
Published: (2025)
by: Zhao, Zhenghui, et al.
Published: (2025)
GeoPixel: Pixel Grounding Large Multimodal Model in Remote Sensing
by: Shabbir, Akashah, et al.
Published: (2025)
by: Shabbir, Akashah, et al.
Published: (2025)
EagleVision: Object-level Attribute Multimodal LLM for Remote Sensing
by: Jiang, Hongxiang, et al.
Published: (2025)
by: Jiang, Hongxiang, et al.
Published: (2025)
A Survey on Remote Sensing Foundation Models: From Vision to Multimodality
by: Huang, Ziyue, et al.
Published: (2025)
by: Huang, Ziyue, et al.
Published: (2025)
Interactive Masked Image Modeling for Multimodal Object Detection in Remote Sensing
by: Vu, Minh-Duc, et al.
Published: (2024)
by: Vu, Minh-Duc, et al.
Published: (2024)
CDChat: A Large Multimodal Model for Remote Sensing Change Description
by: Noman, Mubashir, et al.
Published: (2024)
by: Noman, Mubashir, et al.
Published: (2024)
RemoteShield: Enable Robust Multimodal Large Language Models for Earth Observation
by: Min, Rui, et al.
Published: (2026)
by: Min, Rui, et al.
Published: (2026)
A Spatial-Spectral-Frequency Interactive Network for Multimodal Remote Sensing Classification
by: Liu, Hao, et al.
Published: (2025)
by: Liu, Hao, et al.
Published: (2025)
TinyRS-R1: Compact Multimodal Language Model for Remote Sensing
by: Koksal, Aybora, et al.
Published: (2025)
by: Koksal, Aybora, et al.
Published: (2025)
Beyond Open Vocabulary: Multimodal Prompting for Object Detection in Remote Sensing Images
by: Yang, Shuai, et al.
Published: (2026)
by: Yang, Shuai, et al.
Published: (2026)
Seeing Clearly without Training: Mitigating Hallucinations in Multimodal LLMs for Remote Sensing
by: Liu, Yi, et al.
Published: (2026)
by: Liu, Yi, et al.
Published: (2026)
A Unified Framework with Multimodal Fine-tuning for Remote Sensing Semantic Segmentation
by: Ma, Xianping, et al.
Published: (2024)
by: Ma, Xianping, et al.
Published: (2024)
Similar Items
-
Scale-Aware Recognition in Satellite Images under Resource Constraints
by: Revankar, Shreelekha, et al.
Published: (2024) -
DiSciPLE: Learning Interpretable Programs for Scientific Visual Discovery
by: Mall, Utkarsh, et al.
Published: (2025) -
AllClear: A Comprehensive Dataset and Benchmark for Cloud Removal in Satellite Imagery
by: Zhou, Hangyu, et al.
Published: (2024) -
Towards LLM Agents for Earth Observation
by: Kao, Chia Hsiang, et al.
Published: (2025) -
Pre-Training LiDAR-Based 3D Object Detectors Through Colorization
by: Pan, Tai-Yu, et al.
Published: (2023)