GOMAA-Geo: GOal Modality Agnostic Active Geo-localization
Fuente:
arXiv
Salvato in:
| Autori principali: | Sarkar, Anindya, Sastry, Srikumar, Pirinen, Aleksis, Zhang, Chongjie, Jacobs, Nathan, Vorobeychik, Yevgeniy |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
DiffVAS: Diffusion-Guided Visual Active Search in Partially Observable Environments
di: Sarkar, Anindya, et al.
Pubblicazione: (2026)
di: Sarkar, Anindya, et al.
Pubblicazione: (2026)
GeoSynth: Contextually-Aware High-Resolution Satellite Image Synthesis
di: Sastry, Srikumar, et al.
Pubblicazione: (2024)
di: Sastry, Srikumar, et al.
Pubblicazione: (2024)
Sat2Sound: A Unified Framework for Zero-Shot Soundscape Mapping
di: Khanal, Subash, et al.
Pubblicazione: (2025)
di: Khanal, Subash, et al.
Pubblicazione: (2025)
TaxaBind: A Unified Embedding Space for Ecological Applications
di: Sastry, Srikumar, et al.
Pubblicazione: (2024)
di: Sastry, Srikumar, et al.
Pubblicazione: (2024)
RANGE: Retrieval Augmented Neural Fields for Multi-Resolution Geo-Embeddings
di: Dhakal, Aayush, et al.
Pubblicazione: (2025)
di: Dhakal, Aayush, et al.
Pubblicazione: (2025)
VectorSynth: Fine-Grained Satellite Image Synthesis with Structured Semantics
di: Cher, Daniel, et al.
Pubblicazione: (2025)
di: Cher, Daniel, et al.
Pubblicazione: (2025)
GeoDiT: Point-Conditioned Diffusion Transformer for Satellite Image Synthesis
di: Sastry, Srikumar, et al.
Pubblicazione: (2026)
di: Sastry, Srikumar, et al.
Pubblicazione: (2026)
Online Feedback Efficient Active Target Discovery in Partially Observable Environments
di: Sarkar, Anindya, et al.
Pubblicazione: (2025)
di: Sarkar, Anindya, et al.
Pubblicazione: (2025)
Active Geospatial Search for Efficient Tenant Eviction Outreach
di: Sarkar, Anindya, et al.
Pubblicazione: (2024)
di: Sarkar, Anindya, et al.
Pubblicazione: (2024)
ProM3E: Probabilistic Masked MultiModal Embedding Model for Ecology
di: Sastry, Srikumar, et al.
Pubblicazione: (2025)
di: Sastry, Srikumar, et al.
Pubblicazione: (2025)
Global and Local Entailment Learning for Natural World Imagery
di: Sastry, Srikumar, et al.
Pubblicazione: (2025)
di: Sastry, Srikumar, et al.
Pubblicazione: (2025)
Grazing Detection using Deep Learning and Sentinel-2 Time Series Data
di: Pirinen, Aleksis, et al.
Pubblicazione: (2025)
di: Pirinen, Aleksis, et al.
Pubblicazione: (2025)
Mull-Tokens: Modality-Agnostic Latent Thinking
di: Ray, Arijit, et al.
Pubblicazione: (2025)
di: Ray, Arijit, et al.
Pubblicazione: (2025)
LD-SDM: Language-Driven Hierarchical Species Distribution Modeling
di: Sastry, Srikumar, et al.
Pubblicazione: (2023)
di: Sastry, Srikumar, et al.
Pubblicazione: (2023)
Sat2Cap: Mapping Fine-Grained Textual Descriptions from Satellite Images
di: Dhakal, Aayush, et al.
Pubblicazione: (2023)
di: Dhakal, Aayush, et al.
Pubblicazione: (2023)
A Parameter-Efficient Mixture-of-Experts Framework for Cross-Modal Geo-Localization
di: Li, LinFeng, et al.
Pubblicazione: (2025)
di: Li, LinFeng, et al.
Pubblicazione: (2025)
Architecture-Agnostic Modality-Isolated Gated Fusion for Robust Multi-Modal Prostate MRI Segmentation
di: Shu, Yongbo, et al.
Pubblicazione: (2026)
di: Shu, Yongbo, et al.
Pubblicazione: (2026)
GeoSURGE: Geo-localization using Semantic Fusion with Hierarchy of Geographic Embeddings
di: Daruna, Angel, et al.
Pubblicazione: (2025)
di: Daruna, Angel, et al.
Pubblicazione: (2025)
HiddenObject: Modality-Agnostic Fusion for Multimodal Hidden Object Detection
di: Song, Harris, et al.
Pubblicazione: (2025)
di: Song, Harris, et al.
Pubblicazione: (2025)
Learning Interpretable Policies in Hindsight-Observable POMDPs through Partially Supervised Reinforcement Learning
di: Lanier, Michael, et al.
Pubblicazione: (2024)
di: Lanier, Michael, et al.
Pubblicazione: (2024)
Detecting Dataset Bias in Medical AI: A Generalized and Modality-Agnostic Auditing Framework
di: Drenkow, Nathan, et al.
Pubblicazione: (2025)
di: Drenkow, Nathan, et al.
Pubblicazione: (2025)
Personalized Federated Learning for Cross-view Geo-localization
di: Anagnostopoulos, Christos, et al.
Pubblicazione: (2024)
di: Anagnostopoulos, Christos, et al.
Pubblicazione: (2024)
Learning Policy Committees for Effective Personalization in MDPs with Diverse Tasks
di: Ge, Luise, et al.
Pubblicazione: (2025)
di: Ge, Luise, et al.
Pubblicazione: (2025)
GeoSAM: Fine-tuning SAM with Multi-Modal Prompts for Mobility Infrastructure Segmentation
di: Sultan, Rafi Ibn, et al.
Pubblicazione: (2023)
di: Sultan, Rafi Ibn, et al.
Pubblicazione: (2023)
Multi-Modal Foundation Models for Computational Pathology: A Survey
di: Li, Dong, et al.
Pubblicazione: (2025)
di: Li, Dong, et al.
Pubblicazione: (2025)
GeoVLMath: Enhancing Geometry Reasoning in Vision-Language Models via Cross-Modal Reward for Auxiliary Line Creation
di: Guo, Shasha, et al.
Pubblicazione: (2025)
di: Guo, Shasha, et al.
Pubblicazione: (2025)
TAPS : Frustratingly Simple Test Time Active Learning for VLMs
di: Sarkar, Dhruv, et al.
Pubblicazione: (2025)
di: Sarkar, Dhruv, et al.
Pubblicazione: (2025)
Towards Interpretable Geo-localization: a Concept-Aware Global Image-GPS Alignment Framework
di: Jia, Furong, et al.
Pubblicazione: (2025)
di: Jia, Furong, et al.
Pubblicazione: (2025)
Targeted Downstream-Agnostic Attack
di: Lei, Zhuxin, et al.
Pubblicazione: (2026)
di: Lei, Zhuxin, et al.
Pubblicazione: (2026)
Modality-Agnostic Input Channels Enable Segmentation of Brain lesions in Multimodal MRI with Sequences Unavailable During Training
di: Addison, Anthony P., et al.
Pubblicazione: (2025)
di: Addison, Anthony P., et al.
Pubblicazione: (2025)
Multi-weather Cross-view Geo-localization Using Denoising Diffusion Models
di: Feng, Tongtong, et al.
Pubblicazione: (2024)
di: Feng, Tongtong, et al.
Pubblicazione: (2024)
ERGeoBench:A Comprehensive Benchmark for Embodied Reasoning and Geo-localization in Multimodal Large Language Models
di: Xue, Kaiwen, et al.
Pubblicazione: (2026)
di: Xue, Kaiwen, et al.
Pubblicazione: (2026)
FreeSliders: Training-Free, Modality-Agnostic Concept Sliders for Fine-Grained Diffusion Control in Images, Audio, and Video
di: Ezra, Rotem, et al.
Pubblicazione: (2025)
di: Ezra, Rotem, et al.
Pubblicazione: (2025)
SimLBR: Learning to Detect Fake Images by Learning to Detect Real Images
di: Dhakal, Aayush, et al.
Pubblicazione: (2026)
di: Dhakal, Aayush, et al.
Pubblicazione: (2026)
A Novel Approach to Breast Cancer Histopathological Image Classification Using Cross-Colour Space Feature Fusion and Quantum-Classical Stack Ensemble Method
di: Mallick, Sambit, et al.
Pubblicazione: (2024)
di: Mallick, Sambit, et al.
Pubblicazione: (2024)
Beta Distribution Learning for Reliable Roadway Crash Risk Assessment
di: Elallaf, Ahmad, et al.
Pubblicazione: (2025)
di: Elallaf, Ahmad, et al.
Pubblicazione: (2025)
good4cir: Generating Detailed Synthetic Captions for Composed Image Retrieval
di: Kolouju, Pranavi, et al.
Pubblicazione: (2025)
di: Kolouju, Pranavi, et al.
Pubblicazione: (2025)
LATTE-MV: Learning to Anticipate Table Tennis Hits from Monocular Videos
di: Etaat, Daniel, et al.
Pubblicazione: (2025)
di: Etaat, Daniel, et al.
Pubblicazione: (2025)
Object-level Cross-view Geo-localization with Location Enhancement and Multi-Head Cross Attention
di: Huang, Zheyang, et al.
Pubblicazione: (2025)
di: Huang, Zheyang, et al.
Pubblicazione: (2025)
See Further for Parameter Efficient Fine-tuning by Standing on the Shoulders of Decomposition
di: Si, Chongjie, et al.
Pubblicazione: (2024)
di: Si, Chongjie, et al.
Pubblicazione: (2024)
Documenti analoghi
-
DiffVAS: Diffusion-Guided Visual Active Search in Partially Observable Environments
di: Sarkar, Anindya, et al.
Pubblicazione: (2026) -
GeoSynth: Contextually-Aware High-Resolution Satellite Image Synthesis
di: Sastry, Srikumar, et al.
Pubblicazione: (2024) -
Sat2Sound: A Unified Framework for Zero-Shot Soundscape Mapping
di: Khanal, Subash, et al.
Pubblicazione: (2025) -
TaxaBind: A Unified Embedding Space for Ecological Applications
di: Sastry, Srikumar, et al.
Pubblicazione: (2024) -
RANGE: Retrieval Augmented Neural Fields for Multi-Resolution Geo-Embeddings
di: Dhakal, Aayush, et al.
Pubblicazione: (2025)