ProM3E: Probabilistic Masked MultiModal Embedding Model for Ecology
Fuente:
arXiv
Saved in:
| Main Authors: | Sastry, Srikumar, Khanal, Subash, Dhakal, Aayush, Lin, Jiayu, Cher, Dan, Jarosz, Phoenix, Jacobs, Nathan |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
TaxaBind: A Unified Embedding Space for Ecological Applications
by: Sastry, Srikumar, et al.
Published: (2024)
by: Sastry, Srikumar, et al.
Published: (2024)
GeoSynth: Contextually-Aware High-Resolution Satellite Image Synthesis
by: Sastry, Srikumar, et al.
Published: (2024)
by: Sastry, Srikumar, et al.
Published: (2024)
PSM: Learning Probabilistic Embeddings for Multi-scale Zero-Shot Soundscape Mapping
by: Khanal, Subash, et al.
Published: (2024)
by: Khanal, Subash, et al.
Published: (2024)
RANGE: Retrieval Augmented Neural Fields for Multi-Resolution Geo-Embeddings
by: Dhakal, Aayush, et al.
Published: (2025)
by: Dhakal, Aayush, et al.
Published: (2025)
GeoDiT: Point-Conditioned Diffusion Transformer for Satellite Image Synthesis
by: Sastry, Srikumar, et al.
Published: (2026)
by: Sastry, Srikumar, et al.
Published: (2026)
Global and Local Entailment Learning for Natural World Imagery
by: Sastry, Srikumar, et al.
Published: (2025)
by: Sastry, Srikumar, et al.
Published: (2025)
GEOBIND: Binding Text, Image, and Audio through Satellite Images
by: Dhakal, Aayush, et al.
Published: (2024)
by: Dhakal, Aayush, et al.
Published: (2024)
LD-SDM: Language-Driven Hierarchical Species Distribution Modeling
by: Sastry, Srikumar, et al.
Published: (2023)
by: Sastry, Srikumar, et al.
Published: (2023)
Sat2Sound: A Unified Framework for Zero-Shot Soundscape Mapping
by: Khanal, Subash, et al.
Published: (2025)
by: Khanal, Subash, et al.
Published: (2025)
Sat2Cap: Mapping Fine-Grained Textual Descriptions from Satellite Images
by: Dhakal, Aayush, et al.
Published: (2023)
by: Dhakal, Aayush, et al.
Published: (2023)
SimLBR: Learning to Detect Fake Images by Learning to Detect Real Images
by: Dhakal, Aayush, et al.
Published: (2026)
by: Dhakal, Aayush, et al.
Published: (2026)
VectorSynth: Fine-Grained Satellite Image Synthesis with Structured Semantics
by: Cher, Daniel, et al.
Published: (2025)
by: Cher, Daniel, et al.
Published: (2025)
GOMAA-Geo: GOal Modality Agnostic Active Geo-localization
by: Sarkar, Anindya, et al.
Published: (2024)
by: Sarkar, Anindya, et al.
Published: (2024)
DiffVAS: Diffusion-Guided Visual Active Search in Partially Observable Environments
by: Sarkar, Anindya, et al.
Published: (2026)
by: Sarkar, Anindya, et al.
Published: (2026)
MMCORE: MultiModal COnnection with Representation Aligned Latent Embeddings
by: Li, Zijie, et al.
Published: (2026)
by: Li, Zijie, et al.
Published: (2026)
Multi-objective Binary Differential Approach with Parameter Tuning for Discovering Business Process Models: MoD-ProM
by: Deshmukh, Sonia, et al.
Published: (2024)
by: Deshmukh, Sonia, et al.
Published: (2024)
Mixed-View Panorama Synthesis using Geospatially Guided Diffusion
by: Xiong, Zhexiao, et al.
Published: (2024)
by: Xiong, Zhexiao, et al.
Published: (2024)
FroSSL: Frobenius Norm Minimization for Efficient Multiview Self-Supervised Learning
by: Skean, Oscar, et al.
Published: (2023)
by: Skean, Oscar, et al.
Published: (2023)
MMRPT: MultiModal Reinforcement Pre-Training via Masked Vision-Dependent Reasoning
by: Zheng, Xuhui, et al.
Published: (2025)
by: Zheng, Xuhui, et al.
Published: (2025)
M3: 3D-Spatial MultiModal Memory
by: Zou, Xueyan, et al.
Published: (2025)
by: Zou, Xueyan, et al.
Published: (2025)
MultiModal Action Conditioned Video Generation
by: Li, Yichen, et al.
Published: (2025)
by: Li, Yichen, et al.
Published: (2025)
MultiModal Fine-tuning with Synthetic Captions
by: Enomoto, Shohei, et al.
Published: (2026)
by: Enomoto, Shohei, et al.
Published: (2026)
MM-LLMs: Recent Advances in MultiModal Large Language Models
by: Zhang, Duzhen, et al.
Published: (2024)
by: Zhang, Duzhen, et al.
Published: (2024)
Re-M3Dr: Rebalanced MultiModal Mean Deviation Regression
by: Yin, Haojie, et al.
Published: (2026)
by: Yin, Haojie, et al.
Published: (2026)
MMA-Diffusion: MultiModal Attack on Diffusion Models
by: Yang, Yijun, et al.
Published: (2023)
by: Yang, Yijun, et al.
Published: (2023)
M2R2: MultiModal Robotic Representation for Temporal Action Segmentation
by: Sliwowski, Daniel, et al.
Published: (2025)
by: Sliwowski, Daniel, et al.
Published: (2025)
M3R: Localized Rainfall Nowcasting with Meteorology-Informed MultiModal Attention
by: Panta, Sanjeev, et al.
Published: (2026)
by: Panta, Sanjeev, et al.
Published: (2026)
Dementia Insights: A Context-Based MultiModal Approach
by: Mehdoui, Sahar Sinene, et al.
Published: (2025)
by: Mehdoui, Sahar Sinene, et al.
Published: (2025)
M3FAS: An Accurate and Robust MultiModal Mobile Face Anti-Spoofing System
by: Kong, Chenqi, et al.
Published: (2023)
by: Kong, Chenqi, et al.
Published: (2023)
HAMMR: HierArchical MultiModal React agents for generic VQA
by: Castrejon, Lluis, et al.
Published: (2024)
by: Castrejon, Lluis, et al.
Published: (2024)
MTPareto: A MultiModal Targeted Pareto Framework for Fake News Detection
by: Yan, Kaiying, et al.
Published: (2025)
by: Yan, Kaiying, et al.
Published: (2025)
ControlEdit: A MultiModal Local Clothing Image Editing Method
by: Cheng, Di, et al.
Published: (2024)
by: Cheng, Di, et al.
Published: (2024)
On the Feasibility of Using MultiModal LLMs to Execute AR Social Engineering Attacks
by: Bi, Ting, et al.
Published: (2025)
by: Bi, Ting, et al.
Published: (2025)
FUSE : Failure-aware Usage of Subagent Evidence for MultiModal Search and Recommendation
by: Vatsa, Tushar, et al.
Published: (2025)
by: Vatsa, Tushar, et al.
Published: (2025)
TeamPath: Building MultiModal Pathology Experts with Reasoning AI Copilots
by: Liu, Tianyu, et al.
Published: (2025)
by: Liu, Tianyu, et al.
Published: (2025)
CapS-Adapter: Caption-based MultiModal Adapter in Zero-Shot Classification
by: Wang, Qijie, et al.
Published: (2024)
by: Wang, Qijie, et al.
Published: (2024)
MaskPro: Linear-Space Probabilistic Learning for Strict (N:M)-Sparsity on LLMs
by: Sun, Yan, et al.
Published: (2025)
by: Sun, Yan, et al.
Published: (2025)
Omni-Customizer: End-to-End MultiModal Customization for Joint Audio-Video Generation
by: Chen, Yuheng, et al.
Published: (2026)
by: Chen, Yuheng, et al.
Published: (2026)
MLlm-DR: Towards Explainable Depression Recognition with MultiModal Large Language Models
by: Zhang, Wei, et al.
Published: (2025)
by: Zhang, Wei, et al.
Published: (2025)
Can MLLMs Reason in Multimodality? EMMA: An Enhanced MultiModal ReAsoning Benchmark
by: Hao, Yunzhuo, et al.
Published: (2025)
by: Hao, Yunzhuo, et al.
Published: (2025)
Similar Items
-
TaxaBind: A Unified Embedding Space for Ecological Applications
by: Sastry, Srikumar, et al.
Published: (2024) -
GeoSynth: Contextually-Aware High-Resolution Satellite Image Synthesis
by: Sastry, Srikumar, et al.
Published: (2024) -
PSM: Learning Probabilistic Embeddings for Multi-scale Zero-Shot Soundscape Mapping
by: Khanal, Subash, et al.
Published: (2024) -
RANGE: Retrieval Augmented Neural Fields for Multi-Resolution Geo-Embeddings
by: Dhakal, Aayush, et al.
Published: (2025) -
GeoDiT: Point-Conditioned Diffusion Transformer for Satellite Image Synthesis
by: Sastry, Srikumar, et al.
Published: (2026)