MIRAGE: Multimodal Identification and Recognition of Annotations in Indian General Prescriptions
Fuente:
arXiv
Guardado en:
| Autores principales: | Mankash, Tavish, Kota, V. S. Chaithanya, De, Anish, Prakash, Praveen, Jadhav, Kshitij |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Harnessing Shared Relations via Multimodal Mixup Contrastive Learning for Multimodal Classification
por: Kumar, Raja, et al.
Publicado: (2024)
por: Kumar, Raja, et al.
Publicado: (2024)
MIRAGE: Towards AI-Generated Image Detection in the Wild
por: Xia, Cheng, et al.
Publicado: (2025)
por: Xia, Cheng, et al.
Publicado: (2025)
FESS Loss: Feature-Enhanced Spatial Segmentation Loss for Optimizing Medical Image Analysis
por: Chodvadiya, Charulkumar, et al.
Publicado: (2024)
por: Chodvadiya, Charulkumar, et al.
Publicado: (2024)
MIRAGE: A Multi-modal Benchmark for Spatial Perception, Reasoning, and Intelligence
por: Liu, Chonghan, et al.
Publicado: (2025)
por: Liu, Chonghan, et al.
Publicado: (2025)
MedSAGa: Few-shot Memory Efficient Medical Image Segmentation using Gradient Low-Rank Projection in SAM
por: Mahla, Navyansh, et al.
Publicado: (2024)
por: Mahla, Navyansh, et al.
Publicado: (2024)
PQV-Mobile: A Combined Pruning and Quantization Toolkit to Optimize Vision Transformers for Mobile Applications
por: Bhardwaj, Kshitij
Publicado: (2024)
por: Bhardwaj, Kshitij
Publicado: (2024)
MIRAGE: Knowledge Graph-Guided Cross-Cohort MRI Synthesis for Alzheimer's Disease Prediction
por: Wu, Guanchen, et al.
Publicado: (2026)
por: Wu, Guanchen, et al.
Publicado: (2026)
MIRAGE: A Benchmark for Multimodal Information-Seeking and Reasoning in Agricultural Expert-Guided Conversations
por: Dongre, Vardhan, et al.
Publicado: (2025)
por: Dongre, Vardhan, et al.
Publicado: (2025)
Leveraging Imperfect Medical Data: A Manifold-Consistent Spatio-Temporal Network for Sensor-based Human Activity Recognition
por: Fan, Jiangtao, et al.
Publicado: (2026)
por: Fan, Jiangtao, et al.
Publicado: (2026)
Online-Adaptive Anomaly Detection for Defect Identification in Aircraft Assembly
por: Shete, Siddhant, et al.
Publicado: (2024)
por: Shete, Siddhant, et al.
Publicado: (2024)
Towards Inclusive Face Recognition Through Synthetic Ethnicity Alteration
por: Chandaliya, Praveen Kumar, et al.
Publicado: (2024)
por: Chandaliya, Praveen Kumar, et al.
Publicado: (2024)
EmoNet-Face: An Expert-Annotated Benchmark for Synthetic Emotion Recognition
por: Schuhmann, Christoph, et al.
Publicado: (2025)
por: Schuhmann, Christoph, et al.
Publicado: (2025)
CAGE: Bridging the Accuracy-Aesthetics Gap in Educational Diagrams via Code-Anchored Generative Enhancement
por: Kukreja, Dikshant, et al.
Publicado: (2026)
por: Kukreja, Dikshant, et al.
Publicado: (2026)
Label Convergence: Defining an Upper Performance Bound in Object Recognition through Contradictory Annotations
por: Tschirschwitz, David, et al.
Publicado: (2024)
por: Tschirschwitz, David, et al.
Publicado: (2024)
Efficient Egocentric Action Recognition with Multimodal Data
por: Calzavara, Marco, et al.
Publicado: (2025)
por: Calzavara, Marco, et al.
Publicado: (2025)
Multimodal Prompt Alignment for Facial Expression Recognition
por: Ma, Fuyan, et al.
Publicado: (2025)
por: Ma, Fuyan, et al.
Publicado: (2025)
A Novel Approach to for Multimodal Emotion Recognition : Multimodal semantic information fusion
por: Dai, Wei, et al.
Publicado: (2025)
por: Dai, Wei, et al.
Publicado: (2025)
Interpretable Few-Shot Retinal Disease Diagnosis with Concept-Guided Prompting of Vision-Language Models
por: Mehta, Deval, et al.
Publicado: (2025)
por: Mehta, Deval, et al.
Publicado: (2025)
MCN-CL: Multimodal Cross-Attention Network and Contrastive Learning for Multimodal Emotion Recognition
por: Li, Feng, et al.
Publicado: (2025)
por: Li, Feng, et al.
Publicado: (2025)
A-MESS: Anchor based Multimodal Embedding with Semantic Synchronization for Multimodal Intent Recognition
por: Shen, Yaomin, et al.
Publicado: (2025)
por: Shen, Yaomin, et al.
Publicado: (2025)
Active Multimodal Distillation for Few-shot Action Recognition
por: Feng, Weijia, et al.
Publicado: (2025)
por: Feng, Weijia, et al.
Publicado: (2025)
Arabic Sign Language Recognition using Multimodal Approach
por: Alanazi, Ghadeer, et al.
Publicado: (2026)
por: Alanazi, Ghadeer, et al.
Publicado: (2026)
Multimodal Video Emotion Recognition with Reliable Reasoning Priors
por: Wang, Zhepeng, et al.
Publicado: (2025)
por: Wang, Zhepeng, et al.
Publicado: (2025)
The SA-FARI Dataset: Segment Anything in Footage of Animals for Recognition and Identification
por: Wasmuht, Dante Francisco, et al.
Publicado: (2025)
por: Wasmuht, Dante Francisco, et al.
Publicado: (2025)
BloomNet: Exploring Single vs. Multiple Object Annotation for Flower Recognition Using YOLO Variants
por: Nusrat, Safwat, et al.
Publicado: (2026)
por: Nusrat, Safwat, et al.
Publicado: (2026)
Multimodal Prototype-Enhanced Network for Few-Shot Action Recognition
por: Ni, Xinzhe, et al.
Publicado: (2022)
por: Ni, Xinzhe, et al.
Publicado: (2022)
Application of Multimodal Fusion Deep Learning Model in Disease Recognition
por: Liu, Xiaoyi, et al.
Publicado: (2024)
por: Liu, Xiaoyi, et al.
Publicado: (2024)
Multimodal Emotion Recognition with Vision-language Prompting and Modality Dropout
por: QI, Anbin, et al.
Publicado: (2024)
por: QI, Anbin, et al.
Publicado: (2024)
Aligning Vision to Language: Annotation-Free Multimodal Knowledge Graph Construction for Enhanced LLMs Reasoning
por: Liu, Junming, et al.
Publicado: (2025)
por: Liu, Junming, et al.
Publicado: (2025)
Multimodal Markup Document Models for Graphic Design Completion
por: Kikuchi, Kotaro, et al.
Publicado: (2024)
por: Kikuchi, Kotaro, et al.
Publicado: (2024)
AutoCLIP: Auto-tuning Zero-Shot Classifiers for Vision-Language Models
por: Metzen, Jan Hendrik, et al.
Publicado: (2023)
por: Metzen, Jan Hendrik, et al.
Publicado: (2023)
Visual WetlandBirds Dataset: Bird Species Identification and Behavior Recognition in Videos
por: Rodriguez-Juan, Javier, et al.
Publicado: (2025)
por: Rodriguez-Juan, Javier, et al.
Publicado: (2025)
TV-SAM: Increasing Zero-Shot Segmentation Performance on Multimodal Medical Images Using GPT-4 Generated Descriptive Prompts Without Human Annotation
por: Jiang, Zekun, et al.
Publicado: (2024)
por: Jiang, Zekun, et al.
Publicado: (2024)
Annotated Hands for Generative Models
por: Yang, Yue, et al.
Publicado: (2024)
por: Yang, Yue, et al.
Publicado: (2024)
MIRAGE: Retrieval and Generation of Multimodal Images and Texts for Medical Education
por: Benito, Miguel Diaz, et al.
Publicado: (2026)
por: Benito, Miguel Diaz, et al.
Publicado: (2026)
Multimodal Political Bias Identification and Neutralization
por: Bernard, Cedric, et al.
Publicado: (2025)
por: Bernard, Cedric, et al.
Publicado: (2025)
MPBench: A Comprehensive Multimodal Reasoning Benchmark for Process Errors Identification
por: Xu, Zhaopan, et al.
Publicado: (2025)
por: Xu, Zhaopan, et al.
Publicado: (2025)
Distilling Privileged Multimodal Information for Expression Recognition using Optimal Transport
por: Aslam, Muhammad Haseeb, et al.
Publicado: (2024)
por: Aslam, Muhammad Haseeb, et al.
Publicado: (2024)
Tangram: Benchmark for Evaluating Geometric Element Recognition in Large Multimodal Models
por: Zhang, Chao, et al.
Publicado: (2024)
por: Zhang, Chao, et al.
Publicado: (2024)
SAM for Robust Mitochondria Instance Segmentation in Fluorescence Microscopy
por: Jadhav, Suyog, et al.
Publicado: (2026)
por: Jadhav, Suyog, et al.
Publicado: (2026)
Ejemplares similares
-
Harnessing Shared Relations via Multimodal Mixup Contrastive Learning for Multimodal Classification
por: Kumar, Raja, et al.
Publicado: (2024) -
MIRAGE: Towards AI-Generated Image Detection in the Wild
por: Xia, Cheng, et al.
Publicado: (2025) -
FESS Loss: Feature-Enhanced Spatial Segmentation Loss for Optimizing Medical Image Analysis
por: Chodvadiya, Charulkumar, et al.
Publicado: (2024) -
MIRAGE: A Multi-modal Benchmark for Spatial Perception, Reasoning, and Intelligence
por: Liu, Chonghan, et al.
Publicado: (2025) -
MedSAGa: Few-shot Memory Efficient Medical Image Segmentation using Gradient Low-Rank Projection in SAM
por: Mahla, Navyansh, et al.
Publicado: (2024)