STORM: Strategic Orchestration of Modalities for Rare Event Classification
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kamboj, Payal, Banerjee, Ayan, Gupta, Sandeep K. S. |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Generating customized prompts for Zero-Shot Rare Event Medical Image Classification using LLM
par: Kamboj, Payal, et autres
Publié: (2025)
par: Kamboj, Payal, et autres
Publié: (2025)
Framework for developing and evaluating ethical collaboration between expert and machine
par: Banerjee, Ayan, et autres
Publié: (2024)
par: Banerjee, Ayan, et autres
Publié: (2024)
The Expert Knowledge combined with AI outperforms AI Alone in Seizure Onset Zone Localization using resting state fMRI
par: Kamboj, Payal, et autres
Publié: (2023)
par: Kamboj, Payal, et autres
Publié: (2023)
XAI-MeD: Explainable Knowledge Guided Neuro-Symbolic Framework for Domain Generalization and Rare Class Detection in Medical Imaging
par: Urooj, Midhat, et autres
Publié: (2026)
par: Urooj, Midhat, et autres
Publié: (2026)
Detection of Deployment Operational Deviations for Safety and Security of AI-Enabled Human-Centric Cyber Physical Systems
par: Ngabonziza, Bernard, et autres
Publié: (2026)
par: Ngabonziza, Bernard, et autres
Publié: (2026)
Human Knowledge Integrated Multi-modal Learning for Single Source Domain Generalization
par: Banerjee, Ayan, et autres
Publié: (2026)
par: Banerjee, Ayan, et autres
Publié: (2026)
EMMA: Extracting Multiple physical parameters from Multimodal Data
par: Shaikh, Farhat, et autres
Publié: (2026)
par: Shaikh, Farhat, et autres
Publié: (2026)
NEURO-GUARD: Neuro-Symbolic Generalization and Unbiased Adaptive Routing for Diagnostics -- Explainable Medical AI
par: Urooj, Midhat, et autres
Publié: (2025)
par: Urooj, Midhat, et autres
Publié: (2025)
Experience with Single Domain Generalization in Real World Medical Imaging Deployments
par: Banerjee, Ayan, et autres
Publié: (2026)
par: Banerjee, Ayan, et autres
Publié: (2026)
Single Domain Generalization in Diabetic Retinopathy: A Neuro-Symbolic Learning Approach
par: Urooj, Midhat, et autres
Publié: (2025)
par: Urooj, Midhat, et autres
Publié: (2025)
The Progression of Transformers from Language to Vision to MOT: A Literature Review on Multi-Object Tracking with Transformers
par: Kamboj, Abhi
Publié: (2024)
par: Kamboj, Abhi
Publié: (2024)
Stylistic-STORM (ST-STORM) : Perceiving the Semantic Nature of Appearance
par: Ouattara, Hamed, et autres
Publié: (2026)
par: Ouattara, Hamed, et autres
Publié: (2026)
OmniJigsaw: Enhancing Omni-Modal Reasoning via Modality-Orchestrated Reordering
par: Jia, Yiduo, et autres
Publié: (2026)
par: Jia, Yiduo, et autres
Publié: (2026)
CraftGraffiti: Exploring Human Identity with Custom Graffiti Art via Facial-Preserving Diffusion Models
par: Banerjee, Ayan, et autres
Publié: (2025)
par: Banerjee, Ayan, et autres
Publié: (2025)
STORM: Token-Efficient Long Video Understanding for Multimodal LLMs
par: Jiang, Jindong, et autres
Publié: (2025)
par: Jiang, Jindong, et autres
Publié: (2025)
Image Classification using Fuzzy Pooling in Convolutional Kolmogorov-Arnold Networks
par: Igali, Ayan, et autres
Publié: (2024)
par: Igali, Ayan, et autres
Publié: (2024)
Robust Vision Systems for Connected and Autonomous Vehicles: Security Challenges and Attack Vectors
par: Gupta, Sandeep, et autres
Publié: (2026)
par: Gupta, Sandeep, et autres
Publié: (2026)
STORM: Benchmarking Visual Rating of MLLMs with a Comprehensive Ordinal Regression Dataset
par: Wang, Jinhong, et autres
Publié: (2025)
par: Wang, Jinhong, et autres
Publié: (2025)
STORM: Segment, Track, and Object Re-Localization from a Single Image
par: Deng, Yu, et autres
Publié: (2025)
par: Deng, Yu, et autres
Publié: (2025)
STORM: Search-Guided Generative World Models for Robotic Manipulation
par: Lin, Wenjun, et autres
Publié: (2025)
par: Lin, Wenjun, et autres
Publié: (2025)
Chain of Modality: From Static Fusion to Dynamic Orchestration in Omni-MLLMs
par: Luo, Ziyang, et autres
Publié: (2026)
par: Luo, Ziyang, et autres
Publié: (2026)
TaleDiffusion: Multi-Character Story Generation with Dialogue Rendering
par: Banerjee, Ayan, et autres
Publié: (2025)
par: Banerjee, Ayan, et autres
Publié: (2025)
DocRevive: A Unified Pipeline for Document Text Restoration
par: Purkayastha, Kunal, et autres
Publié: (2026)
par: Purkayastha, Kunal, et autres
Publié: (2026)
STORM: Internalized Modeling for Spatial-Temporal Reasoning in Video-Language Models
par: Liang, Yiming, et autres
Publié: (2026)
par: Liang, Yiming, et autres
Publié: (2026)
Robult: Leveraging Redundancy and Modality Specific Features for Robust Multimodal Learning
par: Nguyen, Duy A., et autres
Publié: (2025)
par: Nguyen, Duy A., et autres
Publié: (2025)
BioVLM: Routing Prompts, Not Parameters, for Cross-Modality Generalization in Biomedical VLMs
par: Singha, Mainak, et autres
Publié: (2026)
par: Singha, Mainak, et autres
Publié: (2026)
CVD-STORM: Cross-View Video Diffusion with Spatial-Temporal Reconstruction Model for Autonomous Driving
par: Zhang, Tianrui, et autres
Publié: (2025)
par: Zhang, Tianrui, et autres
Publié: (2025)
STORM: End-to-End Referring Multi-Object Tracking in Videos
par: Lu, Zijia, et autres
Publié: (2026)
par: Lu, Zijia, et autres
Publié: (2026)
SuperEvent: Cross-Modal Learning of Event-based Keypoint Detection for SLAM
par: Burkhardt, Yannick, et autres
Publié: (2025)
par: Burkhardt, Yannick, et autres
Publié: (2025)
A Survey of IMU Based Cross-Modal Transfer Learning in Human Activity Recognition
par: Kamboj, Abhi, et autres
Publié: (2024)
par: Kamboj, Abhi, et autres
Publié: (2024)
STORM: Spatio-Temporal Reconstruction Model for Large-Scale Outdoor Scenes
par: Yang, Jiawei, et autres
Publié: (2024)
par: Yang, Jiawei, et autres
Publié: (2024)
CPS-LLM: Large Language Model based Safe Usage Plan Generator for Human-in-the-Loop Human-in-the-Plant Cyber-Physical System
par: Banerjee, Ayan, et autres
Publié: (2024)
par: Banerjee, Ayan, et autres
Publié: (2024)
EventVGGT: Exploring Cross-Modal Distillation for Consistent Event-based Depth Estimation
par: Ren, Yinrui, et autres
Publié: (2026)
par: Ren, Yinrui, et autres
Publié: (2026)
TACO-Net: Topological Signatures Triumph in 3D Object Classification
par: Ghosh, Anirban, et autres
Publié: (2025)
par: Ghosh, Anirban, et autres
Publié: (2025)
Sparsity-based background removal for STORM super-resolution images
par: Valera, Patris, et autres
Publié: (2024)
par: Valera, Patris, et autres
Publié: (2024)
Your Interest, Your Summaries: Query-Focused Long Video Summarization
par: Patel, Nirav, et autres
Publié: (2024)
par: Patel, Nirav, et autres
Publié: (2024)
Cross-Modal Mapping: Mitigating the Modality Gap for Few-Shot Image Classification
par: Yang, Xi, et autres
Publié: (2024)
par: Yang, Xi, et autres
Publié: (2024)
Bidirectional Cross-Modal Prompting for Event-Frame Asymmetric Stereo
par: Xu, Ninghui, et autres
Publié: (2026)
par: Xu, Ninghui, et autres
Publié: (2026)
GraphKD: Exploring Knowledge Distillation Towards Document Object Detection with Structured Graph Creation
par: Banerjee, Ayan, et autres
Publié: (2024)
par: Banerjee, Ayan, et autres
Publié: (2024)
A Brief Survey on Leveraging Large Scale Vision Models for Enhanced Robot Grasping
par: Kamboj, Abhi, et autres
Publié: (2024)
par: Kamboj, Abhi, et autres
Publié: (2024)
Documents similaires
-
Generating customized prompts for Zero-Shot Rare Event Medical Image Classification using LLM
par: Kamboj, Payal, et autres
Publié: (2025) -
Framework for developing and evaluating ethical collaboration between expert and machine
par: Banerjee, Ayan, et autres
Publié: (2024) -
The Expert Knowledge combined with AI outperforms AI Alone in Seizure Onset Zone Localization using resting state fMRI
par: Kamboj, Payal, et autres
Publié: (2023) -
XAI-MeD: Explainable Knowledge Guided Neuro-Symbolic Framework for Domain Generalization and Rare Class Detection in Medical Imaging
par: Urooj, Midhat, et autres
Publié: (2026) -
Detection of Deployment Operational Deviations for Safety and Security of AI-Enabled Human-Centric Cyber Physical Systems
par: Ngabonziza, Bernard, et autres
Publié: (2026)