Multimodal Learning with Augmentation Techniques for Natural Disaster Assessment
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Urse, Adrian-Dinu, Cercel, Dumitru-Clementin, Pop, Florin |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Evaluating Data Augmentation Techniques for Coffee Leaf Disease Classification
par: Gheorghiu, Adrian, et autres
Publié: (2024)
par: Gheorghiu, Adrian, et autres
Publié: (2024)
IGAff: Benchmarking Adversarial Iterative and Genetic Affine Algorithms on Deep Neural Networks
par: Echim, Sebastian-Vasile, et autres
Publié: (2025)
par: Echim, Sebastian-Vasile, et autres
Publié: (2025)
Explainability-Driven Leaf Disease Classification Using Adversarial Training and Knowledge Distillation
par: Echim, Sebastian-Vasile, et autres
Publié: (2023)
par: Echim, Sebastian-Vasile, et autres
Publié: (2023)
Investigating the Impact of Semi-Supervised Methods with Data Augmentation on Offensive Language Detection in Romanian Language
par: Nicola, Elena-Beatrice, et autres
Publié: (2024)
par: Nicola, Elena-Beatrice, et autres
Publié: (2024)
Parameter Efficient Multimodal Instruction Tuning for Romanian Vision Language Models
par: Dima, George-Andrei, et autres
Publié: (2025)
par: Dima, George-Andrei, et autres
Publié: (2025)
RoLegalGEC: Legal Domain Grammatical Error Detection and Correction Dataset for Romanian
par: Timpuriu, Mircea, et autres
Publié: (2026)
par: Timpuriu, Mircea, et autres
Publié: (2026)
Scaling Federated Learning Solutions with Kubernetes for Synthesizing Histopathology Images
par: Preda, Andrei-Alexandru, et autres
Publié: (2025)
par: Preda, Andrei-Alexandru, et autres
Publié: (2025)
Deploying Rapid Damage Assessments from sUAS Imagery for Disaster Response
par: Manzini, Thomas, et autres
Publié: (2025)
par: Manzini, Thomas, et autres
Publié: (2025)
The Factuality Tax of Diversity-Intervened Text-to-Image Generation: Benchmark and Fact-Augmented Intervention
par: Wan, Yixin, et autres
Publié: (2024)
par: Wan, Yixin, et autres
Publié: (2024)
Dataset of News Articles with Provenance Metadata for Media Relevance Assessment
par: Peterka, Tomas, et autres
Publié: (2025)
par: Peterka, Tomas, et autres
Publié: (2025)
SNIFFER: Multimodal Large Language Model for Explainable Out-of-Context Misinformation Detection
par: Qi, Peng, et autres
Publié: (2024)
par: Qi, Peng, et autres
Publié: (2024)
A Cross-Lingual Meta-Learning Method Based on Domain Adaptation for Speech Emotion Recognition
par: Ion, David-Gabriel, et autres
Publié: (2024)
par: Ion, David-Gabriel, et autres
Publié: (2024)
Air Pollution Forecasting in Bucharest
par: Şerban, Dragoş-Andrei, et autres
Publié: (2025)
par: Şerban, Dragoş-Andrei, et autres
Publié: (2025)
RadDiff: Describing Differences in Radiology Image Sets with Natural Language
par: Shen, Xiaoxian, et autres
Publié: (2026)
par: Shen, Xiaoxian, et autres
Publié: (2026)
Scientific Reasoning: Assessment of Multimodal Generative LLMs
par: Dreyer, Florian, et autres
Publié: (2025)
par: Dreyer, Florian, et autres
Publié: (2025)
RULE: Reliable Multimodal RAG for Factuality in Medical Vision Language Models
par: Xia, Peng, et autres
Publié: (2024)
par: Xia, Peng, et autres
Publié: (2024)
VideoNorms: Benchmarking Cultural Awareness of Video Language Models
par: Varimalla, Nikhil Reddy, et autres
Publié: (2025)
par: Varimalla, Nikhil Reddy, et autres
Publié: (2025)
Closing the Gap: Data-Centric Fine-Tuning of Vision Language Models for the Standardized Exam Questions
par: Sert, Egemen, et autres
Publié: (2025)
par: Sert, Egemen, et autres
Publié: (2025)
Cultural Awareness in Vision-Language Models: A Cross-Country Exploration
par: Madasu, Avinash, et autres
Publié: (2025)
par: Madasu, Avinash, et autres
Publié: (2025)
Enhancing Geo-localization for Crowdsourced Flood Imagery via LLM-Guided Attention
par: Xu, Fengyi, et autres
Publié: (2025)
par: Xu, Fengyi, et autres
Publié: (2025)
A Survey on Responsible Generative AI: What to Generate and What Not
par: Gu, Jindong
Publié: (2024)
par: Gu, Jindong
Publié: (2024)
Beyond Translation: Cross-Cultural Meme Transcreation with Vision-Language Models
par: Zhao, Yuming, et autres
Publié: (2026)
par: Zhao, Yuming, et autres
Publié: (2026)
Can MLLMs Understand the Deep Implication Behind Chinese Images?
par: Zhang, Chenhao, et autres
Publié: (2024)
par: Zhang, Chenhao, et autres
Publié: (2024)
Auditing Gender Presentation Differences in Text-to-Image Models
par: Zhang, Yanzhe, et autres
Publié: (2023)
par: Zhang, Yanzhe, et autres
Publié: (2023)
REBUS: A Robust Evaluation Benchmark of Understanding Symbols
par: Gritsevskiy, Andrew, et autres
Publié: (2024)
par: Gritsevskiy, Andrew, et autres
Publié: (2024)
A Chinese Multi-label Affective Computing Dataset Based on Social Media Network Users
par: Zhou, Jingyi, et autres
Publié: (2024)
par: Zhou, Jingyi, et autres
Publié: (2024)
Identifying Implicit Social Biases in Vision-Language Models
par: Hamidieh, Kimia, et autres
Publié: (2024)
par: Hamidieh, Kimia, et autres
Publié: (2024)
Seeing the Intangible: Survey of Image Classification into High-Level and Abstract Categories
par: Pandiani, Delfina Sol Martinez, et autres
Publié: (2023)
par: Pandiani, Delfina Sol Martinez, et autres
Publié: (2023)
Vision-Language Models under Cultural and Inclusive Considerations
par: Karamolegkou, Antonia, et autres
Publié: (2024)
par: Karamolegkou, Antonia, et autres
Publié: (2024)
Multimodal Retrieval-Augmented Generation with Large Language Models for Medical VQA
par: Karim, A H M Rezaul, et autres
Publié: (2025)
par: Karim, A H M Rezaul, et autres
Publié: (2025)
MRAG-Bench: Vision-Centric Evaluation for Retrieval-Augmented Multimodal Models
par: Hu, Wenbo, et autres
Publié: (2024)
par: Hu, Wenbo, et autres
Publié: (2024)
SaRoHead: Detecting Satire in a Multi-Domain Romanian News Headline Dataset
par: Vîrlan, Mihnea-Alexandru, et autres
Publié: (2025)
par: Vîrlan, Mihnea-Alexandru, et autres
Publié: (2025)
Investigating Large Language Models for Complex Word Identification in Multilingual and Multidomain Setups
par: Smădu, Răzvan-Alexandru, et autres
Publié: (2024)
par: Smădu, Răzvan-Alexandru, et autres
Publié: (2024)
Prompt4Trust: A Reinforcement Learning Prompt Augmentation Framework for Clinically-Aligned Confidence Calibration in Multimodal Large Language Models
par: Kriz, Anita, et autres
Publié: (2025)
par: Kriz, Anita, et autres
Publié: (2025)
Toward Robust Multimodal Learning using Multimodal Foundational Models
par: Zhao, Xianbing, et autres
Publié: (2024)
par: Zhao, Xianbing, et autres
Publié: (2024)
ZeroNLG: Aligning and Autoencoding Domains for Zero-Shot Multimodal and Multilingual Natural Language Generation
par: Yang, Bang, et autres
Publié: (2023)
par: Yang, Bang, et autres
Publié: (2023)
Intelligent Systems in Neuroimaging: Pioneering AI Techniques for Brain Tumor Detection
par: Islam, Md. Mohaiminul, et autres
Publié: (2025)
par: Islam, Md. Mohaiminul, et autres
Publié: (2025)
Lost in Translation? Translation Errors and Challenges for Fair Assessment of Text-to-Image Models on Multilingual Concepts
par: Saxon, Michael, et autres
Publié: (2024)
par: Saxon, Michael, et autres
Publié: (2024)
BYO-Eval: Build Your Own Dataset for Fine-Grained Visual Assessment of Multimodal Language Models
par: Arnould, Ludovic, et autres
Publié: (2025)
par: Arnould, Ludovic, et autres
Publié: (2025)
Labels or Input? Rethinking Augmentation in Multimodal Hate Detection
par: Singh, Sahajpreet, et autres
Publié: (2025)
par: Singh, Sahajpreet, et autres
Publié: (2025)
Documents similaires
-
Evaluating Data Augmentation Techniques for Coffee Leaf Disease Classification
par: Gheorghiu, Adrian, et autres
Publié: (2024) -
IGAff: Benchmarking Adversarial Iterative and Genetic Affine Algorithms on Deep Neural Networks
par: Echim, Sebastian-Vasile, et autres
Publié: (2025) -
Explainability-Driven Leaf Disease Classification Using Adversarial Training and Knowledge Distillation
par: Echim, Sebastian-Vasile, et autres
Publié: (2023) -
Investigating the Impact of Semi-Supervised Methods with Data Augmentation on Offensive Language Detection in Romanian Language
par: Nicola, Elena-Beatrice, et autres
Publié: (2024) -
Parameter Efficient Multimodal Instruction Tuning for Romanian Vision Language Models
par: Dima, George-Andrei, et autres
Publié: (2025)