Semantic Matters: Multimodal Features for Affective Analysis
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Hallmen, Tobias, Kampa, Robin-Nico, Deuser, Fabian, Oswald, Norbert, André, Elisabeth |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ViewSparsifier: Killing Redundancy in Multi-View Plant Phenotyping
par: Kampa, Robin-Nico, et autres
Publié: (2025)
par: Kampa, Robin-Nico, et autres
Publié: (2025)
Unimodal Multi-Task Fusion for Emotional Mimicry Intensity Prediction
par: Hallmen, Tobias, et autres
Publié: (2024)
par: Hallmen, Tobias, et autres
Publié: (2024)
1GC-7RC: One Graphic Card -- Seven Research Challenges! How Good Are AI Agents at Doing Your Job?
par: Kampa, Robin-Nico, et autres
Publié: (2026)
par: Kampa, Robin-Nico, et autres
Publié: (2026)
Multimodal Fusion with Pre-Trained Model Features in Affective Behaviour Analysis In-the-wild
par: Wen, Zhuofan, et autres
Publié: (2024)
par: Wen, Zhuofan, et autres
Publié: (2024)
Image Matters: A New Dataset and Empirical Study for Multimodal Hyperbole Detection
par: Zhang, Huixuan, et autres
Publié: (2023)
par: Zhang, Huixuan, et autres
Publié: (2023)
KGAlign: Joint Semantic-Structural Knowledge Encoding for Multimodal Fake News Detection
par: La, Tuan-Vinh, et autres
Publié: (2025)
par: La, Tuan-Vinh, et autres
Publié: (2025)
Enhancing Few-Shot Vision-Language Classification with Large Multimodal Model Features
par: Mitra, Chancharik, et autres
Publié: (2024)
par: Mitra, Chancharik, et autres
Publié: (2024)
MANTA: Cross-Modal Semantic Alignment and Information-Theoretic Optimization for Long-form Multimodal Understanding
par: Zhong, Ziqi, et autres
Publié: (2025)
par: Zhong, Ziqi, et autres
Publié: (2025)
Enhancing Contrastive Learning for Geolocalization by Discovering Hard Negatives on Semivariograms
par: Chen, Boyi, et autres
Publié: (2025)
par: Chen, Boyi, et autres
Publié: (2025)
Xiaoice: Training-Free Video Understanding via Self-Supervised Spatio-Temporal Clustering of Semantic Features
par: Ji, Shihao, et autres
Publié: (2025)
par: Ji, Shihao, et autres
Publié: (2025)
Multimodal LLM-Guided Semantic Correction in Text-to-Image Diffusion
par: Lv, Zheqi, et autres
Publié: (2025)
par: Lv, Zheqi, et autres
Publié: (2025)
Multimodal LLMs Struggle with Basic Visual Network Analysis: a VNA Benchmark
par: Williams, Evan M., et autres
Publié: (2024)
par: Williams, Evan M., et autres
Publié: (2024)
Evaluating LLM -- Generated Multimodal Diagnosis from Medical Images and Symptom Analysis
par: Panagoulias, Dimitrios P., et autres
Publié: (2024)
par: Panagoulias, Dimitrios P., et autres
Publié: (2024)
Beyond Unimodal Boundaries: Generative Recommendation with Multimodal Semantics
par: Zhu, Jing, et autres
Publié: (2025)
par: Zhu, Jing, et autres
Publié: (2025)
Locality-Sensitive Hashing for Efficient Hard Negative Sampling in Contrastive Learning
par: Deuser, Fabian, et autres
Publié: (2025)
par: Deuser, Fabian, et autres
Publié: (2025)
A Chinese Multi-label Affective Computing Dataset Based on Social Media Network Users
par: Zhou, Jingyi, et autres
Publié: (2024)
par: Zhou, Jingyi, et autres
Publié: (2024)
Toward Robust Multimodal Learning using Multimodal Foundational Models
par: Zhao, Xianbing, et autres
Publié: (2024)
par: Zhao, Xianbing, et autres
Publié: (2024)
Tone Matters: The Impact of Linguistic Tone on Hallucination in VLMs
par: Hong, Weihao, et autres
Publié: (2026)
par: Hong, Weihao, et autres
Publié: (2026)
Panoptic Vision-Language Feature Fields
par: Chen, Haoran, et autres
Publié: (2023)
par: Chen, Haoran, et autres
Publié: (2023)
ViewSAM: Learning View-aware Cross-modal Semantics for Weakly Supervised Cross-view Referring Multi-Object Tracking
par: Ge, Jiawei, et autres
Publié: (2026)
par: Ge, Jiawei, et autres
Publié: (2026)
Semantic Map-based Generation of Navigation Instructions
par: Li, Chengzu, et autres
Publié: (2024)
par: Li, Chengzu, et autres
Publié: (2024)
E$^2$AT: Multimodal Jailbreak Defense via Dynamic Joint Optimization for Multimodal Large Language Models
par: Lu, Liming, et autres
Publié: (2025)
par: Lu, Liming, et autres
Publié: (2025)
Personalizing Multimodal Large Language Models for Image Captioning: An Experimental Analysis
par: Bucciarelli, Davide, et autres
Publié: (2024)
par: Bucciarelli, Davide, et autres
Publié: (2024)
Focus Matters: Phase-Aware Suppression for Hallucination in Vision-Language Models
par: Kim, Sohyeon, et autres
Publié: (2026)
par: Kim, Sohyeon, et autres
Publié: (2026)
Uncertainty Quantification for Multimodal Large Language Models with Incoherence-adjusted Semantic Volume
par: Lau, Gregory Kang Ruey, et autres
Publié: (2026)
par: Lau, Gregory Kang Ruey, et autres
Publié: (2026)
Multimodal Evaluation of Russian-language Architectures
par: Chervyakov, Artem, et autres
Publié: (2025)
par: Chervyakov, Artem, et autres
Publié: (2025)
Graphic Design with Large Multimodal Model
par: Cheng, Yutao, et autres
Publié: (2024)
par: Cheng, Yutao, et autres
Publié: (2024)
A Multimodal Automated Interpretability Agent
par: Shaham, Tamar Rott, et autres
Publié: (2024)
par: Shaham, Tamar Rott, et autres
Publié: (2024)
Large Multimodal Agents: A Survey
par: Xie, Junlin, et autres
Publié: (2024)
par: Xie, Junlin, et autres
Publié: (2024)
UMBRAE: Unified Multimodal Brain Decoding
par: Xia, Weihao, et autres
Publié: (2024)
par: Xia, Weihao, et autres
Publié: (2024)
Semantically-Prompted Language Models Improve Visual Descriptions
par: Ogezi, Michael, et autres
Publié: (2023)
par: Ogezi, Michael, et autres
Publié: (2023)
MindGYM: What Matters in Question Synthesis for Thinking-Centric Fine-Tuning?
par: Xu, Zhe, et autres
Publié: (2025)
par: Xu, Zhe, et autres
Publié: (2025)
Scientific Reasoning: Assessment of Multimodal Generative LLMs
par: Dreyer, Florian, et autres
Publié: (2025)
par: Dreyer, Florian, et autres
Publié: (2025)
Hierarchy-Aware Multimodal Unlearning for Medical AI
par: Wu, Fengli, et autres
Publié: (2025)
par: Wu, Fengli, et autres
Publié: (2025)
Token Sequence Compression for Efficient Multimodal Computing
par: Omri, Yasmine, et autres
Publié: (2025)
par: Omri, Yasmine, et autres
Publié: (2025)
Generative Universal Verifier as Multimodal Meta-Reasoner
par: Zhang, Xinchen, et autres
Publié: (2025)
par: Zhang, Xinchen, et autres
Publié: (2025)
Keyword-Oriented Multimodal Modeling for Euphemism Identification
par: Hu, Yuxue, et autres
Publié: (2025)
par: Hu, Yuxue, et autres
Publié: (2025)
Nearest Neighbor Normalization Improves Multimodal Retrieval
par: Chowdhury, Neil, et autres
Publié: (2024)
par: Chowdhury, Neil, et autres
Publié: (2024)
Multimodal Chain-of-Thought Reasoning in Language Models
par: Zhang, Zhuosheng, et autres
Publié: (2023)
par: Zhang, Zhuosheng, et autres
Publié: (2023)
Multimodal Fact-Level Attribution for Verifiable Reasoning
par: Wan, David, et autres
Publié: (2026)
par: Wan, David, et autres
Publié: (2026)
Documents similaires
-
ViewSparsifier: Killing Redundancy in Multi-View Plant Phenotyping
par: Kampa, Robin-Nico, et autres
Publié: (2025) -
Unimodal Multi-Task Fusion for Emotional Mimicry Intensity Prediction
par: Hallmen, Tobias, et autres
Publié: (2024) -
1GC-7RC: One Graphic Card -- Seven Research Challenges! How Good Are AI Agents at Doing Your Job?
par: Kampa, Robin-Nico, et autres
Publié: (2026) -
Multimodal Fusion with Pre-Trained Model Features in Affective Behaviour Analysis In-the-wild
par: Wen, Zhuofan, et autres
Publié: (2024) -
Image Matters: A New Dataset and Empirical Study for Multimodal Hyperbole Detection
par: Zhang, Huixuan, et autres
Publié: (2023)