MuVaC: A Variational Causal Framework for Multimodal Sarcasm Understanding in Dialogues
Fuente:
arXiv
Saved in:
| Main Authors: | Guo, Diandian, Yuan, Fangfang, Cao, Cong, Lin, Xixun, Zhou, Chuan, Peng, Hao, Cao, Yanan, Liu, Yanbing |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Multi-View Incongruity Learning for Multimodal Sarcasm Detection
by: Guo, Diandian, et al.
Published: (2024)
by: Guo, Diandian, et al.
Published: (2024)
Can Multimodal Large Language Model Think Analogically?
by: Guo, Diandian, et al.
Published: (2024)
by: Guo, Diandian, et al.
Published: (2024)
MAD-Fact: A Multi-Agent Debate Framework for Long-Form Factuality Evaluation in LLMs
by: Ning, Yucheng, et al.
Published: (2025)
by: Ning, Yucheng, et al.
Published: (2025)
CRAFT: Calibrated Reasoning with Answer-Faithful Traces via Reinforcement Learning for Multi-Hop Question Answering
by: Liu, Yu, et al.
Published: (2026)
by: Liu, Yu, et al.
Published: (2026)
Dialogues Aspect-based Sentiment Quadruple Extraction via Structural Entropy Minimization Partitioning
by: Peng, Kun, et al.
Published: (2025)
by: Peng, Kun, et al.
Published: (2025)
PathMind: A Retrieve-Prioritize-Reason Framework for Knowledge Graph Reasoning with Large Language Models
by: Liu, Yu, et al.
Published: (2025)
by: Liu, Yu, et al.
Published: (2025)
Reliably Bounding False Positives: A Zero-Shot Machine-Generated Text Detection Framework via Multiscaled Conformal Prediction
by: Zhu, Xiaowei, et al.
Published: (2025)
by: Zhu, Xiaowei, et al.
Published: (2025)
Do LLMs Know Tool Irrelevance? Demystifying Structural Alignment Bias in Tool Invocations
by: Liu, Yilong, et al.
Published: (2026)
by: Liu, Yilong, et al.
Published: (2026)
MuSaG: A Multimodal German Sarcasm Dataset with Full-Modal Annotations
by: Scott, Aaron, et al.
Published: (2025)
by: Scott, Aaron, et al.
Published: (2025)
Trans-RAG: Query-Centric Vector Transformation for Secure Cross-Organizational Retrieval
by: Liu, Yu, et al.
Published: (2026)
by: Liu, Yu, et al.
Published: (2026)
Evidential Spectrum-Aware Contrastive Learning for OOD Detection in Dynamic Graphs
by: Sun, Nan, et al.
Published: (2025)
by: Sun, Nan, et al.
Published: (2025)
CIA: Inferring the Communication Topology from LLM-based Multi-Agent Systems
by: Wu, Yongxuan, et al.
Published: (2026)
by: Wu, Yongxuan, et al.
Published: (2026)
PRISMA: Reinforcement Learning Guided Two-Stage Policy Optimization in Multi-Agent Architecture for Open-Domain Multi-Hop Question Answering
by: Liu, Yu, et al.
Published: (2026)
by: Liu, Yu, et al.
Published: (2026)
RANA: Robust Active Learning for Noisy Network Alignment
by: Nan, Yixuan, et al.
Published: (2025)
by: Nan, Yixuan, et al.
Published: (2025)
Enhancing Large Language Model for Knowledge Graph Completion via Structure-Aware Alignment-Tuning
by: Liu, Yu, et al.
Published: (2025)
by: Liu, Yu, et al.
Published: (2025)
Evaluating Multimodal Large Language Models on Spoken Sarcasm Understanding
by: Li, Zhu, et al.
Published: (2025)
by: Li, Zhu, et al.
Published: (2025)
Can Large Vision-Language Models Understand Multimodal Sarcasm?
by: Wang, Xinyu, et al.
Published: (2025)
by: Wang, Xinyu, et al.
Published: (2025)
ProCrit: Self-Elicited Multi-Perspective Reasoning with Critic-Guided Revision for Multimodal Sarcasm Detection
by: Xu, Yingjia, et al.
Published: (2026)
by: Xu, Yingjia, et al.
Published: (2026)
OPERA: A Reinforcement Learning--Enhanced Orchestrated Planner-Executor Architecture for Reasoning-Oriented Multi-Hop Retrieval
by: Liu, Yu, et al.
Published: (2025)
by: Liu, Yu, et al.
Published: (2025)
EA-Agent: A Structured Multi-Step Reasoning Agent for Entity Alignment
by: Nan, Yixuan, et al.
Published: (2026)
by: Nan, Yixuan, et al.
Published: (2026)
Sentiment-enhanced Graph-based Sarcasm Explanation in Dialogue
by: Ouyang, Kun, et al.
Published: (2024)
by: Ouyang, Kun, et al.
Published: (2024)
AbstainGNN: Teaching Graph Neural Networks to Abstain for Graph Classification
by: Lin, Xixun, et al.
Published: (2026)
by: Lin, Xixun, et al.
Published: (2026)
SarcasmBench: Towards Evaluating Large Language Models on Sarcasm Understanding
by: Zhang, Yazhou, et al.
Published: (2024)
by: Zhang, Yazhou, et al.
Published: (2024)
Equivariant Hypergraph Diffusion for Crystal Structure Prediction
by: Liu, Yang, et al.
Published: (2025)
by: Liu, Yang, et al.
Published: (2025)
GRASP: Grounded CoT Reasoning with Dual-Stage Optimization for Multimodal Sarcasm Target Identification
by: Wan, Faxian, et al.
Published: (2026)
by: Wan, Faxian, et al.
Published: (2026)
SafeHarness: Lifecycle-Integrated Security Architecture for LLM-based Agent Deployment
by: Lin, Xixun, et al.
Published: (2026)
by: Lin, Xixun, et al.
Published: (2026)
OmniVaT: Single Domain Generalization for Multimodal Visual-Tactile Learning
by: Qiu, Liuxiang, et al.
Published: (2026)
by: Qiu, Liuxiang, et al.
Published: (2026)
Think out Loud: Emotion Deducing Explanation in Dialogues
by: Li, Jiangnan, et al.
Published: (2024)
by: Li, Jiangnan, et al.
Published: (2024)
A Survey of Multimodal Sarcasm Detection
by: Farabi, Shafkat, et al.
Published: (2024)
by: Farabi, Shafkat, et al.
Published: (2024)
Hypergraph Neural Diffusion: A PDE-Inspired Framework for Hypergraph Message Passing
by: Zhou, Zhiheng, et al.
Published: (2026)
by: Zhou, Zhiheng, et al.
Published: (2026)
Persona-centric Metamorphic Relation guided Robustness Evaluation for Multi-turn Dialogue Modelling
by: Chen, Yanbing, et al.
Published: (2024)
by: Chen, Yanbing, et al.
Published: (2024)
SemIRNet: A Semantic Irony Recognition Network for Multimodal Sarcasm Detection
by: Zhou, Jingxuan, et al.
Published: (2025)
by: Zhou, Jingxuan, et al.
Published: (2025)
V-ITI: Mitigating Hallucinations in Multimodal Large Language Models via Visual Inference-Time Intervention
by: Sun, Nan, et al.
Published: (2025)
by: Sun, Nan, et al.
Published: (2025)
Emotion Transfer with Enhanced Prototype for Unseen Emotion Recognition in Conversation
by: Peng, Kun, et al.
Published: (2025)
by: Peng, Kun, et al.
Published: (2025)
Large Language Models for Planning: A Comprehensive and Systematic Survey
by: Cao, Pengfei, et al.
Published: (2025)
by: Cao, Pengfei, et al.
Published: (2025)
Conditional Information Bottleneck for Multimodal Fusion: Overcoming Shortcut Learning in Sarcasm Detection
by: Wang, Yihua, et al.
Published: (2025)
by: Wang, Yihua, et al.
Published: (2025)
Hard Constraints Meet Soft Generation: Guaranteed Feasibility for LLM-based Combinatorial Optimization
by: Liu, Yang, et al.
Published: (2026)
by: Liu, Yang, et al.
Published: (2026)
Seeing Sarcasm Through Different Eyes: Analyzing Multimodal Sarcasm Perception in Large Vision-Language Models
by: Chen, Junjie, et al.
Published: (2025)
by: Chen, Junjie, et al.
Published: (2025)
Teaching Sarcasm: Few-Shot Multimodal Sarcasm Detection via Distillation to a Parameter-Efficient Student
by: Jana, Soumyadeep, et al.
Published: (2025)
by: Jana, Soumyadeep, et al.
Published: (2025)
CFMS: Towards Explainable and Fine-Grained Chinese Multimodal Sarcasm Detection Benchmark
by: Zhang, Junzhao, et al.
Published: (2026)
by: Zhang, Junzhao, et al.
Published: (2026)
Similar Items
-
Multi-View Incongruity Learning for Multimodal Sarcasm Detection
by: Guo, Diandian, et al.
Published: (2024) -
Can Multimodal Large Language Model Think Analogically?
by: Guo, Diandian, et al.
Published: (2024) -
MAD-Fact: A Multi-Agent Debate Framework for Long-Form Factuality Evaluation in LLMs
by: Ning, Yucheng, et al.
Published: (2025) -
CRAFT: Calibrated Reasoning with Answer-Faithful Traces via Reinforcement Learning for Multi-Hop Question Answering
by: Liu, Yu, et al.
Published: (2026) -
Dialogues Aspect-based Sentiment Quadruple Extraction via Structural Entropy Minimization Partitioning
by: Peng, Kun, et al.
Published: (2025)