MultiClimate: Multimodal Stance Detection on Climate Change Videos
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Jiawen, Zuo, Longfei, Peng, Siyao, Plank, Barbara |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
EVADE: LLM-Based Explanation Generation and Validation for Error Detection in NLI
por: Zuo, Longfei, et al.
Publicado: (2025)
por: Zuo, Longfei, et al.
Publicado: (2025)
Two Stage Context Learning with Large Language Models for Multimodal Stance Detection on Climate Change
por: Pangtey, Lata, et al.
Publicado: (2025)
por: Pangtey, Lata, et al.
Publicado: (2025)
CLIMATELI: Evaluating Entity Linking on Climate Change Data
por: Zhou, Shijia, et al.
Publicado: (2024)
por: Zhou, Shijia, et al.
Publicado: (2024)
UniChange: Unifying Change Detection with Multimodal Large Language Model
por: Zhang, Xu, et al.
Publicado: (2025)
por: Zhang, Xu, et al.
Publicado: (2025)
Support or Refute: Analyzing the Stance of Evidence to Detect Out-of-Context Mis- and Disinformation
por: Yuan, Xin, et al.
Publicado: (2023)
por: Yuan, Xin, et al.
Publicado: (2023)
What Media Frames Reveal About Stance: A Dataset and Study about Memes in Climate Change Discourse
por: Zhou, Shijia, et al.
Publicado: (2025)
por: Zhou, Shijia, et al.
Publicado: (2025)
Mind the Uncertainty in Human Disagreement: Evaluating Discrepancies between Model Predictions and Human Responses in VQA
por: Lan, Jian, et al.
Publicado: (2024)
por: Lan, Jian, et al.
Publicado: (2024)
ClimateViz: A Benchmark for Statistical Reasoning and Fact Verification on Scientific Charts
por: Su, Ruiran, et al.
Publicado: (2025)
por: Su, Ruiran, et al.
Publicado: (2025)
Inter-Stance: A Dyadic Multimodal Corpus for Conversational Stance Analysis
por: Zhang, Xiang, et al.
Publicado: (2026)
por: Zhang, Xiang, et al.
Publicado: (2026)
Towards Effective Long-Video Event Prediction via Multi-Level Event Semantics Mining
por: Peng, Bo, et al.
Publicado: (2026)
por: Peng, Bo, et al.
Publicado: (2026)
Thinking with Video: Video Generation as a Promising Multimodal Reasoning Paradigm
por: Tong, Jingqi, et al.
Publicado: (2025)
por: Tong, Jingqi, et al.
Publicado: (2025)
Mono-InternVL: Pushing the Boundaries of Monolithic Multimodal Large Language Models with Endogenous Visual Pre-training
por: Luo, Gen, et al.
Publicado: (2024)
por: Luo, Gen, et al.
Publicado: (2024)
Mavors: Multi-granularity Video Representation for Multimodal Large Language Model
por: Shi, Yang, et al.
Publicado: (2025)
por: Shi, Yang, et al.
Publicado: (2025)
From Long Videos to Engaging Clips: A Human-Inspired Video Editing Framework with Multimodal Narrative Understanding
por: Wang, Xiangfeng, et al.
Publicado: (2025)
por: Wang, Xiangfeng, et al.
Publicado: (2025)
Towards Patronizing and Condescending Language in Chinese Videos: A Multimodal Dataset and Detector
por: Wang, Hongbo, et al.
Publicado: (2024)
por: Wang, Hongbo, et al.
Publicado: (2024)
OmChat: A Recipe to Train Multimodal Language Models with Strong Long Context and Video Understanding
por: Zhao, Tiancheng, et al.
Publicado: (2024)
por: Zhao, Tiancheng, et al.
Publicado: (2024)
Video-MMMU: Evaluating Knowledge Acquisition from Multi-Discipline Professional Videos
por: Hu, Kairui, et al.
Publicado: (2025)
por: Hu, Kairui, et al.
Publicado: (2025)
IV-Bench: A Benchmark for Image-Grounded Video Perception and Reasoning in Multimodal LLMs
por: Ma, David, et al.
Publicado: (2025)
por: Ma, David, et al.
Publicado: (2025)
Multimodal Abstractive Summarization of Instructional Videos with Vision-Language Models
por: Nazir, Maham, et al.
Publicado: (2026)
por: Nazir, Maham, et al.
Publicado: (2026)
A Culturally-diverse Multilingual Multimodal Video Benchmark & Model
por: Shafique, Bhuiyan Sanjid, et al.
Publicado: (2025)
por: Shafique, Bhuiyan Sanjid, et al.
Publicado: (2025)
MUSEG: Reinforcing Video Temporal Understanding via Timestamp-Aware Multi-Segment Grounding
por: Luo, Fuwen, et al.
Publicado: (2025)
por: Luo, Fuwen, et al.
Publicado: (2025)
VideoStudio: Generating Consistent-Content and Multi-Scene Videos
por: Long, Fuchen, et al.
Publicado: (2024)
por: Long, Fuchen, et al.
Publicado: (2024)
RefereeBench: Are Video MLLMs Ready to be Multi-Sport Referees
por: Xu, Yichen, et al.
Publicado: (2026)
por: Xu, Yichen, et al.
Publicado: (2026)
VidCoM: Fast Video Comprehension through Large Language Models with Multimodal Tools
por: Qi, Ji, et al.
Publicado: (2023)
por: Qi, Ji, et al.
Publicado: (2023)
VLMT: Vision-Language Multimodal Transformer for Multimodal Multi-hop Question Answering
por: Lim, Qi Zhi, et al.
Publicado: (2025)
por: Lim, Qi Zhi, et al.
Publicado: (2025)
Jailbreaking Multimodal Large Language Models using Multi-Clip Video
por: Kang, Choongwon, et al.
Publicado: (2026)
por: Kang, Choongwon, et al.
Publicado: (2026)
Harmfully Manipulated Images Matter in Multimodal Misinformation Detection
por: Wang, Bing, et al.
Publicado: (2024)
por: Wang, Bing, et al.
Publicado: (2024)
Understanding Multimodal Procedural Knowledge by Sequencing Multimodal Instructional Manuals
por: Wu, Te-Lin, et al.
Publicado: (2021)
por: Wu, Te-Lin, et al.
Publicado: (2021)
MultiMat: Multimodal Program Synthesis for Procedural Materials using Large Multimodal Models
por: Belouadi, Jonas, et al.
Publicado: (2025)
por: Belouadi, Jonas, et al.
Publicado: (2025)
Online Misinformation Detection in Live Streaming Videos
por: Cao, Rui
Publicado: (2025)
por: Cao, Rui
Publicado: (2025)
Integrating Video and Text: A Balanced Approach to Multimodal Summary Generation and Evaluation
por: Pennec, Galann, et al.
Publicado: (2025)
por: Pennec, Galann, et al.
Publicado: (2025)
Probabilistic Concept Graph Reasoning for Multimodal Misinformation Detection
por: Yang, Ruichao, et al.
Publicado: (2026)
por: Yang, Ruichao, et al.
Publicado: (2026)
Insight-A: Attribution-aware for Multimodal Misinformation Detection
por: Wu, Junjie, et al.
Publicado: (2025)
por: Wu, Junjie, et al.
Publicado: (2025)
Unlocking Exocentric Video-Language Data for Egocentric Video Representation Learning
por: Dou, Zi-Yi, et al.
Publicado: (2024)
por: Dou, Zi-Yi, et al.
Publicado: (2024)
Video-MME: The First-Ever Comprehensive Evaluation Benchmark of Multi-modal LLMs in Video Analysis
por: Fu, Chaoyou, et al.
Publicado: (2024)
por: Fu, Chaoyou, et al.
Publicado: (2024)
Chitranuvad: Adapting Multi-Lingual LLMs for Multimodal Translation
por: Khan, Shaharukh, et al.
Publicado: (2025)
por: Khan, Shaharukh, et al.
Publicado: (2025)
MMDuet2: Enhancing Proactive Interaction of Video MLLMs with Multi-Turn Reinforcement Learning
por: Wang, Yueqian, et al.
Publicado: (2025)
por: Wang, Yueqian, et al.
Publicado: (2025)
Exploring the Role of Explicit Temporal Modeling in Multimodal Large Language Models for Video Understanding
por: Li, Yun, et al.
Publicado: (2025)
por: Li, Yun, et al.
Publicado: (2025)
MMR-V: What's Left Unsaid? A Benchmark for Multimodal Deep Reasoning in Videos
por: Zhu, Kejian, et al.
Publicado: (2025)
por: Zhu, Kejian, et al.
Publicado: (2025)
ToxVidLM: A Multimodal Framework for Toxicity Detection in Code-Mixed Videos
por: Maity, Krishanu, et al.
Publicado: (2024)
por: Maity, Krishanu, et al.
Publicado: (2024)
Ejemplares similares
-
EVADE: LLM-Based Explanation Generation and Validation for Error Detection in NLI
por: Zuo, Longfei, et al.
Publicado: (2025) -
Two Stage Context Learning with Large Language Models for Multimodal Stance Detection on Climate Change
por: Pangtey, Lata, et al.
Publicado: (2025) -
CLIMATELI: Evaluating Entity Linking on Climate Change Data
por: Zhou, Shijia, et al.
Publicado: (2024) -
UniChange: Unifying Change Detection with Multimodal Large Language Model
por: Zhang, Xu, et al.
Publicado: (2025) -
Support or Refute: Analyzing the Stance of Evidence to Detect Out-of-Context Mis- and Disinformation
por: Yuan, Xin, et al.
Publicado: (2023)