Humans vs Vision-Language Models: A Unified Measure of Narrative Coherence
Fuente:
arXiv
Saved in:
| Main Authors: | Ilinykh, Nikolai, Jang, Hyewon, Lappin, Shalom, Sayeed, Asad, Loáiciga, Sharid |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Coreference as an indicator of context scope in multimodal narrative
by: Ilinykh, Nikolai, et al.
Published: (2025)
by: Ilinykh, Nikolai, et al.
Published: (2025)
Predicting Sentence Acceptability Judgments in Multimodal Contexts
by: Jang, Hyewon, et al.
Published: (2026)
by: Jang, Hyewon, et al.
Published: (2026)
A surprisal oracle for when every layer counts
by: Hong, Xudong, et al.
Published: (2024)
by: Hong, Xudong, et al.
Published: (2024)
Understanding and Analyzing Model Robustness and Knowledge-Transfer in Multilingual Neural Machine Translation using TX-Ray
by: Saxena, Vageesh, et al.
Published: (2024)
by: Saxena, Vageesh, et al.
Published: (2024)
Surprisal reveals diversity gaps in image captioning and different scorers change the story
by: Ilinykh, Nikolai, et al.
Published: (2025)
by: Ilinykh, Nikolai, et al.
Published: (2025)
Diacritic Restoration for Low-Resource Indigenous Languages: Case Study with Bribri and Cook Islands Māori
by: Coto-Solano, Rolando, et al.
Published: (2025)
by: Coto-Solano, Rolando, et al.
Published: (2025)
Generalizable Sarcasm Detection Is Just Around The Corner, Of Course!
by: Jang, Hyewon, et al.
Published: (2024)
by: Jang, Hyewon, et al.
Published: (2024)
Skeleton-based Coherence Modeling in Narratives
by: Asnani, Nishit, et al.
Published: (2026)
by: Asnani, Nishit, et al.
Published: (2026)
IllusionVQA: A Challenging Optical Illusion Dataset for Vision Language Models
by: Shahgir, Haz Sameen, et al.
Published: (2024)
by: Shahgir, Haz Sameen, et al.
Published: (2024)
Are Large Language Models Capable of Generating Human-Level Narratives?
by: Tian, Yufei, et al.
Published: (2024)
by: Tian, Yufei, et al.
Published: (2024)
Coherent Multimodal Reasoning with Iterative Self-Evaluation for Vision-Language Models
by: Luo, Wenjie, et al.
Published: (2025)
by: Luo, Wenjie, et al.
Published: (2025)
Doc-PP: Document Policy Preservation Benchmark for Large Vision-Language Models
by: Jang, Haeun, et al.
Published: (2026)
by: Jang, Haeun, et al.
Published: (2026)
UnifiedVisual: A Framework for Constructing Unified Vision-Language Datasets
by: Wang, Pengyu, et al.
Published: (2025)
by: Wang, Pengyu, et al.
Published: (2025)
SCORE: Story Coherence and Retrieval Enhancement for AI Narratives
by: Yi, Qiang, et al.
Published: (2025)
by: Yi, Qiang, et al.
Published: (2025)
IndiBias: A Benchmark Dataset to Measure Social Biases in Language Models for Indian Context
by: Sahoo, Nihar Ranjan, et al.
Published: (2024)
by: Sahoo, Nihar Ranjan, et al.
Published: (2024)
Multilingual Synopses of Movie Narratives: A Dataset for Vision-Language Story Understanding
by: Sun, Yidan, et al.
Published: (2024)
by: Sun, Yidan, et al.
Published: (2024)
Human Variability vs. Machine Consistency: A Linguistic Analysis of Texts Generated by Humans and Large Language Models
by: Zanotto, Sergio E., et al.
Published: (2024)
by: Zanotto, Sergio E., et al.
Published: (2024)
A Unified Hallucination Mitigation Framework for Large Vision-Language Models
by: Chang, Yue, et al.
Published: (2024)
by: Chang, Yue, et al.
Published: (2024)
Fine-Grained Modeling of Narrative Context: A Coherence Perspective via Retrospective Questions
by: Xu, Liyan, et al.
Published: (2024)
by: Xu, Liyan, et al.
Published: (2024)
Anatomy of a Feeling: Narrating Embodied Emotions via Large Vision-Language Models
by: Saim, Mohammad, et al.
Published: (2025)
by: Saim, Mohammad, et al.
Published: (2025)
Detecting Redundant Health Survey Questions Using Language-agnostic BERT Sentence Embedding (LaBSE)
by: Kang, Sunghoon, et al.
Published: (2024)
by: Kang, Sunghoon, et al.
Published: (2024)
GraphCheck: Multipath Fact-Checking with Entity-Relationship Graphs
by: Jeon, Hyewon, et al.
Published: (2025)
by: Jeon, Hyewon, et al.
Published: (2025)
DUAL-Bench: Measuring Over-Refusal and Robustness in Vision-Language Models
by: Ren, Kaixuan, et al.
Published: (2025)
by: Ren, Kaixuan, et al.
Published: (2025)
Mordal: Automated Pretrained Model Selection for Vision Language Models
by: He, Shiqi, et al.
Published: (2025)
by: He, Shiqi, et al.
Published: (2025)
Classifying Unreliable Narrators with Large Language Models
by: Brei, Anneliese, et al.
Published: (2025)
by: Brei, Anneliese, et al.
Published: (2025)
Narrating Causal Graphs with Large Language Models
by: Phatak, Atharva, et al.
Published: (2024)
by: Phatak, Atharva, et al.
Published: (2024)
UniEDU: A Unified Language and Vision Assistant for Education Applications
by: Chu, Zhendong, et al.
Published: (2025)
by: Chu, Zhendong, et al.
Published: (2025)
A Unified Framework and Dataset for Assessing Societal Bias in Vision-Language Models
by: Sathe, Ashutosh, et al.
Published: (2024)
by: Sathe, Ashutosh, et al.
Published: (2024)
Human vs. Machine: Behavioral Differences Between Expert Humans and Language Models in Wargame Simulations
by: Lamparth, Max, et al.
Published: (2024)
by: Lamparth, Max, et al.
Published: (2024)
MedLayBench-V: A Large-Scale Benchmark for Expert-Lay Semantic Alignment in Medical Vision Language Models
by: Jang, Han, et al.
Published: (2026)
by: Jang, Han, et al.
Published: (2026)
Grounded Concreteness: Human-Like Concreteness Sensitivity in Vision-Language Models
by: Roy, Aryan, et al.
Published: (2026)
by: Roy, Aryan, et al.
Published: (2026)
Vision-Language Models Align with Human Neural Representations in Concept Processing
by: Bavaresco, Anna, et al.
Published: (2024)
by: Bavaresco, Anna, et al.
Published: (2024)
S-GRPO: Unified Post-Training for Large Vision-Language Models
by: Yan, Yuming, et al.
Published: (2026)
by: Yan, Yuming, et al.
Published: (2026)
Are Vision-Language Models Safe in the Wild? A Meme-Based Benchmark Study
by: Lee, DongGeon, et al.
Published: (2025)
by: Lee, DongGeon, et al.
Published: (2025)
Applying Large Language Models to Characterize Public Narratives
by: Poole-Dayan, Elinor, et al.
Published: (2025)
by: Poole-Dayan, Elinor, et al.
Published: (2025)
Fine-tuning vs Prompting, Can Language Models Understand Human Values?
by: Sun, Pingwei
Published: (2024)
by: Sun, Pingwei
Published: (2024)
A Unified Spoken Language Model with Injected Emotional-Attribution Thinking for Human-like Interaction
by: Wang, Qing, et al.
Published: (2026)
by: Wang, Qing, et al.
Published: (2026)
Diagnosing Vision Language Models' Perception by Leveraging Human Methods for Color Vision Deficiencies
by: Hayashi, Kazuki, et al.
Published: (2025)
by: Hayashi, Kazuki, et al.
Published: (2025)
WildVision: Evaluating Vision-Language Models in the Wild with Human Preferences
by: Lu, Yujie, et al.
Published: (2024)
by: Lu, Yujie, et al.
Published: (2024)
CoUDA: Coherence Evaluation via Unified Data Augmentation
by: Zhu, Dawei, et al.
Published: (2024)
by: Zhu, Dawei, et al.
Published: (2024)
Similar Items
-
Coreference as an indicator of context scope in multimodal narrative
by: Ilinykh, Nikolai, et al.
Published: (2025) -
Predicting Sentence Acceptability Judgments in Multimodal Contexts
by: Jang, Hyewon, et al.
Published: (2026) -
A surprisal oracle for when every layer counts
by: Hong, Xudong, et al.
Published: (2024) -
Understanding and Analyzing Model Robustness and Knowledge-Transfer in Multilingual Neural Machine Translation using TX-Ray
by: Saxena, Vageesh, et al.
Published: (2024) -
Surprisal reveals diversity gaps in image captioning and different scorers change the story
by: Ilinykh, Nikolai, et al.
Published: (2025)