VisEval: A Benchmark for Data Visualization in the Era of Large Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Chen, Nan, Zhang, Yuge, Xu, Jiahang, Ren, Kan, Yang, Yuqing |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Prompt Orchestration Markup Language
by: Zhang, Yuge, et al.
Published: (2025)
by: Zhang, Yuge, et al.
Published: (2025)
Prompt4Vis: Prompting Large Language Models with Example Mining and Schema Filtering for Tabular Data Visualization
by: Li, Shuaimin, et al.
Published: (2024)
by: Li, Shuaimin, et al.
Published: (2024)
ChatVis: Automating Scientific Visualization with a Large Language Model
by: Mallick, Tanwi, et al.
Published: (2024)
by: Mallick, Tanwi, et al.
Published: (2024)
Do Text-to-Vis Benchmarks Test Real Use of Visualisations?
by: Nguyen, Hy, et al.
Published: (2024)
by: Nguyen, Hy, et al.
Published: (2024)
Augmenting a Large Language Model with a Combination of Text and Visual Data for Conversational Visualization of Global Geospatial Data
by: Mena, Omar, et al.
Published: (2025)
by: Mena, Omar, et al.
Published: (2025)
Dialogue Language Model with Large-Scale Persona Data Engineering
by: Hong, Mengze, et al.
Published: (2024)
by: Hong, Mengze, et al.
Published: (2024)
Inadequacies of Large Language Model Benchmarks in the Era of Generative Artificial Intelligence
by: McIntosh, Timothy R., et al.
Published: (2024)
by: McIntosh, Timothy R., et al.
Published: (2024)
ChatVis: Large Language Model Agent for Generating Scientific Visualizations
by: Peterka, Tom, et al.
Published: (2025)
by: Peterka, Tom, et al.
Published: (2025)
MHSafeEval: Role-Aware Interaction-Level Evaluation of Mental Health Safety in Large Language Models
by: Lee, Suhyun, et al.
Published: (2026)
by: Lee, Suhyun, et al.
Published: (2026)
Word Synchronization Challenge: A Benchmark for Word Association Responses for Large Language Models
by: Cazalets, Tanguy, et al.
Published: (2025)
by: Cazalets, Tanguy, et al.
Published: (2025)
LalaEval: A Holistic Human Evaluation Framework for Domain-Specific Large Language Models
by: Sun, Chongyan, et al.
Published: (2024)
by: Sun, Chongyan, et al.
Published: (2024)
VeriLLMed: Interactive Visual Debugging of Medical Large Language Models with Knowledge Graphs
by: Xiang, Yurui, et al.
Published: (2026)
by: Xiang, Yurui, et al.
Published: (2026)
EvalLM: Interactive Evaluation of Large Language Model Prompts on User-Defined Criteria
by: Kim, Tae Soo, et al.
Published: (2023)
by: Kim, Tae Soo, et al.
Published: (2023)
Exploring the Efficacy of Large Language Models in Summarizing Mental Health Counseling Sessions: A Benchmark Study
by: Adhikary, Prottay Kumar, et al.
Published: (2024)
by: Adhikary, Prottay Kumar, et al.
Published: (2024)
A Systematic Review on Prompt Engineering in Large Language Models for K-12 STEM Education
by: Chen, Eason, et al.
Published: (2024)
by: Chen, Eason, et al.
Published: (2024)
Large Language Model-based Human-Agent Collaboration for Complex Task Solving
by: Feng, Xueyang, et al.
Published: (2024)
by: Feng, Xueyang, et al.
Published: (2024)
JailbreakLens: Visual Analysis of Jailbreak Attacks Against Large Language Models
by: Feng, Yingchaojie, et al.
Published: (2024)
by: Feng, Yingchaojie, et al.
Published: (2024)
Social Skill Training with Large Language Models
by: Yang, Diyi, et al.
Published: (2024)
by: Yang, Diyi, et al.
Published: (2024)
GerontoVis: Data Visualization at the Confluence of Aging
by: While, Zack, et al.
Published: (2024)
by: While, Zack, et al.
Published: (2024)
ReactGenie: A Development Framework for Complex Multimodal Interactions Using Large Language Models
by: Yang, Jackie Junrui, et al.
Published: (2023)
by: Yang, Jackie Junrui, et al.
Published: (2023)
Low-code LLM: Graphical User Interface over Large Language Models
by: Cai, Yuzhe, et al.
Published: (2023)
by: Cai, Yuzhe, et al.
Published: (2023)
Exploring the Impact of Personality Traits on Conversational Recommender Systems: A Simulation with Large Language Models
by: Zhao, Xiaoyan, et al.
Published: (2025)
by: Zhao, Xiaoyan, et al.
Published: (2025)
Captioning Visualizations with Large Language Models (CVLLM): A Tutorial
by: Carenini, Giuseppe, et al.
Published: (2024)
by: Carenini, Giuseppe, et al.
Published: (2024)
OPRA-Vis: Visual Analytics System to Assist Organization-Public Relationship Assessment with Large Language Models
by: Yoo, Sangbong, et al.
Published: (2025)
by: Yoo, Sangbong, et al.
Published: (2025)
GistVis: Automatic Generation of Word-scale Visualizations from Data-rich Documents
by: Zou, Ruishi, et al.
Published: (2025)
by: Zou, Ruishi, et al.
Published: (2025)
KEditVis: A Visual Analytics System for Knowledge Editing of Large Language Models
by: Chen, Zhenning, et al.
Published: (2026)
by: Chen, Zhenning, et al.
Published: (2026)
When Large Language Models are Reliable for Judging Empathic Communication
by: Kumar, Aakriti, et al.
Published: (2025)
by: Kumar, Aakriti, et al.
Published: (2025)
WinClick: GUI Grounding with Multimodal Large Language Models
by: Hui, Zheng, et al.
Published: (2025)
by: Hui, Zheng, et al.
Published: (2025)
SciDaSynth: Interactive Structured Data Extraction from Scientific Literature with Large Language Model
by: Wang, Xingbo, et al.
Published: (2024)
by: Wang, Xingbo, et al.
Published: (2024)
WundtGPT: Shaping Large Language Models To Be An Empathetic, Proactive Psychologist
by: Ren, Chenyu, et al.
Published: (2024)
by: Ren, Chenyu, et al.
Published: (2024)
Are Humans as Brittle as Large Language Models?
by: Li, Jiahui, et al.
Published: (2025)
by: Li, Jiahui, et al.
Published: (2025)
Visualization Literacy of Multimodal Large Language Models: A Comparative Study
by: Li, Zhimin, et al.
Published: (2024)
by: Li, Zhimin, et al.
Published: (2024)
VisPile: A Visual Analytics System for Analyzing Multiple Text Documents With Large Language Models and Knowledge Graphs
by: Coscia, Adam, et al.
Published: (2025)
by: Coscia, Adam, et al.
Published: (2025)
AutoTutor meets Large Language Models: A Language Model Tutor with Rich Pedagogy and Guardrails
by: Chowdhury, Sankalan Pal, et al.
Published: (2024)
by: Chowdhury, Sankalan Pal, et al.
Published: (2024)
MisVisFix: An Interactive Dashboard for Detecting, Explaining, and Correcting Misleading Visualizations using Large Language Models
by: Das, Amit Kumar, et al.
Published: (2025)
by: Das, Amit Kumar, et al.
Published: (2025)
Screen Reader Programmers in the Vibe Coding Era: Adaptation, Empowerment, and New Accessibility Landscape
by: Chen, Nan, et al.
Published: (2025)
by: Chen, Nan, et al.
Published: (2025)
GestureGPT: Toward Zero-Shot Free-Form Hand Gesture Understanding with Large Language Model Agents
by: Zeng, Xin, et al.
Published: (2023)
by: Zeng, Xin, et al.
Published: (2023)
Story Ribbons: Reimagining Storyline Visualizations with Large Language Models
by: Yeh, Catherine, et al.
Published: (2025)
by: Yeh, Catherine, et al.
Published: (2025)
Large Language Models Pass the Turing Test
by: Jones, Cameron R., et al.
Published: (2025)
by: Jones, Cameron R., et al.
Published: (2025)
Exploring the Potential of Large Language Models for Estimating the Reading Comprehension Question Difficulty
by: Jain, Yoshee, et al.
Published: (2025)
by: Jain, Yoshee, et al.
Published: (2025)
Similar Items
-
Prompt Orchestration Markup Language
by: Zhang, Yuge, et al.
Published: (2025) -
Prompt4Vis: Prompting Large Language Models with Example Mining and Schema Filtering for Tabular Data Visualization
by: Li, Shuaimin, et al.
Published: (2024) -
ChatVis: Automating Scientific Visualization with a Large Language Model
by: Mallick, Tanwi, et al.
Published: (2024) -
Do Text-to-Vis Benchmarks Test Real Use of Visualisations?
by: Nguyen, Hy, et al.
Published: (2024) -
Augmenting a Large Language Model with a Combination of Text and Visual Data for Conversational Visualization of Global Geospatial Data
by: Mena, Omar, et al.
Published: (2025)