StructChart: On the Schema, Metric, and Augmentation for Visual Chart Understanding
Fuente:
arXiv
Salvato in:
| Autori principali: | Xia, Renqiu, Peng, Haoyang, Ye, Hancheng, Li, Mingsheng, Yan, Xiangchao, Ye, Peng, Shi, Botian, Qiao, Yu, Yan, Junchi, Zhang, Bo |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ChartX & ChartVLM: A Versatile Benchmark and Foundation Model for Complicated Chart Reasoning
di: Xia, Renqiu, et al.
Pubblicazione: (2024)
di: Xia, Renqiu, et al.
Pubblicazione: (2024)
Training-Free Adaptive Diffusion with Bounded Difference Approximation Strategy
di: Ye, Hancheng, et al.
Pubblicazione: (2024)
di: Ye, Hancheng, et al.
Pubblicazione: (2024)
GeoX: Geometric Problem Solving Through Unified Formalized Vision-Language Pre-training
di: Xia, Renqiu, et al.
Pubblicazione: (2024)
di: Xia, Renqiu, et al.
Pubblicazione: (2024)
SPOT: Scalable 3D Pre-training via Occupancy Prediction for Learning Transferable 3D Representations
di: Yan, Xiangchao, et al.
Pubblicazione: (2023)
di: Yan, Xiangchao, et al.
Pubblicazione: (2023)
ReSimAD: Zero-Shot 3D Domain Transfer for Autonomous Driving with Source Reconstruction and Target Simulation
di: Zhang, Bo, et al.
Pubblicazione: (2023)
di: Zhang, Bo, et al.
Pubblicazione: (2023)
Once for Both: Single Stage of Importance and Sparsity Search for Vision Transformer Compression
di: Ye, Hancheng, et al.
Pubblicazione: (2024)
di: Ye, Hancheng, et al.
Pubblicazione: (2024)
DocGenome: An Open Large-scale Scientific Document Benchmark for Training and Testing Multi-modal Large Language Models
di: Xia, Renqiu, et al.
Pubblicazione: (2024)
di: Xia, Renqiu, et al.
Pubblicazione: (2024)
TinyChart: Efficient Chart Understanding with Visual Token Merging and Program-of-Thoughts Learning
di: Zhang, Liang, et al.
Pubblicazione: (2024)
di: Zhang, Liang, et al.
Pubblicazione: (2024)
ChartAct: A Benchmark for Dynamic Chart Understanding
di: Huang, Muye, et al.
Pubblicazione: (2026)
di: Huang, Muye, et al.
Pubblicazione: (2026)
ChartAssisstant: A Universal Chart Multimodal Language Model via Chart-to-Table Pre-training and Multitask Instruction Tuning
di: Meng, Fanqing, et al.
Pubblicazione: (2024)
di: Meng, Fanqing, et al.
Pubblicazione: (2024)
On the Evaluation and Refinement of Vision-Language Instruction Tuning Datasets
di: Liao, Ning, et al.
Pubblicazione: (2023)
di: Liao, Ning, et al.
Pubblicazione: (2023)
Visual Programmability: A Guide for Code-as-Thought in Chart Understanding
di: Tang, Bohao, et al.
Pubblicazione: (2025)
di: Tang, Bohao, et al.
Pubblicazione: (2025)
ChartGalaxy: A Dataset for Infographic Chart Understanding and Generation
di: Li, Zhen, et al.
Pubblicazione: (2025)
di: Li, Zhen, et al.
Pubblicazione: (2025)
ChartReformer: Natural Language-Driven Chart Image Editing
di: Yan, Pengyu, et al.
Pubblicazione: (2024)
di: Yan, Pengyu, et al.
Pubblicazione: (2024)
ChartSketcher: Reasoning with Multimodal Feedback and Reflection for Chart Understanding
di: Huang, Muye, et al.
Pubblicazione: (2025)
di: Huang, Muye, et al.
Pubblicazione: (2025)
CharXiv: Charting Gaps in Realistic Chart Understanding in Multimodal LLMs
di: Wang, Zirui, et al.
Pubblicazione: (2024)
di: Wang, Zirui, et al.
Pubblicazione: (2024)
FinChart-Bench: Benchmarking Financial Chart Comprehension in Vision-Language Models
di: Shu, Dong, et al.
Pubblicazione: (2025)
di: Shu, Dong, et al.
Pubblicazione: (2025)
ChartQA-X: Generating Explanations for Visual Chart Reasoning
di: Hegde, Shamanthak, et al.
Pubblicazione: (2025)
di: Hegde, Shamanthak, et al.
Pubblicazione: (2025)
ChartBench: A Benchmark for Complex Visual Reasoning in Charts
di: Xu, Zhengzhuo, et al.
Pubblicazione: (2023)
di: Xu, Zhengzhuo, et al.
Pubblicazione: (2023)
ChartGen: Scaling Chart Understanding Via Code-Guided Synthetic Chart Generation
di: Kondic, Jovana, et al.
Pubblicazione: (2025)
di: Kondic, Jovana, et al.
Pubblicazione: (2025)
DriveVGGT: Calibration-Constrained Visual Geometry Transformers for Multi-Camera Autonomous Driving
di: Jia, Xiaosong, et al.
Pubblicazione: (2025)
di: Jia, Xiaosong, et al.
Pubblicazione: (2025)
Socratic Chart: Cooperating Multiple Agents for Robust SVG Chart Understanding
di: Ji, Yuyang, et al.
Pubblicazione: (2025)
di: Ji, Yuyang, et al.
Pubblicazione: (2025)
AskChart: Universal Chart Understanding through Textual Enhancement
di: Yang, Xudong, et al.
Pubblicazione: (2024)
di: Yang, Xudong, et al.
Pubblicazione: (2024)
InfoChartQA: A Benchmark for Multimodal Question Answering on Infographic Charts
di: Xie, Tianchi, et al.
Pubblicazione: (2025)
di: Xie, Tianchi, et al.
Pubblicazione: (2025)
ChartAgent: A Chart Understanding Framework with Tool Integrated Reasoning
di: Wang, Boran, et al.
Pubblicazione: (2025)
di: Wang, Boran, et al.
Pubblicazione: (2025)
Chart-FR1: Visual Focus-Driven Fine-Grained Reasoning on Dense Charts
di: Pan, Hongkun, et al.
Pubblicazione: (2026)
di: Pan, Hongkun, et al.
Pubblicazione: (2026)
RefChartQA: Grounding Visual Answer on Chart Images through Instruction Tuning
di: Vogel, Alexander, et al.
Pubblicazione: (2025)
di: Vogel, Alexander, et al.
Pubblicazione: (2025)
ChartGemma: Visual Instruction-tuning for Chart Reasoning in the Wild
di: Masry, Ahmed, et al.
Pubblicazione: (2024)
di: Masry, Ahmed, et al.
Pubblicazione: (2024)
Charts Are Not Images: On the Challenges of Scientific Chart Editing
di: Li, Shawn, et al.
Pubblicazione: (2025)
di: Li, Shawn, et al.
Pubblicazione: (2025)
EvoChart: A Benchmark and a Self-Training Approach Towards Real-World Chart Understanding
di: Huang, Muye, et al.
Pubblicazione: (2024)
di: Huang, Muye, et al.
Pubblicazione: (2024)
On the Perception Bottleneck of VLMs for Chart Understanding
di: Liu, Junteng, et al.
Pubblicazione: (2025)
di: Liu, Junteng, et al.
Pubblicazione: (2025)
Chimera: Improving Generalist Model with Domain-Specific Experts
di: Peng, Tianshuo, et al.
Pubblicazione: (2024)
di: Peng, Tianshuo, et al.
Pubblicazione: (2024)
VProChart: Answering Chart Question through Visual Perception Alignment Agent and Programmatic Solution Reasoning
di: Huang, Muye, et al.
Pubblicazione: (2024)
di: Huang, Muye, et al.
Pubblicazione: (2024)
ChartMoE: Mixture of Diversely Aligned Expert Connector for Chart Understanding
di: Xu, Zhengzhuo, et al.
Pubblicazione: (2024)
di: Xu, Zhengzhuo, et al.
Pubblicazione: (2024)
Advancing Multimodal Large Language Models in Chart Question Answering with Visualization-Referenced Instruction Tuning
di: Zeng, Xingchen, et al.
Pubblicazione: (2024)
di: Zeng, Xingchen, et al.
Pubblicazione: (2024)
CycleChart: A Unified Consistency-Based Learning Framework for Bidirectional Chart Understanding and Generation
di: Deng, Dazhen, et al.
Pubblicazione: (2025)
di: Deng, Dazhen, et al.
Pubblicazione: (2025)
ChartAB: A Benchmark for Chart Grounding & Dense Alignment
di: Bansal, Aniruddh, et al.
Pubblicazione: (2025)
di: Bansal, Aniruddh, et al.
Pubblicazione: (2025)
Charting the Future: Using Chart Question-Answering for Scalable Evaluation of LLM-Driven Data Visualizations
di: Ford, James, et al.
Pubblicazione: (2024)
di: Ford, James, et al.
Pubblicazione: (2024)
ChartGaze: Enhancing Chart Understanding in LVLMs with Eye-Tracking Guided Attention Refinement
di: Salamatian, Ali, et al.
Pubblicazione: (2025)
di: Salamatian, Ali, et al.
Pubblicazione: (2025)
ChartNet: A Million-Scale, High-Quality Multimodal Dataset for Robust Chart Understanding
di: Kondic, Jovana, et al.
Pubblicazione: (2026)
di: Kondic, Jovana, et al.
Pubblicazione: (2026)
Documenti analoghi
-
ChartX & ChartVLM: A Versatile Benchmark and Foundation Model for Complicated Chart Reasoning
di: Xia, Renqiu, et al.
Pubblicazione: (2024) -
Training-Free Adaptive Diffusion with Bounded Difference Approximation Strategy
di: Ye, Hancheng, et al.
Pubblicazione: (2024) -
GeoX: Geometric Problem Solving Through Unified Formalized Vision-Language Pre-training
di: Xia, Renqiu, et al.
Pubblicazione: (2024) -
SPOT: Scalable 3D Pre-training via Occupancy Prediction for Learning Transferable 3D Representations
di: Yan, Xiangchao, et al.
Pubblicazione: (2023) -
ReSimAD: Zero-Shot 3D Domain Transfer for Autonomous Driving with Source Reconstruction and Target Simulation
di: Zhang, Bo, et al.
Pubblicazione: (2023)