Beyond Description: A Multimodal Agent Framework for Insightful Chart Summarization
Fuente:
arXiv
Saved in:
| Main Authors: | Bai, Yuhang, Ding, Yujuan, Lin, Shanru, Fan, Wenqi |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Diffusion Generative Recommendation with Continuous Tokens
by: Qu, Haohao, et al.
Published: (2025)
by: Qu, Haohao, et al.
Published: (2025)
ChartAdapter: Large Vision-Language Model for Chart Summarization
by: Xu, Peixin, et al.
Published: (2024)
by: Xu, Peixin, et al.
Published: (2024)
A Survey of WebAgents: Towards Next-Generation AI Agents for Web Automation with Large Foundation Models
by: Ning, Liangbo, et al.
Published: (2025)
by: Ning, Liangbo, et al.
Published: (2025)
PriHA: A RAG-Enhanced LLM Framework for Primary Healthcare Assistant in Hong Kong
by: Chan, Richard Wai Cheung, et al.
Published: (2026)
by: Chan, Richard Wai Cheung, et al.
Published: (2026)
SUPERGLASSES: Benchmarking Vision Language Models as Intelligent Agents for AI Smart Glasses
by: Jiang, Zhuohang, et al.
Published: (2026)
by: Jiang, Zhuohang, et al.
Published: (2026)
HV-Attack: Hierarchical Visual Attack for Multimodal Retrieval Augmented Generation
by: Luo, Linyin, et al.
Published: (2025)
by: Luo, Linyin, et al.
Published: (2025)
Multi-agent Attacks for Black-box Social Recommendations
by: Wang, Shijie, et al.
Published: (2023)
by: Wang, Shijie, et al.
Published: (2023)
Agent-as-Peer-Debriefer: A Multi-Agent Framework with Perspective-Based Refinement for Qualitative Analysis
by: Lin, Zhimin, et al.
Published: (2026)
by: Lin, Zhimin, et al.
Published: (2026)
Faithful Chart Summarization with ChaTS-Pi
by: Krichene, Syrine, et al.
Published: (2024)
by: Krichene, Syrine, et al.
Published: (2024)
Unlocking Financial Insights: An advanced Multimodal Summarization with Multimodal Output Framework for Financial Advisory Videos
by: Das, Sarmistha, et al.
Published: (2025)
by: Das, Sarmistha, et al.
Published: (2025)
FashionReGen: LLM-Empowered Fashion Report Generation
by: Ding, Yujuan, et al.
Published: (2024)
by: Ding, Yujuan, et al.
Published: (2024)
ChartCitor: Multi-Agent Framework for Fine-Grained Chart Visual Attribution
by: Goswami, Kanika, et al.
Published: (2025)
by: Goswami, Kanika, et al.
Published: (2025)
Dual-stage and Lightweight Patient Chart Summarization for Emergency Physicians
by: Wu, Jiajun, et al.
Published: (2025)
by: Wu, Jiajun, et al.
Published: (2025)
Beyond Static Summarization: Proactive Memory Extraction for LLM Agents
by: Yang, Chengyuan, et al.
Published: (2026)
by: Yang, Chengyuan, et al.
Published: (2026)
InfoChartQA: A Benchmark for Multimodal Question Answering on Infographic Charts
by: Xie, Tianchi, et al.
Published: (2025)
by: Xie, Tianchi, et al.
Published: (2025)
Mixture-of-Experts Knowledge Graph Retrieval-Augmented Generation for Multi-Agent LLM-based Recommendation
by: Wang, Shijie, et al.
Published: (2026)
by: Wang, Shijie, et al.
Published: (2026)
ChartCoder: Advancing Multimodal Large Language Model for Chart-to-Code Generation
by: Zhao, Xuanle, et al.
Published: (2025)
by: Zhao, Xuanle, et al.
Published: (2025)
ChartInsights: Evaluating Multimodal Large Language Models for Low-Level Chart Question Answering
by: Wu, Yifan, et al.
Published: (2024)
by: Wu, Yifan, et al.
Published: (2024)
ChartCards: A Chart-Metadata Generation Framework for Multi-Task Chart Understanding
by: Wu, Yifan, et al.
Published: (2025)
by: Wu, Yifan, et al.
Published: (2025)
Chart-RL: Policy Optimization Reinforcement Learning for Enhanced Visual Reasoning in Chart Question Answering with Vision Language Models
by: Bai, Yunfei, et al.
Published: (2026)
by: Bai, Yunfei, et al.
Published: (2026)
ChartAgent: A Multimodal Agent for Visually Grounded Reasoning in Complex Chart Question Answering
by: Kaur, Rachneet, et al.
Published: (2025)
by: Kaur, Rachneet, et al.
Published: (2025)
Benchmarking Multimodal RAG through a Chart-based Document Question-Answering Generation Framework
by: Yang, Yuming, et al.
Published: (2025)
by: Yang, Yuming, et al.
Published: (2025)
A Survey on RAG Meeting LLMs: Towards Retrieval-Augmented Large Language Models
by: Fan, Wenqi, et al.
Published: (2024)
by: Fan, Wenqi, et al.
Published: (2024)
M-ArtAgent: Evidence-Based Multimodal Agent for Implicit Art Influence Discovery
by: Liu, Hanyi, et al.
Published: (2026)
by: Liu, Hanyi, et al.
Published: (2026)
A Multi-Agent Human-LLM Collaborative Framework for Closed-Loop Scientific Literature Summarization
by: Jacobson, Maxwell J., et al.
Published: (2026)
by: Jacobson, Maxwell J., et al.
Published: (2026)
ChartM$^3$: Benchmarking Chart Editing with Multimodal Instructions
by: Yang, Donglu, et al.
Published: (2025)
by: Yang, Donglu, et al.
Published: (2025)
Code Summarization Beyond Function Level
by: Makharev, Vladimir, et al.
Published: (2025)
by: Makharev, Vladimir, et al.
Published: (2025)
Remember the Decision, Not the Description: A Rate-Distortion Framework for Agent Memory
by: Zou, Mingxi, et al.
Published: (2026)
by: Zou, Mingxi, et al.
Published: (2026)
Insight Agents: An LLM-Based Multi-Agent System for Data Insights
by: Bai, Jincheng, et al.
Published: (2026)
by: Bai, Jincheng, et al.
Published: (2026)
ChartEditBench: Evaluating Grounded Multi-Turn Chart Editing in Multimodal Language Models
by: Kapadnis, Manav Nitin, et al.
Published: (2026)
by: Kapadnis, Manav Nitin, et al.
Published: (2026)
Multimodal DeepResearcher: Generating Text-Chart Interleaved Reports From Scratch with Agentic Framework
by: Yang, Zhaorui, et al.
Published: (2025)
by: Yang, Zhaorui, et al.
Published: (2025)
Product Description and QA Assisted Self-Supervised Opinion Summarization
by: Siledar, Tejpalsingh, et al.
Published: (2024)
by: Siledar, Tejpalsingh, et al.
Published: (2024)
OmniNova:A General Multimodal Agent Framework
by: Du, Pengfei
Published: (2025)
by: Du, Pengfei
Published: (2025)
Chart-HQA: A Benchmark for Hypothetical Question Answering in Charts
by: Chen, Xiangnan, et al.
Published: (2025)
by: Chen, Xiangnan, et al.
Published: (2025)
From Charts to Code: A Hierarchical Benchmark for Multimodal Models
by: Tang, Jiahao, et al.
Published: (2025)
by: Tang, Jiahao, et al.
Published: (2025)
InterReal: A Unified Physics-Based Imitation Framework for Learning Human-Object Interaction Skills
by: Liang, Dayang, et al.
Published: (2026)
by: Liang, Dayang, et al.
Published: (2026)
From Virtual Agents to Robot Teams: A Multi-Robot Framework Evaluation in High-Stakes Healthcare Context
by: Bai, Yuanchen, et al.
Published: (2025)
by: Bai, Yuanchen, et al.
Published: (2025)
AEGIS: An Agent-based Framework for General Bug Reproduction from Issue Descriptions
by: Wang, Xinchen, et al.
Published: (2024)
by: Wang, Xinchen, et al.
Published: (2024)
Beyond Literal Summarization: Redefining Hallucination for Medical SOAP Note Evaluation
by: Vachhani, Bhavik, et al.
Published: (2026)
by: Vachhani, Bhavik, et al.
Published: (2026)
CardAIc-Agents: A Multimodal Framework with Hierarchical Adaptation for Cardiac Care Support
by: Zhang, Yuting, et al.
Published: (2025)
by: Zhang, Yuting, et al.
Published: (2025)
Similar Items
-
Diffusion Generative Recommendation with Continuous Tokens
by: Qu, Haohao, et al.
Published: (2025) -
ChartAdapter: Large Vision-Language Model for Chart Summarization
by: Xu, Peixin, et al.
Published: (2024) -
A Survey of WebAgents: Towards Next-Generation AI Agents for Web Automation with Large Foundation Models
by: Ning, Liangbo, et al.
Published: (2025) -
PriHA: A RAG-Enhanced LLM Framework for Primary Healthcare Assistant in Hong Kong
by: Chan, Richard Wai Cheung, et al.
Published: (2026) -
SUPERGLASSES: Benchmarking Vision Language Models as Intelligent Agents for AI Smart Glasses
by: Jiang, Zhuohang, et al.
Published: (2026)