End-to-End Chart Summarization via Visual Chain-of-Thought in Vision-Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Choi, Raymond, Burns, Frank, Lawrence, Chase |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
ChartThinker: A Contextual Chain-of-Thought Approach to Optimized Chart Summarization
por: Liu, Mengsha, et al.
Publicado: (2024)
por: Liu, Mengsha, et al.
Publicado: (2024)
ChartAdapter: Large Vision-Language Model for Chart Summarization
por: Xu, Peixin, et al.
Publicado: (2024)
por: Xu, Peixin, et al.
Publicado: (2024)
End-to-End Long Document Summarization using Gradient Caching
por: Saxena, Rohit, et al.
Publicado: (2025)
por: Saxena, Rohit, et al.
Publicado: (2025)
An End-to-End Speech Summarization Using Large Language Model
por: Shang, Hengchao, et al.
Publicado: (2024)
por: Shang, Hengchao, et al.
Publicado: (2024)
With Good MT There is No Need For End-to-End: A Case for Translate-then-Summarize Cross-lingual Summarization
por: Varab, Daniel, et al.
Publicado: (2024)
por: Varab, Daniel, et al.
Publicado: (2024)
End-to-End Aspect-Guided Review Summarization at Scale
por: Boytsov, Ilya, et al.
Publicado: (2025)
por: Boytsov, Ilya, et al.
Publicado: (2025)
Chain-of-Thought Reasoning in Streaming Full-Duplex End-to-End Spoken Dialogue Systems
por: Arora, Siddhant, et al.
Publicado: (2025)
por: Arora, Siddhant, et al.
Publicado: (2025)
From Data to Insights: Exploring Program-of-Thoughts Prompting for Chart Summarization
por: Qu, Yutong, et al.
Publicado: (2026)
por: Qu, Yutong, et al.
Publicado: (2026)
MMAPS: End-to-End Multi-Grained Multi-Modal Attribute-Aware Product Summarization
por: Chen, Tao, et al.
Publicado: (2023)
por: Chen, Tao, et al.
Publicado: (2023)
Sentence-wise Speech Summarization: Task, Datasets, and End-to-End Modeling with LM Knowledge Distillation
por: Matsuura, Kohei, et al.
Publicado: (2024)
por: Matsuura, Kohei, et al.
Publicado: (2024)
End-to-End Navigation with Vision Language Models: Transforming Spatial Reasoning into Question-Answering
por: Goetting, Dylan, et al.
Publicado: (2024)
por: Goetting, Dylan, et al.
Publicado: (2024)
Chain-of-Agents: End-to-End Agent Foundation Models via Multi-Agent Distillation and Agentic RL
por: Li, Weizhen, et al.
Publicado: (2025)
por: Li, Weizhen, et al.
Publicado: (2025)
The End of Manual Decoding: Towards Truly End-to-End Language Models
por: Wang, Zhichao, et al.
Publicado: (2025)
por: Wang, Zhichao, et al.
Publicado: (2025)
SAGE-LD: Towards Scalable and Generalizable End-to-End Language Diarization via Simulated Data Augmentation
por: Lee, Sangmin, et al.
Publicado: (2025)
por: Lee, Sangmin, et al.
Publicado: (2025)
The Perils of Chart Deception: How Misleading Visualizations Affect Vision-Language Models
por: Mahbub, Ridwan, et al.
Publicado: (2025)
por: Mahbub, Ridwan, et al.
Publicado: (2025)
Language Model Inversion through End-to-End Differentiation
por: Denamganaï, Kevin Yandoka, et al.
Publicado: (2026)
por: Denamganaï, Kevin Yandoka, et al.
Publicado: (2026)
End-to-End Ontology Learning with Large Language Models
por: Lo, Andy, et al.
Publicado: (2024)
por: Lo, Andy, et al.
Publicado: (2024)
Visual Sketchpad: Sketching as a Visual Chain of Thought for Multimodal Language Models
por: Hu, Yushi, et al.
Publicado: (2024)
por: Hu, Yushi, et al.
Publicado: (2024)
End-to-End Training for Back-Translation with Categorical Reparameterization Trick
por: Heo, DongNyeong, et al.
Publicado: (2022)
por: Heo, DongNyeong, et al.
Publicado: (2022)
End-to-End Graph Flattening Method for Large Language Models
por: Hong, Bin, et al.
Publicado: (2024)
por: Hong, Bin, et al.
Publicado: (2024)
End-To-End Clinical Trial Matching with Large Language Models
por: Ferber, Dyke, et al.
Publicado: (2024)
por: Ferber, Dyke, et al.
Publicado: (2024)
Entropy2Vec: Crosslingual Language Modeling Entropy as End-to-End Learnable Language Representations
por: Irawan, Patrick Amadeus, et al.
Publicado: (2025)
por: Irawan, Patrick Amadeus, et al.
Publicado: (2025)
Measuring and Improving Chain-of-Thought Reasoning in Vision-Language Models
por: Chen, Yangyi, et al.
Publicado: (2023)
por: Chen, Yangyi, et al.
Publicado: (2023)
Zero-Shot Generalizable End-to-End Task-Oriented Dialog System using Context Summarization and Domain Schema
por: Mosharrof, Adib, et al.
Publicado: (2023)
por: Mosharrof, Adib, et al.
Publicado: (2023)
Efficient End-to-End Visual Document Understanding with Rationale Distillation
por: Zhu, Wang, et al.
Publicado: (2023)
por: Zhu, Wang, et al.
Publicado: (2023)
Understanding Before Reasoning: Enhancing Chain-of-Thought with Iterative Summarization Pre-Prompting
por: Zhu, Dong-Hai, et al.
Publicado: (2025)
por: Zhu, Dong-Hai, et al.
Publicado: (2025)
Pushing on Multilingual Reasoning Models with Language-Mixed Chain-of-Thought
por: Son, Guijin, et al.
Publicado: (2025)
por: Son, Guijin, et al.
Publicado: (2025)
ChartMuseum: Testing Visual Reasoning Capabilities of Large Vision-Language Models
por: Tang, Liyan, et al.
Publicado: (2025)
por: Tang, Liyan, et al.
Publicado: (2025)
THaMES: An End-to-End Tool for Hallucination Mitigation and Evaluation in Large Language Models
por: Liang, Mengfei, et al.
Publicado: (2024)
por: Liang, Mengfei, et al.
Publicado: (2024)
Pose-Based Sign Language Spotting via an End-to-End Encoder Architecture
por: Johnny, Samuel Ebimobowei, et al.
Publicado: (2025)
por: Johnny, Samuel Ebimobowei, et al.
Publicado: (2025)
Using Large Language Model for End-to-End Chinese ASR and NER
por: Li, Yuang, et al.
Publicado: (2024)
por: Li, Yuang, et al.
Publicado: (2024)
SyncVSR: Data-Efficient Visual Speech Recognition with End-to-End Crossmodal Audio Token Synchronization
por: Ahn, Young Jin, et al.
Publicado: (2024)
por: Ahn, Young Jin, et al.
Publicado: (2024)
The Expressive Power of Low Precision Softmax Transformers with (Summarized) Chain-of-Thought
por: Brösamle, Moritz, et al.
Publicado: (2026)
por: Brösamle, Moritz, et al.
Publicado: (2026)
Beyond Chain-of-Thought, Effective Graph-of-Thought Reasoning in Language Models
por: Yao, Yao, et al.
Publicado: (2023)
por: Yao, Yao, et al.
Publicado: (2023)
Latent Chain-of-Thought World Modeling for End-to-End Driving
por: Tan, Shuhan, et al.
Publicado: (2025)
por: Tan, Shuhan, et al.
Publicado: (2025)
Cross-modality Data Augmentation for End-to-End Sign Language Translation
por: Ye, Jinhui, et al.
Publicado: (2023)
por: Ye, Jinhui, et al.
Publicado: (2023)
Efficient Vision-Language Models by Summarizing Visual Tokens into Compact Registers
por: Wen, Yuxin, et al.
Publicado: (2024)
por: Wen, Yuxin, et al.
Publicado: (2024)
Finetuning End-to-End Models for Estonian Conversational Spoken Language Translation
por: Sildam, Tiia, et al.
Publicado: (2024)
por: Sildam, Tiia, et al.
Publicado: (2024)
Improving End-to-End Training of Retrieval-Augmented Generation Models via Joint Stochastic Approximation
por: Cao, Hongyu, et al.
Publicado: (2025)
por: Cao, Hongyu, et al.
Publicado: (2025)
MultiChartQA: Benchmarking Vision-Language Models on Multi-Chart Problems
por: Zhu, Zifeng, et al.
Publicado: (2024)
por: Zhu, Zifeng, et al.
Publicado: (2024)
Ejemplares similares
-
ChartThinker: A Contextual Chain-of-Thought Approach to Optimized Chart Summarization
por: Liu, Mengsha, et al.
Publicado: (2024) -
ChartAdapter: Large Vision-Language Model for Chart Summarization
por: Xu, Peixin, et al.
Publicado: (2024) -
End-to-End Long Document Summarization using Gradient Caching
por: Saxena, Rohit, et al.
Publicado: (2025) -
An End-to-End Speech Summarization Using Large Language Model
por: Shang, Hengchao, et al.
Publicado: (2024) -
With Good MT There is No Need For End-to-End: A Case for Translate-then-Summarize Cross-lingual Summarization
por: Varab, Daniel, et al.
Publicado: (2024)