Chart-based Reasoning: Transferring Capabilities from LLMs to VLMs
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Carbune, Victor, Mansoor, Hassan, Liu, Fangyu, Aralikatte, Rahul, Baechler, Gilles, Chen, Jindong, Sharma, Abhanshu |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ScreenAI: A Vision-Language Model for UI and Infographics Understanding
par: Baechler, Gilles, et autres
Publié: (2024)
par: Baechler, Gilles, et autres
Publié: (2024)
LLMs cannot find reasoning errors, but can correct them given the error location
par: Tyen, Gladys, et autres
Publié: (2023)
par: Tyen, Gladys, et autres
Publié: (2023)
ScreenQA: Large-Scale Question-Answer Pairs over Mobile App Screenshots
par: Hsiao, Yu-Chung, et autres
Publié: (2022)
par: Hsiao, Yu-Chung, et autres
Publié: (2022)
On the Perception Bottleneck of VLMs for Chart Understanding
par: Liu, Junteng, et autres
Publié: (2025)
par: Liu, Junteng, et autres
Publié: (2025)
Faithful Chart Summarization with ChaTS-Pi
par: Krichene, Syrine, et autres
Publié: (2024)
par: Krichene, Syrine, et autres
Publié: (2024)
ChartMimic: Evaluating LMM's Cross-Modal Reasoning Capability via Chart-to-Code Generation
par: Yang, Cheng, et autres
Publié: (2024)
par: Yang, Cheng, et autres
Publié: (2024)
Are Your LLMs Capable of Stable Reasoning?
par: Liu, Junnan, et autres
Publié: (2024)
par: Liu, Junnan, et autres
Publié: (2024)
Distill Visual Chart Reasoning Ability from LLMs to MLLMs
par: He, Wei, et autres
Publié: (2024)
par: He, Wei, et autres
Publié: (2024)
ChartEdit: How Far Are MLLMs From Automating Chart Analysis? Evaluating MLLMs' Capability via Chart Editing
par: Zhao, Xuanle, et autres
Publié: (2025)
par: Zhao, Xuanle, et autres
Publié: (2025)
VQA Training Sets are Self-play Environments for Generating Few-shot Pools
par: Misiunas, Tautvydas, et autres
Publié: (2024)
par: Misiunas, Tautvydas, et autres
Publié: (2024)
Do LLMs and VLMs Share Neurons for Inference? Evidence and Mechanisms of Cross-Modal Transfer
par: Cui, Chenhang, et autres
Publié: (2026)
par: Cui, Chenhang, et autres
Publié: (2026)
ChartMuseum: Testing Visual Reasoning Capabilities of Large Vision-Language Models
par: Tang, Liyan, et autres
Publié: (2025)
par: Tang, Liyan, et autres
Publié: (2025)
RLAIF vs. RLHF: Scaling Reinforcement Learning from Human Feedback with AI Feedback
par: Lee, Harrison, et autres
Publié: (2023)
par: Lee, Harrison, et autres
Publié: (2023)
Prism: A Framework for Decoupling and Assessing the Capabilities of VLMs
par: Qiao, Yuxuan, et autres
Publié: (2024)
par: Qiao, Yuxuan, et autres
Publié: (2024)
Assessing the Reasoning Capabilities of LLMs in the context of Evidence-based Claim Verification
par: Dougrez-Lewis, John, et autres
Publié: (2024)
par: Dougrez-Lewis, John, et autres
Publié: (2024)
CharXiv: Charting Gaps in Realistic Chart Understanding in Multimodal LLMs
par: Wang, Zirui, et autres
Publié: (2024)
par: Wang, Zirui, et autres
Publié: (2024)
Reasoning Under Uncertainty: Exploring Probabilistic Reasoning Capabilities of LLMs
par: Pournemat, Mobina, et autres
Publié: (2025)
par: Pournemat, Mobina, et autres
Publié: (2025)
Are LLMs Capable of Data-based Statistical and Causal Reasoning? Benchmarking Advanced Quantitative Reasoning with Data
par: Liu, Xiao, et autres
Publié: (2024)
par: Liu, Xiao, et autres
Publié: (2024)
ChartInstruct: Instruction Tuning for Chart Comprehension and Reasoning
par: Masry, Ahmed, et autres
Publié: (2024)
par: Masry, Ahmed, et autres
Publié: (2024)
Explore the Reasoning Capability of LLMs in the Chess Testbed
par: Wang, Shu, et autres
Publié: (2024)
par: Wang, Shu, et autres
Publié: (2024)
LUQ: Long-text Uncertainty Quantification for LLMs
par: Zhang, Caiqi, et autres
Publié: (2024)
par: Zhang, Caiqi, et autres
Publié: (2024)
Beyond Answers: Transferring Reasoning Capabilities to Smaller LLMs Using Multi-Teacher Knowledge Distillation
par: Tian, Yijun, et autres
Publié: (2024)
par: Tian, Yijun, et autres
Publié: (2024)
Decompose, Look, and Reason: Reinforced Latent Reasoning for VLMs
par: Zhu, Mengdan, et autres
Publié: (2026)
par: Zhu, Mengdan, et autres
Publié: (2026)
Are Large Vision Language Models up to the Challenge of Chart Comprehension and Reasoning? An Extensive Investigation into the Capabilities and Limitations of LVLMs
par: Islam, Mohammed Saidul, et autres
Publié: (2024)
par: Islam, Mohammed Saidul, et autres
Publié: (2024)
Quantifying the Capabilities of LLMs across Scale and Precision
par: Badshah, Sher, et autres
Publié: (2024)
par: Badshah, Sher, et autres
Publié: (2024)
ChartAttack: Testing the Vulnerability of LLMs to Malicious Prompting in Chart Generation
par: Ortiz-Barajas, Jesus-German, et autres
Publié: (2026)
par: Ortiz-Barajas, Jesus-German, et autres
Publié: (2026)
ChartReasoner: Code-Driven Modality Bridging for Long-Chain Reasoning in Chart Question Answering
par: Jia, Caijun, et autres
Publié: (2025)
par: Jia, Caijun, et autres
Publié: (2025)
Recursive Think-Answer Process for LLMs and VLMs
par: Lee, Byung-Kwan, et autres
Publié: (2026)
par: Lee, Byung-Kwan, et autres
Publié: (2026)
DocMath-Eval: Evaluating Math Reasoning Capabilities of LLMs in Understanding Long and Specialized Documents
par: Zhao, Yilun, et autres
Publié: (2023)
par: Zhao, Yilun, et autres
Publié: (2023)
Satisfiability Solving with LLMs: A Matched-Pair Evaluation of Reasoning Capability
par: Zhang, Leizhen, et autres
Publié: (2026)
par: Zhang, Leizhen, et autres
Publié: (2026)
HiBench: Benchmarking LLMs Capability on Hierarchical Structure Reasoning
par: Jiang, Zhuohang, et autres
Publié: (2025)
par: Jiang, Zhuohang, et autres
Publié: (2025)
Audio Description Generation in the Era of LLMs and VLMs: A Review of Transferable Generative AI Technologies
par: Gao, Yingqiang, et autres
Publié: (2024)
par: Gao, Yingqiang, et autres
Publié: (2024)
Incentivizing Neuro-symbolic Language-based Reasoning in VLMs via Reinforcement Learning
par: Palaniappan, Karthic
Publié: (2026)
par: Palaniappan, Karthic
Publié: (2026)
Chart-to-Experience: Benchmarking Multimodal LLMs for Predicting Experiential Impact of Charts
par: Kim, Seon Gyeom, et autres
Publié: (2025)
par: Kim, Seon Gyeom, et autres
Publié: (2025)
R1-T1: Fully Incentivizing Translation Capability in LLMs via Reasoning Learning
par: He, Minggui, et autres
Publié: (2025)
par: He, Minggui, et autres
Publié: (2025)
BigCharts-R1: Enhanced Chart Reasoning with Visual Reinforcement Finetuning
par: Masry, Ahmed, et autres
Publié: (2025)
par: Masry, Ahmed, et autres
Publié: (2025)
Reasoning Vectors: Transferring Chain-of-Thought Capabilities via Task Arithmetic
par: Zbeeb, Mohammad, et autres
Publié: (2025)
par: Zbeeb, Mohammad, et autres
Publié: (2025)
Reasoning-Table: Exploring Reinforcement Learning for Table Reasoning
par: Lei, Fangyu, et autres
Publié: (2025)
par: Lei, Fangyu, et autres
Publié: (2025)
For-Value: Efficient Forward-Only Data Valuation for finetuning LLMs and VLMs
par: Deng, Wenlong, et autres
Publié: (2025)
par: Deng, Wenlong, et autres
Publié: (2025)
Format-Adapter: Improving Reasoning Capability of LLMs by Adapting Suitable Format
par: Wang, Dingzirui, et autres
Publié: (2025)
par: Wang, Dingzirui, et autres
Publié: (2025)
Documents similaires
-
ScreenAI: A Vision-Language Model for UI and Infographics Understanding
par: Baechler, Gilles, et autres
Publié: (2024) -
LLMs cannot find reasoning errors, but can correct them given the error location
par: Tyen, Gladys, et autres
Publié: (2023) -
ScreenQA: Large-Scale Question-Answer Pairs over Mobile App Screenshots
par: Hsiao, Yu-Chung, et autres
Publié: (2022) -
On the Perception Bottleneck of VLMs for Chart Understanding
par: Liu, Junteng, et autres
Publié: (2025) -
Faithful Chart Summarization with ChaTS-Pi
par: Krichene, Syrine, et autres
Publié: (2024)