GeoCoder: Solving Geometry Problems by Generating Modular Code through Vision-Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Sharma, Aditya, Dalmia, Aman, Kazemi, Mehran, Zouaq, Amal, Pal, Christopher J. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Reducing Hallucinations in Language Model-based SPARQL Query Generation Using Post-Generation Memory Retrieval
di: Sharma, Aditya, et al.
Pubblicazione: (2025)
di: Sharma, Aditya, et al.
Pubblicazione: (2025)
DeSQ: Decomposition-based SPARQL Query Generation
di: Diallo, Papa Abdou Karim Karou, et al.
Pubblicazione: (2026)
di: Diallo, Papa Abdou Karim Karou, et al.
Pubblicazione: (2026)
What is the Best Process Model Representation? A Comparative Analysis for Process Modeling with Large Language Models
di: Brissard, Alexis, et al.
Pubblicazione: (2025)
di: Brissard, Alexis, et al.
Pubblicazione: (2025)
Ontology-Constrained Generation of Domain-Specific Clinical Summaries
di: Mehenni, Gaya, et al.
Pubblicazione: (2024)
di: Mehenni, Gaya, et al.
Pubblicazione: (2024)
GeoX: Geometric Problem Solving Through Unified Formalized Vision-Language Pre-training
di: Xia, Renqiu, et al.
Pubblicazione: (2024)
di: Xia, Renqiu, et al.
Pubblicazione: (2024)
MapCoder: Multi-Agent Code Generation for Competitive Problem Solving
di: Islam, Md. Ashraful, et al.
Pubblicazione: (2024)
di: Islam, Md. Ashraful, et al.
Pubblicazione: (2024)
LLMs Can't Play Hangman: On the Necessity of a Private Working Memory for Language Agents
di: Baldelli, Davide, et al.
Pubblicazione: (2026)
di: Baldelli, Davide, et al.
Pubblicazione: (2026)
MathCoder-VL: Bridging Vision and Code for Enhanced Multimodal Mathematical Reasoning
di: Wang, Ke, et al.
Pubblicazione: (2025)
di: Wang, Ke, et al.
Pubblicazione: (2025)
FRASE: Structured Representations for Generalizable SPARQL Query Generation
di: Diallo, Papa Abdou Karim Karou, et al.
Pubblicazione: (2025)
di: Diallo, Papa Abdou Karim Karou, et al.
Pubblicazione: (2025)
A Comprehensive Evaluation of Neural SPARQL Query Generation from Natural Language Questions
di: Diallo, Papa Abdou Karim Karou, et al.
Pubblicazione: (2023)
di: Diallo, Papa Abdou Karim Karou, et al.
Pubblicazione: (2023)
GeoMathCode: Understanding Interleaved Math-Code Reasoning for Geometry Problem Solving
di: Zhang, Yingji, et al.
Pubblicazione: (2026)
di: Zhang, Yingji, et al.
Pubblicazione: (2026)
Enhancing Frame Detection with Retrieval Augmented Generation
di: Diallo, Papa Abdou Karim Karou, et al.
Pubblicazione: (2025)
di: Diallo, Papa Abdou Karim Karou, et al.
Pubblicazione: (2025)
Probabilistic Calibration Is a Trainable Capability in Language Models
di: Baldelli, Davide, et al.
Pubblicazione: (2026)
di: Baldelli, Davide, et al.
Pubblicazione: (2026)
Pi-GPS: Enhancing Geometry Problem Solving by Unleashing the Power of Diagrammatic Information
di: Zhao, Junbo, et al.
Pubblicazione: (2025)
di: Zhao, Junbo, et al.
Pubblicazione: (2025)
Losing Visual Needles in Image Haystacks: Vision Language Models are Easily Distracted in Short and Long Contexts
di: Sharma, Aditya, et al.
Pubblicazione: (2024)
di: Sharma, Aditya, et al.
Pubblicazione: (2024)
GeoCode: Interpretable Shape Programs
di: Ofek Pearl, et al.
Pubblicazione: (2025)
di: Ofek Pearl, et al.
Pubblicazione: (2025)
A Survey of Deep Learning for Geometry Problem Solving
di: Ma, Jianzhe, et al.
Pubblicazione: (2025)
di: Ma, Jianzhe, et al.
Pubblicazione: (2025)
Can Vision-Language Models Solve the Shell Game?
di: Liu, Tiedong, et al.
Pubblicazione: (2026)
di: Liu, Tiedong, et al.
Pubblicazione: (2026)
Token Pruning in Multimodal Large Language Models: Are We Solving the Right Problem?
di: Wen, Zichen, et al.
Pubblicazione: (2025)
di: Wen, Zichen, et al.
Pubblicazione: (2025)
GSM8K-V: Can Vision Language Models Solve Grade School Math Word Problems in Visual Contexts
di: Yuan, Fan, et al.
Pubblicazione: (2025)
di: Yuan, Fan, et al.
Pubblicazione: (2025)
MathCoder2: Better Math Reasoning from Continued Pretraining on Model-translated Mathematical Code
di: Lu, Zimu, et al.
Pubblicazione: (2024)
di: Lu, Zimu, et al.
Pubblicazione: (2024)
JanusCoder: Towards a Foundational Visual-Programmatic Interface for Code Intelligence
di: Sun, Qiushi, et al.
Pubblicazione: (2025)
di: Sun, Qiushi, et al.
Pubblicazione: (2025)
Can Vision-Language Models Solve Visual Math Equations?
di: Choudhury, Monjoy Narayan, et al.
Pubblicazione: (2025)
di: Choudhury, Monjoy Narayan, et al.
Pubblicazione: (2025)
How Culturally Aware are Vision-Language Models?
di: Burda-Lassen, Olena, et al.
Pubblicazione: (2024)
di: Burda-Lassen, Olena, et al.
Pubblicazione: (2024)
Script Gap: Evaluating LLM Triage on Indian Languages in Native vs Romanized Scripts in a Real World Setting
di: Khullar, Manurag, et al.
Pubblicazione: (2025)
di: Khullar, Manurag, et al.
Pubblicazione: (2025)
EffiCoder: Enhancing Code Generation in Large Language Models through Efficiency-Aware Fine-tuning
di: Huang, Dong, et al.
Pubblicazione: (2024)
di: Huang, Dong, et al.
Pubblicazione: (2024)
UniCoder: Scaling Code Large Language Model via Universal Code
di: Sun, Tao, et al.
Pubblicazione: (2024)
di: Sun, Tao, et al.
Pubblicazione: (2024)
Learning to Exploit Temporal Structure for Biomedical Vision-Language Processing
di: Bannur, Shruthi, et al.
Pubblicazione: (2023)
di: Bannur, Shruthi, et al.
Pubblicazione: (2023)
Exploring the Frontier of Vision-Language Models: A Survey of Current Methodologies and Future Directions
di: Ghosh, Akash, et al.
Pubblicazione: (2024)
di: Ghosh, Akash, et al.
Pubblicazione: (2024)
NAVIG: Natural Language-guided Analysis with Vision Language Models for Image Geo-localization
di: Zhang, Zheyuan, et al.
Pubblicazione: (2025)
di: Zhang, Zheyuan, et al.
Pubblicazione: (2025)
MultiChartQA: Benchmarking Vision-Language Models on Multi-Chart Problems
di: Zhu, Zifeng, et al.
Pubblicazione: (2024)
di: Zhu, Zifeng, et al.
Pubblicazione: (2024)
MMCode: Benchmarking Multimodal Large Language Models for Code Generation with Visually Rich Programming Problems
di: Li, Kaixin, et al.
Pubblicazione: (2024)
di: Li, Kaixin, et al.
Pubblicazione: (2024)
Geometry-Aware Losses for Structure-Preserving Text-to-Sign Language Generation
di: Wu, Zetian, et al.
Pubblicazione: (2025)
di: Wu, Zetian, et al.
Pubblicazione: (2025)
ERVQA: A Dataset to Benchmark the Readiness of Large Vision Language Models in Hospital Environments
di: Ray, Sourjyadip, et al.
Pubblicazione: (2024)
di: Ray, Sourjyadip, et al.
Pubblicazione: (2024)
Guiding Vision-Language Model Selection for Visual Question-Answering Across Tasks, Domains, and Knowledge Types
di: Sinha, Neelabh, et al.
Pubblicazione: (2024)
di: Sinha, Neelabh, et al.
Pubblicazione: (2024)
Flat-Pack Bench: Evaluating Spatio-Temporal Understanding in Large Vision-Language Models through Furniture Assembly
di: Chetan, Aditya, et al.
Pubblicazione: (2026)
di: Chetan, Aditya, et al.
Pubblicazione: (2026)
ScreenCoder: Advancing Visual-to-Code Generation for Front-End Automation via Modular Multimodal Agents
di: Jiang, Yilei, et al.
Pubblicazione: (2025)
di: Jiang, Yilei, et al.
Pubblicazione: (2025)
StarVector: Generating Scalable Vector Graphics Code from Images and Text
di: Rodriguez, Juan A., et al.
Pubblicazione: (2023)
di: Rodriguez, Juan A., et al.
Pubblicazione: (2023)
Dream-Coder 7B: An Open Diffusion Language Model for Code
di: Xie, Zhihui, et al.
Pubblicazione: (2025)
di: Xie, Zhihui, et al.
Pubblicazione: (2025)
LLM Augmented LLMs: Expanding Capabilities through Composition
di: Bansal, Rachit, et al.
Pubblicazione: (2024)
di: Bansal, Rachit, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Reducing Hallucinations in Language Model-based SPARQL Query Generation Using Post-Generation Memory Retrieval
di: Sharma, Aditya, et al.
Pubblicazione: (2025) -
DeSQ: Decomposition-based SPARQL Query Generation
di: Diallo, Papa Abdou Karim Karou, et al.
Pubblicazione: (2026) -
What is the Best Process Model Representation? A Comparative Analysis for Process Modeling with Large Language Models
di: Brissard, Alexis, et al.
Pubblicazione: (2025) -
Ontology-Constrained Generation of Domain-Specific Clinical Summaries
di: Mehenni, Gaya, et al.
Pubblicazione: (2024) -
GeoX: Geometric Problem Solving Through Unified Formalized Vision-Language Pre-training
di: Xia, Renqiu, et al.
Pubblicazione: (2024)