GeoTikzBridge: Advancing Multimodal Code Generation for Geometric Perception and Reasoning
Fuente:
arXiv
Salvato in:
| Autori principali: | Sun, Jiayin, Sun, Caixia, Yang, Boyu, Li, Hailin, Chen, Xiao, Zhang, Yi, Ding, Errui, Li, Liang, Deng, Chao, Feng, Junlan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
GeoSense: Internalizing Geometric Necessity Perception for Multimodal Reasoning
di: Liu, Ruiheng, et al.
Pubblicazione: (2026)
di: Liu, Ruiheng, et al.
Pubblicazione: (2026)
GeoPQA: Bridging the Visual Perception Gap in MLLMs for Geometric Reasoning
di: Chen, Guizhen, et al.
Pubblicazione: (2025)
di: Chen, Guizhen, et al.
Pubblicazione: (2025)
Rule-VLN: Bridging Perception and Compliance via Semantic Reasoning and Geometric Rectification
di: Wen, Jiawen, et al.
Pubblicazione: (2026)
di: Wen, Jiawen, et al.
Pubblicazione: (2026)
JT-Math: A Multi-Stage Framework for Advanced Mathematical Reasoning in Large Language Models
di: Hao, Yifan, et al.
Pubblicazione: (2025)
di: Hao, Yifan, et al.
Pubblicazione: (2025)
Bridging Perception and Reasoning: Token Reweighting for RLVR in Multimodal LLMs
di: Lu, Jinda, et al.
Pubblicazione: (2026)
di: Lu, Jinda, et al.
Pubblicazione: (2026)
Align to the Pivot: Dual Alignment with Self-Feedback for Multilingual Math Reasoning
di: Zhao, Chunxu, et al.
Pubblicazione: (2026)
di: Zhao, Chunxu, et al.
Pubblicazione: (2026)
Teaching Audio Models to Reason: A Unified Framework for Source- and Layer-wise Distillation
di: Yang, Runyan, et al.
Pubblicazione: (2025)
di: Yang, Runyan, et al.
Pubblicazione: (2025)
TopoSD: Topology-Enhanced Lane Segment Perception with SDMap Prior
di: Yang, Sen, et al.
Pubblicazione: (2024)
di: Yang, Sen, et al.
Pubblicazione: (2024)
GenDistiller: Distilling Pre-trained Language Models based on an Autoregressive Generative Model
di: Gao, Yingying, et al.
Pubblicazione: (2024)
di: Gao, Yingying, et al.
Pubblicazione: (2024)
MathCoder-VL: Bridging Vision and Code for Enhanced Multimodal Mathematical Reasoning
di: Wang, Ke, et al.
Pubblicazione: (2025)
di: Wang, Ke, et al.
Pubblicazione: (2025)
Evaluating and Advancing Multimodal Large Language Models in Perception Ability Lens
di: Chen, Feng, et al.
Pubblicazione: (2024)
di: Chen, Feng, et al.
Pubblicazione: (2024)
CogFlow: Bridging Perception and Reasoning through Knowledge Internalization for Visual Mathematical Problem Solving
di: Chen, Shuhang, et al.
Pubblicazione: (2026)
di: Chen, Shuhang, et al.
Pubblicazione: (2026)
From Geometric Mimicry to Comprehensive Generation: A Context-Informed Multimodal Diffusion Model for Urban Morphology Synthesis
di: Zhou, Fangshuo, et al.
Pubblicazione: (2024)
di: Zhou, Fangshuo, et al.
Pubblicazione: (2024)
Perception-R1: Advancing Multimodal Reasoning Capabilities of MLLMs via Visual Perception Reward
di: Xiao, Tong, et al.
Pubblicazione: (2025)
di: Xiao, Tong, et al.
Pubblicazione: (2025)
NeSyGeo: A Neuro-Symbolic Framework for Multimodal Geometric Reasoning Data Generation
di: Wu, Weiming, et al.
Pubblicazione: (2025)
di: Wu, Weiming, et al.
Pubblicazione: (2025)
Palette of Language Models: A Solver for Controlled Text Generation
di: Yang, Zhe, et al.
Pubblicazione: (2025)
di: Yang, Zhe, et al.
Pubblicazione: (2025)
ReDDiT: Rehashing Noise for Discrete Visual Generation
di: Ma, Tianren, et al.
Pubblicazione: (2025)
di: Ma, Tianren, et al.
Pubblicazione: (2025)
Bridging Formal Language with Chain-of-Thought Reasoning to Geometry Problem Solving
di: Yang, Tianyun, et al.
Pubblicazione: (2025)
di: Yang, Tianyun, et al.
Pubblicazione: (2025)
GeoSense: Evaluating Identification and Application of Geometric Principles in Multimodal Reasoning
di: Xu, Liangyu, et al.
Pubblicazione: (2025)
di: Xu, Liangyu, et al.
Pubblicazione: (2025)
Cognitive Load-Driven VR Memory Palaces: Personalizing Focus and Recall Enhancement
di: Li, Zhengyang, et al.
Pubblicazione: (2025)
di: Li, Zhengyang, et al.
Pubblicazione: (2025)
Two-way Evidence self-Alignment based Dual-Gated Reasoning Enhancement
di: Zhang, Kexin, et al.
Pubblicazione: (2025)
di: Zhang, Kexin, et al.
Pubblicazione: (2025)
Large Language Models Are Cross-Lingual Knowledge-Free Reasoners
di: Hu, Peng, et al.
Pubblicazione: (2024)
di: Hu, Peng, et al.
Pubblicazione: (2024)
Experimental investigation on response mechanism and impact resistance of glass fiber reinforced polymer X‐type foldcore sandwich panel subjected to low‐velocity impact experiments
di: Yunfei Deng, et al.
Pubblicazione: (2024)
di: Yunfei Deng, et al.
Pubblicazione: (2024)
Investigating and Scaling up Code-Switching for Multilingual Language Model Pre-Training
di: Wang, Zhijun, et al.
Pubblicazione: (2025)
di: Wang, Zhijun, et al.
Pubblicazione: (2025)
GGBench: A Geometric Generative Reasoning Benchmark for Unified Multimodal Models
di: Wei, Jingxuan, et al.
Pubblicazione: (2025)
di: Wei, Jingxuan, et al.
Pubblicazione: (2025)
MonoFormer: One Transformer for Both Diffusion and Autoregression
di: Zhao, Chuyang, et al.
Pubblicazione: (2024)
di: Zhao, Chuyang, et al.
Pubblicazione: (2024)
MMEmb-R1: Reasoning-Enhanced Multimodal Embedding with Pair-Aware Selection and Adaptive Control
di: Wang, Yuchi, et al.
Pubblicazione: (2026)
di: Wang, Yuchi, et al.
Pubblicazione: (2026)
Advancing Multimodal Reasoning via Reinforcement Learning with Cold Start
di: Wei, Lai, et al.
Pubblicazione: (2025)
di: Wei, Lai, et al.
Pubblicazione: (2025)
CapGeo: A Caption-Assisted Approach to Geometric Reasoning
di: Li, Yuying, et al.
Pubblicazione: (2025)
di: Li, Yuying, et al.
Pubblicazione: (2025)
Bridging Text and Molecule: A Survey on Multimodal Frameworks for Molecule
di: Xiao, Yi, et al.
Pubblicazione: (2024)
di: Xiao, Yi, et al.
Pubblicazione: (2024)
Three‐Dimensional Ag 2 Se Thermoelectric Network Advances Multimodal Intelligent Perception
di: Fangyuan Yu, et al.
Pubblicazione: (2026)
di: Fangyuan Yu, et al.
Pubblicazione: (2026)
Bridging Developer Instructions and Code Completion Through Instruction-Aware Fill-in-the-Middle Paradigm
di: Sun, Zhensu, et al.
Pubblicazione: (2025)
di: Sun, Zhensu, et al.
Pubblicazione: (2025)
SeaEvo: Advancing Algorithm Discovery with Strategy Space Evolution
di: Luo, Sichun, et al.
Pubblicazione: (2026)
di: Luo, Sichun, et al.
Pubblicazione: (2026)
Decoupling the Image Perception and Multimodal Reasoning for Reasoning Segmentation with Digital Twin Representations
di: Li, Yizhen, et al.
Pubblicazione: (2025)
di: Li, Yizhen, et al.
Pubblicazione: (2025)
Seeing with You: Perception-Reasoning Coevolution for Multimodal Reasoning
di: Miao, Ziqi, et al.
Pubblicazione: (2026)
di: Miao, Ziqi, et al.
Pubblicazione: (2026)
GeoSym127K: Scalable Symbolically-verifiable Synthesis for Multimodal Geometric Reasoning
di: Jing, Jinhao, et al.
Pubblicazione: (2026)
di: Jing, Jinhao, et al.
Pubblicazione: (2026)
Tuning-free Instruction-based Video Editing Via Structural Noise Initialization and Guidance
di: Wu, Song, et al.
Pubblicazione: (2026)
di: Wu, Song, et al.
Pubblicazione: (2026)
MS-DETR: Efficient DETR Training with Mixed Supervision
di: Zhao, Chuyang, et al.
Pubblicazione: (2024)
di: Zhao, Chuyang, et al.
Pubblicazione: (2024)
Slow Perception: Let's Perceive Geometric Figures Step-by-step
di: Wei, Haoran, et al.
Pubblicazione: (2024)
di: Wei, Haoran, et al.
Pubblicazione: (2024)
Self-Correction Distillation for Structured Data Question Answering
di: Zhu, Yushan, et al.
Pubblicazione: (2025)
di: Zhu, Yushan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
GeoSense: Internalizing Geometric Necessity Perception for Multimodal Reasoning
di: Liu, Ruiheng, et al.
Pubblicazione: (2026) -
GeoPQA: Bridging the Visual Perception Gap in MLLMs for Geometric Reasoning
di: Chen, Guizhen, et al.
Pubblicazione: (2025) -
Rule-VLN: Bridging Perception and Compliance via Semantic Reasoning and Geometric Rectification
di: Wen, Jiawen, et al.
Pubblicazione: (2026) -
JT-Math: A Multi-Stage Framework for Advanced Mathematical Reasoning in Large Language Models
di: Hao, Yifan, et al.
Pubblicazione: (2025) -
Bridging Perception and Reasoning: Token Reweighting for RLVR in Multimodal LLMs
di: Lu, Jinda, et al.
Pubblicazione: (2026)