TrustGeoGen: Formal-Verified Data Engine for Trustworthy Multi-modal Geometric Problem Solving
Fuente:
arXiv
Salvato in:
| Autori principali: | Fu, Daocheng, Chen, Jianlong, Xia, Renqiu, Chen, Zijun, Liu, Qi, Feng, Yuan, Zhou, Hongbin, Zhang, Renrui, Feng, Shiyang, Gao, Peng, Zha, Hongyuan, Yan, Junchi, Shi, Botian, Qiao, Yu, Zhang, Bo |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Milestones over Outcome: Unlocking Geometric Reasoning with Sub-Goal Verifiable Reward
di: Chen, Jianlong, et al.
Pubblicazione: (2026)
di: Chen, Jianlong, et al.
Pubblicazione: (2026)
GeoBench: Rethinking Multimodal Geometric Problem-Solving via Hierarchical Evaluation
di: Feng, Yuan, et al.
Pubblicazione: (2025)
di: Feng, Yuan, et al.
Pubblicazione: (2025)
GeoX: Geometric Problem Solving Through Unified Formalized Vision-Language Pre-training
di: Xia, Renqiu, et al.
Pubblicazione: (2024)
di: Xia, Renqiu, et al.
Pubblicazione: (2024)
ChartX & ChartVLM: A Versatile Benchmark and Foundation Model for Complicated Chart Reasoning
di: Xia, Renqiu, et al.
Pubblicazione: (2024)
di: Xia, Renqiu, et al.
Pubblicazione: (2024)
Beyond Theorem Proving: Formulation, Framework and Benchmark for Formal Problem-Solving
di: Liu, Qi, et al.
Pubblicazione: (2025)
di: Liu, Qi, et al.
Pubblicazione: (2025)
DocGenome: An Open Large-scale Scientific Document Benchmark for Training and Testing Multi-modal Large Language Models
di: Xia, Renqiu, et al.
Pubblicazione: (2024)
di: Xia, Renqiu, et al.
Pubblicazione: (2024)
Training-Free Adaptive Diffusion with Bounded Difference Approximation Strategy
di: Ye, Hancheng, et al.
Pubblicazione: (2024)
di: Ye, Hancheng, et al.
Pubblicazione: (2024)
MSSR: Memory-Aware Adaptive Replay for Continual LLM Fine-Tuning
di: Lu, Yiyang, et al.
Pubblicazione: (2026)
di: Lu, Yiyang, et al.
Pubblicazione: (2026)
Fast T2T: Optimization Consistency Speeds Up Diffusion-Based Training-to-Testing Solving for Combinatorial Optimization
di: Li, Yang, et al.
Pubblicazione: (2025)
di: Li, Yang, et al.
Pubblicazione: (2025)
VERGE: Formal Refinement and Guidance Engine for Verifiable LLM Reasoning
di: Singh, Vikash, et al.
Pubblicazione: (2026)
di: Singh, Vikash, et al.
Pubblicazione: (2026)
SPOT: Scalable 3D Pre-training via Occupancy Prediction for Learning Transferable 3D Representations
di: Yan, Xiangchao, et al.
Pubblicazione: (2023)
di: Yan, Xiangchao, et al.
Pubblicazione: (2023)
StructChart: On the Schema, Metric, and Augmentation for Visual Chart Understanding
di: Xia, Renqiu, et al.
Pubblicazione: (2023)
di: Xia, Renqiu, et al.
Pubblicazione: (2023)
On the Evaluation and Refinement of Vision-Language Instruction Tuning Datasets
di: Liao, Ning, et al.
Pubblicazione: (2023)
di: Liao, Ning, et al.
Pubblicazione: (2023)
Chimera: Improving Generalist Model with Domain-Specific Experts
di: Peng, Tianshuo, et al.
Pubblicazione: (2024)
di: Peng, Tianshuo, et al.
Pubblicazione: (2024)
SurveyForge: On the Outline Heuristics, Memory-Driven Generation, and Multi-dimensional Evaluation for Automated Survey Writing
di: Yan, Xiangchao, et al.
Pubblicazione: (2025)
di: Yan, Xiangchao, et al.
Pubblicazione: (2025)
PiSA: A Self-Augmented Data Engine and Training Strategy for 3D Understanding with Large Models
di: Guo, Zilu, et al.
Pubblicazione: (2025)
di: Guo, Zilu, et al.
Pubblicazione: (2025)
Epistemic Gain, Aleatoric Cost: Uncertainty Decomposition in Multi-Agent Debate for Math Reasoning
di: Qiao, Dan, et al.
Pubblicazione: (2026)
di: Qiao, Dan, et al.
Pubblicazione: (2026)
ReSimAD: Zero-Shot 3D Domain Transfer for Autonomous Driving with Source Reconstruction and Target Simulation
di: Zhang, Bo, et al.
Pubblicazione: (2023)
di: Zhang, Bo, et al.
Pubblicazione: (2023)
DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding
di: Feng, Xiang, et al.
Pubblicazione: (2026)
di: Feng, Xiang, et al.
Pubblicazione: (2026)
MMSearch: Benchmarking the Potential of Large Models as Multi-modal Search Engines
di: Jiang, Dongzhi, et al.
Pubblicazione: (2024)
di: Jiang, Dongzhi, et al.
Pubblicazione: (2024)
Dolphin: Moving Towards Closed-loop Auto-research through Thinking, Practice, and Feedback
di: Yuan, Jiakang, et al.
Pubblicazione: (2025)
di: Yuan, Jiakang, et al.
Pubblicazione: (2025)
Depth Reconstruction with Neural Signed Distance Fields in Structured Light Systems
di: Qiao, Rukun, et al.
Pubblicazione: (2024)
di: Qiao, Rukun, et al.
Pubblicazione: (2024)
Trustworthy Image Semantic Communication with GenAI: Explainablity, Controllability, and Efficiency
di: Wang, Xijun, et al.
Pubblicazione: (2024)
di: Wang, Xijun, et al.
Pubblicazione: (2024)
Efficient, Adaptive Near-Field Beam Training based on Linear Bandit
di: Liu, Junchi, et al.
Pubblicazione: (2026)
di: Liu, Junchi, et al.
Pubblicazione: (2026)
FormalGeo: An Extensible Formalized Framework for Olympiad Geometric Problem Solving
di: Zhang, Xiaokai, et al.
Pubblicazione: (2023)
di: Zhang, Xiaokai, et al.
Pubblicazione: (2023)
Picachv: Formally Verified Data Use Policy Enforcement for Secure Data Analytics
di: Chen, Haobin Hiroki, et al.
Pubblicazione: (2025)
di: Chen, Haobin Hiroki, et al.
Pubblicazione: (2025)
On the Emergence of Cross-Task Linearity in the Pretraining-Finetuning Paradigm
di: Zhou, Zhanpeng, et al.
Pubblicazione: (2024)
di: Zhou, Zhanpeng, et al.
Pubblicazione: (2024)
Learning to Generate Formally Verifiable Step-by-Step Logic Reasoning via Structured Formal Intermediaries
di: Chen, Luoxin, et al.
Pubblicazione: (2026)
di: Chen, Luoxin, et al.
Pubblicazione: (2026)
Propose, Solve, Verify: Self-Play Through Formal Verification
di: Wilf, Alex, et al.
Pubblicazione: (2025)
di: Wilf, Alex, et al.
Pubblicazione: (2025)
Trustworthy assessment of heterogeneous treatment effect estimator
di: Gao, Zijun
Pubblicazione: (2024)
di: Gao, Zijun
Pubblicazione: (2024)
Policy-Conditioned Policies for Multi-Agent Task Solving
di: Lin, Yue, et al.
Pubblicazione: (2025)
di: Lin, Yue, et al.
Pubblicazione: (2025)
A Variational Autoencoder for Neural Temporal Point Processes with Dynamic Latent Graphs
di: Yang, Sikun, et al.
Pubblicazione: (2023)
di: Yang, Sikun, et al.
Pubblicazione: (2023)
LimSim Series: An Autonomous Driving Simulation Platform for Validation and Enhancement
di: Fu, Daocheng, et al.
Pubblicazione: (2025)
di: Fu, Daocheng, et al.
Pubblicazione: (2025)
LimSim++: A Closed-Loop Platform for Deploying Multimodal LLMs in Autonomous Driving
di: Fu, Daocheng, et al.
Pubblicazione: (2024)
di: Fu, Daocheng, et al.
Pubblicazione: (2024)
Correspondence on “Needs Assessment for Updating Institute of Medicine Standards for Trustworthy Clinical Practice Guidelines”
di: Zijun Wang, et al.
Pubblicazione: (2025)
di: Zijun Wang, et al.
Pubblicazione: (2025)
TrafficMCTS: A Closed-Loop Traffic Flow Generation Framework with Group-Based Monte Carlo Tree Search
di: Fu, Ze, et al.
Pubblicazione: (2023)
di: Fu, Ze, et al.
Pubblicazione: (2023)
TrustLLM: Trustworthiness in Large Language Models
di: Huang, Yue, et al.
Pubblicazione: (2024)
di: Huang, Yue, et al.
Pubblicazione: (2024)
Chain of Condition: Construct, Verify and Solve Conditions for Conditional Question Answering
di: Lin, Jiuheng, et al.
Pubblicazione: (2024)
di: Lin, Jiuheng, et al.
Pubblicazione: (2024)
Generative Universal Verifier as Multimodal Meta-Reasoner
di: Zhang, Xinchen, et al.
Pubblicazione: (2025)
di: Zhang, Xinchen, et al.
Pubblicazione: (2025)
SE-Merging: A Self-Enhanced Approach for Dynamic Model Merging
di: Chen, Zijun, et al.
Pubblicazione: (2025)
di: Chen, Zijun, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Milestones over Outcome: Unlocking Geometric Reasoning with Sub-Goal Verifiable Reward
di: Chen, Jianlong, et al.
Pubblicazione: (2026) -
GeoBench: Rethinking Multimodal Geometric Problem-Solving via Hierarchical Evaluation
di: Feng, Yuan, et al.
Pubblicazione: (2025) -
GeoX: Geometric Problem Solving Through Unified Formalized Vision-Language Pre-training
di: Xia, Renqiu, et al.
Pubblicazione: (2024) -
ChartX & ChartVLM: A Versatile Benchmark and Foundation Model for Complicated Chart Reasoning
di: Xia, Renqiu, et al.
Pubblicazione: (2024) -
Beyond Theorem Proving: Formulation, Framework and Benchmark for Formal Problem-Solving
di: Liu, Qi, et al.
Pubblicazione: (2025)