Molecular Identifier Visual Prompt and Verifiable Reinforcement Learning for Chemical Reaction Diagram Parsing
Fuente:
arXiv
Salvato in:
| Autori principali: | Song, Jiahe, Wang, Chuang, Wang, Yinfan, Zheng, Hao, Nie, Rui, Jiang, Bowen, Wei, Xingjian, Gao, Junyuan, Wang, Yubin, Wang, Bin, Wu, Lijun, Wu, Jiang, Yu, Qian, He, Conghui |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
RxnCaption: Reformulating Reaction Diagram Parsing as Visual Prompt Guided Captioning
di: Song, Jiahe, et al.
Pubblicazione: (2025)
di: Song, Jiahe, et al.
Pubblicazione: (2025)
GTR-CoT: Graph Traversal as Visual Chain of Thought for Molecular Structure Recognition
di: Wang, Jingchao, et al.
Pubblicazione: (2025)
di: Wang, Jingchao, et al.
Pubblicazione: (2025)
Evaluating Large Language Model with Knowledge Oriented Language Specific Simple Question Answering
di: Jiang, Bowen, et al.
Pubblicazione: (2025)
di: Jiang, Bowen, et al.
Pubblicazione: (2025)
PM4Bench: Benchmarking Large Vision-Language Models with Parallel Multilingual Multi-Modal Multi-task Corpus
di: Gao, Junyuan, et al.
Pubblicazione: (2025)
di: Gao, Junyuan, et al.
Pubblicazione: (2025)
MACReD: A Multi-Agent Collaborative Reasoning Framework for Reaction Diagram Parsing
di: Tang, Chuang, et al.
Pubblicazione: (2026)
di: Tang, Chuang, et al.
Pubblicazione: (2026)
Document Parsing Unveiled: Techniques, Challenges, and Prospects for Structured Information Extraction
di: Zhang, Qintong, et al.
Pubblicazione: (2024)
di: Zhang, Qintong, et al.
Pubblicazione: (2024)
OpenHuEval: Evaluating Large Language Model on Hungarian Specifics
di: Yang, Haote, et al.
Pubblicazione: (2025)
di: Yang, Haote, et al.
Pubblicazione: (2025)
Meta-rater: A Multi-dimensional Data Selection Method for Pre-training Language Models
di: Zhuang, Xinlin, et al.
Pubblicazione: (2025)
di: Zhuang, Xinlin, et al.
Pubblicazione: (2025)
GRAIT: Gradient-Driven Refusal-Aware Instruction Tuning for Effective Hallucination Mitigation
di: Zhu, Runchuan, et al.
Pubblicazione: (2025)
di: Zhu, Runchuan, et al.
Pubblicazione: (2025)
Exploring Interpretability for Visual Prompt Tuning with Cross-layer Concepts
di: Wang, Yubin, et al.
Pubblicazione: (2025)
di: Wang, Yubin, et al.
Pubblicazione: (2025)
Utilize the Flow before Stepping into the Same River Twice: Certainty Represented Knowledge Flow for Refusal-Aware Instruction Tuning
di: Zhu, Runchuan, et al.
Pubblicazione: (2024)
di: Zhu, Runchuan, et al.
Pubblicazione: (2024)
DOCR-Inspector: Fine-Grained and Automated Evaluation of Document Parsing with VLM
di: Zhang, Qintong, et al.
Pubblicazione: (2025)
di: Zhang, Qintong, et al.
Pubblicazione: (2025)
Fuse, Reason and Verify: Geometry Problem Solving with Parsed Clauses from Diagram
di: Zhang, Ming-Liang, et al.
Pubblicazione: (2024)
di: Zhang, Ming-Liang, et al.
Pubblicazione: (2024)
Exploring Visual Prompting: Robustness Inheritance and Beyond
di: Li, Qi, et al.
Pubblicazione: (2025)
di: Li, Qi, et al.
Pubblicazione: (2025)
AgenticOCR: Parsing Only What You Need for Efficient Retrieval-Augmented Generation
di: Wang, Zhengren, et al.
Pubblicazione: (2026)
di: Wang, Zhengren, et al.
Pubblicazione: (2026)
ReactBench: A Benchmark for Topological Reasoning in MLLMs on Chemical Reaction Diagrams
di: Xu, Qiang, et al.
Pubblicazione: (2026)
di: Xu, Qiang, et al.
Pubblicazione: (2026)
MinerU-Popo: Universal Post-Processing Model for Structured Document Parsing
di: Xu, Bangrui, et al.
Pubblicazione: (2026)
di: Xu, Bangrui, et al.
Pubblicazione: (2026)
ChemScraper: Leveraging PDF Graphics Instructions for Molecular Diagram Parsing
di: Shah, Ayush Kumar, et al.
Pubblicazione: (2023)
di: Shah, Ayush Kumar, et al.
Pubblicazione: (2023)
Visual Instance-aware Prompt Tuning
di: Xiao, Xi, et al.
Pubblicazione: (2025)
di: Xiao, Xi, et al.
Pubblicazione: (2025)
Visual Variational Autoencoder Prompt Tuning
di: Xiao, Xi, et al.
Pubblicazione: (2025)
di: Xiao, Xi, et al.
Pubblicazione: (2025)
RGBX-R1: Visual Modality Chain-of-Thought Guided Reinforcement Learning for Multimodal Grounding
di: Wu, Jiahe, et al.
Pubblicazione: (2026)
di: Wu, Jiahe, et al.
Pubblicazione: (2026)
MolRecBench-Wild: A Real-World Benchmark for Optical Chemical Structure Recognition
di: Yang, Haote, et al.
Pubblicazione: (2026)
di: Yang, Haote, et al.
Pubblicazione: (2026)
NMRTrans: Structure Elucidation from Experimental NMR Spectra via Set Transformers
di: Yang, Liujia, et al.
Pubblicazione: (2026)
di: Yang, Liujia, et al.
Pubblicazione: (2026)
ActPrompt: In-Domain Feature Adaptation via Action Cues for Video Temporal Grounding
di: Wang, Yubin, et al.
Pubblicazione: (2024)
di: Wang, Yubin, et al.
Pubblicazione: (2024)
Bridging Visual Representation and Reinforcement Learning from Verifiable Rewards in Large Vision-Language Models
di: Han, Yuhang, et al.
Pubblicazione: (2026)
di: Han, Yuhang, et al.
Pubblicazione: (2026)
Geoparsing: Diagram Parsing for Plane and Solid Geometry with a Unified Formal Language
di: Wang, Peijie, et al.
Pubblicazione: (2026)
di: Wang, Peijie, et al.
Pubblicazione: (2026)
NVSMask3D: Hard Visual Prompting with Camera Pose Interpolation for 3D Open Vocabulary Instance Segmentation
di: Fang, Junyuan, et al.
Pubblicazione: (2025)
di: Fang, Junyuan, et al.
Pubblicazione: (2025)
Reliable and Compact Graph Fine-tuning via GraphSparse Prompting
di: Jiang, Bo, et al.
Pubblicazione: (2024)
di: Jiang, Bo, et al.
Pubblicazione: (2024)
Identifying Unknown Stochastic Dynamics via Finite expression methods
di: Liang, Senwei, et al.
Pubblicazione: (2025)
di: Liang, Senwei, et al.
Pubblicazione: (2025)
LINK: Adaptive Modality Interaction for Audio-Visual Video Parsing
di: Wang, Langyu, et al.
Pubblicazione: (2024)
di: Wang, Langyu, et al.
Pubblicazione: (2024)
Unsupervised Collaborative Domain Adaptation for Driving Scene Parsing
di: Fan, Jiahe, et al.
Pubblicazione: (2026)
di: Fan, Jiahe, et al.
Pubblicazione: (2026)
Integrating Genomic, eQTL, and Mendelian Randomization Analyses to Identify Microglial Drug Targets in Multiple Sclerosis
di: Wu Yan, et al.
Pubblicazione: (2025)
di: Wu Yan, et al.
Pubblicazione: (2025)
Infinity Parser: Layout Aware Reinforcement Learning for Scanned Document Parsing
di: Wang, Baode, et al.
Pubblicazione: (2025)
di: Wang, Baode, et al.
Pubblicazione: (2025)
Infinity Parser: Layout Aware Reinforcement Learning for Scanned Document Parsing
di: Wang, Baode, et al.
Pubblicazione: (2025)
di: Wang, Baode, et al.
Pubblicazione: (2025)
RAIDEN-R1: Improving Role-awareness of LLMs via GRPO with Verifiable Reward
di: Wang, Zongsheng, et al.
Pubblicazione: (2025)
di: Wang, Zongsheng, et al.
Pubblicazione: (2025)
Algebraic hyperbolicity of very general hypersurfaces in weighted projective spaces
di: Wang, Jiahe
Pubblicazione: (2025)
di: Wang, Jiahe
Pubblicazione: (2025)
Jordan bounds for volume-preserving Cremona groups
di: Wang, Jiahe
Pubblicazione: (2025)
di: Wang, Jiahe
Pubblicazione: (2025)
Log algebraic hyperbolicity of $\overline{M}_{0,n}$
di: Wang, Jiahe
Pubblicazione: (2025)
di: Wang, Jiahe
Pubblicazione: (2025)
Closing the Data Loop: Using OpenDataArena to Engineer Superior Training Datasets
di: Gao, Xin, et al.
Pubblicazione: (2025)
di: Gao, Xin, et al.
Pubblicazione: (2025)
Incentivizing Parametric Knowledge via Reinforcement Learning with Verifiable Rewards for Cross-Cultural Entity Translation
di: Zhou, Jiang, et al.
Pubblicazione: (2026)
di: Zhou, Jiang, et al.
Pubblicazione: (2026)
Documenti analoghi
-
RxnCaption: Reformulating Reaction Diagram Parsing as Visual Prompt Guided Captioning
di: Song, Jiahe, et al.
Pubblicazione: (2025) -
GTR-CoT: Graph Traversal as Visual Chain of Thought for Molecular Structure Recognition
di: Wang, Jingchao, et al.
Pubblicazione: (2025) -
Evaluating Large Language Model with Knowledge Oriented Language Specific Simple Question Answering
di: Jiang, Bowen, et al.
Pubblicazione: (2025) -
PM4Bench: Benchmarking Large Vision-Language Models with Parallel Multilingual Multi-Modal Multi-task Corpus
di: Gao, Junyuan, et al.
Pubblicazione: (2025) -
MACReD: A Multi-Agent Collaborative Reasoning Framework for Reaction Diagram Parsing
di: Tang, Chuang, et al.
Pubblicazione: (2026)