Gespeichert in:
| Hauptverfasser: | Chang, Qikai, Zhang, Zhenrong, Hu, Pengfei, Du, Jun, Ma, Jiefeng, Pan, Yicheng, Zhang, Jianshu, Liu, Quan, Gao, Jianqing |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | https://arxiv.org/abs/2509.13761 |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Enhancing the Geometric Problem-Solving Ability of Multimodal LLMs via Symbolic-Neural Integration
von: Pan, Yicheng, et al.
Veröffentlicht: (2025)
von: Pan, Yicheng, et al.
Veröffentlicht: (2025)
PRM-BAS: Enhancing Multimodal Reasoning through PRM-guided Beam Annealing Search
von: Hu, Pengfei, et al.
Veröffentlicht: (2025)
von: Hu, Pengfei, et al.
Veröffentlicht: (2025)
Step Potential Advantage Estimation: Harnessing Intermediate Confidence and Correctness for Efficient Mathematical Reasoning
von: Wu, Fei, et al.
Veröffentlicht: (2026)
von: Wu, Fei, et al.
Veröffentlicht: (2026)
MMC: Iterative Refinement of VLM Reasoning via MCTS-based Multimodal Critique
von: Liu, Shuhang, et al.
Veröffentlicht: (2025)
von: Liu, Shuhang, et al.
Veröffentlicht: (2025)
Skeleton and Font Generation Network for Zero-shot Chinese Character Generation
von: Xue, Mobai, et al.
Veröffentlicht: (2025)
von: Xue, Mobai, et al.
Veröffentlicht: (2025)
DocMamba: Efficient Document Pre-training with State Space Model
von: Hu, Pengfei, et al.
Veröffentlicht: (2024)
von: Hu, Pengfei, et al.
Veröffentlicht: (2024)
PEARL: Training Socratic Tutors with Pedagogically Aligned Reinforcement Learning
von: Chang, Qikai, et al.
Veröffentlicht: (2026)
von: Chang, Qikai, et al.
Veröffentlicht: (2026)
UniTabNet: Bridging Vision and Language Models for Enhanced Table Structure Recognition
von: Zhang, Zhenrong, et al.
Veröffentlicht: (2024)
von: Zhang, Zhenrong, et al.
Veröffentlicht: (2024)
SRFUND: A Multi-Granularity Hierarchical Structure Reconstruction Benchmark in Form Understanding
von: Ma, Jiefeng, et al.
Veröffentlicht: (2024)
von: Ma, Jiefeng, et al.
Veröffentlicht: (2024)
Bidirectional Trained Tree-Structured Decoder for Handwritten Mathematical Expression Recognition
von: Cheng, Hanbo, et al.
Veröffentlicht: (2023)
von: Cheng, Hanbo, et al.
Veröffentlicht: (2023)
RFL: Simplifying Chemical Structure Recognition with Ring-Free Language
von: Chang, Qikai, et al.
Veröffentlicht: (2024)
von: Chang, Qikai, et al.
Veröffentlicht: (2024)
See then Tell: Enhancing Key Information Extraction with Vision Grounding
von: Liu, Shuhang, et al.
Veröffentlicht: (2024)
von: Liu, Shuhang, et al.
Veröffentlicht: (2024)
SEMv2: Table Separation Line Detection Based on Instance Segmentation
von: Zhang, Zhenrong, et al.
Veröffentlicht: (2023)
von: Zhang, Zhenrong, et al.
Veröffentlicht: (2023)
SEMv3: A Fast and Robust Approach to Table Separation Line Detection
von: Qin, Chunxia, et al.
Veröffentlicht: (2024)
von: Qin, Chunxia, et al.
Veröffentlicht: (2024)
ToRL: Scaling Tool-Integrated RL
von: Li, Xuefeng, et al.
Veröffentlicht: (2025)
von: Li, Xuefeng, et al.
Veröffentlicht: (2025)
Implicit Hierarchical GRPO: Decoupling Tool Invocation from Execution for Tool-Integrated Mathematical Reasoning
von: Wang, Li, et al.
Veröffentlicht: (2026)
von: Wang, Li, et al.
Veröffentlicht: (2026)
Quality-aware Masked Diffusion Transformer for Enhanced Music Generation
von: Li, Chang, et al.
Veröffentlicht: (2024)
von: Li, Chang, et al.
Veröffentlicht: (2024)
Unlocking Complex Visual Generation via Closed-Loop Verified Reasoning
von: Cheng, Hanbo, et al.
Veröffentlicht: (2026)
von: Cheng, Hanbo, et al.
Veröffentlicht: (2026)
DAWN: Dynamic Frame Avatar with Non-autoregressive Diffusion Framework for Talking Head Video Generation
von: Cheng, Hanbo, et al.
Veröffentlicht: (2024)
von: Cheng, Hanbo, et al.
Veröffentlicht: (2024)
Latent Swap Joint Diffusion for 2D Long-Form Latent Generation
von: Dai, Yusheng, et al.
Veröffentlicht: (2025)
von: Dai, Yusheng, et al.
Veröffentlicht: (2025)
CharTool: Tool-Integrated Visual Reasoning for Chart Understanding
von: Zhang, Situo, et al.
Veröffentlicht: (2026)
von: Zhang, Situo, et al.
Veröffentlicht: (2026)
THOR: A Generic Energy Estimation Approach for On-Device Training
von: Zhang, Jiaru, et al.
Veröffentlicht: (2025)
von: Zhang, Jiaru, et al.
Veröffentlicht: (2025)
THOR: Thermal-guided Hand-Object Reasoning via Adaptive Vision Sampling
von: Shahi, Soroush, et al.
Veröffentlicht: (2025)
von: Shahi, Soroush, et al.
Veröffentlicht: (2025)
AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning
von: Wei, Yifan, et al.
Veröffentlicht: (2025)
von: Wei, Yifan, et al.
Veröffentlicht: (2025)
Interleaved Tool-Call Reasoning for Protein Function Understanding
von: Fan, Chuanliu, et al.
Veröffentlicht: (2026)
von: Fan, Chuanliu, et al.
Veröffentlicht: (2026)
Multicriteria decision making applied to waste recycling: comparison between THOR and THOR 2 methods
von: Letícia de Oliveira Gago Ramos de Souza
Veröffentlicht: (2023)
von: Letícia de Oliveira Gago Ramos de Souza
Veröffentlicht: (2023)
Geometric phase metasurfaces for linearly polarized light
von: Gao, Yubin, et al.
Veröffentlicht: (2025)
von: Gao, Yubin, et al.
Veröffentlicht: (2025)
Fast Adaptive Anti-Jamming Channel Access via Deep Q Learning and Coarse-Grained Spectrum Prediction
von: Zhang, Jianshu, et al.
Veröffentlicht: (2025)
von: Zhang, Jianshu, et al.
Veröffentlicht: (2025)
HDA-SELD: Hierarchical Cross-Modal Distillation with Multi-Level Data Augmentation for Low-Resource Audio-Visual Sound Event Localization and Detection
von: Wang, Qing, et al.
Veröffentlicht: (2025)
von: Wang, Qing, et al.
Veröffentlicht: (2025)
MindWatcher: Toward Smarter Multimodal Tool-Integrated Reasoning
von: Chen, Jiawei, et al.
Veröffentlicht: (2025)
von: Chen, Jiawei, et al.
Veröffentlicht: (2025)
LogicPuzzleRL: Cultivating Robust Mathematical Reasoning in LLMs via Reinforcement Learning
von: Wong, Zhen Hao, et al.
Veröffentlicht: (2025)
von: Wong, Zhen Hao, et al.
Veröffentlicht: (2025)
VERIFY-RL: Verifiable Recursive Decomposition for Reinforcement Learning in Mathematical Reasoning
von: Qasim, Kaleem Ullah, et al.
Veröffentlicht: (2026)
von: Qasim, Kaleem Ullah, et al.
Veröffentlicht: (2026)
THOR: Transformer Heuristics for On-Demand Retrieval
von: Shi, Isaac, et al.
Veröffentlicht: (2025)
von: Shi, Isaac, et al.
Veröffentlicht: (2025)
Concise Reasoning in the Lens of Lagrangian Optimization
von: Gao, Chengqian, et al.
Veröffentlicht: (2025)
von: Gao, Chengqian, et al.
Veröffentlicht: (2025)
THOR-MoE: Hierarchical Task-Guided and Context-Responsive Routing for Neural Machine Translation
von: Liang, Yunlong, et al.
Veröffentlicht: (2025)
von: Liang, Yunlong, et al.
Veröffentlicht: (2025)
EquivPruner: Boosting Efficiency and Quality in LLM-Based Search via Action Pruning
von: Liu, Jiawei, et al.
Veröffentlicht: (2025)
von: Liu, Jiawei, et al.
Veröffentlicht: (2025)
When Simulation Lies: A Sim-to-Real Benchmark and Domain-Randomized RL Recipe for Tool-Use Agents
von: Zhou, Xiaolin, et al.
Veröffentlicht: (2026)
von: Zhou, Xiaolin, et al.
Veröffentlicht: (2026)
PORTool: Importance-Aware Policy Optimization with Rewarded Tree for Multi-Tool-Integrated Reasoning
von: Wu, Feijie, et al.
Veröffentlicht: (2025)
von: Wu, Feijie, et al.
Veröffentlicht: (2025)
Agent RL Scaling Law: Agent RL with Spontaneous Code Execution for Mathematical Problem Solving
von: Mai, Xinji, et al.
Veröffentlicht: (2025)
von: Mai, Xinji, et al.
Veröffentlicht: (2025)
Efficient Mathematical Reasoning Models via Dynamic Pruning and Knowledge Distillation
von: Yu, Fengming, et al.
Veröffentlicht: (2025)
von: Yu, Fengming, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Enhancing the Geometric Problem-Solving Ability of Multimodal LLMs via Symbolic-Neural Integration
von: Pan, Yicheng, et al.
Veröffentlicht: (2025) -
PRM-BAS: Enhancing Multimodal Reasoning through PRM-guided Beam Annealing Search
von: Hu, Pengfei, et al.
Veröffentlicht: (2025) -
Step Potential Advantage Estimation: Harnessing Intermediate Confidence and Correctness for Efficient Mathematical Reasoning
von: Wu, Fei, et al.
Veröffentlicht: (2026) -
MMC: Iterative Refinement of VLM Reasoning via MCTS-based Multimodal Critique
von: Liu, Shuhang, et al.
Veröffentlicht: (2025) -
Skeleton and Font Generation Network for Zero-shot Chinese Character Generation
von: Xue, Mobai, et al.
Veröffentlicht: (2025)