TaTToo: Tool-Grounded Thinking PRM for Test-Time Scaling in Tabular Reasoning
Fuente:
arXiv
Salvato in:
| Autori principali: | Zou, Jiaru, Roy, Soumya, Verma, Vinay Kumar, Wang, Ziyi, Wipf, David, Lu, Pan, Negi, Sumit, Zou, James, He, Jingrui |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Rethinking Test Time Scaling for Flow-Matching Generative Models
di: Yu, Qingtao, et al.
Pubblicazione: (2025)
di: Yu, Qingtao, et al.
Pubblicazione: (2025)
ReasonFlux-PRM: Trajectory-Aware PRMs for Long Chain-of-Thought Reasoning in LLMs
di: Zou, Jiaru, et al.
Pubblicazione: (2025)
di: Zou, Jiaru, et al.
Pubblicazione: (2025)
AutoTool: Dynamic Tool Selection and Integration for Agentic Reasoning
di: Zou, Jiaru, et al.
Pubblicazione: (2025)
di: Zou, Jiaru, et al.
Pubblicazione: (2025)
ADROIT: A Self-Supervised Framework for Learning Robust Representations for Active Learning
di: Banerjee, Soumya, et al.
Pubblicazione: (2025)
di: Banerjee, Soumya, et al.
Pubblicazione: (2025)
DIVERSED: Relaxed Speculative Decoding via Dynamic Ensemble Verification
di: Wang, Ziyi, et al.
Pubblicazione: (2026)
di: Wang, Ziyi, et al.
Pubblicazione: (2026)
GenPRM: Scaling Test-Time Compute of Process Reward Models via Generative Reasoning
di: Zhao, Jian, et al.
Pubblicazione: (2025)
di: Zhao, Jian, et al.
Pubblicazione: (2025)
Think Right, Not More: Test-Time Scaling for Numerical Claim Verification
di: Chungkham, Primakov, et al.
Pubblicazione: (2025)
di: Chungkham, Primakov, et al.
Pubblicazione: (2025)
Thinking While Listening: Simple Test Time Scaling For Audio Classification
di: Verma, Prateek, et al.
Pubblicazione: (2025)
di: Verma, Prateek, et al.
Pubblicazione: (2025)
Does Thinking More always Help? Mirage of Test-Time Scaling in Reasoning Models
di: Ghosal, Soumya Suvra, et al.
Pubblicazione: (2025)
di: Ghosal, Soumya Suvra, et al.
Pubblicazione: (2025)
Optimal Aggregation of LLM and PRM Signals for Efficient Test-Time Scaling
di: Kuang, Peng, et al.
Pubblicazione: (2025)
di: Kuang, Peng, et al.
Pubblicazione: (2025)
TIM-PRM: Verifying multimodal reasoning with Tool-Integrated PRM
di: Kuang, Peng, et al.
Pubblicazione: (2025)
di: Kuang, Peng, et al.
Pubblicazione: (2025)
NOVO: Unlearning-Compliant Vision Transformers
di: Roy, Soumya, et al.
Pubblicazione: (2025)
di: Roy, Soumya, et al.
Pubblicazione: (2025)
ContextPRM: Leveraging Contextual Coherence for multi-domain Test-Time Scaling
di: Zhang, Haotian, et al.
Pubblicazione: (2025)
di: Zhang, Haotian, et al.
Pubblicazione: (2025)
Thinking vs. Doing: Agents that Reason by Scaling Test-Time Interaction
di: Shen, Junhong, et al.
Pubblicazione: (2025)
di: Shen, Junhong, et al.
Pubblicazione: (2025)
GM-PRM: A Generative Multimodal Process Reward Model for Multimodal Mathematical Reasoning
di: Zhang, Jianghangfan, et al.
Pubblicazione: (2025)
di: Zhang, Jianghangfan, et al.
Pubblicazione: (2025)
STEM-POM: Evaluating Language Models Math-Symbol Reasoning in Document Parsing
di: Zou, Jiaru, et al.
Pubblicazione: (2024)
di: Zou, Jiaru, et al.
Pubblicazione: (2024)
LLM-Forest: Ensemble Learning of LLMs with Graph-Augmented Prompts for Data Imputation
di: He, Xinrui, et al.
Pubblicazione: (2024)
di: He, Xinrui, et al.
Pubblicazione: (2024)
VisRef: Visual Refocusing while Thinking Improves Test-Time Scaling in Multi-Modal Large Reasoning Models
di: Ghosal, Soumya Suvra, et al.
Pubblicazione: (2026)
di: Ghosal, Soumya Suvra, et al.
Pubblicazione: (2026)
Good Learners Think Their Thinking: Generative PRM Makes Large Reasoning Model More Efficient Math Learner
di: He, Tao, et al.
Pubblicazione: (2025)
di: He, Tao, et al.
Pubblicazione: (2025)
Demystifying Reinforcement Learning in Agentic Reasoning
di: Yu, Zhaochen, et al.
Pubblicazione: (2025)
di: Yu, Zhaochen, et al.
Pubblicazione: (2025)
Orion-MSP: Multi-Scale Sparse Attention for Tabular In-Context Learning
di: Bouadi, Mohamed, et al.
Pubblicazione: (2025)
di: Bouadi, Mohamed, et al.
Pubblicazione: (2025)
ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling
di: Lin, Jianghao, et al.
Pubblicazione: (2025)
di: Lin, Jianghao, et al.
Pubblicazione: (2025)
Transformer Copilot: Learning from The Mistake Log in LLM Fine-tuning
di: Zou, Jiaru, et al.
Pubblicazione: (2025)
di: Zou, Jiaru, et al.
Pubblicazione: (2025)
Influence-Preserving Proxies for Gradient-Based Data Selection in LLM Fine-tuning
di: Chen, Sirui, et al.
Pubblicazione: (2026)
di: Chen, Sirui, et al.
Pubblicazione: (2026)
MatryoshkaThinking: Recursive Test-Time Scaling Enables Efficient Reasoning
di: Chen, Hongwei, et al.
Pubblicazione: (2025)
di: Chen, Hongwei, et al.
Pubblicazione: (2025)
Towards Thinking-Optimal Scaling of Test-Time Compute for LLM Reasoning
di: Yang, Wenkai, et al.
Pubblicazione: (2025)
di: Yang, Wenkai, et al.
Pubblicazione: (2025)
AdaFuse: Adaptive Ensemble Decoding with Test-Time Scaling for LLMs
di: Cui, Chengming, et al.
Pubblicazione: (2026)
di: Cui, Chengming, et al.
Pubblicazione: (2026)
PRM-BAS: Enhancing Multimodal Reasoning through PRM-guided Beam Annealing Search
di: Hu, Pengfei, et al.
Pubblicazione: (2025)
di: Hu, Pengfei, et al.
Pubblicazione: (2025)
AvaTaR: Optimizing LLM Agents for Tool Usage via Contrastive Reasoning
di: Wu, Shirley, et al.
Pubblicazione: (2024)
di: Wu, Shirley, et al.
Pubblicazione: (2024)
OctoTools: An Agentic Framework with Extensible Tools for Complex Reasoning
di: Lu, Pan, et al.
Pubblicazione: (2025)
di: Lu, Pan, et al.
Pubblicazione: (2025)
EvoSelect: Data-Efficient LLM Evolution for Targeted Task Adaptation
di: Li, Ting-Wei, et al.
Pubblicazione: (2026)
di: Li, Ting-Wei, et al.
Pubblicazione: (2026)
PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs
di: Zhao, Yanjun, et al.
Pubblicazione: (2026)
di: Zhao, Yanjun, et al.
Pubblicazione: (2026)
MC-Search: Evaluating and Enhancing Multimodal Agentic Search with Structured Long Reasoning Chains
di: Ning, Xuying, et al.
Pubblicazione: (2026)
di: Ning, Xuying, et al.
Pubblicazione: (2026)
GroundedPRM: Tree-Guided and Fidelity-Aware Process Reward Modeling for Step-Level Reasoning
di: Zhang, Yao, et al.
Pubblicazione: (2025)
di: Zhang, Yao, et al.
Pubblicazione: (2025)
Recursive Multi-Agent Systems
di: Yang, Xiyuan, et al.
Pubblicazione: (2026)
di: Yang, Xiyuan, et al.
Pubblicazione: (2026)
MIRAGE: Scaling Test-Time Inference with Parallel Graph-Retrieval-Augmented Reasoning Chains
di: Wei, Kaiwen, et al.
Pubblicazione: (2025)
di: Wei, Kaiwen, et al.
Pubblicazione: (2025)
Language in the Flow of Time: Time-Series-Paired Texts Weaved into a Unified Temporal Narrative
di: Li, Zihao, et al.
Pubblicazione: (2025)
di: Li, Zihao, et al.
Pubblicazione: (2025)
Thinking Long, but Short: Stable Sequential Test-Time Scaling for Large Reasoning Models
di: Metel, Michael R., et al.
Pubblicazione: (2026)
di: Metel, Michael R., et al.
Pubblicazione: (2026)
Thinking in Frames: How Visual Context and Test-Time Scaling Empower Video Reasoning
di: Li, Chengzu, et al.
Pubblicazione: (2026)
di: Li, Chengzu, et al.
Pubblicazione: (2026)
Start Small, Think Big: Curriculum-based Relative Policy Optimization for Visual Grounding
di: Yan, Qingyang, et al.
Pubblicazione: (2025)
di: Yan, Qingyang, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Rethinking Test Time Scaling for Flow-Matching Generative Models
di: Yu, Qingtao, et al.
Pubblicazione: (2025) -
ReasonFlux-PRM: Trajectory-Aware PRMs for Long Chain-of-Thought Reasoning in LLMs
di: Zou, Jiaru, et al.
Pubblicazione: (2025) -
AutoTool: Dynamic Tool Selection and Integration for Agentic Reasoning
di: Zou, Jiaru, et al.
Pubblicazione: (2025) -
ADROIT: A Self-Supervised Framework for Learning Robust Representations for Active Learning
di: Banerjee, Soumya, et al.
Pubblicazione: (2025) -
DIVERSED: Relaxed Speculative Decoding via Dynamic Ensemble Verification
di: Wang, Ziyi, et al.
Pubblicazione: (2026)