Chain-of-Procedure: Hierarchical Visual-Language Reasoning for Procedural QA
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chen, Guanhua, Yao, Yutong, Sun, Shenghe, Gao, Ci-Jun, Liu, Shudong, Chao, Lidia S., Wan, Feng, Wong, Derek F. |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Not All LoRA Parameters Are Essential: Insights on Inference Necessity
par: Chen, Guanhua, et autres
Publié: (2025)
par: Chen, Guanhua, et autres
Publié: (2025)
A Two-Stage Prediction-Aware Contrastive Learning Framework for Multi-Intent NLU
par: Chen, Guanhua, et autres
Publié: (2024)
par: Chen, Guanhua, et autres
Publié: (2024)
From Scenes to Elements: Multi-Granularity Evidence Retrieval for Verifiable Multimodal RAG
par: Chen, Guanhua, et autres
Publié: (2026)
par: Chen, Guanhua, et autres
Publié: (2026)
SGIC: A Self-Guided Iterative Calibration Framework for RAG
par: Chen, Guanhua, et autres
Publié: (2025)
par: Chen, Guanhua, et autres
Publié: (2025)
Risks and NLP Design: A Case Study on Procedural Document QA
par: Haduong, Nikita, et autres
Publié: (2024)
par: Haduong, Nikita, et autres
Publié: (2024)
Procedural Knowledge at Scale Improves Reasoning
par: Wu, Di, et autres
Publié: (2026)
par: Wu, Di, et autres
Publié: (2026)
Let's Focus on Neuron: Neuron-Level Supervised Fine-tuning for Large Language Model
par: Xu, Haoyun, et autres
Publié: (2024)
par: Xu, Haoyun, et autres
Publié: (2024)
Can ChatGPT Really Understand Modern Chinese Poetry?
par: Wang, Shanshan, et autres
Publié: (2026)
par: Wang, Shanshan, et autres
Publié: (2026)
What is the Best Way for ChatGPT to Translate Poetry?
par: Wang, Shanshan, et autres
Publié: (2024)
par: Wang, Shanshan, et autres
Publié: (2024)
ISO-Bench: Benchmarking Multimodal Causal Reasoning in Visual-Language Models through Procedural Plans
par: Sadana, Ananya, et autres
Publié: (2025)
par: Sadana, Ananya, et autres
Publié: (2025)
VisAidMath: Benchmarking Visual-Aided Mathematical Reasoning
par: Ma, Jingkun, et autres
Publié: (2024)
par: Ma, Jingkun, et autres
Publié: (2024)
Path Drift in Large Reasoning Models:How First-Person Commitments Override Safety
par: Huang, Yuyi, et autres
Publié: (2025)
par: Huang, Yuyi, et autres
Publié: (2025)
ProMQA-Assembly: Multimodal Procedural QA Dataset on Assembly
par: Hasegawa, Kimihiro, et autres
Publié: (2025)
par: Hasegawa, Kimihiro, et autres
Publié: (2025)
L0-Reasoning Bench: Evaluating Procedural Correctness in Language Models via Simple Program Execution
par: Sun, Simeng, et autres
Publié: (2025)
par: Sun, Simeng, et autres
Publié: (2025)
Harnessing the Reasoning Economy: A Survey of Efficient Reasoning for Large Language Models
par: Wang, Rui, et autres
Publié: (2025)
par: Wang, Rui, et autres
Publié: (2025)
Procedural Knowledge in Pretraining Drives Reasoning in Large Language Models
par: Ruis, Laura, et autres
Publié: (2024)
par: Ruis, Laura, et autres
Publié: (2024)
Procedural Dilemma Generation for Evaluating Moral Reasoning in Humans and Language Models
par: Fränken, Jan-Philipp, et autres
Publié: (2024)
par: Fränken, Jan-Philipp, et autres
Publié: (2024)
Intrinsic Model Weaknesses: How Priming Attacks Unveil Vulnerabilities in Large Language Models
par: Huang, Yuyi, et autres
Publié: (2025)
par: Huang, Yuyi, et autres
Publié: (2025)
Multilingual Reasoning Gym: Multilingual Scaling of Procedural Reasoning Environments
par: Dobler, Konstantin, et autres
Publié: (2026)
par: Dobler, Konstantin, et autres
Publié: (2026)
Are Large Reasoning Models Good Translation Evaluators? Analysis and Performance Boost
par: Zhan, Runzhe, et autres
Publié: (2025)
par: Zhan, Runzhe, et autres
Publié: (2025)
Prefix Text as a Yarn: Eliciting Non-English Alignment in Foundation Language Model
par: Zhan, Runzhe, et autres
Publié: (2024)
par: Zhan, Runzhe, et autres
Publié: (2024)
AutoPRM: Automating Procedural Supervision for Multi-Step Reasoning via Controllable Question Decomposition
par: Chen, Zhaorun, et autres
Publié: (2024)
par: Chen, Zhaorun, et autres
Publié: (2024)
Rethinking Prompt-based Debiasing in Large Language Models
par: Yang, Xinyi, et autres
Publié: (2025)
par: Yang, Xinyi, et autres
Publié: (2025)
Can Large Language Models Generalize Procedures Across Representations?
par: Lin, Fangru, et autres
Publié: (2026)
par: Lin, Fangru, et autres
Publié: (2026)
Hierarchical Chain-of-Thought Prompting: Enhancing LLM Reasoning Performance and Efficiency
par: Huang, Xingshuai, et autres
Publié: (2026)
par: Huang, Xingshuai, et autres
Publié: (2026)
Unveiling LLMs' Metaphorical Understanding: Exploring Conceptual Irrelevance, Context Leveraging and Syntactic Influence
par: Ye, Fengying, et autres
Publié: (2025)
par: Ye, Fengying, et autres
Publié: (2025)
Is Your Model Really A Good Math Reasoner? Evaluating Mathematical Reasoning with Checklist
par: Zhou, Zihao, et autres
Publié: (2024)
par: Zhou, Zihao, et autres
Publié: (2024)
LongProc: Benchmarking Long-Context Language Models on Long Procedural Generation
par: Ye, Xi, et autres
Publié: (2025)
par: Ye, Xi, et autres
Publié: (2025)
Legal Mathematical Reasoning with LLMs: Procedural Alignment through Two-Stage Reinforcement Learning
par: Zhang, Kepu, et autres
Publié: (2025)
par: Zhang, Kepu, et autres
Publié: (2025)
Evaluating LLMs' Reasoning Over Ordered Procedural Steps
par: Anika, Adrita, et autres
Publié: (2025)
par: Anika, Adrita, et autres
Publié: (2025)
Learning from "Silly" Questions Improves Large Language Models, But Only Slightly
par: Zhu, Tingyuan, et autres
Publié: (2024)
par: Zhu, Tingyuan, et autres
Publié: (2024)
HiQA: A Hierarchical Contextual Augmentation RAG for Multi-Documents QA
par: Chen, Xinyue, et autres
Publié: (2024)
par: Chen, Xinyue, et autres
Publié: (2024)
Benchmarking the Detection of LLMs-Generated Modern Chinese Poetry
par: Wang, Shanshan, et autres
Publié: (2025)
par: Wang, Shanshan, et autres
Publié: (2025)
Decision Procedure for A Theory of String Sequences
par: Hu, Denghang, et autres
Publié: (2025)
par: Hu, Denghang, et autres
Publié: (2025)
Pairing Analogy-Augmented Generation with Procedural Memory for Procedural Q&A
par: Roth, K, et autres
Publié: (2024)
par: Roth, K, et autres
Publié: (2024)
ActPlan-1K: Benchmarking the Procedural Planning Ability of Visual Language Models in Household Activities
par: Su, Ying, et autres
Publié: (2024)
par: Su, Ying, et autres
Publié: (2024)
Boosting Language Models Reasoning with Chain-of-Knowledge Prompting
par: Wang, Jianing, et autres
Publié: (2023)
par: Wang, Jianing, et autres
Publié: (2023)
FOCUS: Forging Originality through Contrastive Use in Self-Plagiarism for Language Models
par: Lan, Kaixin, et autres
Publié: (2024)
par: Lan, Kaixin, et autres
Publié: (2024)
Phraselette: A Poet's Procedural Palette
par: Calderwood, Alex, et autres
Publié: (2025)
par: Calderwood, Alex, et autres
Publié: (2025)
ProcBench: Benchmark for Multi-Step Reasoning and Following Procedure
par: Fujisawa, Ippei, et autres
Publié: (2024)
par: Fujisawa, Ippei, et autres
Publié: (2024)
Documents similaires
-
Not All LoRA Parameters Are Essential: Insights on Inference Necessity
par: Chen, Guanhua, et autres
Publié: (2025) -
A Two-Stage Prediction-Aware Contrastive Learning Framework for Multi-Intent NLU
par: Chen, Guanhua, et autres
Publié: (2024) -
From Scenes to Elements: Multi-Granularity Evidence Retrieval for Verifiable Multimodal RAG
par: Chen, Guanhua, et autres
Publié: (2026) -
SGIC: A Self-Guided Iterative Calibration Framework for RAG
par: Chen, Guanhua, et autres
Publié: (2025) -
Risks and NLP Design: A Case Study on Procedural Document QA
par: Haduong, Nikita, et autres
Publié: (2024)