Paraphrase and Solve: Exploring and Exploiting the Impact of Surface Form on Mathematical Reasoning in Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhou, Yue, Zhu, Yada, Antognini, Diego, Kim, Yoon, Zhang, Yang |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SAAS: Solving Ability Amplification Strategy for Enhanced Mathematical Reasoning in Large Language Models
par: Kim, Hyeonwoo, et autres
Publié: (2024)
par: Kim, Hyeonwoo, et autres
Publié: (2024)
Exploring the Compositional Deficiency of Large Language Models in Mathematical Reasoning
par: Zhao, Jun, et autres
Publié: (2024)
par: Zhao, Jun, et autres
Publié: (2024)
Token-Supervised Value Models for Enhancing Mathematical Problem-Solving Capabilities of Large Language Models
par: Lee, Jung Hyun, et autres
Publié: (2024)
par: Lee, Jung Hyun, et autres
Publié: (2024)
Large Language Models Are Involuntary Truth-Tellers: Exploiting Fallacy Failure for Jailbreak Attacks
par: Zhou, Yue, et autres
Publié: (2024)
par: Zhou, Yue, et autres
Publié: (2024)
GAUSS: Benchmarking Structured Mathematical Skills for Large Language Models
par: Zhang, Yue, et autres
Publié: (2025)
par: Zhang, Yue, et autres
Publié: (2025)
Advancing Mathematical Reasoning in Language Models: The Impact of Problem-Solving Data, Data Synthesis Methods, and Training Stages
par: Chen, Zui, et autres
Publié: (2025)
par: Chen, Zui, et autres
Publié: (2025)
How Large Language Models are Transforming Machine-Paraphrased Plagiarism
par: Wahle, Jan Philip, et autres
Publié: (2022)
par: Wahle, Jan Philip, et autres
Publié: (2022)
Key-Point-Driven Mathematical Reasoning Distillation of Large Language Model
par: Zhu, Xunyu, et autres
Publié: (2024)
par: Zhu, Xunyu, et autres
Publié: (2024)
A Survey on Large Language Models for Mathematical Reasoning
par: Wang, Peng-Yuan, et autres
Publié: (2025)
par: Wang, Peng-Yuan, et autres
Publié: (2025)
Target-Side Paraphrase Augmentation for Sign Language Translation with Large Language Models
par: Bianco, Pedro Dal, et autres
Publié: (2026)
par: Bianco, Pedro Dal, et autres
Publié: (2026)
Mathify: Evaluating Large Language Models on Mathematical Problem Solving Tasks
par: Anand, Avinash, et autres
Publié: (2024)
par: Anand, Avinash, et autres
Publié: (2024)
MathGLM-Vision: Solving Mathematical Problems with Multi-Modal Large Language Model
par: Yang, Zhen, et autres
Publié: (2024)
par: Yang, Zhen, et autres
Publié: (2024)
Abductive Reasoning with Syllogistic Forms in Large Language Models
par: Abe, Hirohiko, et autres
Publié: (2026)
par: Abe, Hirohiko, et autres
Publié: (2026)
Dissecting Failure Dynamics in Large Language Model Reasoning
par: Zhu, Wei, et autres
Publié: (2026)
par: Zhu, Wei, et autres
Publié: (2026)
Learning to Learn from Language Feedback with Social Meta-Learning
par: Cook, Jonathan, et autres
Publié: (2026)
par: Cook, Jonathan, et autres
Publié: (2026)
BPP-Search: Enhancing Tree of Thought Reasoning for Mathematical Modeling Problem Solving
par: Wang, Teng, et autres
Publié: (2024)
par: Wang, Teng, et autres
Publié: (2024)
Exploring Solution Divergence and Its Effect on Large Language Model Problem Solving
par: Li, Hang, et autres
Publié: (2025)
par: Li, Hang, et autres
Publié: (2025)
Limitations of Large Language Models in Clinical Problem-Solving Arising from Inflexible Reasoning
par: Kim, Jonathan, et autres
Publié: (2025)
par: Kim, Jonathan, et autres
Publié: (2025)
DETAIL Matters: Measuring the Impact of Prompt Specificity on Reasoning in Large Language Models
par: Kim, Olivia
Publié: (2025)
par: Kim, Olivia
Publié: (2025)
M3-SLU: Evaluating Speaker-Attributed Reasoning in Multimodal Large Language Models
par: Kwon, Yejin, et autres
Publié: (2025)
par: Kwon, Yejin, et autres
Publié: (2025)
CHAMP: A Competition-level Dataset for Fine-Grained Analyses of LLMs' Mathematical Reasoning Capabilities
par: Mao, Yujun, et autres
Publié: (2024)
par: Mao, Yujun, et autres
Publié: (2024)
Reasoning or Reciting? Exploring the Capabilities and Limitations of Language Models Through Counterfactual Tasks
par: Wu, Zhaofeng, et autres
Publié: (2023)
par: Wu, Zhaofeng, et autres
Publié: (2023)
TeleMath: A Benchmark for Large Language Models in Telecom Mathematical Problem Solving
par: Colle, Vincenzo, et autres
Publié: (2025)
par: Colle, Vincenzo, et autres
Publié: (2025)
Bayesian Teaching Enables Probabilistic Reasoning in Large Language Models
par: Qiu, Linlu, et autres
Publié: (2025)
par: Qiu, Linlu, et autres
Publié: (2025)
News Recommendation with Category Description by a Large Language Model
par: Yada, Yuki, et autres
Publié: (2024)
par: Yada, Yuki, et autres
Publié: (2024)
Distilling Mathematical Reasoning Capabilities into Small Language Models
par: Zhu, Xunyu, et autres
Publié: (2024)
par: Zhu, Xunyu, et autres
Publié: (2024)
Language Modeling and Understanding Through Paraphrase Generation and Detection
par: Wahle, Jan Philip
Publié: (2026)
par: Wahle, Jan Philip
Publié: (2026)
Large Language Model enabled Mathematical Modeling
par: Zhang, Guoyun
Publié: (2025)
par: Zhang, Guoyun
Publié: (2025)
Focusing on Language: Revealing and Exploiting Language Attention Heads in Multilingual Large Language Models
par: Liu, Xin, et autres
Publié: (2025)
par: Liu, Xin, et autres
Publié: (2025)
Puzzle Solving using Reasoning of Large Language Models: A Survey
par: Giadikiaroglou, Panagiotis, et autres
Publié: (2024)
par: Giadikiaroglou, Panagiotis, et autres
Publié: (2024)
UGMathBench: A Diverse and Dynamic Benchmark for Undergraduate-Level Mathematical Reasoning with Large Language Models
par: Xu, Xin, et autres
Publié: (2025)
par: Xu, Xin, et autres
Publié: (2025)
Exploring the Role of Reasoning Structures for Constructing Proofs in Multi-Step Natural Language Reasoning with Large Language Models
par: Zheng, Zi'ou, et autres
Publié: (2024)
par: Zheng, Zi'ou, et autres
Publié: (2024)
Paraphrase and Aggregate with Large Language Models for Minimizing Intent Classification Errors
par: Yadav, Vikas, et autres
Publié: (2024)
par: Yadav, Vikas, et autres
Publié: (2024)
MultiMath: Bridging Visual and Mathematical Reasoning for Large Language Models
par: Peng, Shuai, et autres
Publié: (2024)
par: Peng, Shuai, et autres
Publié: (2024)
Forward-Backward Reasoning in Large Language Models for Mathematical Verification
par: Jiang, Weisen, et autres
Publié: (2023)
par: Jiang, Weisen, et autres
Publié: (2023)
The Impact of Reasoning Step Length on Large Language Models
par: Jin, Mingyu, et autres
Publié: (2024)
par: Jin, Mingyu, et autres
Publié: (2024)
ConceptMath: A Bilingual Concept-wise Benchmark for Measuring Mathematical Reasoning of Large Language Models
par: Wu, Yanan, et autres
Publié: (2024)
par: Wu, Yanan, et autres
Publié: (2024)
Should You Use Your Large Language Model to Explore or Exploit?
par: Harris, Keegan, et autres
Publié: (2025)
par: Harris, Keegan, et autres
Publié: (2025)
Long-horizon Reasoning Agent for Olympiad-Level Mathematical Problem Solving
par: Gao, Songyang, et autres
Publié: (2025)
par: Gao, Songyang, et autres
Publié: (2025)
TInR: Exploring Tool-Internalized Reasoning in Large Language Models
par: Xu, Qiancheng, et autres
Publié: (2026)
par: Xu, Qiancheng, et autres
Publié: (2026)
Documents similaires
-
SAAS: Solving Ability Amplification Strategy for Enhanced Mathematical Reasoning in Large Language Models
par: Kim, Hyeonwoo, et autres
Publié: (2024) -
Exploring the Compositional Deficiency of Large Language Models in Mathematical Reasoning
par: Zhao, Jun, et autres
Publié: (2024) -
Token-Supervised Value Models for Enhancing Mathematical Problem-Solving Capabilities of Large Language Models
par: Lee, Jung Hyun, et autres
Publié: (2024) -
Large Language Models Are Involuntary Truth-Tellers: Exploiting Fallacy Failure for Jailbreak Attacks
par: Zhou, Yue, et autres
Publié: (2024) -
GAUSS: Benchmarking Structured Mathematical Skills for Large Language Models
par: Zhang, Yue, et autres
Publié: (2025)