Guardado en:
| Autores principales: | Sun, Zhishen, Dai, Guang, Tsang, Ivor, Ye, Haishan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2511.08022 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
MSCR: Exploring the Vulnerability of LLMs' Mathematical Reasoning Abilities Using Multi-Source Candidate Replacement
por: Sun, Zhishen, et al.
Publicado: (2025)
por: Sun, Zhishen, et al.
Publicado: (2025)
ESSAM: A Novel Competitive Evolution Strategies Approach to Reinforcement Learning for Memory Efficient LLMs Fine-Tuning
por: Sun, Zhishen, et al.
Publicado: (2026)
por: Sun, Zhishen, et al.
Publicado: (2026)
FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed
por: Dang, Sizhe, et al.
Publicado: (2025)
por: Dang, Sizhe, et al.
Publicado: (2025)
Privacy Leaks by Adversaries: Adversarial Iterations for Membership Inference Attack
por: Xue, Jing, et al.
Publicado: (2025)
por: Xue, Jing, et al.
Publicado: (2025)
Can Large Reasoning Models Improve Accuracy on Mathematical Tasks Using Flawed Thinking?
por: Amjith, Saraswathy, et al.
Publicado: (2025)
por: Amjith, Saraswathy, et al.
Publicado: (2025)
HC$^2$L: Hybrid and Cooperative Contrastive Learning for Cross-lingual Spoken Language Understanding
por: Xing, Bowen, et al.
Publicado: (2024)
por: Xing, Bowen, et al.
Publicado: (2024)
Exploring the Compositional Deficiency of Large Language Models in Mathematical Reasoning
por: Zhao, Jun, et al.
Publicado: (2024)
por: Zhao, Jun, et al.
Publicado: (2024)
Large Language Models and Mathematical Reasoning Failures
por: Boye, Johan, et al.
Publicado: (2025)
por: Boye, Johan, et al.
Publicado: (2025)
From $O(mn)$ to $O(r^2)$: Two-Sided Low-Rank Communication for Adam in Distributed Training with Memory Efficiency
por: Dang, Sizhe, et al.
Publicado: (2026)
por: Dang, Sizhe, et al.
Publicado: (2026)
Mathematical Computation and Reasoning Errors by Large Language Models
por: Zhang, Liang, et al.
Publicado: (2025)
por: Zhang, Liang, et al.
Publicado: (2025)
Towards Backdoor-Based Ownership Verification for Vision-Language-Action Models
por: Sun, Ming, et al.
Publicado: (2026)
por: Sun, Ming, et al.
Publicado: (2026)
I-RAVEN-X: Benchmarking Generalization and Robustness of Analogical and Mathematical Reasoning in Large Language and Reasoning Models
por: Camposampiero, Giacomo, et al.
Publicado: (2025)
por: Camposampiero, Giacomo, et al.
Publicado: (2025)
FindTheFlaws: Annotated Errors for Detecting Flawed Reasoning and Scalable Oversight Research
por: Recchia, Gabriel, et al.
Publicado: (2025)
por: Recchia, Gabriel, et al.
Publicado: (2025)
Paraphrase and Solve: Exploring and Exploiting the Impact of Surface Form on Mathematical Reasoning in Large Language Models
por: Zhou, Yue, et al.
Publicado: (2024)
por: Zhou, Yue, et al.
Publicado: (2024)
A Survey on Mathematical Reasoning and Optimization with Large Language Models
por: Forootani, Ali
Publicado: (2025)
por: Forootani, Ali
Publicado: (2025)
GRPO and Reflection Reward for Mathematical Reasoning in Large Language Models
por: Wang, Zhijie
Publicado: (2026)
por: Wang, Zhijie
Publicado: (2026)
Reasoning Relay: Evaluating Stability and Interchangeability of Large Language Models in Mathematical Reasoning
por: Lu, Leo, et al.
Publicado: (2025)
por: Lu, Leo, et al.
Publicado: (2025)
Mathematical Reasoning in Large Language Models: Assessing Logical and Arithmetic Errors across Wide Numerical Ranges
por: Shrestha, Safal, et al.
Publicado: (2025)
por: Shrestha, Safal, et al.
Publicado: (2025)
A Survey on Large Language Models for Mathematical Reasoning
por: Wang, Peng-Yuan, et al.
Publicado: (2025)
por: Wang, Peng-Yuan, et al.
Publicado: (2025)
Flaw or Artifact? Rethinking Prompt Sensitivity in Evaluating LLMs
por: Hua, Andong, et al.
Publicado: (2025)
por: Hua, Andong, et al.
Publicado: (2025)
Time-Annealed Perturbation Sampling: Diverse Generation for Diffusion Language Models
por: Wu, Jingxuan, et al.
Publicado: (2026)
por: Wu, Jingxuan, et al.
Publicado: (2026)
Flow-Direct: Feedback-Efficient and Reusable Guidance for Flow Models via Non-Parametric Guidance Field
por: Tan, Kim Yong, et al.
Publicado: (2026)
por: Tan, Kim Yong, et al.
Publicado: (2026)
Sharpness-Aware Black-Box Optimization
por: Ye, Feiyang, et al.
Publicado: (2024)
por: Ye, Feiyang, et al.
Publicado: (2024)
Benchmarking Reasoning Robustness in Large Language Models
por: Yu, Tong, et al.
Publicado: (2025)
por: Yu, Tong, et al.
Publicado: (2025)
Double Variance Reduction: A Smoothing Trick for Composite Optimization Problems without First-Order Gradient
por: Di, Hao, et al.
Publicado: (2024)
por: Di, Hao, et al.
Publicado: (2024)
Second-Order Fine-Tuning without Pain for LLMs:A Hessian Informed Zeroth-Order Optimizer
por: Zhao, Yanjun, et al.
Publicado: (2024)
por: Zhao, Yanjun, et al.
Publicado: (2024)
Order Matters: Exploring Order Sensitivity in Multimodal Large Language Models
por: Tan, Zhijie, et al.
Publicado: (2024)
por: Tan, Zhijie, et al.
Publicado: (2024)
Reflective Confidence: Correcting Reasoning Flaws via Online Self-Correction
por: Zeng, Qinglin, et al.
Publicado: (2025)
por: Zeng, Qinglin, et al.
Publicado: (2025)
M2A: Synergizing Mathematical and Agentic Reasoning in Large Language Models
por: Wang, Junjian, et al.
Publicado: (2026)
por: Wang, Junjian, et al.
Publicado: (2026)
Large Language Models in Numberland: A Quick Test of Their Numerical Reasoning Abilities
por: Rahman, Roussel
Publicado: (2025)
por: Rahman, Roussel
Publicado: (2025)
Towards Robust Mathematical Reasoning
por: Luong, Thang, et al.
Publicado: (2025)
por: Luong, Thang, et al.
Publicado: (2025)
CAMA: Enhancing Mathematical Reasoning in Large Language Models with Causal Knowledge
por: Zan, Lei, et al.
Publicado: (2025)
por: Zan, Lei, et al.
Publicado: (2025)
Systematic Optimization of Open Source Large Language Models for Mathematical Reasoning
por: Pawar, Pranav, et al.
Publicado: (2025)
por: Pawar, Pranav, et al.
Publicado: (2025)
FormalMATH: Benchmarking Formal Mathematical Reasoning of Large Language Models
por: Yu, Zhouliang, et al.
Publicado: (2025)
por: Yu, Zhouliang, et al.
Publicado: (2025)
GSM-Symbolic: Understanding the Limitations of Mathematical Reasoning in Large Language Models
por: Mirzadeh, Iman, et al.
Publicado: (2024)
por: Mirzadeh, Iman, et al.
Publicado: (2024)
Key-Point-Driven Mathematical Reasoning Distillation of Large Language Model
por: Zhu, Xunyu, et al.
Publicado: (2024)
por: Zhu, Xunyu, et al.
Publicado: (2024)
MultiMath: Bridging Visual and Mathematical Reasoning for Large Language Models
por: Peng, Shuai, et al.
Publicado: (2024)
por: Peng, Shuai, et al.
Publicado: (2024)
Stepwise Self-Consistent Mathematical Reasoning with Large Language Models
por: Zhao, Zilong, et al.
Publicado: (2024)
por: Zhao, Zilong, et al.
Publicado: (2024)
Forward-Backward Reasoning in Large Language Models for Mathematical Verification
por: Jiang, Weisen, et al.
Publicado: (2023)
por: Jiang, Weisen, et al.
Publicado: (2023)
Enhancing Mathematical Reasoning in Large Language Models with Self-Consistency-Based Hallucination Detection
por: Liu, MingShan, et al.
Publicado: (2025)
por: Liu, MingShan, et al.
Publicado: (2025)
Ejemplares similares
-
MSCR: Exploring the Vulnerability of LLMs' Mathematical Reasoning Abilities Using Multi-Source Candidate Replacement
por: Sun, Zhishen, et al.
Publicado: (2025) -
ESSAM: A Novel Competitive Evolution Strategies Approach to Reinforcement Learning for Memory Efficient LLMs Fine-Tuning
por: Sun, Zhishen, et al.
Publicado: (2026) -
FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed
por: Dang, Sizhe, et al.
Publicado: (2025) -
Privacy Leaks by Adversaries: Adversarial Iterations for Membership Inference Attack
por: Xue, Jing, et al.
Publicado: (2025) -
Can Large Reasoning Models Improve Accuracy on Mathematical Tasks Using Flawed Thinking?
por: Amjith, Saraswathy, et al.
Publicado: (2025)