Salvato in:
| Autori principali: | Hu, Yijie, Zhou, Zihao, Huang, Kaizhu, Huang, Xiaowei, Wang, Qiufeng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2510.14387 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Towards Faithful Reasoning in Comics for Small MLLMs
di: Feng, Chengcheng, et al.
Pubblicazione: (2026)
di: Feng, Chengcheng, et al.
Pubblicazione: (2026)
An Empirical Study of Data Ability Boundary in LLMs' Math Reasoning
di: Chen, Zui, et al.
Pubblicazione: (2024)
di: Chen, Zui, et al.
Pubblicazione: (2024)
Interpret Your Decision: Logical Reasoning Regularization for Generalization in Visual Classification
di: Tan, Zhaorui, et al.
Pubblicazione: (2024)
di: Tan, Zhaorui, et al.
Pubblicazione: (2024)
Covariance-based Space Regularization for Few-shot Class Incremental Learning
di: Hu, Yijie, et al.
Pubblicazione: (2024)
di: Hu, Yijie, et al.
Pubblicazione: (2024)
MATH-Perturb: Benchmarking LLMs' Math Reasoning Abilities against Hard Perturbations
di: Huang, Kaixuan, et al.
Pubblicazione: (2025)
di: Huang, Kaixuan, et al.
Pubblicazione: (2025)
Is Your Model Really A Good Math Reasoner? Evaluating Mathematical Reasoning with Checklist
di: Zhou, Zihao, et al.
Pubblicazione: (2024)
di: Zhou, Zihao, et al.
Pubblicazione: (2024)
Un-mixing Test-time Adaptation under Heterogeneous Data Streams
di: Su, Zixian, et al.
Pubblicazione: (2024)
di: Su, Zixian, et al.
Pubblicazione: (2024)
IDEA: Image Description Enhanced CLIP-Adapter
di: Ye, Zhipeng, et al.
Pubblicazione: (2025)
di: Ye, Zhipeng, et al.
Pubblicazione: (2025)
The Demon is in Ambiguity: Revisiting Situation Recognition with Single Positive Multi-Label Learning
di: Lin, Yiming, et al.
Pubblicazione: (2025)
di: Lin, Yiming, et al.
Pubblicazione: (2025)
CogMath: Assessing LLMs' Authentic Mathematical Ability from a Human Cognitive Perspective
di: Liu, Jiayu, et al.
Pubblicazione: (2025)
di: Liu, Jiayu, et al.
Pubblicazione: (2025)
No Free Lunch: Rethinking Internal Feedback for LLM Reasoning
di: Zhang, Yanzhi, et al.
Pubblicazione: (2025)
di: Zhang, Yanzhi, et al.
Pubblicazione: (2025)
OMEGA: Can LLMs Reason Outside the Box in Math? Evaluating Exploratory, Compositional, and Transformative Generalization
di: Sun, Yiyou, et al.
Pubblicazione: (2025)
di: Sun, Yiyou, et al.
Pubblicazione: (2025)
Beyond Solving Math Quiz: Evaluating the Ability of Large Reasoning Models to Ask for Information
di: Huang, Youcheng, et al.
Pubblicazione: (2025)
di: Huang, Youcheng, et al.
Pubblicazione: (2025)
Disentangling Tabular Data Towards Better One-Class Anomaly Detection
di: Ye, Jianan, et al.
Pubblicazione: (2024)
di: Ye, Jianan, et al.
Pubblicazione: (2024)
Is Factuality Enhancement a Free Lunch For LLMs? Better Factuality Can Lead to Worse Context-Faithfulness
di: Bi, Baolong, et al.
Pubblicazione: (2024)
di: Bi, Baolong, et al.
Pubblicazione: (2024)
Tables as Texts or Images: Evaluating the Table Reasoning Ability of LLMs and MLLMs
di: Deng, Naihao, et al.
Pubblicazione: (2024)
di: Deng, Naihao, et al.
Pubblicazione: (2024)
Can MLLMs "Read" What is Missing?
di: Guo, Jindi, et al.
Pubblicazione: (2026)
di: Guo, Jindi, et al.
Pubblicazione: (2026)
Asking LLMs to Verify First is Almost Free Lunch
di: Wu, Shiguang, et al.
Pubblicazione: (2025)
di: Wu, Shiguang, et al.
Pubblicazione: (2025)
Enhancing Reasoning Abilities of Small LLMs with Cognitive Alignment
di: Cai, Wenrui, et al.
Pubblicazione: (2025)
di: Cai, Wenrui, et al.
Pubblicazione: (2025)
A comprehensive survey of oracle character recognition: challenges, benchmarks, and beyond
di: Li, Jing, et al.
Pubblicazione: (2024)
di: Li, Jing, et al.
Pubblicazione: (2024)
APO: Enhancing Reasoning Ability of MLLMs via Asymmetric Policy Optimization
di: Hong, Minjie, et al.
Pubblicazione: (2025)
di: Hong, Minjie, et al.
Pubblicazione: (2025)
No Free Lunch with Guardrails
di: Kumar, Divyanshu, et al.
Pubblicazione: (2025)
di: Kumar, Divyanshu, et al.
Pubblicazione: (2025)
FreeBind: Free Lunch in Unified Multimodal Space via Knowledge Fusion
di: Wang, Zehan, et al.
Pubblicazione: (2024)
di: Wang, Zehan, et al.
Pubblicazione: (2024)
Math Neurosurgery: Isolating Language Models' Math Reasoning Abilities Using Only Forward Passes
di: Christ, Bryan R., et al.
Pubblicazione: (2024)
di: Christ, Bryan R., et al.
Pubblicazione: (2024)
Inductive or Deductive? Rethinking the Fundamental Reasoning Abilities of LLMs
di: Cheng, Kewei, et al.
Pubblicazione: (2024)
di: Cheng, Kewei, et al.
Pubblicazione: (2024)
Human-Aligned Bench: Fine-Grained Assessment of Reasoning Ability in MLLMs vs. Humans
di: Qiu, Yansheng, et al.
Pubblicazione: (2025)
di: Qiu, Yansheng, et al.
Pubblicazione: (2025)
Unraveling LLM Jailbreaks Through Safety Knowledge Neurons
di: Zhao, Chongwen, et al.
Pubblicazione: (2025)
di: Zhao, Chongwen, et al.
Pubblicazione: (2025)
Integer Scale: A Free Lunch for Faster Fine-grained Quantization of LLMs
di: Li, Qingyuan, et al.
Pubblicazione: (2024)
di: Li, Qingyuan, et al.
Pubblicazione: (2024)
SafeBehavior: Simulating Human-Like Multistage Reasoning to Mitigate Jailbreak Attacks in Large Language Models
di: Zhao, Qinjian, et al.
Pubblicazione: (2025)
di: Zhao, Qinjian, et al.
Pubblicazione: (2025)
MARGE: Improving Math Reasoning for LLMs with Guided Exploration
di: Gao, Jingyue, et al.
Pubblicazione: (2025)
di: Gao, Jingyue, et al.
Pubblicazione: (2025)
Language Models are Super Mario: Absorbing Abilities from Homologous Models as a Free Lunch
di: Yu, Le, et al.
Pubblicazione: (2023)
di: Yu, Le, et al.
Pubblicazione: (2023)
Not Search, But Scan: Benchmarking MLLMs on Scan-Oriented Academic Paper Reasoning
di: Li, Rongjin, et al.
Pubblicazione: (2026)
di: Li, Rongjin, et al.
Pubblicazione: (2026)
Partial Differential Equations is All You Need for Generating Neural Architectures -- A Theory for Physical Artificial Intelligence Systems
di: Guo, Ping, et al.
Pubblicazione: (2021)
di: Guo, Ping, et al.
Pubblicazione: (2021)
A generalizable framework for low-rank tensor completion with numerical priors
di: Yuan, Shiran, et al.
Pubblicazione: (2023)
di: Yuan, Shiran, et al.
Pubblicazione: (2023)
RADAR: Reasoning-Ability and Difficulty-Aware Routing for Reasoning LLMs
di: Fernandez, Nigel, et al.
Pubblicazione: (2025)
di: Fernandez, Nigel, et al.
Pubblicazione: (2025)
Exploring the Reasoning Abilities of Multimodal Large Language Models (MLLMs): A Comprehensive Survey on Emerging Trends in Multimodal Reasoning
di: Wang, Yiqi, et al.
Pubblicazione: (2024)
di: Wang, Yiqi, et al.
Pubblicazione: (2024)
Can LLMs Master Math? Investigating Large Language Models on Math Stack Exchange
di: Satpute, Ankit, et al.
Pubblicazione: (2024)
di: Satpute, Ankit, et al.
Pubblicazione: (2024)
CoPE: Clipped RoPE as A Scalable Free Lunch for Long Context LLMs
di: Li, Haoran, et al.
Pubblicazione: (2026)
di: Li, Haoran, et al.
Pubblicazione: (2026)
SuperCLUE-Math6: Graded Multi-Step Math Reasoning Benchmark for LLMs in Chinese
di: Xu, Liang, et al.
Pubblicazione: (2024)
di: Xu, Liang, et al.
Pubblicazione: (2024)
Improving LLMs' Generalized Reasoning Abilities by Graph Problems
di: Zhang, Qifan, et al.
Pubblicazione: (2025)
di: Zhang, Qifan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Towards Faithful Reasoning in Comics for Small MLLMs
di: Feng, Chengcheng, et al.
Pubblicazione: (2026) -
An Empirical Study of Data Ability Boundary in LLMs' Math Reasoning
di: Chen, Zui, et al.
Pubblicazione: (2024) -
Interpret Your Decision: Logical Reasoning Regularization for Generalization in Visual Classification
di: Tan, Zhaorui, et al.
Pubblicazione: (2024) -
Covariance-based Space Regularization for Few-shot Class Incremental Learning
di: Hu, Yijie, et al.
Pubblicazione: (2024) -
MATH-Perturb: Benchmarking LLMs' Math Reasoning Abilities against Hard Perturbations
di: Huang, Kaixuan, et al.
Pubblicazione: (2025)