System-2 Mathematical Reasoning via Enriched Instruction Tuning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Cai, Huanqia, Yang, Yijun, Li, Zhifeng |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Embedding Self-Correction as an Inherent Ability in Large Language Models for Enhanced Mathematical Reasoning
par: Gao, Kuofeng, et autres
Publié: (2024)
par: Gao, Kuofeng, et autres
Publié: (2024)
MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models
par: Cai, Huanqia, et autres
Publié: (2025)
par: Cai, Huanqia, et autres
Publié: (2025)
MathScale: Scaling Instruction Tuning for Mathematical Reasoning
par: Tang, Zhengyang, et autres
Publié: (2024)
par: Tang, Zhengyang, et autres
Publié: (2024)
Select2Reason: Efficient Instruction-Tuning Data Selection for Long-CoT Reasoning
par: Yang, Cehao, et autres
Publié: (2025)
par: Yang, Cehao, et autres
Publié: (2025)
xCoT: Cross-lingual Instruction Tuning for Cross-lingual Chain-of-Thought Reasoning
par: Chai, Linzheng, et autres
Publié: (2024)
par: Chai, Linzheng, et autres
Publié: (2024)
Instruction Tuning With Loss Over Instructions
par: Shi, Zhengyan, et autres
Publié: (2024)
par: Shi, Zhengyan, et autres
Publié: (2024)
Disperse-Then-Merge: Pushing the Limits of Instruction Tuning via Alignment Tax Reduction
par: Fu, Tingchen, et autres
Publié: (2024)
par: Fu, Tingchen, et autres
Publié: (2024)
Unveiling the Impact of Coding Data Instruction Fine-Tuning on Large Language Models Reasoning
par: Zhang, Xinlu, et autres
Publié: (2024)
par: Zhang, Xinlu, et autres
Publié: (2024)
$\mathcal{S}^2$IT: Stepwise Syntax Integration Tuning for Large Language Models in Aspect Sentiment Quad Prediction
par: Chen, Bingfeng, et autres
Publié: (2026)
par: Chen, Bingfeng, et autres
Publié: (2026)
MetaLadder: Ascending Mathematical Solution Quality via Analogical-Problem Reasoning Transfer
par: Lin, Honglin, et autres
Publié: (2025)
par: Lin, Honglin, et autres
Publié: (2025)
LinguaLIFT: An Effective Two-stage Instruction Tuning Framework for Low-Resource Language Reasoning
par: Zhang, Hongbin, et autres
Publié: (2024)
par: Zhang, Hongbin, et autres
Publié: (2024)
Low-Confidence Gold: Refining Low-Confidence Samples for Efficient Instruction Tuning
par: Cai, Hongyi, et autres
Publié: (2025)
par: Cai, Hongyi, et autres
Publié: (2025)
MLLM-CTBench: A Benchmark for Continual Instruction Tuning with Reasoning Process Diagnosis
par: Guo, Haiyun, et autres
Publié: (2025)
par: Guo, Haiyun, et autres
Publié: (2025)
Retrieval, Reasoning, Re-ranking: A Context-Enriched Framework for Knowledge Graph Completion
par: Li, Muzhi, et autres
Publié: (2024)
par: Li, Muzhi, et autres
Publié: (2024)
Quantization Meets Reasoning: Exploring LLM Low-Bit Quantization Degradation for Mathematical Reasoning
par: Li, Zhen, et autres
Publié: (2025)
par: Li, Zhen, et autres
Publié: (2025)
Markov Chain of Thought for Efficient Mathematical Reasoning
par: Yang, Wen, et autres
Publié: (2024)
par: Yang, Wen, et autres
Publié: (2024)
Rethinking Table Instruction Tuning
par: Deng, Naihao, et autres
Publié: (2025)
par: Deng, Naihao, et autres
Publié: (2025)
Data Selection for Multi-turn Dialogue Instruction Tuning
par: Li, Bo, et autres
Publié: (2026)
par: Li, Bo, et autres
Publié: (2026)
Improving Mathematical Reasoning Capabilities of Small Language Models via Feedback-Driven Distillation
par: Zhu, Xunyu, et autres
Publié: (2024)
par: Zhu, Xunyu, et autres
Publié: (2024)
Towards Robust Mathematical Reasoning
par: Luong, Thang, et autres
Publié: (2025)
par: Luong, Thang, et autres
Publié: (2025)
Don't Half-listen: Capturing Key-part Information in Continual Instruction Tuning
par: He, Yongquan, et autres
Publié: (2024)
par: He, Yongquan, et autres
Publié: (2024)
Exploring Format Consistency for Instruction Tuning
par: Liang, Shihao, et autres
Publié: (2023)
par: Liang, Shihao, et autres
Publié: (2023)
THOR: Tool-Integrated Hierarchical Optimization via RL for Mathematical Reasoning
par: Chang, Qikai, et autres
Publié: (2025)
par: Chang, Qikai, et autres
Publié: (2025)
Joint Flashback Adaptation for Forgetting-Resistant Instruction Tuning
par: Zhao, Yukun, et autres
Publié: (2025)
par: Zhao, Yukun, et autres
Publié: (2025)
Jailbreak Instruction-Tuned LLMs via end-of-sentence MLP Re-weighting
par: Luo, Yifan, et autres
Publié: (2024)
par: Luo, Yifan, et autres
Publié: (2024)
A Survey on Large Language Models for Mathematical Reasoning
par: Wang, Peng-Yuan, et autres
Publié: (2025)
par: Wang, Peng-Yuan, et autres
Publié: (2025)
DeepSeek-Prover-V2: Advancing Formal Mathematical Reasoning via Reinforcement Learning for Subgoal Decomposition
par: Ren, Z. Z., et autres
Publié: (2025)
par: Ren, Z. Z., et autres
Publié: (2025)
Enhancing Multimodal Continual Instruction Tuning with BranchLoRA
par: Zhang, Duzhen, et autres
Publié: (2025)
par: Zhang, Duzhen, et autres
Publié: (2025)
Step-level Value Preference Optimization for Mathematical Reasoning
par: Chen, Guoxin, et autres
Publié: (2024)
par: Chen, Guoxin, et autres
Publié: (2024)
Optimizing Psychological Counseling with Instruction-Tuned Large Language Models
par: Li, Wenjie, et autres
Publié: (2024)
par: Li, Wenjie, et autres
Publié: (2024)
Benchmarking LLMs' Mathematical Reasoning with Unseen Random Variables Questions
par: Hong, Zijin, et autres
Publié: (2025)
par: Hong, Zijin, et autres
Publié: (2025)
GRIP: In-Parameter Graph Reasoning through Fine-Tuning Large Language Models
par: Feng, Jiarui, et autres
Publié: (2025)
par: Feng, Jiarui, et autres
Publié: (2025)
GraphGPT: Graph Instruction Tuning for Large Language Models
par: Tang, Jiabin, et autres
Publié: (2023)
par: Tang, Jiabin, et autres
Publié: (2023)
Cause-Aware Empathetic Response Generation via Chain-of-Thought Fine-Tuning
par: Chen, Xinhao, et autres
Publié: (2024)
par: Chen, Xinhao, et autres
Publié: (2024)
Distilling Mathematical Reasoning Capabilities into Small Language Models
par: Zhu, Xunyu, et autres
Publié: (2024)
par: Zhu, Xunyu, et autres
Publié: (2024)
Generative Representational Instruction Tuning
par: Muennighoff, Niklas, et autres
Publié: (2024)
par: Muennighoff, Niklas, et autres
Publié: (2024)
Examining False Positives under Inference Scaling for Mathematical Reasoning
par: Wang, Yu, et autres
Publié: (2025)
par: Wang, Yu, et autres
Publié: (2025)
HIRAG: Hierarchical-Thought Instruction-Tuning Retrieval-Augmented Generation
par: Jiao, YiHan, et autres
Publié: (2025)
par: Jiao, YiHan, et autres
Publié: (2025)
Unmasking Reasoning Processes: A Process-aware Benchmark for Evaluating Structural Mathematical Reasoning in LLMs
par: Zheng, Xiang, et autres
Publié: (2026)
par: Zheng, Xiang, et autres
Publié: (2026)
Stronger Models are NOT Stronger Teachers for Instruction Tuning
par: Xu, Zhangchen, et autres
Publié: (2024)
par: Xu, Zhangchen, et autres
Publié: (2024)
Documents similaires
-
Embedding Self-Correction as an Inherent Ability in Large Language Models for Enhanced Mathematical Reasoning
par: Gao, Kuofeng, et autres
Publié: (2024) -
MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models
par: Cai, Huanqia, et autres
Publié: (2025) -
MathScale: Scaling Instruction Tuning for Mathematical Reasoning
par: Tang, Zhengyang, et autres
Publié: (2024) -
Select2Reason: Efficient Instruction-Tuning Data Selection for Long-CoT Reasoning
par: Yang, Cehao, et autres
Publié: (2025) -
xCoT: Cross-lingual Instruction Tuning for Cross-lingual Chain-of-Thought Reasoning
par: Chai, Linzheng, et autres
Publié: (2024)