Data Diversification Methods In Alignment Enhance Math Performance In LLMs
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Dokmeci, Berkan, Wu, Qingyang, Athiwaratkun, Ben, Zhang, Ce, Song, Shuaiwen Leon, Zou, James |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Think Deep, Think Fast: Investigating Efficiency of Verifier-free Inference-time-scaling Methods
par: Wang, Junlin, et autres
Publié: (2025)
par: Wang, Junlin, et autres
Publié: (2025)
Dragonfly: Multi-Resolution Zoom-In Encoding Enhances Vision-Language Models
par: Thapa, Rahul, et autres
Publié: (2024)
par: Thapa, Rahul, et autres
Publié: (2024)
Understanding and Steering the Cognitive Behaviors of Reasoning Models at Test-Time
par: Zhang, Zhenyu, et autres
Publié: (2025)
par: Zhang, Zhenyu, et autres
Publié: (2025)
CARE: Covariance-Aware and Rank-Enhanced Decomposition for Enabling Multi-Head Latent Attention
par: Zhou, Zhongzhu, et autres
Publié: (2026)
par: Zhou, Zhongzhu, et autres
Publié: (2026)
Scaling Instruction-Tuned LLMs to Million-Token Contexts via Hierarchical Synthetic Data Generation
par: He, Linda, et autres
Publié: (2025)
par: He, Linda, et autres
Publié: (2025)
Disentangling Reasoning and Knowledge in Medical Large Language Models
par: Thapa, Rahul, et autres
Publié: (2025)
par: Thapa, Rahul, et autres
Publié: (2025)
Introspective Diffusion Language Models
par: Yu, Yifan, et autres
Publié: (2026)
par: Yu, Yifan, et autres
Publié: (2026)
OSCAR: Offline Spectral Covariance-Aware Rotation for 2-bit KV Cache Quantization
par: Zhou, Zhongzhu, et autres
Publié: (2026)
par: Zhou, Zhongzhu, et autres
Publié: (2026)
Staircase Streaming for Low-Latency Multi-Agent Inference
par: Wang, Junlin, et autres
Publié: (2025)
par: Wang, Junlin, et autres
Publié: (2025)
Improving Model Alignment Through Collective Intelligence of Open-Source LLMS
par: Wang, Junlin, et autres
Publié: (2025)
par: Wang, Junlin, et autres
Publié: (2025)
Clinical Trials Ontology Engineering with Large Language Models
par: Çakır, Berkan
Publié: (2024)
par: Çakır, Berkan
Publié: (2024)
Squeeze Evolve: Unified Multi-Model Orchestration for Verifier-Free Evolution
par: Maheswaran, Monishwaran, et autres
Publié: (2026)
par: Maheswaran, Monishwaran, et autres
Publié: (2026)
Kitty: Accurate and Efficient 2-bit KV Cache Quantization with Dynamic Channel-wise Precision Boost
par: Xia, Haojun, et autres
Publié: (2025)
par: Xia, Haojun, et autres
Publié: (2025)
Reward-Augmented Data Enhances Direct Preference Alignment of LLMs
par: Zhang, Shenao, et autres
Publié: (2024)
par: Zhang, Shenao, et autres
Publié: (2024)
MathArena: Evaluating LLMs on Uncontaminated Math Competitions
par: Balunović, Mislav, et autres
Publié: (2025)
par: Balunović, Mislav, et autres
Publié: (2025)
MathGenie: Generating Synthetic Data with Question Back-translation for Enhancing Mathematical Reasoning of LLMs
par: Lu, Zimu, et autres
Publié: (2024)
par: Lu, Zimu, et autres
Publié: (2024)
MathMistake Checker: A Comprehensive Demonstration for Step-by-Step Math Problem Mistake Finding by Prompt-Guided LLMs
par: Zhang, Tianyang, et autres
Publié: (2025)
par: Zhang, Tianyang, et autres
Publié: (2025)
AgenticMath: Enhancing LLM Reasoning via Agentic-based Math Data Generation
par: Liu, Xianyang, et autres
Publié: (2025)
par: Liu, Xianyang, et autres
Publié: (2025)
Training-Free Activation Sparsity in Large Language Models
par: Liu, James, et autres
Publié: (2024)
par: Liu, James, et autres
Publié: (2024)
MathOdyssey: Benchmarking Mathematical Problem-Solving Skills in Large Language Models Using Odyssey Math Data
par: Fang, Meng, et autres
Publié: (2024)
par: Fang, Meng, et autres
Publié: (2024)
CorDA: Context-Oriented Decomposition Adaptation of Large Language Models for Task-Aware Parameter-Efficient Fine-tuning
par: Yang, Yibo, et autres
Publié: (2024)
par: Yang, Yibo, et autres
Publié: (2024)
Mixture-of-Agents Enhances Large Language Model Capabilities
par: Wang, Junlin, et autres
Publié: (2024)
par: Wang, Junlin, et autres
Publié: (2024)
CogMath: Assessing LLMs' Authentic Mathematical Ability from a Human Cognitive Perspective
par: Liu, Jiayu, et autres
Publié: (2025)
par: Liu, Jiayu, et autres
Publié: (2025)
Bridging the Novice-Expert Gap via Models of Decision-Making: A Case Study on Remediating Math Mistakes
par: Wang, Rose E., et autres
Publié: (2023)
par: Wang, Rose E., et autres
Publié: (2023)
Token Alignment via Character Matching for Subword Completion
par: Athiwaratkun, Ben, et autres
Publié: (2024)
par: Athiwaratkun, Ben, et autres
Publié: (2024)
MARGE: Improving Math Reasoning for LLMs with Guided Exploration
par: Gao, Jingyue, et autres
Publié: (2025)
par: Gao, Jingyue, et autres
Publié: (2025)
LEMMA: Learning from Errors for MatheMatical Advancement in LLMs
par: Pan, Zhuoshi, et autres
Publié: (2025)
par: Pan, Zhuoshi, et autres
Publié: (2025)
An Empirical Study of Data Ability Boundary in LLMs' Math Reasoning
par: Chen, Zui, et autres
Publié: (2024)
par: Chen, Zui, et autres
Publié: (2024)
ControlMath: Controllable Data Generation Promotes Math Generalist Models
par: Chen, Nuo, et autres
Publié: (2024)
par: Chen, Nuo, et autres
Publié: (2024)
Confidence-Aware Alignment Makes Reasoning LLMs More Reliable
par: Chen, Kejia, et autres
Publié: (2026)
par: Chen, Kejia, et autres
Publié: (2026)
Neuro-Symbolic Data Generation for Math Reasoning
par: Li, Zenan, et autres
Publié: (2024)
par: Li, Zenan, et autres
Publié: (2024)
Rewriting Pre-Training Data Boosts LLM Performance in Math and Code
par: Fujii, Kazuki, et autres
Publié: (2025)
par: Fujii, Kazuki, et autres
Publié: (2025)
Mining Math Conjectures from LLMs: A Pruning Approach
par: Chuharski, Jake, et autres
Publié: (2024)
par: Chuharski, Jake, et autres
Publié: (2024)
Population-Evolve: a Parallel Sampling and Evolutionary Method for LLM Math Reasoning
par: Zhang, Yanzhi, et autres
Publié: (2025)
par: Zhang, Yanzhi, et autres
Publié: (2025)
DAG-Math: Graph-of-Thought Guided Mathematical Reasoning in LLMs
par: Zhang, Yuanhe, et autres
Publié: (2025)
par: Zhang, Yuanhe, et autres
Publié: (2025)
SuperCLUE-Math6: Graded Multi-Step Math Reasoning Benchmark for LLMs in Chinese
par: Xu, Liang, et autres
Publié: (2024)
par: Xu, Liang, et autres
Publié: (2024)
JT-DA: Enhancing Data Analysis with Tool-Integrated Table Reasoning Large Language Models
par: Chi, Ce, et autres
Publié: (2025)
par: Chi, Ce, et autres
Publié: (2025)
GEA: Generation-Enhanced Alignment for Text-to-Image Person Retrieval
par: Zou, Hao, et autres
Publié: (2025)
par: Zou, Hao, et autres
Publié: (2025)
How Well Can General Vision-Language Models Learn Medicine By Watching Public Educational Videos?
par: Thapa, Rahul, et autres
Publié: (2025)
par: Thapa, Rahul, et autres
Publié: (2025)
MCA-RG: Enhancing LLMs with Medical Concept Alignment for Radiology Report Generation
par: Xing, Qilong, et autres
Publié: (2025)
par: Xing, Qilong, et autres
Publié: (2025)
Documents similaires
-
Think Deep, Think Fast: Investigating Efficiency of Verifier-free Inference-time-scaling Methods
par: Wang, Junlin, et autres
Publié: (2025) -
Dragonfly: Multi-Resolution Zoom-In Encoding Enhances Vision-Language Models
par: Thapa, Rahul, et autres
Publié: (2024) -
Understanding and Steering the Cognitive Behaviors of Reasoning Models at Test-Time
par: Zhang, Zhenyu, et autres
Publié: (2025) -
CARE: Covariance-Aware and Rank-Enhanced Decomposition for Enabling Multi-Head Latent Attention
par: Zhou, Zhongzhu, et autres
Publié: (2026) -
Scaling Instruction-Tuned LLMs to Million-Token Contexts via Hierarchical Synthetic Data Generation
par: He, Linda, et autres
Publié: (2025)