Bias-Restrained Prefix Representation Finetuning for Mathematical Reasoning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liang, Sirui, Cao, Pengfei, Zhao, Jian, Huang, Cong, Zhao, Jun, Liu, Kang |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Representation Finetuning for Continual Learning
par: Luo, Haihua, et autres
Publié: (2026)
par: Luo, Haihua, et autres
Publié: (2026)
Fast and Effective On-policy Distillation from Reasoning Prefixes
par: Zhang, Dongxu, et autres
Publié: (2026)
par: Zhang, Dongxu, et autres
Publié: (2026)
Towards Infinite-Long Prefix in Transformer
par: Liang, Yingyu, et autres
Publié: (2024)
par: Liang, Yingyu, et autres
Publié: (2024)
Prefix Grouper: Efficient GRPO Training through Shared-Prefix Forward
par: Liu, Zikang, et autres
Publié: (2025)
par: Liu, Zikang, et autres
Publié: (2025)
Beyond Parameter Finetuning: Test-Time Representation Refinement for Node Classification
par: Zhang, Jiaxin, et autres
Publié: (2026)
par: Zhang, Jiaxin, et autres
Publié: (2026)
PromptCoT: Synthesizing Olympiad-level Problems for Mathematical Reasoning in Large Language Models
par: Zhao, Xueliang, et autres
Publié: (2025)
par: Zhao, Xueliang, et autres
Publié: (2025)
Self-Supervised Representation Learning for Geospatial Objects: A Survey
par: Chen, Yile, et autres
Publié: (2024)
par: Chen, Yile, et autres
Publié: (2024)
Synthetic Prefixes to Mitigate Bias in Real-Time Neural Query Autocomplete
par: Rajan, Adithya, et autres
Publié: (2025)
par: Rajan, Adithya, et autres
Publié: (2025)
CARE-RFT: Confidence-Anchored Reinforcement Finetuning for Reliable Reasoning in Large Language Models
par: Li, Shuozhe, et autres
Publié: (2026)
par: Li, Shuozhe, et autres
Publié: (2026)
Process In-Context Learning: Enhancing Mathematical Reasoning via Dynamic Demonstration Insertion
par: Gao, Ang, et autres
Publié: (2026)
par: Gao, Ang, et autres
Publié: (2026)
Large Language Models to Diffusion Finetuning
par: Cetin, Edoardo, et autres
Publié: (2025)
par: Cetin, Edoardo, et autres
Publié: (2025)
Learning How to Remember: A Meta-Cognitive Management Method for Structured and Transferable Agent Memory
par: Liang, Sirui, et autres
Publié: (2026)
par: Liang, Sirui, et autres
Publié: (2026)
Can Past Experience Accelerate LLM Reasoning?
par: Pan, Bo, et autres
Publié: (2025)
par: Pan, Bo, et autres
Publié: (2025)
Dynamics-Predictive Sampling for Active RL Finetuning of Large Reasoning Models
par: Mao, Yixiu, et autres
Publié: (2026)
par: Mao, Yixiu, et autres
Publié: (2026)
Task-Stratified Knowledge Scaling Laws for Post-Training Quantized Large Language Models
par: Zhou, Chenxi, et autres
Publié: (2025)
par: Zhou, Chenxi, et autres
Publié: (2025)
From Signal Degradation to Computation Collapse: Uncovering the Two Failure Modes of LLM Quantization
par: Zhou, Chenxi, et autres
Publié: (2026)
par: Zhou, Chenxi, et autres
Publié: (2026)
Quantization Meets Reasoning: Exploring and Mitigating Degradation of Low-Bit LLMs in Mathematical Reasoning
par: Li, Zhen, et autres
Publié: (2025)
par: Li, Zhen, et autres
Publié: (2025)
ReFT: Representation Finetuning for Language Models
par: Wu, Zhengxuan, et autres
Publié: (2024)
par: Wu, Zhengxuan, et autres
Publié: (2024)
Deja vu: Contrastive Historical Modeling with Prefix-tuning for Temporal Knowledge Graph Reasoning
par: Peng, Miao, et autres
Publié: (2024)
par: Peng, Miao, et autres
Publié: (2024)
Training Reasoning Models on Saturated Problems via Failure-Prefix Conditioning
par: Kim, Minwu, et autres
Publié: (2026)
par: Kim, Minwu, et autres
Publié: (2026)
SBS: Enhancing Parameter-Efficiency of Neural Representations for Neural Networks via Spectral Bias Suppression
par: Xie, Qihu, et autres
Publié: (2025)
par: Xie, Qihu, et autres
Publié: (2025)
Can Prompt Difficulty be Online Predicted for Accelerating RL Finetuning of Reasoning Models?
par: Qu, Yun, et autres
Publié: (2025)
par: Qu, Yun, et autres
Publié: (2025)
GeoAda: Efficiently Finetune Geometric Diffusion Models with Equivariant Adapters
par: Zhao, Wanjia, et autres
Publié: (2025)
par: Zhao, Wanjia, et autres
Publié: (2025)
Towards Robust Knowledge Unlearning: An Adversarial Framework for Assessing and Improving Unlearning Robustness in Large Language Models
par: Yuan, Hongbang, et autres
Publié: (2024)
par: Yuan, Hongbang, et autres
Publié: (2024)
Skywork-Math: Data Scaling Laws for Mathematical Reasoning in Large Language Models -- The Story Goes On
par: Zeng, Liang, et autres
Publié: (2024)
par: Zeng, Liang, et autres
Publié: (2024)
Auxiliary Reward Generation with Transition Distance Representation Learning
par: Li, Siyuan, et autres
Publié: (2024)
par: Li, Siyuan, et autres
Publié: (2024)
Bifurcated Attention: Accelerating Massively Parallel Decoding with Shared Prefixes in LLMs
par: Athiwaratkun, Ben, et autres
Publié: (2024)
par: Athiwaratkun, Ben, et autres
Publié: (2024)
VAR-MATH: Probing True Mathematical Reasoning in LLMS via Symbolic Multi-Instance Benchmarks
par: Yao, Jian, et autres
Publié: (2025)
par: Yao, Jian, et autres
Publié: (2025)
Multiagent Finetuning: Self Improvement with Diverse Reasoning Chains
par: Subramaniam, Vighnesh, et autres
Publié: (2025)
par: Subramaniam, Vighnesh, et autres
Publié: (2025)
Conformalized Link Prediction on Graph Neural Networks
par: Zhao, Tianyi, et autres
Publié: (2024)
par: Zhao, Tianyi, et autres
Publié: (2024)
PrefixGPT: Prefix Adder Optimization by a Generative Pre-trained Transformer
par: Ding, Ruogu, et autres
Publié: (2025)
par: Ding, Ruogu, et autres
Publié: (2025)
FormalMATH: Benchmarking Formal Mathematical Reasoning of Large Language Models
par: Yu, Zhouliang, et autres
Publié: (2025)
par: Yu, Zhouliang, et autres
Publié: (2025)
Learn to Think: Bootstrapping LLM Reasoning Capability Through Graph Representation Learning
par: Gao, Hang, et autres
Publié: (2025)
par: Gao, Hang, et autres
Publié: (2025)
Large Language Model Cascades with Mixture of Thoughts Representations for Cost-efficient Reasoning
par: Yue, Murong, et autres
Publié: (2023)
par: Yue, Murong, et autres
Publié: (2023)
On the Empirical Complexity of Reasoning and Planning in LLMs
par: Kang, Liwei, et autres
Publié: (2024)
par: Kang, Liwei, et autres
Publié: (2024)
Training Verification-Friendly Neural Networks via Neuron Behavior Consistency
par: Liu, Zongxin, et autres
Publié: (2024)
par: Liu, Zongxin, et autres
Publié: (2024)
Sparse Prefix Caching for Hybrid and Recurrent LLM Serving
par: Shirokikh, Mikhail, et autres
Publié: (2026)
par: Shirokikh, Mikhail, et autres
Publié: (2026)
Geometric Mixture-of-Experts with Curvature-Guided Adaptive Routing for Graph Representation Learning
par: Cao, Haifang, et autres
Publié: (2026)
par: Cao, Haifang, et autres
Publié: (2026)
Evaluating Robustness of Reward Models for Mathematical Reasoning
par: Kim, Sunghwan, et autres
Publié: (2024)
par: Kim, Sunghwan, et autres
Publié: (2024)
RL-Finetuned LLMs for Privacy-Preserving Synthetic Rewriting
par: Shi, Zhan, et autres
Publié: (2025)
par: Shi, Zhan, et autres
Publié: (2025)
Documents similaires
-
Representation Finetuning for Continual Learning
par: Luo, Haihua, et autres
Publié: (2026) -
Fast and Effective On-policy Distillation from Reasoning Prefixes
par: Zhang, Dongxu, et autres
Publié: (2026) -
Towards Infinite-Long Prefix in Transformer
par: Liang, Yingyu, et autres
Publié: (2024) -
Prefix Grouper: Efficient GRPO Training through Shared-Prefix Forward
par: Liu, Zikang, et autres
Publié: (2025) -
Beyond Parameter Finetuning: Test-Time Representation Refinement for Node Classification
par: Zhang, Jiaxin, et autres
Publié: (2026)