Bias-Restrained Prefix Representation Finetuning for Mathematical Reasoning
Fuente:
arXiv
Guardado en:
| Autores principales: | Liang, Sirui, Cao, Pengfei, Zhao, Jian, Huang, Cong, Zhao, Jun, Liu, Kang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Representation Finetuning for Continual Learning
por: Luo, Haihua, et al.
Publicado: (2026)
por: Luo, Haihua, et al.
Publicado: (2026)
Fast and Effective On-policy Distillation from Reasoning Prefixes
por: Zhang, Dongxu, et al.
Publicado: (2026)
por: Zhang, Dongxu, et al.
Publicado: (2026)
Towards Infinite-Long Prefix in Transformer
por: Liang, Yingyu, et al.
Publicado: (2024)
por: Liang, Yingyu, et al.
Publicado: (2024)
Prefix Grouper: Efficient GRPO Training through Shared-Prefix Forward
por: Liu, Zikang, et al.
Publicado: (2025)
por: Liu, Zikang, et al.
Publicado: (2025)
Beyond Parameter Finetuning: Test-Time Representation Refinement for Node Classification
por: Zhang, Jiaxin, et al.
Publicado: (2026)
por: Zhang, Jiaxin, et al.
Publicado: (2026)
PromptCoT: Synthesizing Olympiad-level Problems for Mathematical Reasoning in Large Language Models
por: Zhao, Xueliang, et al.
Publicado: (2025)
por: Zhao, Xueliang, et al.
Publicado: (2025)
Self-Supervised Representation Learning for Geospatial Objects: A Survey
por: Chen, Yile, et al.
Publicado: (2024)
por: Chen, Yile, et al.
Publicado: (2024)
Synthetic Prefixes to Mitigate Bias in Real-Time Neural Query Autocomplete
por: Rajan, Adithya, et al.
Publicado: (2025)
por: Rajan, Adithya, et al.
Publicado: (2025)
CARE-RFT: Confidence-Anchored Reinforcement Finetuning for Reliable Reasoning in Large Language Models
por: Li, Shuozhe, et al.
Publicado: (2026)
por: Li, Shuozhe, et al.
Publicado: (2026)
Process In-Context Learning: Enhancing Mathematical Reasoning via Dynamic Demonstration Insertion
por: Gao, Ang, et al.
Publicado: (2026)
por: Gao, Ang, et al.
Publicado: (2026)
Large Language Models to Diffusion Finetuning
por: Cetin, Edoardo, et al.
Publicado: (2025)
por: Cetin, Edoardo, et al.
Publicado: (2025)
Learning How to Remember: A Meta-Cognitive Management Method for Structured and Transferable Agent Memory
por: Liang, Sirui, et al.
Publicado: (2026)
por: Liang, Sirui, et al.
Publicado: (2026)
Can Past Experience Accelerate LLM Reasoning?
por: Pan, Bo, et al.
Publicado: (2025)
por: Pan, Bo, et al.
Publicado: (2025)
Dynamics-Predictive Sampling for Active RL Finetuning of Large Reasoning Models
por: Mao, Yixiu, et al.
Publicado: (2026)
por: Mao, Yixiu, et al.
Publicado: (2026)
Task-Stratified Knowledge Scaling Laws for Post-Training Quantized Large Language Models
por: Zhou, Chenxi, et al.
Publicado: (2025)
por: Zhou, Chenxi, et al.
Publicado: (2025)
From Signal Degradation to Computation Collapse: Uncovering the Two Failure Modes of LLM Quantization
por: Zhou, Chenxi, et al.
Publicado: (2026)
por: Zhou, Chenxi, et al.
Publicado: (2026)
Quantization Meets Reasoning: Exploring and Mitigating Degradation of Low-Bit LLMs in Mathematical Reasoning
por: Li, Zhen, et al.
Publicado: (2025)
por: Li, Zhen, et al.
Publicado: (2025)
ReFT: Representation Finetuning for Language Models
por: Wu, Zhengxuan, et al.
Publicado: (2024)
por: Wu, Zhengxuan, et al.
Publicado: (2024)
Deja vu: Contrastive Historical Modeling with Prefix-tuning for Temporal Knowledge Graph Reasoning
por: Peng, Miao, et al.
Publicado: (2024)
por: Peng, Miao, et al.
Publicado: (2024)
Training Reasoning Models on Saturated Problems via Failure-Prefix Conditioning
por: Kim, Minwu, et al.
Publicado: (2026)
por: Kim, Minwu, et al.
Publicado: (2026)
SBS: Enhancing Parameter-Efficiency of Neural Representations for Neural Networks via Spectral Bias Suppression
por: Xie, Qihu, et al.
Publicado: (2025)
por: Xie, Qihu, et al.
Publicado: (2025)
Can Prompt Difficulty be Online Predicted for Accelerating RL Finetuning of Reasoning Models?
por: Qu, Yun, et al.
Publicado: (2025)
por: Qu, Yun, et al.
Publicado: (2025)
GeoAda: Efficiently Finetune Geometric Diffusion Models with Equivariant Adapters
por: Zhao, Wanjia, et al.
Publicado: (2025)
por: Zhao, Wanjia, et al.
Publicado: (2025)
Towards Robust Knowledge Unlearning: An Adversarial Framework for Assessing and Improving Unlearning Robustness in Large Language Models
por: Yuan, Hongbang, et al.
Publicado: (2024)
por: Yuan, Hongbang, et al.
Publicado: (2024)
Skywork-Math: Data Scaling Laws for Mathematical Reasoning in Large Language Models -- The Story Goes On
por: Zeng, Liang, et al.
Publicado: (2024)
por: Zeng, Liang, et al.
Publicado: (2024)
Auxiliary Reward Generation with Transition Distance Representation Learning
por: Li, Siyuan, et al.
Publicado: (2024)
por: Li, Siyuan, et al.
Publicado: (2024)
Bifurcated Attention: Accelerating Massively Parallel Decoding with Shared Prefixes in LLMs
por: Athiwaratkun, Ben, et al.
Publicado: (2024)
por: Athiwaratkun, Ben, et al.
Publicado: (2024)
VAR-MATH: Probing True Mathematical Reasoning in LLMS via Symbolic Multi-Instance Benchmarks
por: Yao, Jian, et al.
Publicado: (2025)
por: Yao, Jian, et al.
Publicado: (2025)
Multiagent Finetuning: Self Improvement with Diverse Reasoning Chains
por: Subramaniam, Vighnesh, et al.
Publicado: (2025)
por: Subramaniam, Vighnesh, et al.
Publicado: (2025)
Conformalized Link Prediction on Graph Neural Networks
por: Zhao, Tianyi, et al.
Publicado: (2024)
por: Zhao, Tianyi, et al.
Publicado: (2024)
PrefixGPT: Prefix Adder Optimization by a Generative Pre-trained Transformer
por: Ding, Ruogu, et al.
Publicado: (2025)
por: Ding, Ruogu, et al.
Publicado: (2025)
FormalMATH: Benchmarking Formal Mathematical Reasoning of Large Language Models
por: Yu, Zhouliang, et al.
Publicado: (2025)
por: Yu, Zhouliang, et al.
Publicado: (2025)
Learn to Think: Bootstrapping LLM Reasoning Capability Through Graph Representation Learning
por: Gao, Hang, et al.
Publicado: (2025)
por: Gao, Hang, et al.
Publicado: (2025)
Large Language Model Cascades with Mixture of Thoughts Representations for Cost-efficient Reasoning
por: Yue, Murong, et al.
Publicado: (2023)
por: Yue, Murong, et al.
Publicado: (2023)
On the Empirical Complexity of Reasoning and Planning in LLMs
por: Kang, Liwei, et al.
Publicado: (2024)
por: Kang, Liwei, et al.
Publicado: (2024)
Training Verification-Friendly Neural Networks via Neuron Behavior Consistency
por: Liu, Zongxin, et al.
Publicado: (2024)
por: Liu, Zongxin, et al.
Publicado: (2024)
Sparse Prefix Caching for Hybrid and Recurrent LLM Serving
por: Shirokikh, Mikhail, et al.
Publicado: (2026)
por: Shirokikh, Mikhail, et al.
Publicado: (2026)
Geometric Mixture-of-Experts with Curvature-Guided Adaptive Routing for Graph Representation Learning
por: Cao, Haifang, et al.
Publicado: (2026)
por: Cao, Haifang, et al.
Publicado: (2026)
Evaluating Robustness of Reward Models for Mathematical Reasoning
por: Kim, Sunghwan, et al.
Publicado: (2024)
por: Kim, Sunghwan, et al.
Publicado: (2024)
RL-Finetuned LLMs for Privacy-Preserving Synthetic Rewriting
por: Shi, Zhan, et al.
Publicado: (2025)
por: Shi, Zhan, et al.
Publicado: (2025)
Ejemplares similares
-
Representation Finetuning for Continual Learning
por: Luo, Haihua, et al.
Publicado: (2026) -
Fast and Effective On-policy Distillation from Reasoning Prefixes
por: Zhang, Dongxu, et al.
Publicado: (2026) -
Towards Infinite-Long Prefix in Transformer
por: Liang, Yingyu, et al.
Publicado: (2024) -
Prefix Grouper: Efficient GRPO Training through Shared-Prefix Forward
por: Liu, Zikang, et al.
Publicado: (2025) -
Beyond Parameter Finetuning: Test-Time Representation Refinement for Node Classification
por: Zhang, Jiaxin, et al.
Publicado: (2026)