Understanding Post-Training Structural Changes in Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | He, Xinyu, Cao, Xianghui |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
PTQTP: Post-Training Quantization to Trit-Planes for Large Language Models
par: Xiao, He, et autres
Publié: (2025)
par: Xiao, He, et autres
Publié: (2025)
Post Training Quantization of Large Language Models with Microscaling Formats
par: Sharify, Sayeh, et autres
Publié: (2024)
par: Sharify, Sayeh, et autres
Publié: (2024)
Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models
par: Xu, Zihuai, et autres
Publié: (2025)
par: Xu, Zihuai, et autres
Publié: (2025)
PT$^2$-LLM: Post-Training Ternarization for Large Language Models
par: Yan, Xianglong, et autres
Publié: (2025)
par: Yan, Xianglong, et autres
Publié: (2025)
DiRL: An Efficient Post-Training Framework for Diffusion Language Models
par: Zhu, Ying, et autres
Publié: (2025)
par: Zhu, Ying, et autres
Publié: (2025)
GVPO: Group Variance Policy Optimization for Large Language Model Post-Training
par: Zhang, Kaichen, et autres
Publié: (2025)
par: Zhang, Kaichen, et autres
Publié: (2025)
Task-Stratified Knowledge Scaling Laws for Post-Training Quantized Large Language Models
par: Zhou, Chenxi, et autres
Publié: (2025)
par: Zhou, Chenxi, et autres
Publié: (2025)
Param$Δ$ for Direct Weight Mixing: Post-Train Large Language Model at Zero Cost
par: Cao, Sheng, et autres
Publié: (2025)
par: Cao, Sheng, et autres
Publié: (2025)
Accumulator-Aware Post-Training Quantization for Large Language Models
par: Colbert, Ian, et autres
Publié: (2024)
par: Colbert, Ian, et autres
Publié: (2024)
Towards a Unified View of Large Language Model Post-Training
par: Lv, Xingtai, et autres
Publié: (2025)
par: Lv, Xingtai, et autres
Publié: (2025)
Interactions Across Blocks in Post-Training Quantization of Large Language Models
par: Shabanovi, Khasmamad, et autres
Publié: (2024)
par: Shabanovi, Khasmamad, et autres
Publié: (2024)
Quant-dLLM: Post-Training Extreme Low-Bit Quantization for Diffusion Large Language Models
par: Zhang, Tianao, et autres
Publié: (2025)
par: Zhang, Tianao, et autres
Publié: (2025)
Exploring Layer-wise Information Effectiveness for Post-Training Quantization in Small Language Models
par: Xiao, He, et autres
Publié: (2025)
par: Xiao, He, et autres
Publié: (2025)
LRQ: Optimizing Post-Training Quantization for Large Language Models by Learning Low-Rank Weight-Scaling Matrices
par: Lee, Jung Hyun, et autres
Publié: (2024)
par: Lee, Jung Hyun, et autres
Publié: (2024)
Beyond GRPO and On-Policy Distillation: An Empirical Sparse-to-Dense Reward Principle for Language-Model Post-Training
par: Xu, Yuanda, et autres
Publié: (2026)
par: Xu, Yuanda, et autres
Publié: (2026)
SmoothQuant: Accurate and Efficient Post-Training Quantization for Large Language Models
par: Xiao, Guangxuan, et autres
Publié: (2022)
par: Xiao, Guangxuan, et autres
Publié: (2022)
Athena: Efficient Block-Wise Post-Training Quantization for Large Language Models Using Second-Order Matrix Derivative Information
par: Wang, Yanshu, et autres
Publié: (2024)
par: Wang, Yanshu, et autres
Publié: (2024)
CrossQuant: A Post-Training Quantization Method with Smaller Quantization Kernel for Precise Large Language Model Compression
par: Liu, Wenyuan, et autres
Publié: (2024)
par: Liu, Wenyuan, et autres
Publié: (2024)
GPrune-LLM: Generalization-Aware Structured Pruning for Large Language Models
par: Liu, Xiaoyun, et autres
Publié: (2026)
par: Liu, Xiaoyun, et autres
Publié: (2026)
APTQ: Attention-aware Post-Training Mixed-Precision Quantization for Large Language Models
par: Guan, Ziyi, et autres
Publié: (2024)
par: Guan, Ziyi, et autres
Publié: (2024)
Post-Training as Reweighting: A Stochastic View of Reasoning Trajectories in Language Models
par: Bu, Dake, et autres
Publié: (2025)
par: Bu, Dake, et autres
Publié: (2025)
Representation-Based Exploration for Language Models: From Test-Time to Post-Training
par: Tuyls, Jens, et autres
Publié: (2025)
par: Tuyls, Jens, et autres
Publié: (2025)
PTQ1.61: Push the Real Limit of Extremely Low-Bit Post-Training Quantization Methods for Large Language Models
par: Zhao, Jiaqi, et autres
Publié: (2025)
par: Zhao, Jiaqi, et autres
Publié: (2025)
Lightning OPD: Efficient Post-Training for Large Reasoning Models with Offline On-Policy Distillation
par: Wu, Yecheng, et autres
Publié: (2026)
par: Wu, Yecheng, et autres
Publié: (2026)
Chasing the Tail: Effective Rubric-based Reward Modeling for Large Language Model Post-Training
par: Zhang, Junkai, et autres
Publié: (2025)
par: Zhang, Junkai, et autres
Publié: (2025)
Do Large Language Models (LLMs) Understand Chronology?
par: Wongchamcharoen, Pattaraphon Kenny, et autres
Publié: (2025)
par: Wongchamcharoen, Pattaraphon Kenny, et autres
Publié: (2025)
LOGIN: A Large Language Model Consulted Graph Neural Network Training Framework
par: Qiao, Yiran, et autres
Publié: (2024)
par: Qiao, Yiran, et autres
Publié: (2024)
Inverse Reinforcement Learning Meets Large Language Model Post-Training: Basics, Advances, and Opportunities
par: Sun, Hao, et autres
Publié: (2025)
par: Sun, Hao, et autres
Publié: (2025)
Large Language Model Post-Training: A Unified View of Off-Policy and On-Policy Learning
par: Zhao, Shiwan, et autres
Publié: (2026)
par: Zhao, Shiwan, et autres
Publié: (2026)
Self-Improving Tabular Language Models via Iterative Reward-Guided Post-Training
par: Long, Yunbo, et autres
Publié: (2026)
par: Long, Yunbo, et autres
Publié: (2026)
Mapping Post-Training Forgetting in Language Models at Scale
par: Harmon, Jackson, et autres
Publié: (2025)
par: Harmon, Jackson, et autres
Publié: (2025)
Provable Training Data Identification for Large Language Models
par: Liu, Zhenlong, et autres
Publié: (2025)
par: Liu, Zhenlong, et autres
Publié: (2025)
Saliency-Aware Regularized Quantization Calibration for Large Language Models
par: Zhao, Yanlong, et autres
Publié: (2026)
par: Zhao, Yanlong, et autres
Publié: (2026)
ChessQA: Evaluating Large Language Models for Chess Understanding
par: Wen, Qianfeng, et autres
Publié: (2025)
par: Wen, Qianfeng, et autres
Publié: (2025)
Efficient Table Retrieval and Understanding with Multimodal Large Language Models
par: Xu, Zhuoyan, et autres
Publié: (2026)
par: Xu, Zhuoyan, et autres
Publié: (2026)
Small Generalizable Prompt Predictive Models Can Steer Efficient RL Post-Training of Large Reasoning Models
par: Qu, Yun, et autres
Publié: (2026)
par: Qu, Yun, et autres
Publié: (2026)
NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning
par: Liu, Wei, et autres
Publié: (2025)
par: Liu, Wei, et autres
Publié: (2025)
Scaling and Transferability of Annealing Strategies in Large Language Model Training
par: Wang, Siqi, et autres
Publié: (2025)
par: Wang, Siqi, et autres
Publié: (2025)
Test-Time Training on Graphs with Large Language Models (LLMs)
par: Zhang, Jiaxin, et autres
Publié: (2024)
par: Zhang, Jiaxin, et autres
Publié: (2024)
Shifting the Gradient: Understanding How Defensive Training Methods Protect Language Model Integrity
par: Grant, Satchel, et autres
Publié: (2026)
par: Grant, Satchel, et autres
Publié: (2026)
Documents similaires
-
PTQTP: Post-Training Quantization to Trit-Planes for Large Language Models
par: Xiao, He, et autres
Publié: (2025) -
Post Training Quantization of Large Language Models with Microscaling Formats
par: Sharify, Sayeh, et autres
Publié: (2024) -
Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models
par: Xu, Zihuai, et autres
Publié: (2025) -
PT$^2$-LLM: Post-Training Ternarization for Large Language Models
par: Yan, Xianglong, et autres
Publié: (2025) -
DiRL: An Efficient Post-Training Framework for Diffusion Language Models
par: Zhu, Ying, et autres
Publié: (2025)