Norm Anchors Make Model Edits Last
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liu, Mingda, Zhu, Zhenghan, Miao, Ze'an, Fujisawa, Katsuki |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Signs Beat Floats: Low-Rank Double-Binary Adaptation for On-Device Fine-Tuning
par: Fujisawa, Yoshihiko, et autres
Publié: (2026)
par: Fujisawa, Yoshihiko, et autres
Publié: (2026)
Enhancing Output Diversity Improves Conjugate Gradient-based Adversarial Attacks
par: Yamamura, Keiichiro, et autres
Publié: (2024)
par: Yamamura, Keiichiro, et autres
Publié: (2024)
More Than Bits: Multi-Envelope Double Binary Factorization for Extreme Quantization
par: Ichikawa, Yuma, et autres
Publié: (2025)
par: Ichikawa, Yuma, et autres
Publié: (2025)
Edit Flows: Flow Matching with Edit Operations
par: Havasi, Marton, et autres
Publié: (2025)
par: Havasi, Marton, et autres
Publié: (2025)
GEDAN: Learning the Edit Costs for Graph Edit Distance
par: Leonardi, Francesco, et autres
Publié: (2025)
par: Leonardi, Francesco, et autres
Publié: (2025)
AdvAnchor: Enhancing Diffusion Model Unlearning with Adversarial Anchors
par: Zhao, Mengnan, et autres
Publié: (2024)
par: Zhao, Mengnan, et autres
Publié: (2024)
Scalable Valuation of Human Feedback through Provably Robust Model Alignment
par: Fujisawa, Masahiro, et autres
Publié: (2025)
par: Fujisawa, Masahiro, et autres
Publié: (2025)
Generalized Tree Edit Distance (GTED): A Faithful Evaluation Metric for Statement Autoformalization
par: Liu, Yuntian, et autres
Publié: (2025)
par: Liu, Yuntian, et autres
Publié: (2025)
Sycophantic Anchors: Localizing and Quantifying User Agreement in Reasoning Models
par: Duszenko, Jacek
Publié: (2026)
par: Duszenko, Jacek
Publié: (2026)
K-Edit: Language Model Editing with Contextual Knowledge Awareness
par: Markowitz, Elan, et autres
Publié: (2025)
par: Markowitz, Elan, et autres
Publié: (2025)
GraphEdit: Large Language Models for Graph Structure Learning
par: Guo, Zirui, et autres
Publié: (2024)
par: Guo, Zirui, et autres
Publié: (2024)
Resolving UnderEdit & OverEdit with Iterative & Neighbor-Assisted Model Editing
par: Baghel, Bhiman Kumar, et autres
Publié: (2025)
par: Baghel, Bhiman Kumar, et autres
Publié: (2025)
MimicNorm: Weight Mean and Last BN Layer Mimic the Dynamic of Batch Normalization
par: Fei, Wen, et autres
Publié: (2020)
par: Fei, Wen, et autres
Publié: (2020)
GradientStabilizer:Fix the Norm, Not the Gradient
par: Huang, Tianjin, et autres
Publié: (2025)
par: Huang, Tianjin, et autres
Publié: (2025)
Beyond the Norms: Detecting Prediction Errors in Regression Models
par: Altieri, Andres, et autres
Publié: (2024)
par: Altieri, Andres, et autres
Publié: (2024)
MAnchors: Memorization-Based Acceleration of Anchors via Rule Reuse and Transformation
par: Yu, Haonan, et autres
Publié: (2025)
par: Yu, Haonan, et autres
Publié: (2025)
A General Anchor-Based Framework for Scalable Fair Clustering
par: Wei, Shengfei, et autres
Publié: (2025)
par: Wei, Shengfei, et autres
Publié: (2025)
Verifier-Free RL for LLMs via Intrinsic Gradient-Norm Reward
par: Wen, Xuexiang, et autres
Publié: (2026)
par: Wen, Xuexiang, et autres
Publié: (2026)
Overcoming Data and Model Heterogeneities in Decentralized Federated Learning via Synthetic Anchors
par: Huang, Chun-Yin, et autres
Publié: (2024)
par: Huang, Chun-Yin, et autres
Publié: (2024)
MobiEdit: Resource-efficient Knowledge Editing for Personalized On-device LLMs
par: Lu, Zhenyan, et autres
Publié: (2025)
par: Lu, Zhenyan, et autres
Publié: (2025)
Detecting Model Drifts in Non-Stationary Environment Using Edit Operation Measures
par: Lee, Chang-Hwan, et autres
Publié: (2025)
par: Lee, Chang-Hwan, et autres
Publié: (2025)
Annealed Co-Generation: Disentangling Variables via Progressive Pairwise Modeling
par: Zhang, Hantao, et autres
Publié: (2026)
par: Zhang, Hantao, et autres
Publié: (2026)
Last Layer Empirical Bayes
par: Villecroze, Valentin, et autres
Publié: (2025)
par: Villecroze, Valentin, et autres
Publié: (2025)
A Survey on Diffusion Language Models
par: Li, Tianyi, et autres
Publié: (2025)
par: Li, Tianyi, et autres
Publié: (2025)
Unpacking the Implicit Norm Dynamics of Sharpness-Aware Minimization in Tensorized Models
par: Cao, Tianxiao, et autres
Publié: (2025)
par: Cao, Tianxiao, et autres
Publié: (2025)
Discriminative Anchor Learning for Efficient Multi-view Clustering
par: Qin, Yalan, et autres
Publié: (2024)
par: Qin, Yalan, et autres
Publié: (2024)
Towards Learnable Anchor for Deep Multi-View Clustering
par: Wang, Bocheng, et autres
Publié: (2025)
par: Wang, Bocheng, et autres
Publié: (2025)
Post-Norm can Resharpen Attention
par: Zsámboki, Pál, et autres
Publié: (2025)
par: Zsámboki, Pál, et autres
Publié: (2025)
Optimal Scaling Needs Optimal Norm
par: Filatov, Oleg, et autres
Publié: (2025)
par: Filatov, Oleg, et autres
Publié: (2025)
Graph Edits for Counterfactual Explanations: A comparative study
par: Dimitriou, Angeliki, et autres
Publié: (2024)
par: Dimitriou, Angeliki, et autres
Publié: (2024)
Reinforcement Learning with Rubric Anchors
par: Huang, Zenan, et autres
Publié: (2025)
par: Huang, Zenan, et autres
Publié: (2025)
Constraining Sequential Model Editing with Editing Anchor Compression
par: Xu, Hao-Xiang, et autres
Publié: (2025)
par: Xu, Hao-Xiang, et autres
Publié: (2025)
Laying Anchors: Semantically Priming Numerals in Language Modeling
par: Sharma, Mandar, et autres
Publié: (2024)
par: Sharma, Mandar, et autres
Publié: (2024)
ESI: Epistemic Uncertainty Quantification via Semantic-preserving Intervention for Large Language Models
par: Li, Mingda, et autres
Publié: (2025)
par: Li, Mingda, et autres
Publié: (2025)
MLC-GCN: Multi-Level Generated Connectome Based GCN for AD Analysis
par: Zhu, Wenqi, et autres
Publié: (2024)
par: Zhu, Wenqi, et autres
Publié: (2024)
Measuring How LLMs Internalize Human Psychological Concepts: A preliminary analysis
par: Hamada, Hiro Taiyo, et autres
Publié: (2025)
par: Hamada, Hiro Taiyo, et autres
Publié: (2025)
Flexible Bayesian Last Layer Models Using Implicit Priors and Diffusion Posterior Sampling
par: Xu, Jian, et autres
Publié: (2024)
par: Xu, Jian, et autres
Publié: (2024)
Computing Approximate Graph Edit Distance via Optimal Transport
par: Cheng, Qihao, et autres
Publié: (2024)
par: Cheng, Qihao, et autres
Publié: (2024)
VL Norm: Rethink Loss Aggregation in RLVR
par: He, Zhiyuan, et autres
Publié: (2025)
par: He, Zhiyuan, et autres
Publié: (2025)
Measuring Social Norms of Large Language Models
par: Yuan, Ye, et autres
Publié: (2024)
par: Yuan, Ye, et autres
Publié: (2024)
Documents similaires
-
Signs Beat Floats: Low-Rank Double-Binary Adaptation for On-Device Fine-Tuning
par: Fujisawa, Yoshihiko, et autres
Publié: (2026) -
Enhancing Output Diversity Improves Conjugate Gradient-based Adversarial Attacks
par: Yamamura, Keiichiro, et autres
Publié: (2024) -
More Than Bits: Multi-Envelope Double Binary Factorization for Extreme Quantization
par: Ichikawa, Yuma, et autres
Publié: (2025) -
Edit Flows: Flow Matching with Edit Operations
par: Havasi, Marton, et autres
Publié: (2025) -
GEDAN: Learning the Edit Costs for Graph Edit Distance
par: Leonardi, Francesco, et autres
Publié: (2025)