Rebuilding ROME : Resolving Model Collapse during Sequential Model Editing
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Gupta, Akshat, Baskaran, Sidharth, Anumanchipalli, Gopala |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
A Unified Framework for Model Editing
von: Gupta, Akshat, et al.
Veröffentlicht: (2024)
von: Gupta, Akshat, et al.
Veröffentlicht: (2024)
Model Editing at Scale leads to Gradual and Catastrophic Forgetting
von: Gupta, Akshat, et al.
Veröffentlicht: (2024)
von: Gupta, Akshat, et al.
Veröffentlicht: (2024)
Is Bigger Edit Batch Size Always Better? -- An Empirical Study on Model Editing with Llama-3
von: Yoon, Junsang, et al.
Veröffentlicht: (2024)
von: Yoon, Junsang, et al.
Veröffentlicht: (2024)
Efficient Knowledge Editing via Minimal Precomputation
von: Gupta, Akshat, et al.
Veröffentlicht: (2025)
von: Gupta, Akshat, et al.
Veröffentlicht: (2025)
Self-Assessment Tests are Unreliable Measures of LLM Personality
von: Gupta, Akshat, et al.
Veröffentlicht: (2023)
von: Gupta, Akshat, et al.
Veröffentlicht: (2023)
Norm Growth and Stability Challenges in Localized Sequential Knowledge Editing
von: Gupta, Akshat, et al.
Veröffentlicht: (2025)
von: Gupta, Akshat, et al.
Veröffentlicht: (2025)
Geometric Interpretation of Layer Normalization and a Comparative Analysis with RMSNorm
von: Gupta, Akshat, et al.
Veröffentlicht: (2024)
von: Gupta, Akshat, et al.
Veröffentlicht: (2024)
How Do LLMs Use Their Depth?
von: Gupta, Akshat, et al.
Veröffentlicht: (2025)
von: Gupta, Akshat, et al.
Veröffentlicht: (2025)
Lifelong Knowledge Editing requires Better Regularization
von: Gupta, Akshat, et al.
Veröffentlicht: (2025)
von: Gupta, Akshat, et al.
Veröffentlicht: (2025)
The Oracle Has Spoken: A Multi-Aspect Evaluation of Dialogue in Pythia
von: Chen, Zixun, et al.
Veröffentlicht: (2025)
von: Chen, Zixun, et al.
Veröffentlicht: (2025)
PokerBench: Training Large Language Models to become Professional Poker Players
von: Zhuang, Richard, et al.
Veröffentlicht: (2025)
von: Zhuang, Richard, et al.
Veröffentlicht: (2025)
Evolutionary Strategies lead to Catastrophic Forgetting in LLMs
von: Abdi, Immanuel, et al.
Veröffentlicht: (2026)
von: Abdi, Immanuel, et al.
Veröffentlicht: (2026)
FineZip : Pushing the Limits of Large Language Models for Practical Lossless Text Compression
von: Mittu, Fazal, et al.
Veröffentlicht: (2024)
von: Mittu, Fazal, et al.
Veröffentlicht: (2024)
Identifying Multiple Personalities in Large Language Models with External Evaluation
von: Song, Xiaoyang, et al.
Veröffentlicht: (2024)
von: Song, Xiaoyang, et al.
Veröffentlicht: (2024)
Unsupervised TTS Acoustic Modeling for TTS with Conditional Disentangled Sequential VAE
von: Lian, Jiachen, et al.
Veröffentlicht: (2022)
von: Lian, Jiachen, et al.
Veröffentlicht: (2022)
Spectral Characterization and Mitigation of Sequential Knowledge Editing Collapse
von: Zhang, Chi, et al.
Veröffentlicht: (2026)
von: Zhang, Chi, et al.
Veröffentlicht: (2026)
Understanding the Collapse of LLMs in Model Editing
von: Yang, Wanli, et al.
Veröffentlicht: (2024)
von: Yang, Wanli, et al.
Veröffentlicht: (2024)
ROME: Memorization Insights from Text, Logits and Representation
von: Li, Bo, et al.
Veröffentlicht: (2024)
von: Li, Bo, et al.
Veröffentlicht: (2024)
Constraining Sequential Model Editing with Editing Anchor Compression
von: Xu, Hao-Xiang, et al.
Veröffentlicht: (2025)
von: Xu, Hao-Xiang, et al.
Veröffentlicht: (2025)
Let It Flow: Agentic Crafting on Rock and Roll, Building the ROME Model within an Open Agentic Learning Ecosystem
von: Wang, Weixun, et al.
Veröffentlicht: (2025)
von: Wang, Weixun, et al.
Veröffentlicht: (2025)
Towards Hierarchical Spoken Language Dysfluency Modeling
von: Lian, Jiachen, et al.
Veröffentlicht: (2024)
von: Lian, Jiachen, et al.
Veröffentlicht: (2024)
On the Superimposed Noise Accumulation Problem in Sequential Knowledge Editing of Large Language Models
von: Cao, Ding, et al.
Veröffentlicht: (2025)
von: Cao, Ding, et al.
Veröffentlicht: (2025)
The Labyrinth and the Thread: Rethinking Regularizations in Sequential Knowledge Editing for Large Language Models
von: Wang, Zheng, et al.
Veröffentlicht: (2026)
von: Wang, Zheng, et al.
Veröffentlicht: (2026)
HyperSteer: Activation Steering at Scale with Hypernetworks
von: Sun, Jiuding, et al.
Veröffentlicht: (2025)
von: Sun, Jiuding, et al.
Veröffentlicht: (2025)
Coding Speech through Vocal Tract Kinematics
von: Cho, Cheol Jun, et al.
Veröffentlicht: (2024)
von: Cho, Cheol Jun, et al.
Veröffentlicht: (2024)
Navigating the Dual Facets: A Comprehensive Evaluation of Sequential Memory Editing in Large Language Models
von: Lin, Zihao, et al.
Veröffentlicht: (2024)
von: Lin, Zihao, et al.
Veröffentlicht: (2024)
Resolving UnderEdit & OverEdit with Iterative & Neighbor-Assisted Model Editing
von: Baghel, Bhiman Kumar, et al.
Veröffentlicht: (2025)
von: Baghel, Bhiman Kumar, et al.
Veröffentlicht: (2025)
SSDM: Scalable Speech Dysfluency Modeling
von: Lian, Jiachen, et al.
Veröffentlicht: (2024)
von: Lian, Jiachen, et al.
Veröffentlicht: (2024)
Enabling Conversational Behavior Reasoning Capabilities in Full-Duplex Speech
von: Pan, Shuchang, et al.
Veröffentlicht: (2025)
von: Pan, Shuchang, et al.
Veröffentlicht: (2025)
HyperDAS: Towards Automating Mechanistic Interpretability with Hypernetworks
von: Sun, Jiuding, et al.
Veröffentlicht: (2025)
von: Sun, Jiuding, et al.
Veröffentlicht: (2025)
Collapse of Self-trained Language Models
von: Herel, David, et al.
Veröffentlicht: (2024)
von: Herel, David, et al.
Veröffentlicht: (2024)
LLM-Barber: Block-Aware Rebuilder for Sparsity Mask in One-Shot for Large Language Models
von: Su, Yupeng, et al.
Veröffentlicht: (2024)
von: Su, Yupeng, et al.
Veröffentlicht: (2024)
It Takes Two: A Dual Stage Approach for Terminology-Aware Translation
von: Jaswal, Akshat Singh
Veröffentlicht: (2025)
von: Jaswal, Akshat Singh
Veröffentlicht: (2025)
Detecting Mode Collapse in Language Models via Narration
von: Hamilton, Sil
Veröffentlicht: (2024)
von: Hamilton, Sil
Veröffentlicht: (2024)
Mechanistic Behavior Editing of Language Models
von: Singh, Joykirat, et al.
Veröffentlicht: (2024)
von: Singh, Joykirat, et al.
Veröffentlicht: (2024)
Learning by Surprise: Surplexity for Mitigating Model Collapse in Generative AI
von: Gambetta, Daniele, et al.
Veröffentlicht: (2024)
von: Gambetta, Daniele, et al.
Veröffentlicht: (2024)
Language Models as Semantic Augmenters for Sequential Recommenders
von: Valizadeh, Mahsa, et al.
Veröffentlicht: (2025)
von: Valizadeh, Mahsa, et al.
Veröffentlicht: (2025)
Cross-lingual Editing in Multilingual Language Models
von: Beniwal, Himanshu, et al.
Veröffentlicht: (2024)
von: Beniwal, Himanshu, et al.
Veröffentlicht: (2024)
Potential and Challenges of Model Editing for Social Debiasing
von: Yan, Jianhao, et al.
Veröffentlicht: (2024)
von: Yan, Jianhao, et al.
Veröffentlicht: (2024)
Context-Robust Knowledge Editing for Language Models
von: Park, Haewon, et al.
Veröffentlicht: (2025)
von: Park, Haewon, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
A Unified Framework for Model Editing
von: Gupta, Akshat, et al.
Veröffentlicht: (2024) -
Model Editing at Scale leads to Gradual and Catastrophic Forgetting
von: Gupta, Akshat, et al.
Veröffentlicht: (2024) -
Is Bigger Edit Batch Size Always Better? -- An Empirical Study on Model Editing with Llama-3
von: Yoon, Junsang, et al.
Veröffentlicht: (2024) -
Efficient Knowledge Editing via Minimal Precomputation
von: Gupta, Akshat, et al.
Veröffentlicht: (2025) -
Self-Assessment Tests are Unreliable Measures of LLM Personality
von: Gupta, Akshat, et al.
Veröffentlicht: (2023)