Model Fusion via Neuron Transplantation
Fuente:
arXiv
Salvato in:
| Autori principali: | Öz, Muhammed, Kiefer, Nicholas, Debus, Charlotte, Hörter, Jasmin, Streit, Achim, Götz, Markus |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Differentiable Power-Flow Optimization
di: Öz, Muhammed, et al.
Pubblicazione: (2026)
di: Öz, Muhammed, et al.
Pubblicazione: (2026)
A Comparative Study of Pruning Methods in Transformer-based Time Series Forecasting
di: Kiefer, Nicholas, et al.
Pubblicazione: (2024)
di: Kiefer, Nicholas, et al.
Pubblicazione: (2024)
AB-Training: A Communication-Efficient Approach for Distributed Low-Rank Learning
di: Coquelin, Daniel, et al.
Pubblicazione: (2024)
di: Coquelin, Daniel, et al.
Pubblicazione: (2024)
Harnessing Orthogonality to Train Low-Rank Neural Networks
di: Coquelin, Daniel, et al.
Pubblicazione: (2024)
di: Coquelin, Daniel, et al.
Pubblicazione: (2024)
Beyond Backpropagation: Optimization with Multi-Tangent Forward Gradients
di: Flügel, Katharina, et al.
Pubblicazione: (2024)
di: Flügel, Katharina, et al.
Pubblicazione: (2024)
Feed-Forward Optimization With Delayed Feedback for Neural Network Training
di: Flügel, Katharina, et al.
Pubblicazione: (2023)
di: Flügel, Katharina, et al.
Pubblicazione: (2023)
ReCycle: Fast and Efficient Long Time Series Forecasting with Residual Cyclic Transformers
di: Weyrauch, Arvid, et al.
Pubblicazione: (2024)
di: Weyrauch, Arvid, et al.
Pubblicazione: (2024)
Energy Consumption in Parallel Neural Network Training
di: Huber, Philipp, et al.
Pubblicazione: (2025)
di: Huber, Philipp, et al.
Pubblicazione: (2025)
Sampling Parallelism for Fast and Efficient Bayesian Learning
di: Özdemir, Asena Karolin, et al.
Pubblicazione: (2026)
di: Özdemir, Asena Karolin, et al.
Pubblicazione: (2026)
Jigsaw: Training Multi-Billion-Parameter AI Weather Models with Optimized Model Parallelism
di: Kieckhefen, Deifilia, et al.
Pubblicazione: (2025)
di: Kieckhefen, Deifilia, et al.
Pubblicazione: (2025)
Bayesian Lottery Ticket Hypothesis
di: Kuhn, Nicholas, et al.
Pubblicazione: (2026)
di: Kuhn, Nicholas, et al.
Pubblicazione: (2026)
Inverse Design of Optical Multilayer Thin Films using Robust Masked Diffusion Models
di: Schaible, Jonas, et al.
Pubblicazione: (2026)
di: Schaible, Jonas, et al.
Pubblicazione: (2026)
PETNet -- Coincident Particle Event Detection using Spiking Neural Networks
di: Debus, Jan, et al.
Pubblicazione: (2025)
di: Debus, Jan, et al.
Pubblicazione: (2025)
ARM: Role-Conditioned Neuron Transplantation for Training-Free Generalist LLM Agent Merging
di: Feng, Zhuoka, et al.
Pubblicazione: (2026)
di: Feng, Zhuoka, et al.
Pubblicazione: (2026)
Exploring Federated Learning for Thermal Urban Feature Segmentation -- A Comparison of Centralized and Decentralized Approaches
di: Duda, Leonhard, et al.
Pubblicazione: (2025)
di: Duda, Leonhard, et al.
Pubblicazione: (2025)
Classifying Overlapping Gaussian Mixtures in High Dimensions: From Optimal Classifiers to Neural Nets
di: Cohen, Khen, et al.
Pubblicazione: (2024)
di: Cohen, Khen, et al.
Pubblicazione: (2024)
Neuron-Anchored Rule Extraction for Large Language Models via Contrastive Hierarchical Ablation
di: Sovrano, Francesco, et al.
Pubblicazione: (2026)
di: Sovrano, Francesco, et al.
Pubblicazione: (2026)
NeuronSeek: On Stability and Expressivity of Task-driven Neurons
di: Pei, Hanyu, et al.
Pubblicazione: (2025)
di: Pei, Hanyu, et al.
Pubblicazione: (2025)
Cross-Modal Unlearning via Influential Neuron Path Editing in Multimodal Large Language Models
di: Li, Kunhao, et al.
Pubblicazione: (2025)
di: Li, Kunhao, et al.
Pubblicazione: (2025)
Light Alignment Improves LLM Safety via Model Self-Reflection with a Single Neuron
di: Shen, Sicheng, et al.
Pubblicazione: (2026)
di: Shen, Sicheng, et al.
Pubblicazione: (2026)
Bayesian Kolmogorov Arnold Networks (Bayesian_KANs): A Probabilistic Approach to Enhance Accuracy and Interpretability
di: Hassan, Masoud Muhammed
Pubblicazione: (2024)
di: Hassan, Masoud Muhammed
Pubblicazione: (2024)
MIN-Merging: Merge the Important Neurons for Model Merging
di: Liang, Yunfei
Pubblicazione: (2025)
di: Liang, Yunfei
Pubblicazione: (2025)
Shapley Neuron Values for Continual Learning: Which Neurons Matter Most?
di: Vahedifar, Mohammad Ali, et al.
Pubblicazione: (2026)
di: Vahedifar, Mohammad Ali, et al.
Pubblicazione: (2026)
Inertial Confinement Fusion Forecasting via Large Language Models
di: Chen, Mingkai, et al.
Pubblicazione: (2024)
di: Chen, Mingkai, et al.
Pubblicazione: (2024)
Training Verification-Friendly Neural Networks via Neuron Behavior Consistency
di: Liu, Zongxin, et al.
Pubblicazione: (2024)
di: Liu, Zongxin, et al.
Pubblicazione: (2024)
Towards Effective Theory of LLMs: A Representation Learning Approach
di: Ustaomeroglu, Muhammed, et al.
Pubblicazione: (2026)
di: Ustaomeroglu, Muhammed, et al.
Pubblicazione: (2026)
Abduction-Deduction Entanglement: Domain Generalization via Representation Transplants
di: Jalaldoust, Kasra, et al.
Pubblicazione: (2026)
di: Jalaldoust, Kasra, et al.
Pubblicazione: (2026)
Dendritic Resonate-and-Fire Neuron for Effective and Efficient Long Sequence Modeling
di: Zhang, Dehao, et al.
Pubblicazione: (2025)
di: Zhang, Dehao, et al.
Pubblicazione: (2025)
Finding NeMo: Localizing Neurons Responsible For Memorization in Diffusion Models
di: Hintersdorf, Dominik, et al.
Pubblicazione: (2024)
di: Hintersdorf, Dominik, et al.
Pubblicazione: (2024)
SAFR: Neuron Redistribution for Interpretability
di: Chang, Ruidi, et al.
Pubblicazione: (2025)
di: Chang, Ruidi, et al.
Pubblicazione: (2025)
Artificial Kuramoto Oscillatory Neurons
di: Miyato, Takeru, et al.
Pubblicazione: (2024)
di: Miyato, Takeru, et al.
Pubblicazione: (2024)
Rethinking the Function of Neurons in KANs
di: Altarabichi, Mohammed Ghaith
Pubblicazione: (2024)
di: Altarabichi, Mohammed Ghaith
Pubblicazione: (2024)
Near-Optimal Dynamic Matching via Coarsening with Application to Heart Transplantation
di: Zilberstein, Itai, et al.
Pubblicazione: (2026)
di: Zilberstein, Itai, et al.
Pubblicazione: (2026)
The Impact of Post-training on Data Contamination
di: Kocyigit, Muhammed Yusuf, et al.
Pubblicazione: (2026)
di: Kocyigit, Muhammed Yusuf, et al.
Pubblicazione: (2026)
On the dimension of pullback attractors in recurrent neural networks
di: Fadera, Muhammed
Pubblicazione: (2025)
di: Fadera, Muhammed
Pubblicazione: (2025)
Mitigating Biases for Instruction-following Language Models via Bias Neurons Elimination
di: Yang, Nakyeong, et al.
Pubblicazione: (2023)
di: Yang, Nakyeong, et al.
Pubblicazione: (2023)
WINA: Weight Informed Neuron Activation for Accelerating Large Language Model Inference
di: Chen, Sihan, et al.
Pubblicazione: (2025)
di: Chen, Sihan, et al.
Pubblicazione: (2025)
NeuRel-Attack: Neuron Relearning for Safety Disalignment in Large Language Models
di: Zhou, Yi, et al.
Pubblicazione: (2025)
di: Zhou, Yi, et al.
Pubblicazione: (2025)
Towards Efficient Pareto Set Approximation via Mixture of Experts Based Model Fusion
di: Tang, Anke, et al.
Pubblicazione: (2024)
di: Tang, Anke, et al.
Pubblicazione: (2024)
LLM Advertisement based on Neuron Auctions
di: Yun, Peiran, et al.
Pubblicazione: (2026)
di: Yun, Peiran, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Differentiable Power-Flow Optimization
di: Öz, Muhammed, et al.
Pubblicazione: (2026) -
A Comparative Study of Pruning Methods in Transformer-based Time Series Forecasting
di: Kiefer, Nicholas, et al.
Pubblicazione: (2024) -
AB-Training: A Communication-Efficient Approach for Distributed Low-Rank Learning
di: Coquelin, Daniel, et al.
Pubblicazione: (2024) -
Harnessing Orthogonality to Train Low-Rank Neural Networks
di: Coquelin, Daniel, et al.
Pubblicazione: (2024) -
Beyond Backpropagation: Optimization with Multi-Tangent Forward Gradients
di: Flügel, Katharina, et al.
Pubblicazione: (2024)