Layer by Layer: Uncovering Where Multi-Task Learning Happens in Instruction-Tuned Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhao, Zheng, Ziser, Yftah, Cohen, Shay B. |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Spectral Editing of Activations for Large Language Model Alignment
por: Qiu, Yifu, et al.
Publicado: (2024)
por: Qiu, Yifu, et al.
Publicado: (2024)
Self-Improving World Modelling with Latent Actions
por: Qiu, Yifu, et al.
Publicado: (2026)
por: Qiu, Yifu, et al.
Publicado: (2026)
Lost in Space? Vision-Language Models Struggle with Relative Camera Pose Estimation
por: Deng, Ken, et al.
Publicado: (2026)
por: Deng, Ken, et al.
Publicado: (2026)
Layer by Layer: Uncovering Hidden Representations in Language Models
por: Skean, Oscar, et al.
Publicado: (2025)
por: Skean, Oscar, et al.
Publicado: (2025)
Bootstrapping Action-Grounded Visual Dynamics in Unified Vision-Language Models
por: Qiu, Yifu, et al.
Publicado: (2025)
por: Qiu, Yifu, et al.
Publicado: (2025)
Iterative Multilingual Spectral Attribute Erasure
por: Shao, Shun, et al.
Publicado: (2025)
por: Shao, Shun, et al.
Publicado: (2025)
Layer-Aware Task Arithmetic: Disentangling Task-Specific and Instruction-Following Knowledge
por: Chen, Yan-Lun, et al.
Publicado: (2025)
por: Chen, Yan-Lun, et al.
Publicado: (2025)
Scaling Embedding Layers in Language Models
por: Yu, Da, et al.
Publicado: (2025)
por: Yu, Da, et al.
Publicado: (2025)
What can Large Language Models Capture about Code Functional Equivalence?
por: Maveli, Nickil, et al.
Publicado: (2024)
por: Maveli, Nickil, et al.
Publicado: (2024)
Investigating Layer Importance in Large Language Models
por: Zhang, Yang, et al.
Publicado: (2024)
por: Zhang, Yang, et al.
Publicado: (2024)
Optimizing Multi-Task Learning for Enhanced Performance in Large Language Models
por: Qi, Zhen, et al.
Publicado: (2024)
por: Qi, Zhen, et al.
Publicado: (2024)
An Ensemble Classification Approach in A Multi-Layered Large Language Model Framework for Disease Prediction
por: Hamdi, Ali, et al.
Publicado: (2025)
por: Hamdi, Ali, et al.
Publicado: (2025)
LayerIF: Estimating Layer Quality for Large Language Models using Influence Functions
por: Askari, Hadi, et al.
Publicado: (2025)
por: Askari, Hadi, et al.
Publicado: (2025)
Instruction Mining: Instruction Data Selection for Tuning Large Language Models
por: Cao, Yihan, et al.
Publicado: (2023)
por: Cao, Yihan, et al.
Publicado: (2023)
Backdooring Instruction-Tuned Large Language Models with Virtual Prompt Injection
por: Yan, Jun, et al.
Publicado: (2023)
por: Yan, Jun, et al.
Publicado: (2023)
Instruction Tuning for Large Language Models: A Survey
por: Zhang, Shengyu, et al.
Publicado: (2023)
por: Zhang, Shengyu, et al.
Publicado: (2023)
A Semantic-Aware Layer-Freezing Approach to Computation-Efficient Fine-Tuning of Language Models
por: Gu, Jian, et al.
Publicado: (2024)
por: Gu, Jian, et al.
Publicado: (2024)
Does Representation Matter? Exploring Intermediate Layers in Large Language Models
por: Skean, Oscar, et al.
Publicado: (2024)
por: Skean, Oscar, et al.
Publicado: (2024)
Learning to Generate Instruction Tuning Datasets for Zero-Shot Task Adaptation
por: Nayak, Nihal V., et al.
Publicado: (2024)
por: Nayak, Nihal V., et al.
Publicado: (2024)
Spectral Insights into Data-Oblivious Critical Layers in Large Language Models
por: Liu, Xuyuan, et al.
Publicado: (2025)
por: Liu, Xuyuan, et al.
Publicado: (2025)
Rethinking Layer Relevance in Large Language Models Beyond Cosine Similarity
por: Hinostroza, Cristian, et al.
Publicado: (2026)
por: Hinostroza, Cristian, et al.
Publicado: (2026)
Iterative Layer-wise Distillation for Efficient Compression of Large Language Models
por: Kovalev, Grigory, et al.
Publicado: (2025)
por: Kovalev, Grigory, et al.
Publicado: (2025)
Advancing Multi-Step Mathematical Reasoning in Large Language Models through Multi-Layered Self-Reflection with Auto-Prompting
por: Loureiro, André de Souza, et al.
Publicado: (2025)
por: Loureiro, André de Souza, et al.
Publicado: (2025)
Dynamic Adaptation of LoRA Fine-Tuning for Efficient and Task-Specific Optimization of Large Language Models
por: Liao, Xiaoxuan, et al.
Publicado: (2025)
por: Liao, Xiaoxuan, et al.
Publicado: (2025)
Mortgage Language Model: Domain-Adaptive Pretraining with Residual Instruction, Alignment Tuning, and Task-Specific Routing
por: Jain, Manish, et al.
Publicado: (2025)
por: Jain, Manish, et al.
Publicado: (2025)
Compositional Instruction Following with Language Models and Reinforcement Learning
por: Cohen, Vanya, et al.
Publicado: (2025)
por: Cohen, Vanya, et al.
Publicado: (2025)
SABER: Uncovering Vulnerabilities in Safety Alignment via Cross-Layer Residual Connection
por: Joshi, Maithili, et al.
Publicado: (2025)
por: Joshi, Maithili, et al.
Publicado: (2025)
MoRFI: Monotonic Sparse Autoencoder Feature Identification
por: Dimakopoulos, Dimitris, et al.
Publicado: (2026)
por: Dimakopoulos, Dimitris, et al.
Publicado: (2026)
Parameter-Efficient Tuning Large Language Models for Graph Representation Learning
por: Zhu, Qi, et al.
Publicado: (2024)
por: Zhu, Qi, et al.
Publicado: (2024)
Basis Sharing: Cross-Layer Parameter Sharing for Large Language Model Compression
por: Wang, Jingcun, et al.
Publicado: (2024)
por: Wang, Jingcun, et al.
Publicado: (2024)
Federated Data-Efficient Instruction Tuning for Large Language Models
por: Qin, Zhen, et al.
Publicado: (2024)
por: Qin, Zhen, et al.
Publicado: (2024)
Optimizing Large Language Models with an Enhanced LoRA Fine-Tuning Algorithm for Efficiency and Robustness in NLP Tasks
por: Hu, Jiacheng, et al.
Publicado: (2024)
por: Hu, Jiacheng, et al.
Publicado: (2024)
What Happened in LLMs Layers when Trained for Fast vs. Slow Thinking: A Gradient Perspective
por: Li, Ming, et al.
Publicado: (2024)
por: Li, Ming, et al.
Publicado: (2024)
Eliciting In-context Retrieval and Reasoning for Long-context Large Language Models
por: Qiu, Yifu, et al.
Publicado: (2025)
por: Qiu, Yifu, et al.
Publicado: (2025)
TELL-TALE: Task Efficient LLMs with Task Aware Layer Elimination
por: Naim, Omar, et al.
Publicado: (2025)
por: Naim, Omar, et al.
Publicado: (2025)
Instructions as Backdoors: Backdoor Vulnerabilities of Instruction Tuning for Large Language Models
por: Xu, Jiashu, et al.
Publicado: (2023)
por: Xu, Jiashu, et al.
Publicado: (2023)
Federated Learning with Layer Skipping: Efficient Training of Large Language Models for Healthcare NLP
por: Zhang, Lihong, et al.
Publicado: (2025)
por: Zhang, Lihong, et al.
Publicado: (2025)
Bridging the Dimensional Chasm: Uncover Layer-wise Dimensional Reduction in Transformers through Token Correlation
por: Song, Zhuo-Yang, et al.
Publicado: (2025)
por: Song, Zhuo-Yang, et al.
Publicado: (2025)
Investigating the Multilingual Calibration Effects of Language Model Instruction-Tuning
por: Huang, Jerry, et al.
Publicado: (2026)
por: Huang, Jerry, et al.
Publicado: (2026)
Enhancing Event Reasoning in Large Language Models through Instruction Fine-Tuning with Semantic Causal Graphs
por: Bethany, Mazal, et al.
Publicado: (2024)
por: Bethany, Mazal, et al.
Publicado: (2024)
Ejemplares similares
-
Spectral Editing of Activations for Large Language Model Alignment
por: Qiu, Yifu, et al.
Publicado: (2024) -
Self-Improving World Modelling with Latent Actions
por: Qiu, Yifu, et al.
Publicado: (2026) -
Lost in Space? Vision-Language Models Struggle with Relative Camera Pose Estimation
por: Deng, Ken, et al.
Publicado: (2026) -
Layer by Layer: Uncovering Hidden Representations in Language Models
por: Skean, Oscar, et al.
Publicado: (2025) -
Bootstrapping Action-Grounded Visual Dynamics in Unified Vision-Language Models
por: Qiu, Yifu, et al.
Publicado: (2025)