Spectral Insights into Data-Oblivious Critical Layers in Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Liu, Xuyuan, Hsiung, Lei, Yang, Yaoqing, Yan, Yujun |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Investigating Layer Importance in Large Language Models
por: Zhang, Yang, et al.
Publicado: (2024)
por: Zhang, Yang, et al.
Publicado: (2024)
Sparse Layers are Critical to Scaling Looped Language Models
por: Lee, Ryan, et al.
Publicado: (2026)
por: Lee, Ryan, et al.
Publicado: (2026)
Large Language Model Prompt Datasets: An In-depth Analysis and Insights
por: Zhang, Yuanming, et al.
Publicado: (2025)
por: Zhang, Yuanming, et al.
Publicado: (2025)
How Can Large Language Models Understand Spatial-Temporal Data?
por: Liu, Lei, et al.
Publicado: (2024)
por: Liu, Lei, et al.
Publicado: (2024)
A Critical Review of Causal Reasoning Benchmarks for Large Language Models
por: Yang, Linying, et al.
Publicado: (2024)
por: Yang, Linying, et al.
Publicado: (2024)
Why LLM Safety Guardrails Collapse After Fine-tuning: A Similarity Analysis Between Alignment and Fine-tuning Datasets
por: Hsiung, Lei, et al.
Publicado: (2025)
por: Hsiung, Lei, et al.
Publicado: (2025)
GENUINE: Graph Enhanced Multi-level Uncertainty Estimation for Large Language Models
por: Wang, Tuo, et al.
Publicado: (2025)
por: Wang, Tuo, et al.
Publicado: (2025)
DeepCritic: Deliberate Critique with Large Language Models
por: Yang, Wenkai, et al.
Publicado: (2025)
por: Yang, Wenkai, et al.
Publicado: (2025)
Frustratingly Easy Task-aware Pruning for Large Language Models
por: Tian, Yuanhe, et al.
Publicado: (2025)
por: Tian, Yuanhe, et al.
Publicado: (2025)
Iterative Layer-wise Distillation for Efficient Compression of Large Language Models
por: Kovalev, Grigory, et al.
Publicado: (2025)
por: Kovalev, Grigory, et al.
Publicado: (2025)
Layer by Layer: Uncovering Where Multi-Task Learning Happens in Instruction-Tuned Large Language Models
por: Zhao, Zheng, et al.
Publicado: (2024)
por: Zhao, Zheng, et al.
Publicado: (2024)
Rethinking Layer Relevance in Large Language Models Beyond Cosine Similarity
por: Hinostroza, Cristian, et al.
Publicado: (2026)
por: Hinostroza, Cristian, et al.
Publicado: (2026)
Does Representation Matter? Exploring Intermediate Layers in Large Language Models
por: Skean, Oscar, et al.
Publicado: (2024)
por: Skean, Oscar, et al.
Publicado: (2024)
Mitigating Memorization In Language Models
por: Sakarvadia, Mansi, et al.
Publicado: (2024)
por: Sakarvadia, Mansi, et al.
Publicado: (2024)
Scaling Embedding Layers in Language Models
por: Yu, Da, et al.
Publicado: (2025)
por: Yu, Da, et al.
Publicado: (2025)
A Survey on Medical Large Language Models: Technology, Application, Trustworthiness, and Future Directions
por: Liu, Lei, et al.
Publicado: (2024)
por: Liu, Lei, et al.
Publicado: (2024)
Spectral Generative Flow Models: A Physics-Inspired Replacement for Vectorized Large Language Models
por: Kiruluta, Andrew
Publicado: (2026)
por: Kiruluta, Andrew
Publicado: (2026)
Teach LLMs to Phish: Stealing Private Information from Language Models
por: Panda, Ashwinee, et al.
Publicado: (2024)
por: Panda, Ashwinee, et al.
Publicado: (2024)
Basis Sharing: Cross-Layer Parameter Sharing for Large Language Model Compression
por: Wang, Jingcun, et al.
Publicado: (2024)
por: Wang, Jingcun, et al.
Publicado: (2024)
Fact or Guesswork? Evaluating Large Language Models' Medical Knowledge with Structured One-Hop Judgments
por: Li, Jiaxi, et al.
Publicado: (2025)
por: Li, Jiaxi, et al.
Publicado: (2025)
ILRe: Intermediate Layer Retrieval for Context Compression in Causal Language Models
por: Liang, Manlai, et al.
Publicado: (2025)
por: Liang, Manlai, et al.
Publicado: (2025)
Spectral Editing of Activations for Large Language Model Alignment
por: Qiu, Yifu, et al.
Publicado: (2024)
por: Qiu, Yifu, et al.
Publicado: (2024)
Large Language Models as Agents in Two-Player Games
por: Liu, Yang, et al.
Publicado: (2024)
por: Liu, Yang, et al.
Publicado: (2024)
Addressing Stereotypes in Large Language Models: A Critical Examination and Mitigation
por: Kazi, Fatima
Publicado: (2025)
por: Kazi, Fatima
Publicado: (2025)
LayerIF: Estimating Layer Quality for Large Language Models using Influence Functions
por: Askari, Hadi, et al.
Publicado: (2025)
por: Askari, Hadi, et al.
Publicado: (2025)
On the Thinking-Language Modeling Gap in Large Language Models
por: Liu, Chenxi, et al.
Publicado: (2025)
por: Liu, Chenxi, et al.
Publicado: (2025)
Large Language Models for Intent-Driven Session Recommendations
por: Sun, Zhu, et al.
Publicado: (2023)
por: Sun, Zhu, et al.
Publicado: (2023)
Data Augmentations for Improved (Large) Language Model Generalization
por: Feder, Amir, et al.
Publicado: (2023)
por: Feder, Amir, et al.
Publicado: (2023)
Data-Centric AI in the Age of Large Language Models
por: Xu, Xinyi, et al.
Publicado: (2024)
por: Xu, Xinyi, et al.
Publicado: (2024)
Skywork-Math: Data Scaling Laws for Mathematical Reasoning in Large Language Models -- The Story Goes On
por: Zeng, Liang, et al.
Publicado: (2024)
por: Zeng, Liang, et al.
Publicado: (2024)
DavIR: Data Selection via Implicit Reward for Large Language Models
por: Zhou, Haotian, et al.
Publicado: (2023)
por: Zhou, Haotian, et al.
Publicado: (2023)
Synthetic Data Generation in Low-Resource Settings via Fine-Tuning of Large Language Models
por: Kaddour, Jean, et al.
Publicado: (2023)
por: Kaddour, Jean, et al.
Publicado: (2023)
An Ensemble Classification Approach in A Multi-Layered Large Language Model Framework for Disease Prediction
por: Hamdi, Ali, et al.
Publicado: (2025)
por: Hamdi, Ali, et al.
Publicado: (2025)
Sorted LLaMA: Unlocking the Potential of Intermediate Layers of Large Language Models for Dynamic Inference
por: Kavehzadeh, Parsa, et al.
Publicado: (2023)
por: Kavehzadeh, Parsa, et al.
Publicado: (2023)
GRASS: Gradient-based Adaptive Layer-wise Importance Sampling for Memory-efficient Large Language Model Fine-tuning
por: Tian, Kaiyuan, et al.
Publicado: (2026)
por: Tian, Kaiyuan, et al.
Publicado: (2026)
Min-K%++: Improved Baseline for Detecting Pre-Training Data from Large Language Models
por: Zhang, Jingyang, et al.
Publicado: (2024)
por: Zhang, Jingyang, et al.
Publicado: (2024)
Layer Swapping for Zero-Shot Cross-Lingual Transfer in Large Language Models
por: Bandarkar, Lucas, et al.
Publicado: (2024)
por: Bandarkar, Lucas, et al.
Publicado: (2024)
Robust and Scalable Model Editing for Large Language Models
por: Chen, Yingfa, et al.
Publicado: (2024)
por: Chen, Yingfa, et al.
Publicado: (2024)
InfiFPO: Implicit Model Fusion via Preference Optimization in Large Language Models
por: Gu, Yanggan, et al.
Publicado: (2025)
por: Gu, Yanggan, et al.
Publicado: (2025)
Graph-Based Spectral Decomposition for Parameter Coordination in Language Model Fine-Tuning
por: Zhang, Hanlu, et al.
Publicado: (2025)
por: Zhang, Hanlu, et al.
Publicado: (2025)
Ejemplares similares
-
Investigating Layer Importance in Large Language Models
por: Zhang, Yang, et al.
Publicado: (2024) -
Sparse Layers are Critical to Scaling Looped Language Models
por: Lee, Ryan, et al.
Publicado: (2026) -
Large Language Model Prompt Datasets: An In-depth Analysis and Insights
por: Zhang, Yuanming, et al.
Publicado: (2025) -
How Can Large Language Models Understand Spatial-Temporal Data?
por: Liu, Lei, et al.
Publicado: (2024) -
A Critical Review of Causal Reasoning Benchmarks for Large Language Models
por: Yang, Linying, et al.
Publicado: (2024)