What Affects the Effective Depth of Large Language Models?
Fuente:
arXiv
Saved in:
| Main Authors: | Hu, Yi, Zhou, Cai, Zhang, Muhan |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
GRIP: In-Parameter Graph Reasoning through Fine-Tuning Large Language Models
by: Feng, Jiarui, et al.
Published: (2025)
by: Feng, Jiarui, et al.
Published: (2025)
Number Cookbook: Number Understanding of Language Models and How to Improve It
by: Yang, Haotong, et al.
Published: (2024)
by: Yang, Haotong, et al.
Published: (2024)
SubTokenTest: A Practical Benchmark for Real-World Sub-token Understanding
by: Hou, Shuyang, et al.
Published: (2026)
by: Hou, Shuyang, et al.
Published: (2026)
Coevolutionary Continuous Discrete Diffusion: Make Your Diffusion Language Model a Latent Reasoner
by: Zhou, Cai, et al.
Published: (2025)
by: Zhou, Cai, et al.
Published: (2025)
Affect Recognition in Conversations Using Large Language Models
by: Feng, Shutong, et al.
Published: (2023)
by: Feng, Shutong, et al.
Published: (2023)
Parrot Mind: Towards Explaining the Complex Task Reasoning of Pretrained Large Language Models with Template-Content Structure
by: Yang, Haotong, et al.
Published: (2023)
by: Yang, Haotong, et al.
Published: (2023)
Towards Effective Time-Aware Language Representation: Exploring Enhanced Temporal Understanding in Language Models
by: Wang, Jiexin, et al.
Published: (2024)
by: Wang, Jiexin, et al.
Published: (2024)
On Lexical Invariance on Multisets and Graphs
by: Zhang, Muhan
Published: (2024)
by: Zhang, Muhan
Published: (2024)
What Factors Affect Multi-Modal In-Context Learning? An In-Depth Exploration
by: Qin, Libo, et al.
Published: (2024)
by: Qin, Libo, et al.
Published: (2024)
Case-Based or Rule-Based: How Do Transformers Do the Math?
by: Hu, Yi, et al.
Published: (2024)
by: Hu, Yi, et al.
Published: (2024)
On the (In)Effectiveness of Large Language Models for Chinese Text Correction
by: Li, Yinghui, et al.
Published: (2023)
by: Li, Yinghui, et al.
Published: (2023)
How Proficient Are Large Language Models in Formal Languages? An In-Depth Insight for Knowledge Base Question Answering
by: Liu, Jinxin, et al.
Published: (2024)
by: Liu, Jinxin, et al.
Published: (2024)
What Factors Affect LLMs and RLLMs in Financial Question Answering?
by: Wang, Peng, et al.
Published: (2025)
by: Wang, Peng, et al.
Published: (2025)
Towards a Mechanistic Understanding of Large Reasoning Models: A Survey of Training, Inference, and Failures
by: Hu, Yi, et al.
Published: (2026)
by: Hu, Yi, et al.
Published: (2026)
Beyond Single-Task: Robust Multi-Task Length Generalization for LLMs
by: Hu, Yi, et al.
Published: (2025)
by: Hu, Yi, et al.
Published: (2025)
AttackEval: How to Evaluate the Effectiveness of Jailbreak Attacking on Large Language Models
by: Shu, Dong, et al.
Published: (2024)
by: Shu, Dong, et al.
Published: (2024)
GL-Fusion: Rethinking the Combination of Graph Neural Network and Large Language model
by: Yang, Haotong, et al.
Published: (2024)
by: Yang, Haotong, et al.
Published: (2024)
Enhancing Large Language Model with Decomposed Reasoning for Emotion Cause Pair Extraction
by: Wu, Jialiang, et al.
Published: (2024)
by: Wu, Jialiang, et al.
Published: (2024)
LooGLE: Can Long-Context Language Models Understand Long Contexts?
by: Li, Jiaqi, et al.
Published: (2023)
by: Li, Jiaqi, et al.
Published: (2023)
What Gets Activated: Uncovering Domain and Driver Experts in MoE Language Models
by: Hu, Guimin, et al.
Published: (2026)
by: Hu, Guimin, et al.
Published: (2026)
When Quantization Affects Confidence of Large Language Models?
by: Proskurina, Irina, et al.
Published: (2024)
by: Proskurina, Irina, et al.
Published: (2024)
The Depth Ceiling: On the Limits of Large Language Models in Discovering Latent Planning
by: Xu, Yi, et al.
Published: (2026)
by: Xu, Yi, et al.
Published: (2026)
Beyond the Surface: Probing the Ideological Depth of Large Language Models
by: Kabir, Shariar, et al.
Published: (2025)
by: Kabir, Shariar, et al.
Published: (2025)
LoRASuite: Efficient LoRA Adaptation Across Large Language Model Upgrades
by: Li, Yanan, et al.
Published: (2025)
by: Li, Yanan, et al.
Published: (2025)
Measuring Psychological Depth in Language Models
by: Harel-Canada, Fabrice, et al.
Published: (2024)
by: Harel-Canada, Fabrice, et al.
Published: (2024)
USB-Rec: An Effective Framework for Improving Conversational Recommendation Capability of Large Language Model
by: Wen, Jianyu, et al.
Published: (2025)
by: Wen, Jianyu, et al.
Published: (2025)
What Language(s) Does Aya-23 Think In? How Multilinguality Affects Internal Language Representations
by: Trinley, Katharina, et al.
Published: (2025)
by: Trinley, Katharina, et al.
Published: (2025)
Annotating Training Data for Conditional Semantic Textual Similarity Measurement using Large Language Models
by: Zhang, Gaifan, et al.
Published: (2025)
by: Zhang, Gaifan, et al.
Published: (2025)
Speech Translation with Speech Foundation Models and Large Language Models: What is There and What is Missing?
by: Gaido, Marco, et al.
Published: (2024)
by: Gaido, Marco, et al.
Published: (2024)
E$^3$-Pruner: Towards Efficient, Economical, and Effective Layer Pruning for Large Language Models
by: Yuan, Tao, et al.
Published: (2025)
by: Yuan, Tao, et al.
Published: (2025)
Scale-Distribution Decoupling: Enabling Stable and Effective Training of Large Language Models
by: Wang, Ya, et al.
Published: (2025)
by: Wang, Ya, et al.
Published: (2025)
Recognizing Limits: Investigating Infeasibility in Large Language Models
by: Zhang, Wenbo, et al.
Published: (2024)
by: Zhang, Wenbo, et al.
Published: (2024)
Prompt-based Depth Pruning of Large Language Models
by: Wee, Juyun, et al.
Published: (2025)
by: Wee, Juyun, et al.
Published: (2025)
Pooling And Attention: What Are Effective Designs For LLM-Based Embedding Models?
by: Tang, Yixuan, et al.
Published: (2024)
by: Tang, Yixuan, et al.
Published: (2024)
Glitch Tokens in Large Language Models: Categorization Taxonomy and Effective Detection
by: Li, Yuxi, et al.
Published: (2024)
by: Li, Yuxi, et al.
Published: (2024)
What Large Language Models Know and What People Think They Know
by: Steyvers, Mark, et al.
Published: (2024)
by: Steyvers, Mark, et al.
Published: (2024)
A Comprehensive Analysis of the Effectiveness of Large Language Models as Automatic Dialogue Evaluators
by: Zhang, Chen, et al.
Published: (2023)
by: Zhang, Chen, et al.
Published: (2023)
Towards Efficient and Effective Alignment of Large Language Models
by: Jiang, Yuxin
Published: (2025)
by: Jiang, Yuxin
Published: (2025)
Are Large Language Models Effective Knowledge Graph Constructors?
by: Chen, Ruirui, et al.
Published: (2025)
by: Chen, Ruirui, et al.
Published: (2025)
Mechanistic Indicators of Steering Effectiveness in Large Language Models
by: Jafari, Mehdi, et al.
Published: (2026)
by: Jafari, Mehdi, et al.
Published: (2026)
Similar Items
-
GRIP: In-Parameter Graph Reasoning through Fine-Tuning Large Language Models
by: Feng, Jiarui, et al.
Published: (2025) -
Number Cookbook: Number Understanding of Language Models and How to Improve It
by: Yang, Haotong, et al.
Published: (2024) -
SubTokenTest: A Practical Benchmark for Real-World Sub-token Understanding
by: Hou, Shuyang, et al.
Published: (2026) -
Coevolutionary Continuous Discrete Diffusion: Make Your Diffusion Language Model a Latent Reasoner
by: Zhou, Cai, et al.
Published: (2025) -
Affect Recognition in Conversations Using Large Language Models
by: Feng, Shutong, et al.
Published: (2023)