LEGO: Language Model Building Blocks
Fuente:
arXiv
Saved in:
| Main Authors: | Bhansali, Shrenik, Jin, Alwin, Lizzo, Tyler, Heck, Larry |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Draft, Verify, and Improve: Toward Training-Aware Speculative Decoding
by: Bhansali, Shrenik, et al.
Published: (2025)
by: Bhansali, Shrenik, et al.
Published: (2025)
Evaluating Cross-Lingual Unlearning in Multilingual Language Models
by: Lizzo, Tyler, et al.
Published: (2026)
by: Lizzo, Tyler, et al.
Published: (2026)
UNLEARN Efficient Removal of Knowledge in Large Language Models
by: Lizzo, Tyler, et al.
Published: (2024)
by: Lizzo, Tyler, et al.
Published: (2024)
Unlearning in LLMs: Methods, Evaluation, and Open Challenges
by: Lizzo, Tyler, et al.
Published: (2026)
by: Lizzo, Tyler, et al.
Published: (2026)
FLEx: Language Modeling with Few-shot Language Explanations
by: Avsian, Adar, et al.
Published: (2026)
by: Avsian, Adar, et al.
Published: (2026)
Large Body Language Models
by: Punjwani, Saif, et al.
Published: (2024)
by: Punjwani, Saif, et al.
Published: (2024)
Weight-of-Thought Reasoning: Exploring Neural Network Weights for Enhanced LLM Reasoning
by: Punjwani, Saif, et al.
Published: (2025)
by: Punjwani, Saif, et al.
Published: (2025)
Are Human Conversations Special? A Large Language Model Perspective
by: Jawale, Toshish, et al.
Published: (2024)
by: Jawale, Toshish, et al.
Published: (2024)
gTBLS: Generating Tables from Text by Conditional Question Answering
by: Sundar, Anirudh, et al.
Published: (2024)
by: Sundar, Anirudh, et al.
Published: (2024)
Reading with Intent -- Neutralizing Intent
by: Reichman, Benjamin, et al.
Published: (2025)
by: Reichman, Benjamin, et al.
Published: (2025)
cPAPERS: A Dataset of Situated and Multimodal Interactive Conversations in Scientific Papers
by: Sundar, Anirudh, et al.
Published: (2024)
by: Sundar, Anirudh, et al.
Published: (2024)
iTBLS: A Dataset of Interactive Conversations Over Tabular Information
by: Sundar, Anirudh, et al.
Published: (2024)
by: Sundar, Anirudh, et al.
Published: (2024)
Emotion is Not Just a Label: Latent Emotional Factors in LLM Processing
by: Reichman, Benjamin, et al.
Published: (2026)
by: Reichman, Benjamin, et al.
Published: (2026)
LLM Library Learning Fails: A LEGO-Prover Case Study
by: Berlot-Attwell, Ian, et al.
Published: (2025)
by: Berlot-Attwell, Ian, et al.
Published: (2025)
Block Circulant Adapter for Large Language Models
by: Ding, Xinyu, et al.
Published: (2025)
by: Ding, Xinyu, et al.
Published: (2025)
GeoBlock: Inferring Block Granularity from Dependency Geometry in Diffusion Language Models
by: Wan, Lipeng, et al.
Published: (2026)
by: Wan, Lipeng, et al.
Published: (2026)
CBQ: Cross-Block Quantization for Large Language Models
by: Ding, Xin, et al.
Published: (2023)
by: Ding, Xin, et al.
Published: (2023)
Building a Strong Instruction Language Model for a Less-Resourced Language
by: Vreš, Domen, et al.
Published: (2026)
by: Vreš, Domen, et al.
Published: (2026)
RSD: A Local Triangulation Audit Primitive for Learned Vector Blocks
by: Jin, Seungmin
Published: (2026)
by: Jin, Seungmin
Published: (2026)
SNEAK: Evaluating Strategic Communication and Information Leakage in Large Language Models
by: Avsian, Adar, et al.
Published: (2026)
by: Avsian, Adar, et al.
Published: (2026)
Emotional RAG LLMs: Reading Comprehension for the Open Internet
by: Reichman, Benjamin, et al.
Published: (2024)
by: Reichman, Benjamin, et al.
Published: (2024)
LoSA: Locality Aware Sparse Attention for Block-Wise Diffusion Language Models
by: Xi, Haocheng, et al.
Published: (2026)
by: Xi, Haocheng, et al.
Published: (2026)
AF Adapter: Continual Pretraining for Building Chinese Biomedical Language Model
by: Yan, Yongyu, et al.
Published: (2022)
by: Yan, Yongyu, et al.
Published: (2022)
When to Commit? Towards Variable-Size Self-Contained Blocks for Discrete Diffusion Language Models
by: Wang, Danny, et al.
Published: (2026)
by: Wang, Danny, et al.
Published: (2026)
LLM-Barber: Block-Aware Rebuilder for Sparsity Mask in One-Shot for Large Language Models
by: Su, Yupeng, et al.
Published: (2024)
by: Su, Yupeng, et al.
Published: (2024)
Block Transformer: Global-to-Local Language Modeling for Fast Inference
by: Ho, Namgyu, et al.
Published: (2024)
by: Ho, Namgyu, et al.
Published: (2024)
$\texttt{MoE-RBench}$: Towards Building Reliable Language Models with Sparse Mixture-of-Experts
by: Chen, Guanjie, et al.
Published: (2024)
by: Chen, Guanjie, et al.
Published: (2024)
Building Decision Making Models Through Language Model Regime
by: Zhang, Yu, et al.
Published: (2024)
by: Zhang, Yu, et al.
Published: (2024)
Interactions Across Blocks in Post-Training Quantization of Large Language Models
by: Shabanovi, Khasmamad, et al.
Published: (2024)
by: Shabanovi, Khasmamad, et al.
Published: (2024)
Merging LoRAs like Playing LEGO: Pushing the Modularity of LoRA to Extremes Through Rank-Wise Clustering
by: Zhao, Ziyu, et al.
Published: (2024)
by: Zhao, Ziyu, et al.
Published: (2024)
What Will My Model Forget? Forecasting Forgotten Examples in Language Model Refinement
by: Jin, Xisen, et al.
Published: (2024)
by: Jin, Xisen, et al.
Published: (2024)
Demystifying Language Model Forgetting with Low-rank Example Associations
by: Jin, Xisen, et al.
Published: (2024)
by: Jin, Xisen, et al.
Published: (2024)
Learn To be Efficient: Build Structured Sparsity in Large Language Models
by: Zheng, Haizhong, et al.
Published: (2024)
by: Zheng, Haizhong, et al.
Published: (2024)
Local Topology Measures of Contextual Language Model Latent Spaces With Applications to Dialogue Term Extraction
by: Ruppik, Benjamin Matthias, et al.
Published: (2024)
by: Ruppik, Benjamin Matthias, et al.
Published: (2024)
Optimizing Mixture of Block Attention
by: Xiao, Guangxuan, et al.
Published: (2025)
by: Xiao, Guangxuan, et al.
Published: (2025)
From Narratives to Numbers: Valid Inference Using Language Model Predictions from Verbal Autopsy Narratives
by: Fan, Shuxian, et al.
Published: (2024)
by: Fan, Shuxian, et al.
Published: (2024)
A Confidence-based Acquisition Model for Self-supervised Active Learning and Label Correction
by: van Niekerk, Carel, et al.
Published: (2023)
by: van Niekerk, Carel, et al.
Published: (2023)
Time Series Language Model for Descriptive Caption Generation
by: Trabelsi, Mohamed, et al.
Published: (2025)
by: Trabelsi, Mohamed, et al.
Published: (2025)
BlockDialect: Block-wise Fine-grained Mixed Format Quantization for Energy-Efficient LLM Inference
by: Jang, Wonsuk, et al.
Published: (2025)
by: Jang, Wonsuk, et al.
Published: (2025)
MULTIVERSE: Exposing Large Language Model Alignment Problems in Diverse Worlds
by: Jin, Xiaolong, et al.
Published: (2024)
by: Jin, Xiaolong, et al.
Published: (2024)
Similar Items
-
Draft, Verify, and Improve: Toward Training-Aware Speculative Decoding
by: Bhansali, Shrenik, et al.
Published: (2025) -
Evaluating Cross-Lingual Unlearning in Multilingual Language Models
by: Lizzo, Tyler, et al.
Published: (2026) -
UNLEARN Efficient Removal of Knowledge in Large Language Models
by: Lizzo, Tyler, et al.
Published: (2024) -
Unlearning in LLMs: Methods, Evaluation, and Open Challenges
by: Lizzo, Tyler, et al.
Published: (2026) -
FLEx: Language Modeling with Few-shot Language Explanations
by: Avsian, Adar, et al.
Published: (2026)