Seeking Neural Nuggets: Knowledge Transfer in Large Language Models from a Parametric Perspective
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhong, Ming, An, Chenxin, Chen, Weizhu, Han, Jiawei, He, Pengcheng |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Investigating Data Contamination for Pre-training Language Models
por: Jiang, Minhao, et al.
Publicado: (2024)
por: Jiang, Minhao, et al.
Publicado: (2024)
Uncertainty of Thoughts: Uncertainty-Aware Planning Enhances Information Seeking in Large Language Models
por: Hu, Zhiyuan, et al.
Publicado: (2024)
por: Hu, Zhiyuan, et al.
Publicado: (2024)
TAID: Temporally Adaptive Interpolated Distillation for Efficient Knowledge Transfer in Language Models
por: Shing, Makoto, et al.
Publicado: (2025)
por: Shing, Makoto, et al.
Publicado: (2025)
Reinforcement Learning for Reasoning in Large Language Models with One Training Example
por: Wang, Yiping, et al.
Publicado: (2025)
por: Wang, Yiping, et al.
Publicado: (2025)
Knowledge Editing on Black-box Large Language Models
por: Song, Xiaoshuai, et al.
Publicado: (2024)
por: Song, Xiaoshuai, et al.
Publicado: (2024)
DoLa: Decoding by Contrasting Layers Improves Factuality in Large Language Models
por: Chuang, Yung-Sung, et al.
Publicado: (2023)
por: Chuang, Yung-Sung, et al.
Publicado: (2023)
KGLens: Towards Efficient and Effective Knowledge Probing of Large Language Models with Knowledge Graphs
por: Zheng, Shangshang, et al.
Publicado: (2023)
por: Zheng, Shangshang, et al.
Publicado: (2023)
RWKU: Benchmarking Real-World Knowledge Unlearning for Large Language Models
por: Jin, Zhuoran, et al.
Publicado: (2024)
por: Jin, Zhuoran, et al.
Publicado: (2024)
A Note on LoRA
por: Fomenko, Vlad, et al.
Publicado: (2024)
por: Fomenko, Vlad, et al.
Publicado: (2024)
From Symbolic to Neural and Back: Exploring Knowledge Graph-Large Language Model Synergies
por: Škrlj, Blaž, et al.
Publicado: (2025)
por: Škrlj, Blaž, et al.
Publicado: (2025)
Neural Incompatibility: The Unbridgeable Gap of Cross-Scale Parametric Knowledge Transfer in Large Language Models
por: Tan, Yuqiao, et al.
Publicado: (2025)
por: Tan, Yuqiao, et al.
Publicado: (2025)
Rethinking Data Mixing from the Perspective of Large Language Models
por: Xu, Yuanjian, et al.
Publicado: (2026)
por: Xu, Yuanjian, et al.
Publicado: (2026)
Evaluating the Factuality of Large Language Models using Large-Scale Knowledge Graphs
por: Liu, Xiaoze, et al.
Publicado: (2024)
por: Liu, Xiaoze, et al.
Publicado: (2024)
Analyzing the Evaluation of Cross-Lingual Knowledge Transfer in Multilingual Language Models
por: Rajaee, Sara, et al.
Publicado: (2024)
por: Rajaee, Sara, et al.
Publicado: (2024)
Delta Knowledge Distillation for Large Language Models
por: Cao, Yihan, et al.
Publicado: (2025)
por: Cao, Yihan, et al.
Publicado: (2025)
Knowledge Boundary Discovery for Large Language Models
por: Wang, Ziquan, et al.
Publicado: (2026)
por: Wang, Ziquan, et al.
Publicado: (2026)
AgroLLM: Connecting Farmers and Agricultural Practices through Large Language Models for Enhanced Knowledge Transfer and Practical Application
por: Samuel, Dinesh Jackson, et al.
Publicado: (2025)
por: Samuel, Dinesh Jackson, et al.
Publicado: (2025)
SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator
por: Chen, Guoxuan, et al.
Publicado: (2024)
por: Chen, Guoxuan, et al.
Publicado: (2024)
LangTopo: Aligning Language Descriptions of Graphs with Tokenized Topological Modeling
por: Guan, Zhong, et al.
Publicado: (2024)
por: Guan, Zhong, et al.
Publicado: (2024)
Efficient Non-Parametric Uncertainty Quantification for Black-Box Large Language Models and Decision Planning
por: Tsai, Yao-Hung Hubert, et al.
Publicado: (2024)
por: Tsai, Yao-Hung Hubert, et al.
Publicado: (2024)
METEOR: Evolutionary Journey of Large Language Models from Guidance to Self-Growth
por: Li, Jiawei, et al.
Publicado: (2024)
por: Li, Jiawei, et al.
Publicado: (2024)
Principled Detection of Hallucinations in Large Language Models via Multiple Testing
por: Li, Jiawei, et al.
Publicado: (2025)
por: Li, Jiawei, et al.
Publicado: (2025)
Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models
por: Huang, Yukun, et al.
Publicado: (2025)
por: Huang, Yukun, et al.
Publicado: (2025)
DeepSeek LLM: Scaling Open-Source Language Models with Longtermism
por: DeepSeek-AI, et al.
Publicado: (2024)
por: DeepSeek-AI, et al.
Publicado: (2024)
Unveiling and Addressing Pseudo Forgetting in Large Language Models
por: Sun, Huashan, et al.
Publicado: (2024)
por: Sun, Huashan, et al.
Publicado: (2024)
PRISM: Parametrically Refactoring Inference for Speculative Sampling Draft Models
por: Wang, Xuliang, et al.
Publicado: (2026)
por: Wang, Xuliang, et al.
Publicado: (2026)
Examining LLMs' Uncertainty Expression Towards Questions Outside Parametric Knowledge
por: Liu, Genglin, et al.
Publicado: (2023)
por: Liu, Genglin, et al.
Publicado: (2023)
Knowledge-based Consistency Testing of Large Language Models
por: Rajan, Sai Sathiesh, et al.
Publicado: (2024)
por: Rajan, Sai Sathiesh, et al.
Publicado: (2024)
InfuserKI: Enhancing Large Language Models with Knowledge Graphs via Infuser-Guided Knowledge Integration
por: Wang, Fali, et al.
Publicado: (2024)
por: Wang, Fali, et al.
Publicado: (2024)
Transfer Learning of Tabular Data by Finetuning Large Language Models
por: Rabbani, Shourav B., et al.
Publicado: (2025)
por: Rabbani, Shourav B., et al.
Publicado: (2025)
Hierarchical Federated Unlearning for Large Language Models
por: Zhong, Yisheng, et al.
Publicado: (2025)
por: Zhong, Yisheng, et al.
Publicado: (2025)
Graph Neural Prompting with Large Language Models
por: Tian, Yijun, et al.
Publicado: (2023)
por: Tian, Yijun, et al.
Publicado: (2023)
Switchable Decision: Dynamic Neural Generation Networks
por: Zhang, Shujian, et al.
Publicado: (2024)
por: Zhang, Shujian, et al.
Publicado: (2024)
Robust Knowledge Transfer in Tiered Reinforcement Learning
por: Huang, Jiawei, et al.
Publicado: (2023)
por: Huang, Jiawei, et al.
Publicado: (2023)
Multi-LoRA Composition for Image Generation
por: Zhong, Ming, et al.
Publicado: (2024)
por: Zhong, Ming, et al.
Publicado: (2024)
A Dual-Space Framework for General Knowledge Distillation of Large Language Models
por: Zhang, Xue, et al.
Publicado: (2025)
por: Zhang, Xue, et al.
Publicado: (2025)
Are Human Conversations Special? A Large Language Model Perspective
por: Jawale, Toshish, et al.
Publicado: (2024)
por: Jawale, Toshish, et al.
Publicado: (2024)
Multilinguality of Large Language Models From a Structural Perspective
por: Sakajo, Haruki, et al.
Publicado: (2026)
por: Sakajo, Haruki, et al.
Publicado: (2026)
Knowledgeable Agents by Offline Reinforcement Learning from Large Language Model Rollouts
por: Pang, Jing-Cheng, et al.
Publicado: (2024)
por: Pang, Jing-Cheng, et al.
Publicado: (2024)
Large Scale Transfer Learning for Tabular Data via Language Modeling
por: Gardner, Josh, et al.
Publicado: (2024)
por: Gardner, Josh, et al.
Publicado: (2024)
Ejemplares similares
-
Investigating Data Contamination for Pre-training Language Models
por: Jiang, Minhao, et al.
Publicado: (2024) -
Uncertainty of Thoughts: Uncertainty-Aware Planning Enhances Information Seeking in Large Language Models
por: Hu, Zhiyuan, et al.
Publicado: (2024) -
TAID: Temporally Adaptive Interpolated Distillation for Efficient Knowledge Transfer in Language Models
por: Shing, Makoto, et al.
Publicado: (2025) -
Reinforcement Learning for Reasoning in Large Language Models with One Training Example
por: Wang, Yiping, et al.
Publicado: (2025) -
Knowledge Editing on Black-box Large Language Models
por: Song, Xiaoshuai, et al.
Publicado: (2024)