Efficient Knowledge Probing of Large Language Models by Adapting Pre-trained Embeddings
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Sharma, Kartik, Jin, Yiqiao, Trivedi, Rakshit, Kumar, Srijan |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
COLD-Steer: Steering Large Language Models via In-Context One-step Learning Dynamics
par: Sharma, Kartik, et autres
Publié: (2026)
par: Sharma, Kartik, et autres
Publié: (2026)
Sysformer: Safeguarding Frozen Large Language Models with Adaptive System Prompts
par: Sharma, Kartik, et autres
Publié: (2025)
par: Sharma, Kartik, et autres
Publié: (2025)
Inner Speech as Behavior Guides: Steerable Imitation of Diverse Behaviors for Human-AI coordination
par: Trivedi, Rakshit, et autres
Publié: (2026)
par: Trivedi, Rakshit, et autres
Publié: (2026)
UniGuard: Towards Universal Safety Guardrails for Jailbreak Attacks on Multimodal Large Language Models
par: Oh, Sejoon, et autres
Publié: (2024)
par: Oh, Sejoon, et autres
Publié: (2024)
MIA-Tuner: Adapting Large Language Models as Pre-training Text Detector
par: Fu, Wenjie, et autres
Publié: (2024)
par: Fu, Wenjie, et autres
Publié: (2024)
DEPT: Decoupled Embeddings for Pre-training Language Models
par: Iacob, Alex, et autres
Publié: (2024)
par: Iacob, Alex, et autres
Publié: (2024)
Model Merging in Pre-training of Large Language Models
par: Li, Yunshui, et autres
Publié: (2025)
par: Li, Yunshui, et autres
Publié: (2025)
UniSD: Towards a Unified Self-Distillation Framework for Large Language Models
par: Jin, Yiqiao, et autres
Publié: (2026)
par: Jin, Yiqiao, et autres
Publié: (2026)
Evaluating Gender Bias Transfer between Pre-trained and Prompt-Adapted Language Models
par: Mackraz, Natalie, et autres
Publié: (2024)
par: Mackraz, Natalie, et autres
Publié: (2024)
Pre-training Limited Memory Language Models with Internal and External Knowledge
par: Zhao, Linxi, et autres
Publié: (2025)
par: Zhao, Linxi, et autres
Publié: (2025)
MLKD-BERT: Multi-level Knowledge Distillation for Pre-trained Language Models
par: Zhang, Ying, et autres
Publié: (2024)
par: Zhang, Ying, et autres
Publié: (2024)
Adapting Multilingual LLMs to Low-Resource Languages using Continued Pre-training and Synthetic Corpus
par: Joshi, Raviraj, et autres
Publié: (2024)
par: Joshi, Raviraj, et autres
Publié: (2024)
MediSwift: Efficient Sparse Pre-trained Biomedical Language Models
par: Thangarasa, Vithursan, et autres
Publié: (2024)
par: Thangarasa, Vithursan, et autres
Publié: (2024)
An Analysis of Embedding Layers and Similarity Scores using Siamese Neural Networks
par: Bingi, Yash, et autres
Publié: (2023)
par: Bingi, Yash, et autres
Publié: (2023)
KGLens: Towards Efficient and Effective Knowledge Probing of Large Language Models with Knowledge Graphs
par: Zheng, Shangshang, et autres
Publié: (2023)
par: Zheng, Shangshang, et autres
Publié: (2023)
Adapting Large Language Models for Parameter-Efficient Log Anomaly Detection
par: Lim, Ying Fu, et autres
Publié: (2025)
par: Lim, Ying Fu, et autres
Publié: (2025)
Machine Unlearning of Pre-trained Large Language Models
par: Yao, Jin, et autres
Publié: (2024)
par: Yao, Jin, et autres
Publié: (2024)
Pre-trained Large Language Models Use Fourier Features to Compute Addition
par: Zhou, Tianyi, et autres
Publié: (2024)
par: Zhou, Tianyi, et autres
Publié: (2024)
HLAT: High-quality Large Language Model Pre-trained on AWS Trainium
par: Fan, Haozheng, et autres
Publié: (2024)
par: Fan, Haozheng, et autres
Publié: (2024)
Efficient Continual Pre-training of LLMs for Low-resource Languages
par: Nag, Arijit, et autres
Publié: (2024)
par: Nag, Arijit, et autres
Publié: (2024)
Generating with Confidence: Uncertainty Quantification for Black-box Large Language Models
par: Lin, Zhen, et autres
Publié: (2023)
par: Lin, Zhen, et autres
Publié: (2023)
Hadamard Adapter: An Extreme Parameter-Efficient Adapter Tuning Method for Pre-trained Language Models
par: Chen, Yuyan, et autres
Publié: (2024)
par: Chen, Yuyan, et autres
Publié: (2024)
Simple and Scalable Strategies to Continually Pre-train Large Language Models
par: Ibrahim, Adam, et autres
Publié: (2024)
par: Ibrahim, Adam, et autres
Publié: (2024)
Sparse is Enough in Fine-tuning Pre-trained Large Language Models
par: Song, Weixi, et autres
Publié: (2023)
par: Song, Weixi, et autres
Publié: (2023)
Exploiting Vocabulary Frequency Imbalance in Language Model Pre-training
par: Chung, Woojin, et autres
Publié: (2025)
par: Chung, Woojin, et autres
Publié: (2025)
Making Pre-trained Language Models Great on Tabular Prediction
par: Yan, Jiahuan, et autres
Publié: (2024)
par: Yan, Jiahuan, et autres
Publié: (2024)
Fine-Tuning Small Language Models for Domain-Specific AI: An Edge AI Perspective
par: Aralimatti, Rakshit, et autres
Publié: (2025)
par: Aralimatti, Rakshit, et autres
Publié: (2025)
Scaling Smart: Accelerating Large Language Model Pre-training with Small Model Initialization
par: Samragh, Mohammad, et autres
Publié: (2024)
par: Samragh, Mohammad, et autres
Publié: (2024)
PaPaformer: Language Model from Pre-trained Parallel Paths
par: Tapaninaho, Joonas, et autres
Publié: (2025)
par: Tapaninaho, Joonas, et autres
Publié: (2025)
Learn or Recall? Revisiting Incremental Learning with Pre-trained Language Models
par: Zheng, Junhao, et autres
Publié: (2023)
par: Zheng, Junhao, et autres
Publié: (2023)
Does Pre-trained Language Model Actually Infer Unseen Links in Knowledge Graph Completion?
par: Sakai, Yusuke, et autres
Publié: (2023)
par: Sakai, Yusuke, et autres
Publié: (2023)
MM-Soc: Benchmarking Multimodal Large Language Models in Social Media Platforms
par: Jin, Yiqiao, et autres
Publié: (2024)
par: Jin, Yiqiao, et autres
Publié: (2024)
Empirical Analysis of Efficient Fine-Tuning Methods for Large Pre-Trained Language Models
par: Doering, Nigel, et autres
Publié: (2024)
par: Doering, Nigel, et autres
Publié: (2024)
ForeCite: Adapting Pre-Trained Language Models to Predict Future Citation Rates of Academic Papers
par: Hull, Gavin, et autres
Publié: (2025)
par: Hull, Gavin, et autres
Publié: (2025)
LLM Surgery: Efficient Knowledge Unlearning and Editing in Large Language Models
par: Veldanda, Akshaj Kumar, et autres
Publié: (2024)
par: Veldanda, Akshaj Kumar, et autres
Publié: (2024)
Adaptive Pre-training Data Detection for Large Language Models via Surprising Tokens
par: Zhang, Anqi, et autres
Publié: (2024)
par: Zhang, Anqi, et autres
Publié: (2024)
Fine-Tuning Pre-trained Language Models to Detect In-Game Trash Talks
par: Fesalbon, Daniel, et autres
Publié: (2024)
par: Fesalbon, Daniel, et autres
Publié: (2024)
Structural Pruning of Pre-trained Language Models via Neural Architecture Search
par: Klein, Aaron, et autres
Publié: (2024)
par: Klein, Aaron, et autres
Publié: (2024)
Lory: Fully Differentiable Mixture-of-Experts for Autoregressive Language Model Pre-training
par: Zhong, Zexuan, et autres
Publié: (2024)
par: Zhong, Zexuan, et autres
Publié: (2024)
Investigating Data Contamination for Pre-training Language Models
par: Jiang, Minhao, et autres
Publié: (2024)
par: Jiang, Minhao, et autres
Publié: (2024)
Documents similaires
-
COLD-Steer: Steering Large Language Models via In-Context One-step Learning Dynamics
par: Sharma, Kartik, et autres
Publié: (2026) -
Sysformer: Safeguarding Frozen Large Language Models with Adaptive System Prompts
par: Sharma, Kartik, et autres
Publié: (2025) -
Inner Speech as Behavior Guides: Steerable Imitation of Diverse Behaviors for Human-AI coordination
par: Trivedi, Rakshit, et autres
Publié: (2026) -
UniGuard: Towards Universal Safety Guardrails for Jailbreak Attacks on Multimodal Large Language Models
par: Oh, Sejoon, et autres
Publié: (2024) -
MIA-Tuner: Adapting Large Language Models as Pre-training Text Detector
par: Fu, Wenjie, et autres
Publié: (2024)