D-Models and E-Models: Diversity-Stability Trade-offs in the Sampling Behavior of Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Gu, Jia, Pang, Liang, Shen, Huawei, Cheng, Xueqi |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Do LLMs Play Dice? Exploring Probability Distribution Sampling in Large Language Models for Behavioral Simulation
par: Gu, Jia, et autres
Publié: (2024)
par: Gu, Jia, et autres
Publié: (2024)
Enhancing Training Data Attribution for Large Language Models with Fitting Error Consideration
par: Wu, Kangxi, et autres
Publié: (2024)
par: Wu, Kangxi, et autres
Publié: (2024)
Think Before You Speak: Cultivating Communication Skills of Large Language Models via Inner Monologue
par: Zhou, Junkai, et autres
Publié: (2023)
par: Zhou, Junkai, et autres
Publié: (2023)
Stable Knowledge Editing in Large Language Models
par: Wei, Zihao, et autres
Publié: (2024)
par: Wei, Zihao, et autres
Publié: (2024)
Cross-Modal Safety Mechanism Transfer in Large Vision-Language Models
par: Xu, Shicheng, et autres
Publié: (2024)
par: Xu, Shicheng, et autres
Publié: (2024)
Search-in-the-Chain: Interactively Enhancing Large Language Models with Search for Knowledge-intensive Tasks
par: Xu, Shicheng, et autres
Publié: (2023)
par: Xu, Shicheng, et autres
Publié: (2023)
MLaKE: Multilingual Knowledge Editing Benchmark for Large Language Models
par: Wei, Zihao, et autres
Publié: (2024)
par: Wei, Zihao, et autres
Publié: (2024)
Everything is Editable: Extend Knowledge Editing to Unstructured Data in Large Language Models
par: Deng, Jingcheng, et autres
Publié: (2024)
par: Deng, Jingcheng, et autres
Publié: (2024)
Large Language Model Sourcing: A Survey
par: Pang, Liang, et autres
Publié: (2025)
par: Pang, Liang, et autres
Publié: (2025)
Reverse Physician-AI Relationship: Full-process Clinical Diagnosis Driven by a Large Language Model
par: Xu, Shicheng, et autres
Publié: (2025)
par: Xu, Shicheng, et autres
Publié: (2025)
Unsupervised Information Refinement Training of Large Language Models for Retrieval-Augmented Generation
par: Xu, Shicheng, et autres
Publié: (2024)
par: Xu, Shicheng, et autres
Publié: (2024)
ToolCoder: A Systematic Code-Empowered Tool Learning Framework for Large Language Models
par: Ding, Hanxing, et autres
Publié: (2025)
par: Ding, Hanxing, et autres
Publié: (2025)
Cross-Model Comparative Loss for Enhancing Neuronal Utility in Language Understanding
par: Zhu, Yunchang, et autres
Publié: (2023)
par: Zhu, Yunchang, et autres
Publié: (2023)
List-aware Reranking-Truncation Joint Model for Search and Retrieval-augmented Generation
par: Xu, Shicheng, et autres
Publié: (2024)
par: Xu, Shicheng, et autres
Publié: (2024)
Knowledge Boundary and Persona Dynamic Shape A Better Social Media Agent
par: Zhou, Junkai, et autres
Publié: (2024)
par: Zhou, Junkai, et autres
Publié: (2024)
A Theory for Token-Level Harmonization in Retrieval-Augmented Generation
par: Xu, Shicheng, et autres
Publié: (2024)
par: Xu, Shicheng, et autres
Publié: (2024)
Rowen: Adaptive Retrieval-Augmented Generation for Hallucination Mitigation in LLMs
par: Ding, Hanxing, et autres
Publié: (2024)
par: Ding, Hanxing, et autres
Publié: (2024)
Qsnail: A Questionnaire Dataset for Sequential Question Generation
par: Lei, Yan, et autres
Publié: (2024)
par: Lei, Yan, et autres
Publié: (2024)
RLKD: Distilling LLMs' Reasoning via Reinforcement Learning
par: Xu, Shicheng, et autres
Publié: (2025)
par: Xu, Shicheng, et autres
Publié: (2025)
Training a Utility-based Retriever Through Shared Context Attribution for Retrieval-Augmented Language Models
par: Xu, Yilong, et autres
Publié: (2025)
par: Xu, Yilong, et autres
Publié: (2025)
Understanding the Quality-Diversity Trade-off in Diffusion Language Models
par: Buzzard, Zak
Publié: (2025)
par: Buzzard, Zak
Publié: (2025)
SLANG: New Concept Comprehension of Large Language Models
par: Mei, Lingrui, et autres
Publié: (2024)
par: Mei, Lingrui, et autres
Publié: (2024)
Fundamental Safety-Capability Trade-offs in Fine-tuning Large Language Models
par: Chen, Pin-Yu, et autres
Publié: (2025)
par: Chen, Pin-Yu, et autres
Publié: (2025)
The Mirage of Model Editing: Revisiting Evaluation in the Wild
par: Yang, Wanli, et autres
Publié: (2025)
par: Yang, Wanli, et autres
Publié: (2025)
Representational and Behavioral Stability of Truth in Large Language Models
par: Dies, Samantha, et autres
Publié: (2025)
par: Dies, Samantha, et autres
Publié: (2025)
Following the Autoregressive Nature of LLM Embeddings via Compression and Alignment
par: Deng, Jingcheng, et autres
Publié: (2025)
par: Deng, Jingcheng, et autres
Publié: (2025)
On the Diminishing Returns of Complex Robust RAG Training in the Era of Powerful LLMs
par: Ding, Hanxing, et autres
Publié: (2025)
par: Ding, Hanxing, et autres
Publié: (2025)
Exploring Accuracy-Fairness Trade-off in Large Language Models
par: Zhang, Qingquan, et autres
Publié: (2024)
par: Zhang, Qingquan, et autres
Publié: (2024)
A Probability--Quality Trade-off in Aligned Language Models and its Relation to Sampling Adaptors
par: Tan, Naaman, et autres
Publié: (2024)
par: Tan, Naaman, et autres
Publié: (2024)
Iterative Structured Pruning for Large Language Models with Multi-Domain Calibration
par: Wu, Guangxin, et autres
Publié: (2026)
par: Wu, Guangxin, et autres
Publié: (2026)
ReAD: Reinforcement-Guided Capability Distillation for Large Language Models
par: Cheng, Xueqi, et autres
Publié: (2026)
par: Cheng, Xueqi, et autres
Publié: (2026)
Fine-tuning Done Right in Model Editing
par: Yang, Wanli, et autres
Publié: (2025)
par: Yang, Wanli, et autres
Publié: (2025)
DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts
par: Feng, Yuchen, et autres
Publié: (2025)
par: Feng, Yuchen, et autres
Publié: (2025)
WaterJudge: Quality-Detection Trade-off when Watermarking Large Language Models
par: Molenda, Piotr, et autres
Publié: (2024)
par: Molenda, Piotr, et autres
Publié: (2024)
Emissions and Performance Trade-off Between Small and Large Language Models
par: Garg, Anandita, et autres
Publié: (2025)
par: Garg, Anandita, et autres
Publié: (2025)
Generating Diverse Training Samples for Relation Extraction with Large Language Models
par: Li, Zexuan, et autres
Publié: (2025)
par: Li, Zexuan, et autres
Publié: (2025)
Performance Trade-offs of Optimizing Small Language Models for E-Commerce
par: Licardo, Josip Tomo, et autres
Publié: (2025)
par: Licardo, Josip Tomo, et autres
Publié: (2025)
LLM Latent Reasoning as Chain of Superposition
par: Deng, Jingcheng, et autres
Publié: (2025)
par: Deng, Jingcheng, et autres
Publié: (2025)
MI-PRUN: Optimize Large Language Model Pruning via Mutual Information
par: Zhang, Hao, et autres
Publié: (2026)
par: Zhang, Hao, et autres
Publié: (2026)
"Not Aligned" is Not "Malicious": Being Careful about Hallucinations of Large Language Models' Jailbreak
par: Mei, Lingrui, et autres
Publié: (2024)
par: Mei, Lingrui, et autres
Publié: (2024)
Documents similaires
-
Do LLMs Play Dice? Exploring Probability Distribution Sampling in Large Language Models for Behavioral Simulation
par: Gu, Jia, et autres
Publié: (2024) -
Enhancing Training Data Attribution for Large Language Models with Fitting Error Consideration
par: Wu, Kangxi, et autres
Publié: (2024) -
Think Before You Speak: Cultivating Communication Skills of Large Language Models via Inner Monologue
par: Zhou, Junkai, et autres
Publié: (2023) -
Stable Knowledge Editing in Large Language Models
par: Wei, Zihao, et autres
Publié: (2024) -
Cross-Modal Safety Mechanism Transfer in Large Vision-Language Models
par: Xu, Shicheng, et autres
Publié: (2024)