EDT: Improving Large Language Models' Generation by Entropy-based Dynamic Temperature Sampling
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Shimao, Bao, Yu, Huang, Shujian |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Process-based Self-Rewarding Language Models
di: Zhang, Shimao, et al.
Pubblicazione: (2025)
di: Zhang, Shimao, et al.
Pubblicazione: (2025)
Getting More from Less: Large Language Models are Good Spontaneous Multilingual Learners
di: Zhang, Shimao, et al.
Pubblicazione: (2024)
di: Zhang, Shimao, et al.
Pubblicazione: (2024)
PATS: Process-Level Adaptive Thinking Mode Switching
di: Wang, Yi, et al.
Pubblicazione: (2025)
di: Wang, Yi, et al.
Pubblicazione: (2025)
Trans-Zero: Self-Play Incentivizes Large Language Models for Multilingual Translation Without Parallel Data
di: Zou, Wei, et al.
Pubblicazione: (2025)
di: Zou, Wei, et al.
Pubblicazione: (2025)
How Does Alignment Enhance LLMs' Multilingual Capabilities? A Language Neurons Perspective
di: Zhang, Shimao, et al.
Pubblicazione: (2025)
di: Zhang, Shimao, et al.
Pubblicazione: (2025)
Formality is Favored: Unraveling the Learning Preferences of Large Language Models on Data with Conflicting Knowledge
di: Li, Jiahuan, et al.
Pubblicazione: (2024)
di: Li, Jiahuan, et al.
Pubblicazione: (2024)
MT-PATCHER: Selective and Extendable Knowledge Distillation from Large Language Models for Machine Translation
di: Li, Jiahuan, et al.
Pubblicazione: (2024)
di: Li, Jiahuan, et al.
Pubblicazione: (2024)
Extroversion or Introversion? Controlling The Personality of Your Large Language Models
di: Chen, Yanquan, et al.
Pubblicazione: (2024)
di: Chen, Yanquan, et al.
Pubblicazione: (2024)
Large Language Models are Limited in Out-of-Context Knowledge Reasoning
di: Hu, Peng, et al.
Pubblicazione: (2024)
di: Hu, Peng, et al.
Pubblicazione: (2024)
Exploring the Factual Consistency in Dialogue Comprehension of Large Language Models
di: She, Shuaijie, et al.
Pubblicazione: (2023)
di: She, Shuaijie, et al.
Pubblicazione: (2023)
Entropy Guided Extrapolative Decoding to Improve Factuality in Large Language Models
di: Das, Souvik, et al.
Pubblicazione: (2024)
di: Das, Souvik, et al.
Pubblicazione: (2024)
Lost in the Source Language: How Large Language Models Evaluate the Quality of Machine Translation
di: Huang, Xu, et al.
Pubblicazione: (2024)
di: Huang, Xu, et al.
Pubblicazione: (2024)
DLM-One: Diffusion Language Models for One-Step Sequence Generation
di: Chen, Tianqi, et al.
Pubblicazione: (2025)
di: Chen, Tianqi, et al.
Pubblicazione: (2025)
Eliciting the Translation Ability of Large Language Models via Multilingual Finetuning with Translation Instructions
di: Li, Jiahuan, et al.
Pubblicazione: (2023)
di: Li, Jiahuan, et al.
Pubblicazione: (2023)
Measuring Meaning Composition in the Human Brain with Composition Scores from Large Language Models
di: Gao, Changjiang, et al.
Pubblicazione: (2024)
di: Gao, Changjiang, et al.
Pubblicazione: (2024)
A Wolf in Sheep's Clothing: Generalized Nested Jailbreak Prompts can Fool Large Language Models Easily
di: Ding, Peng, et al.
Pubblicazione: (2023)
di: Ding, Peng, et al.
Pubblicazione: (2023)
BenchMAX: A Comprehensive Multilingual Evaluation Suite for Large Language Models
di: Huang, Xu, et al.
Pubblicazione: (2025)
di: Huang, Xu, et al.
Pubblicazione: (2025)
Large Language Models Are Cross-Lingual Knowledge-Free Reasoners
di: Hu, Peng, et al.
Pubblicazione: (2024)
di: Hu, Peng, et al.
Pubblicazione: (2024)
ExpLang: Improved Exploration and Exploitation in LLM Reasoning with On-Policy Thinking Language Selection
di: Gao, Changjiang, et al.
Pubblicazione: (2026)
di: Gao, Changjiang, et al.
Pubblicazione: (2026)
Improved Paraphrase Generation via Controllable Latent Diffusion
di: Zou, Wei, et al.
Pubblicazione: (2024)
di: Zou, Wei, et al.
Pubblicazione: (2024)
Entropy in Large Language Models
di: Scharringhausen, Marco
Pubblicazione: (2026)
di: Scharringhausen, Marco
Pubblicazione: (2026)
SDGO: Self-Discrimination-Guided Optimization for Consistent Safety in Large Language Models
di: Ding, Peng, et al.
Pubblicazione: (2025)
di: Ding, Peng, et al.
Pubblicazione: (2025)
Improving Sample Efficiency of Reinforcement Learning with Background Knowledge from Large Language Models
di: Zhang, Fuxiang, et al.
Pubblicazione: (2024)
di: Zhang, Fuxiang, et al.
Pubblicazione: (2024)
Multilingual Machine Translation with Large Language Models: Empirical Results and Analysis
di: Zhu, Wenhao, et al.
Pubblicazione: (2023)
di: Zhu, Wenhao, et al.
Pubblicazione: (2023)
MoE-LPR: Multilingual Extension of Large Language Models through Mixture-of-Experts with Language Priors Routing
di: Zhou, Hao, et al.
Pubblicazione: (2024)
di: Zhou, Hao, et al.
Pubblicazione: (2024)
The Effect of Sampling Temperature on Problem Solving in Large Language Models
di: Renze, Matthew, et al.
Pubblicazione: (2024)
di: Renze, Matthew, et al.
Pubblicazione: (2024)
EnAnchored-X2X: English-Anchored Optimization for Many-to-Many Translation
di: Yang, Sen, et al.
Pubblicazione: (2025)
di: Yang, Sen, et al.
Pubblicazione: (2025)
Neuron-Aware Data Selection In Instruction Tuning For Large Language Models
di: Chen, Xin, et al.
Pubblicazione: (2026)
di: Chen, Xin, et al.
Pubblicazione: (2026)
Language Rectified Flow: Advancing Diffusion Language Generation with Probabilistic Flows
di: Zhang, Shujian, et al.
Pubblicazione: (2024)
di: Zhang, Shujian, et al.
Pubblicazione: (2024)
Improved Unbiased Watermark for Large Language Models
di: Chen, Ruibo, et al.
Pubblicazione: (2025)
di: Chen, Ruibo, et al.
Pubblicazione: (2025)
Self-Evolution Knowledge Distillation for LLM-based Machine Translation
di: Song, Yuncheng, et al.
Pubblicazione: (2024)
di: Song, Yuncheng, et al.
Pubblicazione: (2024)
Detecting Stealthy Backdoor Samples based on Intra-class Distance for Large Language Models
di: Chen, Jinwen, et al.
Pubblicazione: (2025)
di: Chen, Jinwen, et al.
Pubblicazione: (2025)
PEGRL: Improving Machine Translation by Post-Editing Guided Reinforcement Learning
di: Shen, Yunzhi, et al.
Pubblicazione: (2026)
di: Shen, Yunzhi, et al.
Pubblicazione: (2026)
Improving Diversity of Commonsense Generation by Large Language Models via In-Context Learning
di: Zhang, Tianhui, et al.
Pubblicazione: (2024)
di: Zhang, Tianhui, et al.
Pubblicazione: (2024)
GCoder: Improving Large Language Model for Generalized Graph Problem Solving
di: Zhang, Qifan, et al.
Pubblicazione: (2024)
di: Zhang, Qifan, et al.
Pubblicazione: (2024)
Reasoning While Asking: Transforming Reasoning Large Language Models from Passive Solvers to Proactive Inquirers
di: Chen, Xin, et al.
Pubblicazione: (2026)
di: Chen, Xin, et al.
Pubblicazione: (2026)
DSVD: Dynamic Self-Verify Decoding for Faithful Generation in Large Language Models
di: Guo, YiQiu, et al.
Pubblicazione: (2025)
di: Guo, YiQiu, et al.
Pubblicazione: (2025)
Improve Decoding Factuality by Token-wise Cross Layer Entropy of Large Language Models
di: Wu, Jialiang, et al.
Pubblicazione: (2025)
di: Wu, Jialiang, et al.
Pubblicazione: (2025)
Evaluating and Improving Graph to Text Generation with Large Language Models
di: He, Jie, et al.
Pubblicazione: (2025)
di: He, Jie, et al.
Pubblicazione: (2025)
Generating Diverse Training Samples for Relation Extraction with Large Language Models
di: Li, Zexuan, et al.
Pubblicazione: (2025)
di: Li, Zexuan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Process-based Self-Rewarding Language Models
di: Zhang, Shimao, et al.
Pubblicazione: (2025) -
Getting More from Less: Large Language Models are Good Spontaneous Multilingual Learners
di: Zhang, Shimao, et al.
Pubblicazione: (2024) -
PATS: Process-Level Adaptive Thinking Mode Switching
di: Wang, Yi, et al.
Pubblicazione: (2025) -
Trans-Zero: Self-Play Incentivizes Large Language Models for Multilingual Translation Without Parallel Data
di: Zou, Wei, et al.
Pubblicazione: (2025) -
How Does Alignment Enhance LLMs' Multilingual Capabilities? A Language Neurons Perspective
di: Zhang, Shimao, et al.
Pubblicazione: (2025)