Mind the Gap: Conformative Decoding to Improve Output Diversity of Instruction-Tuned Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Peeperkorn, Max, Kouwenhoven, Tom, Brown, Dan, Jordanous, Anna |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Is Temperature the Creativity Parameter of Large Language Models?
di: Peeperkorn, Max, et al.
Pubblicazione: (2024)
di: Peeperkorn, Max, et al.
Pubblicazione: (2024)
Searching for Structure: Investigating Emergent Communication with Large Language Models
di: Kouwenhoven, Tom, et al.
Pubblicazione: (2024)
di: Kouwenhoven, Tom, et al.
Pubblicazione: (2024)
Shaping Shared Languages: Human and Large Language Models' Inductive Biases in Emergent Communication
di: Kouwenhoven, Tom, et al.
Pubblicazione: (2025)
di: Kouwenhoven, Tom, et al.
Pubblicazione: (2025)
Mind the Gap: Bridging Thought Leap for Improved Chain-of-Thought Tuning
di: Xu, Haolei, et al.
Pubblicazione: (2025)
di: Xu, Haolei, et al.
Pubblicazione: (2025)
Conformity in Large Language Models
di: Zhu, Xiaochen, et al.
Pubblicazione: (2024)
di: Zhu, Xiaochen, et al.
Pubblicazione: (2024)
Improving Linguistic Diversity of Large Language Models with Possibility Exploration Fine-Tuning
di: Mai, Long, et al.
Pubblicazione: (2024)
di: Mai, Long, et al.
Pubblicazione: (2024)
The Curious Case of Representational Alignment: Unravelling Visio-Linguistic Tasks in Emergent Communication
di: Kouwenhoven, Tom, et al.
Pubblicazione: (2024)
di: Kouwenhoven, Tom, et al.
Pubblicazione: (2024)
DolphCoder: Echo-Locating Code Large Language Models with Diverse and Multi-Objective Instruction Tuning
di: Wang, Yejie, et al.
Pubblicazione: (2024)
di: Wang, Yejie, et al.
Pubblicazione: (2024)
Semantic-guided Diverse Decoding for Large Language Model
di: Shi, Weijie, et al.
Pubblicazione: (2025)
di: Shi, Weijie, et al.
Pubblicazione: (2025)
Phased Instruction Fine-Tuning for Large Language Models
di: Pang, Wei, et al.
Pubblicazione: (2024)
di: Pang, Wei, et al.
Pubblicazione: (2024)
Investigating Instruction Tuning Large Language Models on Graphs
di: Zhu, Kerui, et al.
Pubblicazione: (2024)
di: Zhu, Kerui, et al.
Pubblicazione: (2024)
Mind the Confidence Gap: Overconfidence, Calibration, and Distractor Effects in Large Language Models
di: Chhikara, Prateek
Pubblicazione: (2025)
di: Chhikara, Prateek
Pubblicazione: (2025)
GraphGPT: Graph Instruction Tuning for Large Language Models
di: Tang, Jiabin, et al.
Pubblicazione: (2023)
di: Tang, Jiabin, et al.
Pubblicazione: (2023)
Towards Robust Instruction Tuning on Multimodal Large Language Models
di: Han, Wei, et al.
Pubblicazione: (2024)
di: Han, Wei, et al.
Pubblicazione: (2024)
OctoPack: Instruction Tuning Code Large Language Models
di: Muennighoff, Niklas, et al.
Pubblicazione: (2023)
di: Muennighoff, Niklas, et al.
Pubblicazione: (2023)
Optimizing Psychological Counseling with Instruction-Tuned Large Language Models
di: Li, Wenjie, et al.
Pubblicazione: (2024)
di: Li, Wenjie, et al.
Pubblicazione: (2024)
COFT: Counterfactual-Conformal Decoding for Fair Chain-of-Thought Reasoning in Large Language Models
di: Fayyazi, Arya, et al.
Pubblicazione: (2026)
di: Fayyazi, Arya, et al.
Pubblicazione: (2026)
DELIA: Diversity-Enhanced Learning for Instruction Adaptation in Large Language Models
di: Zeng, Yuanhao, et al.
Pubblicazione: (2024)
di: Zeng, Yuanhao, et al.
Pubblicazione: (2024)
BioInstruct: Instruction Tuning of Large Language Models for Biomedical Natural Language Processing
di: Tran, Hieu, et al.
Pubblicazione: (2023)
di: Tran, Hieu, et al.
Pubblicazione: (2023)
Instruction Mining: Instruction Data Selection for Tuning Large Language Models
di: Cao, Yihan, et al.
Pubblicazione: (2023)
di: Cao, Yihan, et al.
Pubblicazione: (2023)
The Outputs of Large Language Models are Meaningless
di: Hattiangadi, Anandi, et al.
Pubblicazione: (2025)
di: Hattiangadi, Anandi, et al.
Pubblicazione: (2025)
Group-Aware Reinforcement Learning for Output Diversity in Large Language Models
di: Anschel, Oron, et al.
Pubblicazione: (2025)
di: Anschel, Oron, et al.
Pubblicazione: (2025)
LARFT: Closing the Cognition-Action Gap for Length Instruction Following in Large Language Models
di: Zhang, Wei, et al.
Pubblicazione: (2026)
di: Zhang, Wei, et al.
Pubblicazione: (2026)
Vikhr: The Family of Open-Source Instruction-Tuned Large Language Models for Russian
di: Nikolich, Aleksandr, et al.
Pubblicazione: (2024)
di: Nikolich, Aleksandr, et al.
Pubblicazione: (2024)
Graph-oriented Instruction Tuning of Large Language Models for Generic Graph Mining
di: Tan, Yanchao, et al.
Pubblicazione: (2024)
di: Tan, Yanchao, et al.
Pubblicazione: (2024)
Toward Graph-Tokenizing Large Language Models with Reconstructive Graph Instruction Tuning
di: Zhang, Zhongjian, et al.
Pubblicazione: (2026)
di: Zhang, Zhongjian, et al.
Pubblicazione: (2026)
Instruction Tuning for Large Language Models: A Survey
di: Zhang, Shengyu, et al.
Pubblicazione: (2023)
di: Zhang, Shengyu, et al.
Pubblicazione: (2023)
Bridging Writing Manner Gap in Visual Instruction Tuning by Creating LLM-aligned Instructions
di: Jing, Dong, et al.
Pubblicazione: (2025)
di: Jing, Dong, et al.
Pubblicazione: (2025)
CommonIT: Commonality-Aware Instruction Tuning for Large Language Models via Data Partitions
di: Rao, Jun, et al.
Pubblicazione: (2024)
di: Rao, Jun, et al.
Pubblicazione: (2024)
Unveiling the Impact of Coding Data Instruction Fine-Tuning on Large Language Models Reasoning
di: Zhang, Xinlu, et al.
Pubblicazione: (2024)
di: Zhang, Xinlu, et al.
Pubblicazione: (2024)
Federated Data-Efficient Instruction Tuning for Large Language Models
di: Qin, Zhen, et al.
Pubblicazione: (2024)
di: Qin, Zhen, et al.
Pubblicazione: (2024)
Emovectors: assessing emotional content in jazz improvisations for creativity evaluation
di: Jordanous, Anna
Pubblicazione: (2025)
di: Jordanous, Anna
Pubblicazione: (2025)
Token Constraint Decoding Improves Robustness on Question Answering for Large Language Models
di: Yao, Jui-Ming, et al.
Pubblicazione: (2025)
di: Yao, Jui-Ming, et al.
Pubblicazione: (2025)
DeAL: Decoding-time Alignment for Large Language Models
di: Huang, James Y., et al.
Pubblicazione: (2024)
di: Huang, James Y., et al.
Pubblicazione: (2024)
Decoding the Mind of Large Language Models: A Quantitative Evaluation of Ideology and Biases
di: Hirose, Manari, et al.
Pubblicazione: (2025)
di: Hirose, Manari, et al.
Pubblicazione: (2025)
Taiyi: A Bilingual Fine-Tuned Large Language Model for Diverse Biomedical Tasks
di: Luo, Ling, et al.
Pubblicazione: (2023)
di: Luo, Ling, et al.
Pubblicazione: (2023)
SwitchCIT: Switching for Continual Instruction Tuning
di: Wu, Xinbo, et al.
Pubblicazione: (2024)
di: Wu, Xinbo, et al.
Pubblicazione: (2024)
Constraint Back-translation Improves Complex Instruction Following of Large Language Models
di: Qi, Yunjia, et al.
Pubblicazione: (2024)
di: Qi, Yunjia, et al.
Pubblicazione: (2024)
Log Probabilities Are a Reliable Estimate of Semantic Plausibility in Base and Instruction-Tuned Language Models
di: Kauf, Carina, et al.
Pubblicazione: (2024)
di: Kauf, Carina, et al.
Pubblicazione: (2024)
Is It Good Data for Multilingual Instruction Tuning or Just Bad Multilingual Evaluation for Large Language Models?
di: Chen, Pinzhen, et al.
Pubblicazione: (2024)
di: Chen, Pinzhen, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Is Temperature the Creativity Parameter of Large Language Models?
di: Peeperkorn, Max, et al.
Pubblicazione: (2024) -
Searching for Structure: Investigating Emergent Communication with Large Language Models
di: Kouwenhoven, Tom, et al.
Pubblicazione: (2024) -
Shaping Shared Languages: Human and Large Language Models' Inductive Biases in Emergent Communication
di: Kouwenhoven, Tom, et al.
Pubblicazione: (2025) -
Mind the Gap: Bridging Thought Leap for Improved Chain-of-Thought Tuning
di: Xu, Haolei, et al.
Pubblicazione: (2025) -
Conformity in Large Language Models
di: Zhu, Xiaochen, et al.
Pubblicazione: (2024)