Turning Up the Heat: Min-p Sampling for Creative and Coherent LLM Outputs
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Nguyen, Minh Nhat, Baker, Andrew, Neo, Clement, Roush, Allen, Kirsch, Andreas, Shwartz-Ziv, Ravid |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Antislop: A Comprehensive Framework for Identifying and Eliminating Repetitive Patterns in Language Models
par: Paech, Samuel, et autres
Publié: (2025)
par: Paech, Samuel, et autres
Publié: (2025)
A superpersuasive autonomous policy debating system
par: Roush, Allen, et autres
Publié: (2025)
par: Roush, Allen, et autres
Publié: (2025)
OpenDebateEvidence: A Massive-Scale Argument Mining and Summarization Dataset
par: Roush, Allen, et autres
Publié: (2024)
par: Roush, Allen, et autres
Publié: (2024)
When Attention Collapses: How Degenerate Layers in LLMs Enable Smaller, Stronger Models
par: Sanyal, Sunny, et autres
Publié: (2024)
par: Sanyal, Sunny, et autres
Publié: (2024)
Does Representation Matter? Exploring Intermediate Layers in Large Language Models
par: Skean, Oscar, et autres
Publié: (2024)
par: Skean, Oscar, et autres
Publié: (2024)
Learning to Compress: Local Rank and Information Compression in Deep Neural Networks
par: Patel, Niket, et autres
Publié: (2024)
par: Patel, Niket, et autres
Publié: (2024)
Sudden Drops in the Loss: Syntax Acquisition, Phase Transitions, and Simplicity Bias in MLMs
par: Chen, Angelica, et autres
Publié: (2023)
par: Chen, Angelica, et autres
Publié: (2023)
From Tokens to Thoughts: How LLMs and Humans Trade Compression for Meaning
par: Shani, Chen, et autres
Publié: (2025)
par: Shani, Chen, et autres
Publié: (2025)
You Had One Job: Per-Task Quantization Using LLMs' Hidden Representations
par: LeVi, Amit, et autres
Publié: (2025)
par: LeVi, Amit, et autres
Publié: (2025)
The Illusion of Progress: Re-evaluating Hallucination Detection in LLMs
par: Janiak, Denis, et autres
Publié: (2025)
par: Janiak, Denis, et autres
Publié: (2025)
Do Multi-Agents Dream of Electric Screens? Achieving Perfect Accuracy on AndroidWorld Through Task Decomposition
par: Favreau, Pierre-Louis, et autres
Publié: (2026)
par: Favreau, Pierre-Louis, et autres
Publié: (2026)
Measure what Matters: Psychometric Evaluation of AI with Situational Judgment Tests
par: Yost, Alexandra, et autres
Publié: (2025)
par: Yost, Alexandra, et autres
Publié: (2025)
Seq-VCR: Preventing Collapse in Intermediate Transformer Representations for Enhanced Reasoning
par: Arefin, Md Rifat, et autres
Publié: (2024)
par: Arefin, Md Rifat, et autres
Publié: (2024)
Video Representation Learning with Joint-Embedding Predictive Architectures
par: Drozdov, Katrina, et autres
Publié: (2024)
par: Drozdov, Katrina, et autres
Publié: (2024)
Min-p, Max Exaggeration: A Critical Analysis of Min-p Sampling in Language Models
par: Schaeffer, Rylan, et autres
Publié: (2025)
par: Schaeffer, Rylan, et autres
Publié: (2025)
Layer by Layer: Uncovering Hidden Representations in Language Models
par: Skean, Oscar, et autres
Publié: (2025)
par: Skean, Oscar, et autres
Publié: (2025)
Cooking Up Creativity: Enhancing LLM Creativity through Structured Recombination
par: Mizrahi, Moran, et autres
Publié: (2025)
par: Mizrahi, Moran, et autres
Publié: (2025)
When Two LLMs Debate, Both Think They'll Win
par: Prasad, Pradyumna Shyama, et autres
Publié: (2025)
par: Prasad, Pradyumna Shyama, et autres
Publié: (2025)
Understanding Addition and Subtraction in Transformers
par: Quirke, Philip, et autres
Publié: (2024)
par: Quirke, Philip, et autres
Publié: (2024)
AI Must Embrace Specialization via Superhuman Adaptable Intelligence
par: Goldfeder, Judah, et autres
Publié: (2026)
par: Goldfeder, Judah, et autres
Publié: (2026)
The Entropy Enigma: Success and Failure of Entropy Minimization
par: Press, Ori, et autres
Publié: (2024)
par: Press, Ori, et autres
Publié: (2024)
NdLinear: Preserving Multi-Dimensional Structure for Parameter-Efficient Neural Networks
par: Reneau, Alex, et autres
Publié: (2025)
par: Reneau, Alex, et autres
Publié: (2025)
Answering Students' Questions on Course Forums Using Multiple Chain-of-Thought Reasoning and Finetuning RAG-Enabled LLM
par: Wang, Neo, et autres
Publié: (2025)
par: Wang, Neo, et autres
Publié: (2025)
Interpreting Context Look-ups in Transformers: Investigating Attention-MLP Interactions
par: Neo, Clement, et autres
Publié: (2024)
par: Neo, Clement, et autres
Publié: (2024)
History-Aware Cross-Attention Reinforcement: Self-Supervised Multi Turn and Chain-of-Thought Fine-Tuning with vLLM
par: Kiruluta, Andrew, et autres
Publié: (2025)
par: Kiruluta, Andrew, et autres
Publié: (2025)
UETQuintet at BioCreative IX -- MedHopQA: Enhancing Biomedical QA with Selective Multi-hop Reasoning and Contextual Retrieval
par: Nguyen, Quoc-An, et autres
Publié: (2026)
par: Nguyen, Quoc-An, et autres
Publié: (2026)
Latent Transfer Attack: Adversarial Examples via Generative Latent Spaces
par: Shaar, Eitan, et autres
Publié: (2026)
par: Shaar, Eitan, et autres
Publié: (2026)
RAGEN: Understanding Self-Evolution in LLM Agents via Multi-Turn Reinforcement Learning
par: Wang, Zihan, et autres
Publié: (2025)
par: Wang, Zihan, et autres
Publié: (2025)
Adaptive Stopping for Multi-Turn LLM Reasoning
par: Zhou, Xiaofan, et autres
Publié: (2026)
par: Zhou, Xiaofan, et autres
Publié: (2026)
Analysing LLM Persona Generation and Fairness Interpretation in Polarised Geopolitical Contexts
par: Aizaz, Maida, et autres
Publié: (2026)
par: Aizaz, Maida, et autres
Publié: (2026)
Fairness in Large Language Models in Three Hours
par: Viet, Thang Doan, et autres
Publié: (2024)
par: Viet, Thang Doan, et autres
Publié: (2024)
ECoh: Turn-level Coherence Evaluation for Multilingual Dialogues
par: Mendonça, John, et autres
Publié: (2024)
par: Mendonça, John, et autres
Publié: (2024)
Benchmark Inflation: Revealing LLM Performance Gaps Using Retro-Holdouts
par: Haimes, Jacob, et autres
Publié: (2024)
par: Haimes, Jacob, et autres
Publié: (2024)
Co-NAML-LSTUR: A Combined Model with Attentive Multi-View Learning and Long- and Short-term User Representations for News Recommendation
par: Nguyen, Minh Hoang, et autres
Publié: (2025)
par: Nguyen, Minh Hoang, et autres
Publié: (2025)
On Training in Imagination
par: Timor, Nadav, et autres
Publié: (2026)
par: Timor, Nadav, et autres
Publié: (2026)
Variance-Covariance Regularization Improves Representation Learning
par: Zhu, Jiachen, et autres
Publié: (2023)
par: Zhu, Jiachen, et autres
Publié: (2023)
LiveBench: A Challenging, Contamination-Limited LLM Benchmark
par: White, Colin, et autres
Publié: (2024)
par: White, Colin, et autres
Publié: (2024)
Link prediction Graph Neural Networks for structure recognition of Handwritten Mathematical Expressions
par: Nguyen, Cuong Tuan, et autres
Publié: (2025)
par: Nguyen, Cuong Tuan, et autres
Publié: (2025)
Improving LLM Unlearning Robustness via Random Perturbations
par: Huu-Tien, Dang, et autres
Publié: (2025)
par: Huu-Tien, Dang, et autres
Publié: (2025)
Control the Temperature: Selective Sampling for Diverse and High-Quality LLM Outputs
par: Troshin, Sergey, et autres
Publié: (2025)
par: Troshin, Sergey, et autres
Publié: (2025)
Documents similaires
-
Antislop: A Comprehensive Framework for Identifying and Eliminating Repetitive Patterns in Language Models
par: Paech, Samuel, et autres
Publié: (2025) -
A superpersuasive autonomous policy debating system
par: Roush, Allen, et autres
Publié: (2025) -
OpenDebateEvidence: A Massive-Scale Argument Mining and Summarization Dataset
par: Roush, Allen, et autres
Publié: (2024) -
When Attention Collapses: How Degenerate Layers in LLMs Enable Smaller, Stronger Models
par: Sanyal, Sunny, et autres
Publié: (2024) -
Does Representation Matter? Exploring Intermediate Layers in Large Language Models
par: Skean, Oscar, et autres
Publié: (2024)