Distribution Prompting: Understanding the Expressivity of Language Models Through the Next-Token Distributions They Can Produce
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Haojin, Zhu, Zining, Shi, Freda |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
How Tokenization Limits Phonological Knowledge Representation in Language Models and How to Improve Them
por: Liao, Disen, et al.
Publicado: (2026)
por: Liao, Disen, et al.
Publicado: (2026)
Better Language Model Inversion by Compactly Representing Next-Token Distributions
por: Nazir, Murtaza, et al.
Publicado: (2025)
por: Nazir, Murtaza, et al.
Publicado: (2025)
Understanding Language Model Circuits through Knowledge Editing
por: Ge, Huaizhi, et al.
Publicado: (2024)
por: Ge, Huaizhi, et al.
Publicado: (2024)
Learning Language Structures through Grounding
por: Shi, Freda
Publicado: (2024)
por: Shi, Freda
Publicado: (2024)
Efficient Training of Language Models with Compact and Consistent Next Token Distributions
por: Sathe, Ashutosh, et al.
Publicado: (2024)
por: Sathe, Ashutosh, et al.
Publicado: (2024)
Error Reflection Prompting: Can Large Language Models Successfully Understand Errors?
por: Li, Jason, et al.
Publicado: (2025)
por: Li, Jason, et al.
Publicado: (2025)
Logical forms complement probability in understanding language model (and human) performance
por: Wang, Yixuan, et al.
Publicado: (2025)
por: Wang, Yixuan, et al.
Publicado: (2025)
How Well Can Knowledge Edit Methods Edit Perplexing Knowledge?
por: Ge, Huaizhi, et al.
Publicado: (2024)
por: Ge, Huaizhi, et al.
Publicado: (2024)
Real Images, Worse Judgments: Evaluating Vision-Language Models on Concreteness and Imagery
por: Jiang, Yifan, et al.
Publicado: (2026)
por: Jiang, Yifan, et al.
Publicado: (2026)
Beyond the Next Token: Towards Prompt-Robust Zero-Shot Classification via Efficient Multi-Token Prediction
por: Qian, Junlang, et al.
Publicado: (2025)
por: Qian, Junlang, et al.
Publicado: (2025)
From Token to Token Pair: Efficient Prompt Compression for Large Language Models in Clinical Prediction
por: Zhu, Mingcheng, et al.
Publicado: (2026)
por: Zhu, Mingcheng, et al.
Publicado: (2026)
Can Large Language Models Understand Internet Buzzwords Through User-Generated Content
por: Huang, Chen, et al.
Publicado: (2025)
por: Huang, Chen, et al.
Publicado: (2025)
Measuring Language Model Hallucinations Through Distributional Correctness
por: Burns, Thomas F
Publicado: (2025)
por: Burns, Thomas F
Publicado: (2025)
Multimodal Latent Language Modeling with Next-Token Diffusion
por: Sun, Yutao, et al.
Publicado: (2024)
por: Sun, Yutao, et al.
Publicado: (2024)
Bigram Subnetworks: Mapping to Next Tokens in Transformer Language Models
por: Chang, Tyler A., et al.
Publicado: (2025)
por: Chang, Tyler A., et al.
Publicado: (2025)
Ain't Misbehavin' -- Using LLMs to Generate Expressive Robot Behavior in Conversations with the Tabletop Robot Haru
por: Wang, Zining, et al.
Publicado: (2024)
por: Wang, Zining, et al.
Publicado: (2024)
LingGym: How Far Are LLMs from Thinking Like Field Linguists?
por: Yang, Changbing, et al.
Publicado: (2025)
por: Yang, Changbing, et al.
Publicado: (2025)
LLM-Generated Black-box Explanations Can Be Adversarially Helpful
por: Ajwani, Rohan, et al.
Publicado: (2024)
por: Ajwani, Rohan, et al.
Publicado: (2024)
One Token Can Help! Learning Scalable and Pluggable Virtual Tokens for Retrieval-Augmented Large Language Models
por: Zhu, Yutao, et al.
Publicado: (2024)
por: Zhu, Yutao, et al.
Publicado: (2024)
Chartographer: Counterfactual Chart Generation for Evaluating Vision-Language Models
por: Jiang, Yifan, et al.
Publicado: (2026)
por: Jiang, Yifan, et al.
Publicado: (2026)
Can Large Language Models Understand Context?
por: Zhu, Yilun, et al.
Publicado: (2024)
por: Zhu, Yilun, et al.
Publicado: (2024)
Fine-tuning vs Prompting, Can Language Models Understand Human Values?
por: Sun, Pingwei
Publicado: (2024)
por: Sun, Pingwei
Publicado: (2024)
Text-to-Distribution Prediction with Quantile Tokens and Neighbor Context
por: Zhu, Yilun, et al.
Publicado: (2026)
por: Zhu, Yilun, et al.
Publicado: (2026)
Robust Prompt Optimization for Large Language Models Against Distribution Shifts
por: Li, Moxin, et al.
Publicado: (2023)
por: Li, Moxin, et al.
Publicado: (2023)
Blessing of Multilinguality: A Systematic Analysis of Multilingual In-Context Learning
por: Tu, Yilei, et al.
Publicado: (2025)
por: Tu, Yilei, et al.
Publicado: (2025)
Language Model Maps for Prompt-Response Distributions via Log-Likelihood Vectors
por: Takase, Yusuke, et al.
Publicado: (2026)
por: Takase, Yusuke, et al.
Publicado: (2026)
Plug and Play with Prompts: A Prompt Tuning Approach for Controlling Text Generation
por: Ajwani, Rohan Deepak, et al.
Publicado: (2024)
por: Ajwani, Rohan Deepak, et al.
Publicado: (2024)
Revisiting Graph-Tokenizing Large Language Models: A Systematic Evaluation of Graph Token Understanding
por: Zhang, Zhongjian, et al.
Publicado: (2026)
por: Zhang, Zhongjian, et al.
Publicado: (2026)
Understanding the Emergence of Seemingly Useless Features in Next-Token Predictors
por: Rofin, Mark, et al.
Publicado: (2026)
por: Rofin, Mark, et al.
Publicado: (2026)
Scenarios and Approaches for Situated Natural Language Explanations
por: Qiu, Pengshuo, et al.
Publicado: (2024)
por: Qiu, Pengshuo, et al.
Publicado: (2024)
Trading Complexity for Expressivity Through Structured Generalized Linear Token Mixing
por: Fagnou, Erwan, et al.
Publicado: (2026)
por: Fagnou, Erwan, et al.
Publicado: (2026)
Jailbreaking Large Language Models Through Alignment Vulnerabilities in Out-of-Distribution Settings
por: Huang, Yue, et al.
Publicado: (2024)
por: Huang, Yue, et al.
Publicado: (2024)
DiffuMask: Diffusion Language Model for Token-level Prompt Pruning
por: Zheng, Caleb, et al.
Publicado: (2026)
por: Zheng, Caleb, et al.
Publicado: (2026)
Metacognitive Prompting Improves Understanding in Large Language Models
por: Wang, Yuqing, et al.
Publicado: (2023)
por: Wang, Yuqing, et al.
Publicado: (2023)
NDP: Next Distribution Prediction as a More Broad Target
por: Ruan, Junhao, et al.
Publicado: (2024)
por: Ruan, Junhao, et al.
Publicado: (2024)
How Confident Is the First Token? An Uncertainty-Calibrated Prompt Optimization Framework for Large Language Model Classification and Understanding
por: Chen, Wei, et al.
Publicado: (2026)
por: Chen, Wei, et al.
Publicado: (2026)
Can Language Models Perform Robust Reasoning in Chain-of-thought Prompting with Noisy Rationales?
por: Zhou, Zhanke, et al.
Publicado: (2024)
por: Zhou, Zhanke, et al.
Publicado: (2024)
Can You Learn Semantics Through Next-Word Prediction? The Case of Entailment
por: Merrill, William, et al.
Publicado: (2024)
por: Merrill, William, et al.
Publicado: (2024)
A Law of Next-Token Prediction in Large Language Models
por: He, Hangfeng, et al.
Publicado: (2024)
por: He, Hangfeng, et al.
Publicado: (2024)
Differentially Private Next-Token Prediction of Large Language Models
por: Flemings, James, et al.
Publicado: (2024)
por: Flemings, James, et al.
Publicado: (2024)
Ejemplares similares
-
How Tokenization Limits Phonological Knowledge Representation in Language Models and How to Improve Them
por: Liao, Disen, et al.
Publicado: (2026) -
Better Language Model Inversion by Compactly Representing Next-Token Distributions
por: Nazir, Murtaza, et al.
Publicado: (2025) -
Understanding Language Model Circuits through Knowledge Editing
por: Ge, Huaizhi, et al.
Publicado: (2024) -
Learning Language Structures through Grounding
por: Shi, Freda
Publicado: (2024) -
Efficient Training of Language Models with Compact and Consistent Next Token Distributions
por: Sathe, Ashutosh, et al.
Publicado: (2024)