When Does a Language Model Commit? A Finite-Answer Theory of Pre-Verbalization Commitment
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhang, Long, Chen, Wei-neng, Wei, Feng-feng, Qin, Zi-bo |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Authority Inversion in LLM-Mediated Ubiquitous Systems: When Models Trust Users Over Sensors
por: Zhang, Long, et al.
Publicado: (2026)
por: Zhang, Long, et al.
Publicado: (2026)
Rewarding Intellectual Humility Learning When Not To Answer In Large Language Models
por: Jha, Abha, et al.
Publicado: (2026)
por: Jha, Abha, et al.
Publicado: (2026)
When Answers Stray from Questions: Hallucination Detection via Question-Answer Orthogonal Decomposition
por: Yao, Siyang, et al.
Publicado: (2026)
por: Yao, Siyang, et al.
Publicado: (2026)
Language Models Can Learn from Verbal Feedback Without Scalar Rewards
por: Luo, Renjie, et al.
Publicado: (2025)
por: Luo, Renjie, et al.
Publicado: (2025)
Hallucination as Trajectory Commitment: Causal Evidence for Asymmetric Attractor Dynamics in Transformer Generation
por: Akarlar, G. Aytug
Publicado: (2026)
por: Akarlar, G. Aytug
Publicado: (2026)
When to Commit? Towards Variable-Size Self-Contained Blocks for Discrete Diffusion Language Models
por: Wang, Danny, et al.
Publicado: (2026)
por: Wang, Danny, et al.
Publicado: (2026)
What Is the Minimum Architecture for Prolepsis? Early Irrevocable Commitment Across Tasks in Small Transformers
por: Jacopin, Éric
Publicado: (2026)
por: Jacopin, Éric
Publicado: (2026)
Dynamic Universal Approximation Theory: The Basic Theory for Transformer-based Large Language Models
por: Wang, Wei, et al.
Publicado: (2024)
por: Wang, Wei, et al.
Publicado: (2024)
Verbal Werewolf: Engage Users with Verbalized Agentic Werewolf Game Framework
por: Fan, Qihui, et al.
Publicado: (2025)
por: Fan, Qihui, et al.
Publicado: (2025)
Does Pre-trained Language Model Actually Infer Unseen Links in Knowledge Graph Completion?
por: Sakai, Yusuke, et al.
Publicado: (2023)
por: Sakai, Yusuke, et al.
Publicado: (2023)
Answer Matching Outperforms Multiple Choice for Language Model Evaluation
por: Chandak, Nikhil, et al.
Publicado: (2025)
por: Chandak, Nikhil, et al.
Publicado: (2025)
Deferred Commitment Decoding for Diffusion Language Models
por: Shu, Yingte, et al.
Publicado: (2026)
por: Shu, Yingte, et al.
Publicado: (2026)
ParaPO: Aligning Language Models to Reduce Verbatim Reproduction of Pre-training Data
por: Chen, Tong, et al.
Publicado: (2025)
por: Chen, Tong, et al.
Publicado: (2025)
When Does Multimodality Lead to Better Time Series Forecasting?
por: Zhang, Xiyuan, et al.
Publicado: (2025)
por: Zhang, Xiyuan, et al.
Publicado: (2025)
Are Retrials All You Need? Enhancing Large Language Model Reasoning Without Verbalized Feedback
por: Potamitis, Nearchos, et al.
Publicado: (2025)
por: Potamitis, Nearchos, et al.
Publicado: (2025)
Inference and Verbalization Functions During In-Context Learning
por: Tao, Junyi, et al.
Publicado: (2024)
por: Tao, Junyi, et al.
Publicado: (2024)
Beyond Answers: Transferring Reasoning Capabilities to Smaller LLMs Using Multi-Teacher Knowledge Distillation
por: Tian, Yijun, et al.
Publicado: (2024)
por: Tian, Yijun, et al.
Publicado: (2024)
RAVR: Reference-Answer-guided Variational Reasoning for Large Language Models
por: Lin, Tianqianjin, et al.
Publicado: (2025)
por: Lin, Tianqianjin, et al.
Publicado: (2025)
The Geometric Price of Discrete Logic: Context-driven Manifold Dynamics of Number Representations
por: Zhang, Long, et al.
Publicado: (2026)
por: Zhang, Long, et al.
Publicado: (2026)
Inference-Time Intervention: Eliciting Truthful Answers from a Language Model
por: Li, Kenneth, et al.
Publicado: (2023)
por: Li, Kenneth, et al.
Publicado: (2023)
Explicit Diversity Conditions for Effective Question Answer Generation with Large Language Models
por: Yadav, Vikas, et al.
Publicado: (2024)
por: Yadav, Vikas, et al.
Publicado: (2024)
Measuring and Reducing LLM Hallucination without Gold-Standard Answers
por: Wei, Jiaheng, et al.
Publicado: (2024)
por: Wei, Jiaheng, et al.
Publicado: (2024)
Effective Structured Prompting by Meta-Learning and Representative Verbalizer
por: Jiang, Weisen, et al.
Publicado: (2023)
por: Jiang, Weisen, et al.
Publicado: (2023)
Verbal Process Supervision Elicits Better Coding Agents
por: Chen, Hao-Yuan, et al.
Publicado: (2025)
por: Chen, Hao-Yuan, et al.
Publicado: (2025)
Promote, Suppress, Iterate: How Language Models Answer One-to-Many Factual Queries
por: Yan, Tianyi Lorena, et al.
Publicado: (2025)
por: Yan, Tianyi Lorena, et al.
Publicado: (2025)
RLVF: Learning from Verbal Feedback without Overgeneralization
por: Stephan, Moritz, et al.
Publicado: (2024)
por: Stephan, Moritz, et al.
Publicado: (2024)
ALPINE: Unveiling the Planning Capability of Autoregressive Learning in Language Models
por: Wang, Siwei, et al.
Publicado: (2024)
por: Wang, Siwei, et al.
Publicado: (2024)
When Attention Sink Emerges in Language Models: An Empirical View
por: Gu, Xiangming, et al.
Publicado: (2024)
por: Gu, Xiangming, et al.
Publicado: (2024)
AdaptThink: Reasoning Models Can Learn When to Think
por: Zhang, Jiajie, et al.
Publicado: (2025)
por: Zhang, Jiajie, et al.
Publicado: (2025)
BBox-Adapter: Lightweight Adapting for Black-Box Large Language Models
por: Sun, Haotian, et al.
Publicado: (2024)
por: Sun, Haotian, et al.
Publicado: (2024)
Learning from Reference Answers: Versatile Language Model Alignment without Binary Human Preference Data
por: Zhao, Shuai, et al.
Publicado: (2025)
por: Zhao, Shuai, et al.
Publicado: (2025)
Sparse is Enough in Fine-tuning Pre-trained Large Language Models
por: Song, Weixi, et al.
Publicado: (2023)
por: Song, Weixi, et al.
Publicado: (2023)
How do LLMs Compute Verbal Confidence
por: Kumaran, Dharshan, et al.
Publicado: (2026)
por: Kumaran, Dharshan, et al.
Publicado: (2026)
Theoretical Benefit and Limitation of Diffusion Language Model
por: Feng, Guhao, et al.
Publicado: (2025)
por: Feng, Guhao, et al.
Publicado: (2025)
HiFloat4 Format for Language Model Pre-training on Ascend NPUs
por: Taghian, Mehran, et al.
Publicado: (2026)
por: Taghian, Mehran, et al.
Publicado: (2026)
Investigating Data Contamination for Pre-training Language Models
por: Jiang, Minhao, et al.
Publicado: (2024)
por: Jiang, Minhao, et al.
Publicado: (2024)
Aligning Pre-trained Models for Spoken Language Translation
por: Sedláček, Šimon, et al.
Publicado: (2024)
por: Sedláček, Šimon, et al.
Publicado: (2024)
Sequence-to-Sequence Spanish Pre-trained Language Models
por: Araujo, Vladimir, et al.
Publicado: (2023)
por: Araujo, Vladimir, et al.
Publicado: (2023)
When Large Language Models Meet Vector Databases: A Survey
por: Jing, Zhi, et al.
Publicado: (2024)
por: Jing, Zhi, et al.
Publicado: (2024)
Model Compression and Efficient Inference for Large Language Models: A Survey
por: Wang, Wenxiao, et al.
Publicado: (2024)
por: Wang, Wenxiao, et al.
Publicado: (2024)
Ejemplares similares
-
Authority Inversion in LLM-Mediated Ubiquitous Systems: When Models Trust Users Over Sensors
por: Zhang, Long, et al.
Publicado: (2026) -
Rewarding Intellectual Humility Learning When Not To Answer In Large Language Models
por: Jha, Abha, et al.
Publicado: (2026) -
When Answers Stray from Questions: Hallucination Detection via Question-Answer Orthogonal Decomposition
por: Yao, Siyang, et al.
Publicado: (2026) -
Language Models Can Learn from Verbal Feedback Without Scalar Rewards
por: Luo, Renjie, et al.
Publicado: (2025) -
Hallucination as Trajectory Commitment: Causal Evidence for Asymmetric Attractor Dynamics in Transformer Generation
por: Akarlar, G. Aytug
Publicado: (2026)