SH2: Self-Highlighted Hesitation Helps You Decode More Truthfully
Fuente:
arXiv
Guardado en:
| Autores principales: | Kai, Jushi, Zhang, Tianhang, Hu, Hai, Lin, Zhouhan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Leveraging Grammar Induction for Language Understanding and Generation
por: Kai, Jushi, et al.
Publicado: (2024)
por: Kai, Jushi, et al.
Publicado: (2024)
FreqKV: Key-Value Compression in Frequency Domain for Context Window Extension
por: Kai, Jushi, et al.
Publicado: (2025)
por: Kai, Jushi, et al.
Publicado: (2025)
CoDAR: Continuous Diffusion Language Models are More Powerful Than You Think
por: Shen, Junzhe, et al.
Publicado: (2026)
por: Shen, Junzhe, et al.
Publicado: (2026)
One Size Does Not Fit All: Token-Wise Adaptive Compression for KV Cache
por: Lu, Liming, et al.
Publicado: (2026)
por: Lu, Liming, et al.
Publicado: (2026)
Memory Decoder: A Pretrained, Plug-and-Play Memory for Large Language Models
por: Cao, Jiaqi, et al.
Publicado: (2025)
por: Cao, Jiaqi, et al.
Publicado: (2025)
Debating with More Persuasive LLMs Leads to More Truthful Answers
por: Khan, Akbir, et al.
Publicado: (2024)
por: Khan, Akbir, et al.
Publicado: (2024)
FlowLM: Few-Step Language Modeling via Diffusion-to-Flow Adaptation
por: Zhang, Runzhe, et al.
Publicado: (2026)
por: Zhang, Runzhe, et al.
Publicado: (2026)
Pipeline Parallelism is All You Need for Optimized Early-Exit Based Self-Speculative Decoding
por: Li, Ruanjun, et al.
Publicado: (2025)
por: Li, Ruanjun, et al.
Publicado: (2025)
Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model
por: Ding, Bowen, et al.
Publicado: (2025)
por: Ding, Bowen, et al.
Publicado: (2025)
Fourier Compressor: Frequency-Domain Visual Token Compression for Vision-Language Models
por: Wang, Huanyu, et al.
Publicado: (2025)
por: Wang, Huanyu, et al.
Publicado: (2025)
Your Teacher Can't Help You Here: Combating Supervision Fidelity Decay in On-Policy Distillation
por: Liu, Yanjiang, et al.
Publicado: (2026)
por: Liu, Yanjiang, et al.
Publicado: (2026)
More Agents Is All You Need
por: Li, Junyou, et al.
Publicado: (2024)
por: Li, Junyou, et al.
Publicado: (2024)
Critical Data Size of Language Models from a Grokking Perspective
por: Zhu, Xuekai, et al.
Publicado: (2024)
por: Zhu, Xuekai, et al.
Publicado: (2024)
Consistent Paths Lead to Truth: Self-Rewarding Reinforcement Learning for LLM Reasoning
por: Zhang, Kongcheng, et al.
Publicado: (2025)
por: Zhang, Kongcheng, et al.
Publicado: (2025)
Look at the Text: Instruction-Tuned Language Models are More Robust Multiple Choice Selectors than You Think
por: Wang, Xinpeng, et al.
Publicado: (2024)
por: Wang, Xinpeng, et al.
Publicado: (2024)
Does Thinking More always Help? Mirage of Test-Time Scaling in Reasoning Models
por: Ghosal, Soumya Suvra, et al.
Publicado: (2025)
por: Ghosal, Soumya Suvra, et al.
Publicado: (2025)
Mirror-Consistency: Harnessing Inconsistency in Majority Voting
por: Huang, Siyuan, et al.
Publicado: (2024)
por: Huang, Siyuan, et al.
Publicado: (2024)
Enhancing LLM Reasoning via Non-Human-Like Reasoning Path Preference Optimization
por: Lu, Junjie, et al.
Publicado: (2025)
por: Lu, Junjie, et al.
Publicado: (2025)
HARP: Hesitation-Aware Reframing in Transformer Inference Pass
por: Storaï, Romain, et al.
Publicado: (2024)
por: Storaï, Romain, et al.
Publicado: (2024)
More Compute Is What You Need
por: Guo, Zhen
Publicado: (2024)
por: Guo, Zhen
Publicado: (2024)
HuRef: HUman-REadable Fingerprint for Large Language Models
por: Zeng, Boyi, et al.
Publicado: (2023)
por: Zeng, Boyi, et al.
Publicado: (2023)
RACER: Retrieval-Augmented Contextual Rapid Speculative Decoding
por: Zhang, Zihong, et al.
Publicado: (2026)
por: Zhang, Zihong, et al.
Publicado: (2026)
TruthStance: An Annotated Dataset of Conversations on Truth Social
por: Ameen, Fathima, et al.
Publicado: (2026)
por: Ameen, Fathima, et al.
Publicado: (2026)
Context-level Language Modeling by Learning Predictive Context Embeddings
por: Dai, Beiya, et al.
Publicado: (2025)
por: Dai, Beiya, et al.
Publicado: (2025)
Next Concept Prediction in Discrete Latent Space Leads to Stronger Language Models
por: Liu, Yuliang, et al.
Publicado: (2026)
por: Liu, Yuliang, et al.
Publicado: (2026)
LycheeDecode: Accelerating Long-Context LLM Inference via Hybrid-Head Sparse Decoding
por: Lin, Gang, et al.
Publicado: (2026)
por: Lin, Gang, et al.
Publicado: (2026)
TruthEval: A Dataset to Evaluate LLM Truthfulness and Reliability
por: Khatun, Aisha, et al.
Publicado: (2024)
por: Khatun, Aisha, et al.
Publicado: (2024)
Truth Sleuth and Trend Bender: AI Agents to fact-check YouTube videos and influence opinions
por: Logé, Cécile, et al.
Publicado: (2025)
por: Logé, Cécile, et al.
Publicado: (2025)
YouTube Comments Decoded: Leveraging LLMs for Low Resource Language Classification
por: Deroy, Aniket, et al.
Publicado: (2024)
por: Deroy, Aniket, et al.
Publicado: (2024)
Towards Supporting Legal Argumentation with NLP: Is More Data Really All You Need?
por: Santosh, T. Y. S. S, et al.
Publicado: (2024)
por: Santosh, T. Y. S. S, et al.
Publicado: (2024)
Truth Knows No Language: Evaluating Truthfulness Beyond English
por: Figueras, Blanca Calvo, et al.
Publicado: (2025)
por: Figueras, Blanca Calvo, et al.
Publicado: (2025)
Importance Weighting Can Help Large Language Models Self-Improve
por: Jiang, Chunyang, et al.
Publicado: (2024)
por: Jiang, Chunyang, et al.
Publicado: (2024)
Do Before You Judge: Self-Reference as a Pathway to Better LLM Evaluation
por: Lin, Wei-Hsiang, et al.
Publicado: (2025)
por: Lin, Wei-Hsiang, et al.
Publicado: (2025)
TruthRL: Incentivizing Truthful LLMs via Reinforcement Learning
por: Wei, Zhepei, et al.
Publicado: (2025)
por: Wei, Zhepei, et al.
Publicado: (2025)
Just Ask One More Time! Self-Agreement Improves Reasoning of Language Models in (Almost) All Scenarios
por: Lin, Lei, et al.
Publicado: (2023)
por: Lin, Lei, et al.
Publicado: (2023)
How Context Shapes Truth: Geometric Transformations of Statement-level Truth Representations in LLMs
por: Adarsh, Shivam, et al.
Publicado: (2026)
por: Adarsh, Shivam, et al.
Publicado: (2026)
Decoding at the Speed of Thought: Harnessing Parallel Decoding of Lexical Units for LLMs
por: Sun, Chenxi, et al.
Publicado: (2024)
por: Sun, Chenxi, et al.
Publicado: (2024)
CompassJudger-1: All-in-one Judge Model Helps Model Evaluation and Evolution
por: Cao, Maosong, et al.
Publicado: (2024)
por: Cao, Maosong, et al.
Publicado: (2024)
How Much Can RAG Help the Reasoning of LLM?
por: Liu, Jingyu, et al.
Publicado: (2024)
por: Liu, Jingyu, et al.
Publicado: (2024)
Think Twice Before You Write -- an Entropy-based Decoding Strategy to Enhance LLM Reasoning
por: He, Jiashu, et al.
Publicado: (2026)
por: He, Jiashu, et al.
Publicado: (2026)
Ejemplares similares
-
Leveraging Grammar Induction for Language Understanding and Generation
por: Kai, Jushi, et al.
Publicado: (2024) -
FreqKV: Key-Value Compression in Frequency Domain for Context Window Extension
por: Kai, Jushi, et al.
Publicado: (2025) -
CoDAR: Continuous Diffusion Language Models are More Powerful Than You Think
por: Shen, Junzhe, et al.
Publicado: (2026) -
One Size Does Not Fit All: Token-Wise Adaptive Compression for KV Cache
por: Lu, Liming, et al.
Publicado: (2026) -
Memory Decoder: A Pretrained, Plug-and-Play Memory for Large Language Models
por: Cao, Jiaqi, et al.
Publicado: (2025)