Guardado en:
| Autores principales: | Ji, Ziwei, Yu, Lei, Koishekenov, Yeskendir, Bang, Yejin, Hartshorn, Anthony, Schelten, Alan, Zhang, Cheng, Fung, Pascale, Cancedda, Nicola |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2503.14477 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
HalluLens: LLM Hallucination Benchmark
por: Bang, Yejin, et al.
Publicado: (2025)
por: Bang, Yejin, et al.
Publicado: (2025)
Encode, Think, Decode: Scaling test-time reasoning with recursive latent thoughts
por: Koishekenov, Yeskendir, et al.
Publicado: (2025)
por: Koishekenov, Yeskendir, et al.
Publicado: (2025)
Verifying Chain-of-Thought Reasoning via Its Computational Graph
por: Zhao, Zheng, et al.
Publicado: (2025)
por: Zhao, Zheng, et al.
Publicado: (2025)
LLM Internal States Reveal Hallucination Risk Faced With a Query
por: Ji, Ziwei, et al.
Publicado: (2024)
por: Ji, Ziwei, et al.
Publicado: (2024)
Measuring Political Bias in Large Language Models: What Is Said and How It Is Said
por: Bang, Yejin, et al.
Publicado: (2024)
por: Bang, Yejin, et al.
Publicado: (2024)
Survey of Hallucination in Natural Language Generation
por: Ji, Ziwei, et al.
Publicado: (2022)
por: Ji, Ziwei, et al.
Publicado: (2022)
High-Dimension Human Value Representation in Large Language Models
por: Cahyawijaya, Samuel, et al.
Publicado: (2024)
por: Cahyawijaya, Samuel, et al.
Publicado: (2024)
Negative Object Presence Evaluation (NOPE) to Measure Object Hallucination in Vision-Language Models
por: Lovenia, Holy, et al.
Publicado: (2023)
por: Lovenia, Holy, et al.
Publicado: (2023)
Spectral Filters, Dark Signals, and Attention Sinks
por: Cancedda, Nicola
Publicado: (2024)
por: Cancedda, Nicola
Publicado: (2024)
WorldPrediction: A Benchmark for High-level World Modeling and Long-horizon Procedural Planning
por: Chen, Delong, et al.
Publicado: (2025)
por: Chen, Delong, et al.
Publicado: (2025)
Hallucination reduction with CASAL: Contrastive Activation Steering For Amortized Learning
por: Wannan, et al.
Publicado: (2025)
por: Wannan, et al.
Publicado: (2025)
Robust LLM safeguarding via refusal feature adversarial training
por: Yu, Lei, et al.
Publicado: (2024)
por: Yu, Lei, et al.
Publicado: (2024)
Calibrating LLM Judges: Linear Probes for Fast and Reliable Uncertainty Estimation
por: Radharapu, Bhaktipriya, et al.
Publicado: (2025)
por: Radharapu, Bhaktipriya, et al.
Publicado: (2025)
Planning with Reasoning using Vision Language World Model
por: Chen, Delong, et al.
Publicado: (2025)
por: Chen, Delong, et al.
Publicado: (2025)
Know When To Stop: A Study of Semantic Drift in Text Generation
por: Spataru, Ava, et al.
Publicado: (2024)
por: Spataru, Ava, et al.
Publicado: (2024)
Calibrating Verbalized Probabilities for Large Language Models
por: Wang, Cheng, et al.
Publicado: (2024)
por: Wang, Cheng, et al.
Publicado: (2024)
Mitigating Hallucination in Large Vision-Language Models via Adaptive Attention Calibration
por: Fazli, Mehrdad, et al.
Publicado: (2025)
por: Fazli, Mehrdad, et al.
Publicado: (2025)
Uncertainty-Based Abstention in LLMs Improves Safety and Reduces Hallucinations
por: Tomani, Christian, et al.
Publicado: (2024)
por: Tomani, Christian, et al.
Publicado: (2024)
Reducing Tool Hallucination via Reliability Alignment
por: Xu, Hongshen, et al.
Publicado: (2024)
por: Xu, Hongshen, et al.
Publicado: (2024)
Calibrating Verbalized Confidence with Self-Generated Distractors
por: Wang, Victor, et al.
Publicado: (2025)
por: Wang, Victor, et al.
Publicado: (2025)
LLMs Are Few-Shot In-Context Low-Resource Language Learners
por: Cahyawijaya, Samuel, et al.
Publicado: (2024)
por: Cahyawijaya, Samuel, et al.
Publicado: (2024)
Delusions of Large Language Models
por: Xu, Hongshen, et al.
Publicado: (2025)
por: Xu, Hongshen, et al.
Publicado: (2025)
Anthropomimetic Uncertainty: What Verbalized Uncertainty in Language Models is Missing
por: Ulmer, Dennis, et al.
Publicado: (2025)
por: Ulmer, Dennis, et al.
Publicado: (2025)
NAACL: Noise-AwAre Verbal Confidence Calibration for Robust LLMs in RAG Systems
por: Liu, Jiayu, et al.
Publicado: (2026)
por: Liu, Jiayu, et al.
Publicado: (2026)
Knowledge Overshadowing Causes Amalgamated Hallucination in Large Language Models
por: Zhang, Yuji, et al.
Publicado: (2024)
por: Zhang, Yuji, et al.
Publicado: (2024)
Why and How LLMs Hallucinate: Connecting the Dots with Subsequence Associations
por: Sun, Yiyou, et al.
Publicado: (2025)
por: Sun, Yiyou, et al.
Publicado: (2025)
The Law of Knowledge Overshadowing: Towards Understanding, Predicting, and Preventing LLM Hallucination
por: Zhang, Yuji, et al.
Publicado: (2025)
por: Zhang, Yuji, et al.
Publicado: (2025)
High-Dimensional Interlingual Representations of Large Language Models
por: Wilie, Bryan, et al.
Publicado: (2025)
por: Wilie, Bryan, et al.
Publicado: (2025)
HALoGEN: Fantastic LLM Hallucinations and Where to Find Them
por: Ravichander, Abhilasha, et al.
Publicado: (2025)
por: Ravichander, Abhilasha, et al.
Publicado: (2025)
ANAH: Analytical Annotation of Hallucinations in Large Language Models
por: Ji, Ziwei, et al.
Publicado: (2024)
por: Ji, Ziwei, et al.
Publicado: (2024)
Scalable Token-Level Hallucination Detection in Large Language Models
por: Min, Rui, et al.
Publicado: (2026)
por: Min, Rui, et al.
Publicado: (2026)
RePPL: Recalibrating Perplexity by Uncertainty in Semantic Propagation and Language Generation for Explainable QA Hallucination Detection
por: Huang, Yiming, et al.
Publicado: (2025)
por: Huang, Yiming, et al.
Publicado: (2025)
Source2Synth: Synthetic Data Generation and Curation Grounded in Real Data Sources
por: Lupidi, Alisia, et al.
Publicado: (2024)
por: Lupidi, Alisia, et al.
Publicado: (2024)
ANAH-v2: Scaling Analytical Hallucination Annotation of Large Language Models
por: Gu, Yuzhe, et al.
Publicado: (2024)
por: Gu, Yuzhe, et al.
Publicado: (2024)
Calibrated Language Models Must Hallucinate
por: Kalai, Adam Tauman, et al.
Publicado: (2023)
por: Kalai, Adam Tauman, et al.
Publicado: (2023)
What Makes for Good Image Captions?
por: Chen, Delong, et al.
Publicado: (2024)
por: Chen, Delong, et al.
Publicado: (2024)
Verbal Werewolf: Engage Users with Verbalized Agentic Werewolf Game Framework
por: Fan, Qihui, et al.
Publicado: (2025)
por: Fan, Qihui, et al.
Publicado: (2025)
Belief Revision: The Adaptability of Large Language Models Reasoning
por: Wilie, Bryan, et al.
Publicado: (2024)
por: Wilie, Bryan, et al.
Publicado: (2024)
Grounding Language with Vision: A Conditional Mutual Information Calibrated Decoding Strategy for Reducing Hallucinations in LVLMs
por: Fang, Hao, et al.
Publicado: (2025)
por: Fang, Hao, et al.
Publicado: (2025)
Think More, Hallucinate Less: Mitigating Hallucinations via Dual Process of Fast and Slow Thinking
por: Cheng, Xiaoxue, et al.
Publicado: (2025)
por: Cheng, Xiaoxue, et al.
Publicado: (2025)
Ejemplares similares
-
HalluLens: LLM Hallucination Benchmark
por: Bang, Yejin, et al.
Publicado: (2025) -
Encode, Think, Decode: Scaling test-time reasoning with recursive latent thoughts
por: Koishekenov, Yeskendir, et al.
Publicado: (2025) -
Verifying Chain-of-Thought Reasoning via Its Computational Graph
por: Zhao, Zheng, et al.
Publicado: (2025) -
LLM Internal States Reveal Hallucination Risk Faced With a Query
por: Ji, Ziwei, et al.
Publicado: (2024) -
Measuring Political Bias in Large Language Models: What Is Said and How It Is Said
por: Bang, Yejin, et al.
Publicado: (2024)