On Large Language Models' Hallucination with Regard to Known Facts
Fuente:
arXiv
Guardado en:
| Autores principales: | Jiang, Che, Qi, Biqing, Hong, Xiangyu, Fu, Dayuan, Cheng, Yang, Meng, Fandong, Yu, Mo, Zhou, Bowen, Zhou, Jie |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
On the token distance modeling ability of higher RoPE attention dimension
por: Hong, Xiangyu, et al.
Publicado: (2024)
por: Hong, Xiangyu, et al.
Publicado: (2024)
MSI-Agent: Incorporating Multi-Scale Insight into Embodied Agents for Superior Planning and Decision-Making
por: Fu, Dayuan, et al.
Publicado: (2024)
por: Fu, Dayuan, et al.
Publicado: (2024)
Accelerating Inference in Large Language Models with a Unified Layer Skipping Strategy
por: Liu, Yijin, et al.
Publicado: (2024)
por: Liu, Yijin, et al.
Publicado: (2024)
DePass: Unified Feature Attributing by Simple Decomposed Forward Pass
por: Hong, Xiangyu, et al.
Publicado: (2025)
por: Hong, Xiangyu, et al.
Publicado: (2025)
Mitigating Hallucinations in Large Vision-Language Models with Internal Fact-based Contrastive Decoding
por: Wang, Chao, et al.
Publicado: (2025)
por: Wang, Chao, et al.
Publicado: (2025)
TEAL: Tokenize and Embed ALL for Multi-modal Large Language Models
por: Yang, Zhen, et al.
Publicado: (2023)
por: Yang, Zhen, et al.
Publicado: (2023)
Beyond Next Token Prediction: Patch-Level Training for Large Language Models
por: Shao, Chenze, et al.
Publicado: (2024)
por: Shao, Chenze, et al.
Publicado: (2024)
TIM: Teaching Large Language Models to Translate with Comparison
por: Zeng, Jiali, et al.
Publicado: (2023)
por: Zeng, Jiali, et al.
Publicado: (2023)
Unsupervised Information Refinement Training of Large Language Models for Retrieval-Augmented Generation
por: Xu, Shicheng, et al.
Publicado: (2024)
por: Xu, Shicheng, et al.
Publicado: (2024)
Large Language Models Are Not Robust Multiple Choice Selectors
por: Zheng, Chujie, et al.
Publicado: (2023)
por: Zheng, Chujie, et al.
Publicado: (2023)
Generative Multi-Modal Knowledge Retrieval with Large Language Models
por: Long, Xinwei, et al.
Publicado: (2024)
por: Long, Xinwei, et al.
Publicado: (2024)
Improving Machine Translation with Large Language Models: A Preliminary Study with Cooperative Decoding
por: Zeng, Jiali, et al.
Publicado: (2023)
por: Zeng, Jiali, et al.
Publicado: (2023)
Towards Building Specialized Generalist AI with System 1 and System 2 Fusion
por: Zhang, Kaiyan, et al.
Publicado: (2024)
por: Zhang, Kaiyan, et al.
Publicado: (2024)
An Empirical Study of Catastrophic Forgetting in Large Language Models During Continual Fine-tuning
por: Luo, Yun, et al.
Publicado: (2023)
por: Luo, Yun, et al.
Publicado: (2023)
MiniPLM: Knowledge Distillation for Pre-Training Language Models
por: Gu, Yuxian, et al.
Publicado: (2024)
por: Gu, Yuxian, et al.
Publicado: (2024)
CRAT: A Multi-Agent Framework for Causality-Enhanced Reflective and Retrieval-Augmented Translation with Large Language Models
por: Chen, Meiqi, et al.
Publicado: (2024)
por: Chen, Meiqi, et al.
Publicado: (2024)
CoGenesis: A Framework Collaborating Large and Small Language Models for Secure Context-Aware Instruction Following
por: Zhang, Kaiyan, et al.
Publicado: (2024)
por: Zhang, Kaiyan, et al.
Publicado: (2024)
Continuous Autoregressive Language Models
por: Shao, Chenze, et al.
Publicado: (2025)
por: Shao, Chenze, et al.
Publicado: (2025)
DARE: Diffusion Large Language Models Alignment and Reinforcement Executor
por: Yang, Jingyi, et al.
Publicado: (2026)
por: Yang, Jingyi, et al.
Publicado: (2026)
Fast and Slow Generating: An Empirical Study on Large and Small Language Models Collaborative Decoding
por: Zhang, Kaiyan, et al.
Publicado: (2024)
por: Zhang, Kaiyan, et al.
Publicado: (2024)
Beyond Facts: Evaluating Intent Hallucination in Large Language Models
por: Hao, Yijie, et al.
Publicado: (2025)
por: Hao, Yijie, et al.
Publicado: (2025)
THOR-MoE: Hierarchical Task-Guided and Context-Responsive Routing for Neural Machine Translation
por: Liang, Yunlong, et al.
Publicado: (2025)
por: Liang, Yunlong, et al.
Publicado: (2025)
Figure It Out: Improve the Frontier of Reasoning with Executable Visual States
por: Chen, Meiqi, et al.
Publicado: (2025)
por: Chen, Meiqi, et al.
Publicado: (2025)
TasTe: Teaching Large Language Models to Translate through Self-Reflection
por: Wang, Yutong, et al.
Publicado: (2024)
por: Wang, Yutong, et al.
Publicado: (2024)
HGMEM: Hypergraph-based Working Memory to Improve Multi-step RAG for Long-Context Complex Relational Modeling
por: Zhou, Chulun, et al.
Publicado: (2025)
por: Zhou, Chulun, et al.
Publicado: (2025)
Language Generation with Strictly Proper Scoring Rules
por: Shao, Chenze, et al.
Publicado: (2024)
por: Shao, Chenze, et al.
Publicado: (2024)
CM-Align: Consistency-based Multilingual Alignment for Large Language Models
por: Zhang, Xue, et al.
Publicado: (2025)
por: Zhang, Xue, et al.
Publicado: (2025)
LLaVE: Large Language and Vision Embedding Models with Hardness-Weighted Contrastive Learning
por: Lan, Zhibin, et al.
Publicado: (2025)
por: Lan, Zhibin, et al.
Publicado: (2025)
CSCD-NS: a Chinese Spelling Check Dataset for Native Speakers
por: Hu, Yong, et al.
Publicado: (2022)
por: Hu, Yong, et al.
Publicado: (2022)
DeepTrans: Deep Reasoning Translation via Reinforcement Learning
por: Wang, Jiaan, et al.
Publicado: (2025)
por: Wang, Jiaan, et al.
Publicado: (2025)
ExTrans: Multilingual Deep Reasoning Translation via Exemplar-Enhanced Reinforcement Learning
por: Wang, Jiaan, et al.
Publicado: (2025)
por: Wang, Jiaan, et al.
Publicado: (2025)
On Prompt-Driven Safeguarding for Large Language Models
por: Zheng, Chujie, et al.
Publicado: (2024)
por: Zheng, Chujie, et al.
Publicado: (2024)
Dense Retrievers Can Fail on Simple Queries: Revealing The Granularity Dilemma of Embeddings
por: Xu, Liyan, et al.
Publicado: (2025)
por: Xu, Liyan, et al.
Publicado: (2025)
EAG: Extract and Generate Multi-way Aligned Corpus for Complete Multi-lingual Neural Machine Translation
por: Xu, Yulin, et al.
Publicado: (2022)
por: Xu, Yulin, et al.
Publicado: (2022)
Large Language Models as Biomedical Hypothesis Generators: A Comprehensive Evaluation
por: Qi, Biqing, et al.
Publicado: (2024)
por: Qi, Biqing, et al.
Publicado: (2024)
LongDPO: Unlock Better Long-form Generation Abilities for LLMs via Critique-augmented Stepwise Information
por: Ping, Bowen, et al.
Publicado: (2025)
por: Ping, Bowen, et al.
Publicado: (2025)
An Empirical Study of Many-to-Many Summarization with Large Language Models
por: Wang, Jiaan, et al.
Publicado: (2025)
por: Wang, Jiaan, et al.
Publicado: (2025)
A Dual-Space Framework for General Knowledge Distillation of Large Language Models
por: Zhang, Xue, et al.
Publicado: (2025)
por: Zhang, Xue, et al.
Publicado: (2025)
Efficient Speech Language Modeling via Energy Distance in Continuous Latent Space
por: Ma, Zhengrui, et al.
Publicado: (2025)
por: Ma, Zhengrui, et al.
Publicado: (2025)
Grasping the Essentials: Tailoring Large Language Models for Zero-Shot Relation Extraction
por: Zhou, Sizhe, et al.
Publicado: (2024)
por: Zhou, Sizhe, et al.
Publicado: (2024)
Ejemplares similares
-
On the token distance modeling ability of higher RoPE attention dimension
por: Hong, Xiangyu, et al.
Publicado: (2024) -
MSI-Agent: Incorporating Multi-Scale Insight into Embodied Agents for Superior Planning and Decision-Making
por: Fu, Dayuan, et al.
Publicado: (2024) -
Accelerating Inference in Large Language Models with a Unified Layer Skipping Strategy
por: Liu, Yijin, et al.
Publicado: (2024) -
DePass: Unified Feature Attributing by Simple Decomposed Forward Pass
por: Hong, Xiangyu, et al.
Publicado: (2025) -
Mitigating Hallucinations in Large Vision-Language Models with Internal Fact-based Contrastive Decoding
por: Wang, Chao, et al.
Publicado: (2025)