Improving Factuality with Explicit Working Memory
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Chen, Mingda, Li, Yang, Padthe, Karthik, Shao, Rulin, Sun, Alicia, Zettlemoyer, Luke, Ghosh, Gargi, Yih, Wen-tau |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Learning to Reason for Factuality
von: Chen, Xilun, et al.
Veröffentlicht: (2025)
von: Chen, Xilun, et al.
Veröffentlicht: (2025)
Memory Layers at Scale
von: Berges, Vincent-Pierre, et al.
Veröffentlicht: (2024)
von: Berges, Vincent-Pierre, et al.
Veröffentlicht: (2024)
FACTORY: A Challenging Human-Verified Prompt Set for Long-Form Factuality
von: Chen, Mingda, et al.
Veröffentlicht: (2025)
von: Chen, Mingda, et al.
Veröffentlicht: (2025)
Few-Shot Data Synthesis for Open Domain Multi-Hop Question Answering
von: Chen, Mingda, et al.
Veröffentlicht: (2023)
von: Chen, Mingda, et al.
Veröffentlicht: (2023)
Procedural Knowledge at Scale Improves Reasoning
von: Wu, Di, et al.
Veröffentlicht: (2026)
von: Wu, Di, et al.
Veröffentlicht: (2026)
Continual Learning via Sparse Memory Finetuning
von: Lin, Jessy, et al.
Veröffentlicht: (2025)
von: Lin, Jessy, et al.
Veröffentlicht: (2025)
Anchored Decoding: Provably Reducing Copyright Risk for Any Language Model
von: He, Jacqueline, et al.
Veröffentlicht: (2026)
von: He, Jacqueline, et al.
Veröffentlicht: (2026)
ImpRAG: Retrieval-Augmented Generation with Implicit Queries
von: Zhang, Wenzheng, et al.
Veröffentlicht: (2025)
von: Zhang, Wenzheng, et al.
Veröffentlicht: (2025)
Mixture-of-Transformers: A Sparse and Scalable Architecture for Multi-Modal Foundation Models
von: Liang, Weixin, et al.
Veröffentlicht: (2024)
von: Liang, Weixin, et al.
Veröffentlicht: (2024)
Text Quality-Based Pruning for Efficient Training of Language Models
von: Sharma, Vasu, et al.
Veröffentlicht: (2024)
von: Sharma, Vasu, et al.
Veröffentlicht: (2024)
FLAME: Factuality-Aware Alignment for Large Language Models
von: Lin, Sheng-Chieh, et al.
Veröffentlicht: (2024)
von: Lin, Sheng-Chieh, et al.
Veröffentlicht: (2024)
Reliable, Adaptable, and Attributable Language Models with Retrieval
von: Asai, Akari, et al.
Veröffentlicht: (2024)
von: Asai, Akari, et al.
Veröffentlicht: (2024)
Altogether: Image Captioning via Re-aligning Alt-text
von: Xu, Hu, et al.
Veröffentlicht: (2024)
von: Xu, Hu, et al.
Veröffentlicht: (2024)
ReasonIR: Training Retrievers for Reasoning Tasks
von: Shao, Rulin, et al.
Veröffentlicht: (2025)
von: Shao, Rulin, et al.
Veröffentlicht: (2025)
SCRIBES: Web-Scale Script-Based Semi-Structured Data Extraction with Reinforcement Learning
von: Liu, Shicheng, et al.
Veröffentlicht: (2025)
von: Liu, Shicheng, et al.
Veröffentlicht: (2025)
PrismRAG: Boosting RAG Factuality with Distractor Resilience and Strategized Reasoning
von: Kachuee, Mohammad, et al.
Veröffentlicht: (2025)
von: Kachuee, Mohammad, et al.
Veröffentlicht: (2025)
Compute Optimal Tokenization
von: Limisiewicz, Tomasz, et al.
Veröffentlicht: (2026)
von: Limisiewicz, Tomasz, et al.
Veröffentlicht: (2026)
Learning Facts at Scale with Active Reading
von: Lin, Jessy, et al.
Veröffentlicht: (2025)
von: Lin, Jessy, et al.
Veröffentlicht: (2025)
Nearest Neighbor Speculative Decoding for LLM Generation and Attribution
von: Li, Minghan, et al.
Veröffentlicht: (2024)
von: Li, Minghan, et al.
Veröffentlicht: (2024)
DRAMA: Diverse Augmentation from Large Language Models to Smaller Dense Retrievers
von: Ma, Xueguang, et al.
Veröffentlicht: (2025)
von: Ma, Xueguang, et al.
Veröffentlicht: (2025)
Group-Level Data Selection for Efficient Pretraining
von: Yu, Zichun, et al.
Veröffentlicht: (2025)
von: Yu, Zichun, et al.
Veröffentlicht: (2025)
Fast Byte Latent Transformer
von: Kallini, Julie, et al.
Veröffentlicht: (2026)
von: Kallini, Julie, et al.
Veröffentlicht: (2026)
Meta CLIP 2: A Worldwide Scaling Recipe
von: Chuang, Yung-Sung, et al.
Veröffentlicht: (2025)
von: Chuang, Yung-Sung, et al.
Veröffentlicht: (2025)
RA-DIT: Retrieval-Augmented Dual Instruction Tuning
von: Lin, Xi Victoria, et al.
Veröffentlicht: (2023)
von: Lin, Xi Victoria, et al.
Veröffentlicht: (2023)
TruthRL: Incentivizing Truthful LLMs via Reinforcement Learning
von: Wei, Zhepei, et al.
Veröffentlicht: (2025)
von: Wei, Zhepei, et al.
Veröffentlicht: (2025)
Demystifying CLIP Data
von: Xu, Hu, et al.
Veröffentlicht: (2023)
von: Xu, Hu, et al.
Veröffentlicht: (2023)
Scaling Retrieval-Based Language Models with a Trillion-Token Datastore
von: Shao, Rulin, et al.
Veröffentlicht: (2024)
von: Shao, Rulin, et al.
Veröffentlicht: (2024)
Improving Faithfulness of Abstractive Summarization by Controlling Confounding Effect of Irrelevant Sentences
von: Ghoshal, Asish, et al.
Veröffentlicht: (2022)
von: Ghoshal, Asish, et al.
Veröffentlicht: (2022)
Micro Language Models Enable Instant Responses
von: Cheng, Wen, et al.
Veröffentlicht: (2026)
von: Cheng, Wen, et al.
Veröffentlicht: (2026)
DRIFT: Detecting Representational Inconsistencies for Factual Truthfulness
von: Bhatnagar, Rohan, et al.
Veröffentlicht: (2026)
von: Bhatnagar, Rohan, et al.
Veröffentlicht: (2026)
DR Tulu: Reinforcement Learning with Evolving Rubrics for Deep Research
von: Shao, Rulin, et al.
Veröffentlicht: (2025)
von: Shao, Rulin, et al.
Veröffentlicht: (2025)
NaturalThoughts: Selecting and Distilling Reasoning Traces for General Reasoning Tasks
von: Li, Yang, et al.
Veröffentlicht: (2025)
von: Li, Yang, et al.
Veröffentlicht: (2025)
Comparing Hallucination Detection Metrics for Multilingual Generation
von: Kang, Haoqiang, et al.
Veröffentlicht: (2024)
von: Kang, Haoqiang, et al.
Veröffentlicht: (2024)
Frustratingly Simple Retrieval Improves Challenging, Reasoning-Intensive Benchmarks
von: Lyu, Xinxi, et al.
Veröffentlicht: (2025)
von: Lyu, Xinxi, et al.
Veröffentlicht: (2025)
MoDE: CLIP Data Experts via Clustering
von: Ma, Jiawei, et al.
Veröffentlicht: (2024)
von: Ma, Jiawei, et al.
Veröffentlicht: (2024)
(Mis)Fitting: A Survey of Scaling Laws
von: Li, Margaret, et al.
Veröffentlicht: (2025)
von: Li, Margaret, et al.
Veröffentlicht: (2025)
Improving Factuality in Large Language Models via Decoding-Time Hallucinatory and Truthful Comparators
von: Yang, Dingkang, et al.
Veröffentlicht: (2024)
von: Yang, Dingkang, et al.
Veröffentlicht: (2024)
The Curious Case of Factuality Finetuning: Models' Internal Beliefs Can Improve Factuality
von: Newman, Benjamin, et al.
Veröffentlicht: (2025)
von: Newman, Benjamin, et al.
Veröffentlicht: (2025)
Slicing and Dicing: Configuring Optimal Mixtures of Experts
von: Li, Margaret, et al.
Veröffentlicht: (2026)
von: Li, Margaret, et al.
Veröffentlicht: (2026)
ART: Attention Replacement Technique to Improve Factuality in LLMs
von: Luo, Ziqin, et al.
Veröffentlicht: (2026)
von: Luo, Ziqin, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
Learning to Reason for Factuality
von: Chen, Xilun, et al.
Veröffentlicht: (2025) -
Memory Layers at Scale
von: Berges, Vincent-Pierre, et al.
Veröffentlicht: (2024) -
FACTORY: A Challenging Human-Verified Prompt Set for Long-Form Factuality
von: Chen, Mingda, et al.
Veröffentlicht: (2025) -
Few-Shot Data Synthesis for Open Domain Multi-Hop Question Answering
von: Chen, Mingda, et al.
Veröffentlicht: (2023) -
Procedural Knowledge at Scale Improves Reasoning
von: Wu, Di, et al.
Veröffentlicht: (2026)