Gespeichert in:
| Hauptverfasser: | Lin, Xi Victoria, Chen, Xilun, Chen, Mingda, Shi, Weijia, Lomeli, Maria, James, Rich, Rodriguez, Pedro, Kahn, Jacob, Szilvasy, Gergely, Lewis, Mike, Zettlemoyer, Luke, Yih, Scott |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2023
|
| Schlagworte: | |
| Online-Zugang: | https://arxiv.org/abs/2310.01352 |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
In-context Pretraining: Language Modeling Beyond Document Boundaries
von: Shi, Weijia, et al.
Veröffentlicht: (2023)
von: Shi, Weijia, et al.
Veröffentlicht: (2023)
Few-Shot Data Synthesis for Open Domain Multi-Hop Question Answering
von: Chen, Mingda, et al.
Veröffentlicht: (2023)
von: Chen, Mingda, et al.
Veröffentlicht: (2023)
ImpRAG: Retrieval-Augmented Generation with Implicit Queries
von: Zhang, Wenzheng, et al.
Veröffentlicht: (2025)
von: Zhang, Wenzheng, et al.
Veröffentlicht: (2025)
DRAMA: Diverse Augmentation from Large Language Models to Smaller Dense Retrievers
von: Ma, Xueguang, et al.
Veröffentlicht: (2025)
von: Ma, Xueguang, et al.
Veröffentlicht: (2025)
FACTORY: A Challenging Human-Verified Prompt Set for Long-Form Factuality
von: Chen, Mingda, et al.
Veröffentlicht: (2025)
von: Chen, Mingda, et al.
Veröffentlicht: (2025)
Self-Pruned Key-Value Attention: Learning When to Write by Predicting Future Utility
von: Szilvasy, Gergely, et al.
Veröffentlicht: (2026)
von: Szilvasy, Gergely, et al.
Veröffentlicht: (2026)
Improving Factuality with Explicit Working Memory
von: Chen, Mingda, et al.
Veröffentlicht: (2024)
von: Chen, Mingda, et al.
Veröffentlicht: (2024)
Inference-time sparse attention with asymmetric indexing
von: Mazaré, Pierre-Emmanuel, et al.
Veröffentlicht: (2025)
von: Mazaré, Pierre-Emmanuel, et al.
Veröffentlicht: (2025)
Nearest Neighbor Speculative Decoding for LLM Generation and Attribution
von: Li, Minghan, et al.
Veröffentlicht: (2024)
von: Li, Minghan, et al.
Veröffentlicht: (2024)
Train for Truth, Keep the Skills: Binary Retrieval-Augmented Reward Mitigates Hallucinations
von: Chen, Tong, et al.
Veröffentlicht: (2025)
von: Chen, Tong, et al.
Veröffentlicht: (2025)
Self-Alignment with Instruction Backtranslation
von: Li, Xian, et al.
Veröffentlicht: (2023)
von: Li, Xian, et al.
Veröffentlicht: (2023)
Reliable, Adaptable, and Attributable Language Models with Retrieval
von: Asai, Akari, et al.
Veröffentlicht: (2024)
von: Asai, Akari, et al.
Veröffentlicht: (2024)
Vector search with small radiuses
von: Szilvasy, Gergely, et al.
Veröffentlicht: (2024)
von: Szilvasy, Gergely, et al.
Veröffentlicht: (2024)
Mixture-of-Transformers: A Sparse and Scalable Architecture for Multi-Modal Foundation Models
von: Liang, Weixin, et al.
Veröffentlicht: (2024)
von: Liang, Weixin, et al.
Veröffentlicht: (2024)
Evaluation data contamination in LLMs: how do we measure it and (when) does it matter?
von: Singh, Aaditya K., et al.
Veröffentlicht: (2024)
von: Singh, Aaditya K., et al.
Veröffentlicht: (2024)
MoMa: Efficient Early-Fusion Pre-training with Mixture of Modality-Aware Experts
von: Lin, Xi Victoria, et al.
Veröffentlicht: (2024)
von: Lin, Xi Victoria, et al.
Veröffentlicht: (2024)
LMFusion: Adapting Pretrained Language Models for Multimodal Generation
von: Shi, Weijia, et al.
Veröffentlicht: (2024)
von: Shi, Weijia, et al.
Veröffentlicht: (2024)
ReasonIR: Training Retrievers for Reasoning Tasks
von: Shao, Rulin, et al.
Veröffentlicht: (2025)
von: Shao, Rulin, et al.
Veröffentlicht: (2025)
Livcornelissen/DIT_mooringdata: Processing and Quality Control Code for DIT Mooring Data
von: Livcornelissen
Veröffentlicht: (2026)
von: Livcornelissen
Veröffentlicht: (2026)
The Faiss library
von: Douze, Matthijs, et al.
Veröffentlicht: (2024)
von: Douze, Matthijs, et al.
Veröffentlicht: (2024)
Short window attention enables long-term memorization
von: Cabannes, Loïc, et al.
Veröffentlicht: (2025)
von: Cabannes, Loïc, et al.
Veröffentlicht: (2025)
Instruction-tuned Language Models are Better Knowledge Learners
von: Jiang, Zhengbao, et al.
Veröffentlicht: (2024)
von: Jiang, Zhengbao, et al.
Veröffentlicht: (2024)
Unraveling and Mitigating Retriever Inconsistencies in Retrieval-Augmented Large Language Models
von: Li, Mingda, et al.
Veröffentlicht: (2024)
von: Li, Mingda, et al.
Veröffentlicht: (2024)
Stochastic activations
von: Lomeli, Maria, et al.
Veröffentlicht: (2025)
von: Lomeli, Maria, et al.
Veröffentlicht: (2025)
Scaling Retrieval-Based Language Models with a Trillion-Token Datastore
von: Shao, Rulin, et al.
Veröffentlicht: (2024)
von: Shao, Rulin, et al.
Veröffentlicht: (2024)
Procedural Knowledge at Scale Improves Reasoning
von: Wu, Di, et al.
Veröffentlicht: (2026)
von: Wu, Di, et al.
Veröffentlicht: (2026)
CID-GraphRAG: Enhancing Multi-Turn Dialogue Systems through Dual-Pathway Retrieval of Conversation Flow and Context Semantics
von: Zhu, Ziqi, et al.
Veröffentlicht: (2025)
von: Zhu, Ziqi, et al.
Veröffentlicht: (2025)
Anchored Decoding: Provably Reducing Copyright Risk for Any Language Model
von: He, Jacqueline, et al.
Veröffentlicht: (2026)
von: He, Jacqueline, et al.
Veröffentlicht: (2026)
Memory Layers at Scale
von: Berges, Vincent-Pierre, et al.
Veröffentlicht: (2024)
von: Berges, Vincent-Pierre, et al.
Veröffentlicht: (2024)
Learning Facts at Scale with Active Reading
von: Lin, Jessy, et al.
Veröffentlicht: (2025)
von: Lin, Jessy, et al.
Veröffentlicht: (2025)
InstructRetro: Instruction Tuning post Retrieval-Augmented Pretraining
von: Wang, Boxin, et al.
Veröffentlicht: (2023)
von: Wang, Boxin, et al.
Veröffentlicht: (2023)
HIRAG: Hierarchical-Thought Instruction-Tuning Retrieval-Augmented Generation
von: Jiao, YiHan, et al.
Veröffentlicht: (2025)
von: Jiao, YiHan, et al.
Veröffentlicht: (2025)
Detecting Pretraining Data from Large Language Models
von: Shi, Weijia, et al.
Veröffentlicht: (2023)
von: Shi, Weijia, et al.
Veröffentlicht: (2023)
JORA: JAX Tensor-Parallel LoRA Library for Retrieval Augmented Fine-Tuning
von: Tahir, Anique, et al.
Veröffentlicht: (2024)
von: Tahir, Anique, et al.
Veröffentlicht: (2024)
SlangDIT: Benchmarking LLMs in Interpretative Slang Translation
von: Liang, Yunlong, et al.
Veröffentlicht: (2025)
von: Liang, Yunlong, et al.
Veröffentlicht: (2025)
MENTAL HEALTH IN MEDICAL STUDENTS AND DOCTORS‐IN‐TRAINING (DIT)
Veröffentlicht: (2024)
Veröffentlicht: (2024)
SMoLoRA: Exploring and Defying Dual Catastrophic Forgetting in Continual Visual Instruction Tuning
von: Wang, Ziqi, et al.
Veröffentlicht: (2024)
von: Wang, Ziqi, et al.
Veröffentlicht: (2024)
RA-LWLM: Retrieval-Augmented In-Context Localization with Wireless Foundation Models
von: Pan, Guangjin, et al.
Veröffentlicht: (2026)
von: Pan, Guangjin, et al.
Veröffentlicht: (2026)
ParaPO: Aligning Language Models to Reduce Verbatim Reproduction of Pre-training Data
von: Chen, Tong, et al.
Veröffentlicht: (2025)
von: Chen, Tong, et al.
Veröffentlicht: (2025)
Retrieval Augmented Instruction Tuning for Open NER with Large Language Models
von: Xie, Tingyu, et al.
Veröffentlicht: (2024)
von: Xie, Tingyu, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
In-context Pretraining: Language Modeling Beyond Document Boundaries
von: Shi, Weijia, et al.
Veröffentlicht: (2023) -
Few-Shot Data Synthesis for Open Domain Multi-Hop Question Answering
von: Chen, Mingda, et al.
Veröffentlicht: (2023) -
ImpRAG: Retrieval-Augmented Generation with Implicit Queries
von: Zhang, Wenzheng, et al.
Veröffentlicht: (2025) -
DRAMA: Diverse Augmentation from Large Language Models to Smaller Dense Retrievers
von: Ma, Xueguang, et al.
Veröffentlicht: (2025) -
FACTORY: A Challenging Human-Verified Prompt Set for Long-Form Factuality
von: Chen, Mingda, et al.
Veröffentlicht: (2025)