Anchored Decoding: Provably Reducing Copyright Risk for Any Language Model
Fuente:
arXiv
Salvato in:
| Autori principali: | He, Jacqueline, Hayase, Jonathan, Yih, Wen-tau, Oh, Sewoong, Zettlemoyer, Luke, Koh, Pang Wei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Reliable, Adaptable, and Attributable Language Models with Retrieval
di: Asai, Akari, et al.
Pubblicazione: (2024)
di: Asai, Akari, et al.
Pubblicazione: (2024)
Sampling from Your Language Model One Byte at a Time
di: Hayase, Jonathan, et al.
Pubblicazione: (2025)
di: Hayase, Jonathan, et al.
Pubblicazione: (2025)
Memory Layers at Scale
di: Berges, Vincent-Pierre, et al.
Pubblicazione: (2024)
di: Berges, Vincent-Pierre, et al.
Pubblicazione: (2024)
SuperBPE: Space Travel for Language Models
di: Liu, Alisa, et al.
Pubblicazione: (2025)
di: Liu, Alisa, et al.
Pubblicazione: (2025)
PLeaS -- Merging Models with Permutations and Least Squares
di: Nasery, Anshul, et al.
Pubblicazione: (2024)
di: Nasery, Anshul, et al.
Pubblicazione: (2024)
CopyBench: Measuring Literal and Non-Literal Reproduction of Copyright-Protected Text in Language Model Generation
di: Chen, Tong, et al.
Pubblicazione: (2024)
di: Chen, Tong, et al.
Pubblicazione: (2024)
Improving Factuality with Explicit Working Memory
di: Chen, Mingda, et al.
Pubblicazione: (2024)
di: Chen, Mingda, et al.
Pubblicazione: (2024)
Data Mixture Inference: What do BPE Tokenizers Reveal about their Training Data?
di: Hayase, Jonathan, et al.
Pubblicazione: (2024)
di: Hayase, Jonathan, et al.
Pubblicazione: (2024)
Few-Shot Data Synthesis for Open Domain Multi-Hop Question Answering
di: Chen, Mingda, et al.
Pubblicazione: (2023)
di: Chen, Mingda, et al.
Pubblicazione: (2023)
Recycling the Web: A Method to Enhance Pre-training Data Quality and Quantity for Language Models
di: Nguyen, Thao, et al.
Pubblicazione: (2025)
di: Nguyen, Thao, et al.
Pubblicazione: (2025)
ParaPO: Aligning Language Models to Reduce Verbatim Reproduction of Pre-training Data
di: Chen, Tong, et al.
Pubblicazione: (2025)
di: Chen, Tong, et al.
Pubblicazione: (2025)
Scaling Retrieval-Based Language Models with a Trillion-Token Datastore
di: Shao, Rulin, et al.
Pubblicazione: (2024)
di: Shao, Rulin, et al.
Pubblicazione: (2024)
Evaluating Copyright Takedown Methods for Language Models
di: Wei, Boyi, et al.
Pubblicazione: (2024)
di: Wei, Boyi, et al.
Pubblicazione: (2024)
ReasonIR: Training Retrievers for Reasoning Tasks
di: Shao, Rulin, et al.
Pubblicazione: (2025)
di: Shao, Rulin, et al.
Pubblicazione: (2025)
Nearest Neighbor Speculative Decoding for LLM Generation and Attribution
di: Li, Minghan, et al.
Pubblicazione: (2024)
di: Li, Minghan, et al.
Pubblicazione: (2024)
Mixture-of-Transformers: A Sparse and Scalable Architecture for Multi-Modal Foundation Models
di: Liang, Weixin, et al.
Pubblicazione: (2024)
di: Liang, Weixin, et al.
Pubblicazione: (2024)
Procedural Knowledge at Scale Improves Reasoning
di: Wu, Di, et al.
Pubblicazione: (2026)
di: Wu, Di, et al.
Pubblicazione: (2026)
Better Alignment with Instruction Back-and-Forth Translation
di: Nguyen, Thao, et al.
Pubblicazione: (2024)
di: Nguyen, Thao, et al.
Pubblicazione: (2024)
DRAMA: Diverse Augmentation from Large Language Models to Smaller Dense Retrievers
di: Ma, Xueguang, et al.
Pubblicazione: (2025)
di: Ma, Xueguang, et al.
Pubblicazione: (2025)
FLAME: Factuality-Aware Alignment for Large Language Models
di: Lin, Sheng-Chieh, et al.
Pubblicazione: (2024)
di: Lin, Sheng-Chieh, et al.
Pubblicazione: (2024)
Precise Information Control in Long-Form Text Generation
di: He, Jacqueline, et al.
Pubblicazione: (2025)
di: He, Jacqueline, et al.
Pubblicazione: (2025)
ImpRAG: Retrieval-Augmented Generation with Implicit Queries
di: Zhang, Wenzheng, et al.
Pubblicazione: (2025)
di: Zhang, Wenzheng, et al.
Pubblicazione: (2025)
FlexOlmo: Open Language Models for Flexible Data Use
di: Shi, Weijia, et al.
Pubblicazione: (2025)
di: Shi, Weijia, et al.
Pubblicazione: (2025)
Privacy-Preserving Instructions for Aligning Large Language Models
di: Yu, Da, et al.
Pubblicazione: (2024)
di: Yu, Da, et al.
Pubblicazione: (2024)
Micro Language Models Enable Instant Responses
di: Cheng, Wen, et al.
Pubblicazione: (2026)
di: Cheng, Wen, et al.
Pubblicazione: (2026)
Group-Level Data Selection for Efficient Pretraining
di: Yu, Zichun, et al.
Pubblicazione: (2025)
di: Yu, Zichun, et al.
Pubblicazione: (2025)
CHANCERY: Evaluating Corporate Governance Reasoning Capabilities in Language Models
di: Irwin, Lucas, et al.
Pubblicazione: (2025)
di: Irwin, Lucas, et al.
Pubblicazione: (2025)
Continual Learning via Sparse Memory Finetuning
di: Lin, Jessy, et al.
Pubblicazione: (2025)
di: Lin, Jessy, et al.
Pubblicazione: (2025)
Altogether: Image Captioning via Re-aligning Alt-text
di: Xu, Hu, et al.
Pubblicazione: (2024)
di: Xu, Hu, et al.
Pubblicazione: (2024)
Demystifying Prompts in Language Models via Perplexity Estimation
di: Gonen, Hila, et al.
Pubblicazione: (2022)
di: Gonen, Hila, et al.
Pubblicazione: (2022)
Instruction-tuned Language Models are Better Knowledge Learners
di: Jiang, Zhengbao, et al.
Pubblicazione: (2024)
di: Jiang, Zhengbao, et al.
Pubblicazione: (2024)
SILO Language Models: Isolating Legal Risk In a Nonparametric Datastore
di: Min, Sewon, et al.
Pubblicazione: (2023)
di: Min, Sewon, et al.
Pubblicazione: (2023)
Does Liking Yellow Imply Driving a School Bus? Semantic Leakage in Language Models
di: Gonen, Hila, et al.
Pubblicazione: (2024)
di: Gonen, Hila, et al.
Pubblicazione: (2024)
AnyEdit: Edit Any Knowledge Encoded in Language Models
di: Jiang, Houcheng, et al.
Pubblicazione: (2025)
di: Jiang, Houcheng, et al.
Pubblicazione: (2025)
Learning to Reason for Factuality
di: Chen, Xilun, et al.
Pubblicazione: (2025)
di: Chen, Xilun, et al.
Pubblicazione: (2025)
SelfCite: Self-Supervised Alignment for Context Attribution in Large Language Models
di: Chuang, Yung-Sung, et al.
Pubblicazione: (2025)
di: Chuang, Yung-Sung, et al.
Pubblicazione: (2025)
A False Sense of Privacy: Evaluating Textual Data Sanitization Beyond Surface-level Privacy Leakage
di: Xin, Rui, et al.
Pubblicazione: (2025)
di: Xin, Rui, et al.
Pubblicazione: (2025)
Copyright Detective: A Forensic System to Evidence LLMs Flickering Copyright Leakage Risks
di: Zhang, Guangwei, et al.
Pubblicazione: (2026)
di: Zhang, Guangwei, et al.
Pubblicazione: (2026)
Comparing Hallucination Detection Metrics for Multilingual Generation
di: Kang, Haoqiang, et al.
Pubblicazione: (2024)
di: Kang, Haoqiang, et al.
Pubblicazione: (2024)
Meta CLIP 2: A Worldwide Scaling Recipe
di: Chuang, Yung-Sung, et al.
Pubblicazione: (2025)
di: Chuang, Yung-Sung, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Reliable, Adaptable, and Attributable Language Models with Retrieval
di: Asai, Akari, et al.
Pubblicazione: (2024) -
Sampling from Your Language Model One Byte at a Time
di: Hayase, Jonathan, et al.
Pubblicazione: (2025) -
Memory Layers at Scale
di: Berges, Vincent-Pierre, et al.
Pubblicazione: (2024) -
SuperBPE: Space Travel for Language Models
di: Liu, Alisa, et al.
Pubblicazione: (2025) -
PLeaS -- Merging Models with Permutations and Least Squares
di: Nasery, Anshul, et al.
Pubblicazione: (2024)