Evaluating Copyright Takedown Methods for Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Wei, Boyi, Shi, Weijia, Huang, Yangsibo, Smith, Noah A., Zhang, Chiyuan, Zettlemoyer, Luke, Li, Kai, Henderson, Peter |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Fantastic Copyrighted Beasts and How (Not) to Generate Them
di: He, Luxi, et al.
Pubblicazione: (2024)
di: He, Luxi, et al.
Pubblicazione: (2024)
Detecting Pretraining Data from Large Language Models
di: Shi, Weijia, et al.
Pubblicazione: (2023)
di: Shi, Weijia, et al.
Pubblicazione: (2023)
MUSE: Machine Unlearning Six-Way Evaluation for Language Models
di: Shi, Weijia, et al.
Pubblicazione: (2024)
di: Shi, Weijia, et al.
Pubblicazione: (2024)
SILO Language Models: Isolating Legal Risk In a Nonparametric Datastore
di: Min, Sewon, et al.
Pubblicazione: (2023)
di: Min, Sewon, et al.
Pubblicazione: (2023)
An Adversarial Perspective on Machine Unlearning for AI Safety
di: Łucki, Jakub, et al.
Pubblicazione: (2024)
di: Łucki, Jakub, et al.
Pubblicazione: (2024)
Scaling Embedding Layers in Language Models
di: Yu, Da, et al.
Pubblicazione: (2025)
di: Yu, Da, et al.
Pubblicazione: (2025)
Crosslingual Capabilities and Knowledge Barriers in Multilingual Large Language Models
di: Chua, Lynn, et al.
Pubblicazione: (2024)
di: Chua, Lynn, et al.
Pubblicazione: (2024)
CopyBench: Measuring Literal and Non-Literal Reproduction of Copyright-Protected Text in Language Model Generation
di: Chen, Tong, et al.
Pubblicazione: (2024)
di: Chen, Tong, et al.
Pubblicazione: (2024)
Assessing the Brittleness of Safety Alignment via Pruning and Low-Rank Modifications
di: Wei, Boyi, et al.
Pubblicazione: (2024)
di: Wei, Boyi, et al.
Pubblicazione: (2024)
In-context Pretraining: Language Modeling Beyond Document Boundaries
di: Shi, Weijia, et al.
Pubblicazione: (2023)
di: Shi, Weijia, et al.
Pubblicazione: (2023)
ParaPO: Aligning Language Models to Reduce Verbatim Reproduction of Pre-training Data
di: Chen, Tong, et al.
Pubblicazione: (2025)
di: Chen, Tong, et al.
Pubblicazione: (2025)
Mind the Privacy Unit! User-Level Differential Privacy for Language Model Fine-Tuning
di: Chua, Lynn, et al.
Pubblicazione: (2024)
di: Chua, Lynn, et al.
Pubblicazione: (2024)
Scaling Retrieval-Based Language Models with a Trillion-Token Datastore
di: Shao, Rulin, et al.
Pubblicazione: (2024)
di: Shao, Rulin, et al.
Pubblicazione: (2024)
LMFusion: Adapting Pretrained Language Models for Multimodal Generation
di: Shi, Weijia, et al.
Pubblicazione: (2024)
di: Shi, Weijia, et al.
Pubblicazione: (2024)
Recycling the Web: A Method to Enhance Pre-training Data Quality and Quantity for Language Models
di: Nguyen, Thao, et al.
Pubblicazione: (2025)
di: Nguyen, Thao, et al.
Pubblicazione: (2025)
Quantifying Cross-Modality Memorization in Vision-Language Models
di: Wen, Yuxin, et al.
Pubblicazione: (2025)
di: Wen, Yuxin, et al.
Pubblicazione: (2025)
Slicing and Dicing: Configuring Optimal Mixtures of Experts
di: Li, Margaret, et al.
Pubblicazione: (2026)
di: Li, Margaret, et al.
Pubblicazione: (2026)
Localizing Paragraph Memorization in Language Models
di: Stoehr, Niklas, et al.
Pubblicazione: (2024)
di: Stoehr, Niklas, et al.
Pubblicazione: (2024)
MYTE: Morphology-Driven Byte Encoding for Better and Fairer Multilingual Language Modeling
di: Limisiewicz, Tomasz, et al.
Pubblicazione: (2024)
di: Limisiewicz, Tomasz, et al.
Pubblicazione: (2024)
(Mis)Fitting: A Survey of Scaling Laws
di: Li, Margaret, et al.
Pubblicazione: (2025)
di: Li, Margaret, et al.
Pubblicazione: (2025)
Reliable, Adaptable, and Attributable Language Models with Retrieval
di: Asai, Akari, et al.
Pubblicazione: (2024)
di: Asai, Akari, et al.
Pubblicazione: (2024)
Sample, Don't Search: Rethinking Test-Time Alignment for Language Models
di: Faria, Gonçalo, et al.
Pubblicazione: (2025)
di: Faria, Gonçalo, et al.
Pubblicazione: (2025)
Representation Deficiency in Masked Language Modeling
di: Meng, Yu, et al.
Pubblicazione: (2023)
di: Meng, Yu, et al.
Pubblicazione: (2023)
Large Language Models Generate Harmful Content Using a Distinct, Unified Mechanism
di: Orgad, Hadas, et al.
Pubblicazione: (2026)
di: Orgad, Hadas, et al.
Pubblicazione: (2026)
s1: Simple test-time scaling
di: Muennighoff, Niklas, et al.
Pubblicazione: (2025)
di: Muennighoff, Niklas, et al.
Pubblicazione: (2025)
Train for Truth, Keep the Skills: Binary Retrieval-Augmented Reward Mitigates Hallucinations
di: Chen, Tong, et al.
Pubblicazione: (2025)
di: Chen, Tong, et al.
Pubblicazione: (2025)
Signal and Noise: A Framework for Reducing Uncertainty in Language Model Evaluation
di: Heineman, David, et al.
Pubblicazione: (2025)
di: Heineman, David, et al.
Pubblicazione: (2025)
Merge to Learn: Efficiently Adding Skills to Language Models with Model Merging
di: Morrison, Jacob, et al.
Pubblicazione: (2024)
di: Morrison, Jacob, et al.
Pubblicazione: (2024)
Digger: Detecting Copyright Content Mis-usage in Large Language Model Training
di: Li, Haodong, et al.
Pubblicazione: (2024)
di: Li, Haodong, et al.
Pubblicazione: (2024)
RAVEL: Evaluating Interpretability Methods on Disentangling Language Model Representations
di: Huang, Jing, et al.
Pubblicazione: (2024)
di: Huang, Jing, et al.
Pubblicazione: (2024)
Fact or Guesswork? Evaluating Large Language Models' Medical Knowledge with Structured One-Hop Judgments
di: Li, Jiaxi, et al.
Pubblicazione: (2025)
di: Li, Jiaxi, et al.
Pubblicazione: (2025)
Generative Adapter: Contextualizing Language Models in Parameters with A Single Forward Pass
di: Chen, Tong, et al.
Pubblicazione: (2024)
di: Chen, Tong, et al.
Pubblicazione: (2024)
Text Quality-Based Pruning for Efficient Training of Language Models
di: Sharma, Vasu, et al.
Pubblicazione: (2024)
di: Sharma, Vasu, et al.
Pubblicazione: (2024)
DE-COP: Detecting Copyrighted Content in Language Models Training Data
di: Duarte, André V., et al.
Pubblicazione: (2024)
di: Duarte, André V., et al.
Pubblicazione: (2024)
Anchored Decoding: Provably Reducing Copyright Risk for Any Language Model
di: He, Jacqueline, et al.
Pubblicazione: (2026)
di: He, Jacqueline, et al.
Pubblicazione: (2026)
VSPO: Vector-Steered Policy Optimization for Behavioral Control
di: Zhang, Xuechen, et al.
Pubblicazione: (2026)
di: Zhang, Xuechen, et al.
Pubblicazione: (2026)
Sampling from Your Language Model One Byte at a Time
di: Hayase, Jonathan, et al.
Pubblicazione: (2025)
di: Hayase, Jonathan, et al.
Pubblicazione: (2025)
Copyright-Protected Language Generation via Adaptive Model Fusion
di: Abad, Javier, et al.
Pubblicazione: (2024)
di: Abad, Javier, et al.
Pubblicazione: (2024)
SuperBPE: Space Travel for Language Models
di: Liu, Alisa, et al.
Pubblicazione: (2025)
di: Liu, Alisa, et al.
Pubblicazione: (2025)
Automated Statistical Model Discovery with Language Models
di: Li, Michael Y., et al.
Pubblicazione: (2024)
di: Li, Michael Y., et al.
Pubblicazione: (2024)
Documenti analoghi
-
Fantastic Copyrighted Beasts and How (Not) to Generate Them
di: He, Luxi, et al.
Pubblicazione: (2024) -
Detecting Pretraining Data from Large Language Models
di: Shi, Weijia, et al.
Pubblicazione: (2023) -
MUSE: Machine Unlearning Six-Way Evaluation for Language Models
di: Shi, Weijia, et al.
Pubblicazione: (2024) -
SILO Language Models: Isolating Legal Risk In a Nonparametric Datastore
di: Min, Sewon, et al.
Pubblicazione: (2023) -
An Adversarial Perspective on Machine Unlearning for AI Safety
di: Łucki, Jakub, et al.
Pubblicazione: (2024)