Forcing Diffuse Distributions out of Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhang, Yiming, Schwarzschild, Avi, Carlini, Nicholas, Kolter, Zico, Ippolito, Daphne |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
TOFU: A Task of Fictitious Unlearning for LLMs
por: Maini, Pratyush, et al.
Publicado: (2024)
por: Maini, Pratyush, et al.
Publicado: (2024)
Rethinking LLM Memorization through the Lens of Adversarial Compression
por: Schwarzschild, Avi, et al.
Publicado: (2024)
por: Schwarzschild, Avi, et al.
Publicado: (2024)
Effective Prompt Extraction from Language Models
por: Zhang, Yiming, et al.
Publicado: (2023)
por: Zhang, Yiming, et al.
Publicado: (2023)
Existing Large Language Model Unlearning Evaluations Are Inconclusive
por: Feng, Zhili, et al.
Publicado: (2025)
por: Feng, Zhili, et al.
Publicado: (2025)
Measuring Non-Adversarial Reproduction of Training Data in Large Language Models
por: Aerni, Michael, et al.
Publicado: (2024)
por: Aerni, Michael, et al.
Publicado: (2024)
Prompt Recovery for Image Generation Models: A Comparative Study of Discrete Optimizers
por: Williams, Joshua Nathaniel, et al.
Publicado: (2024)
por: Williams, Joshua Nathaniel, et al.
Publicado: (2024)
FUSE-ing Language Models: Zero-Shot Adapter Discovery for Prompt Optimization Across Tokenizers
por: Williams, Joshua Nathaniel, et al.
Publicado: (2024)
por: Williams, Joshua Nathaniel, et al.
Publicado: (2024)
Massive Activations in Large Language Models
por: Sun, Mingjie, et al.
Publicado: (2024)
por: Sun, Mingjie, et al.
Publicado: (2024)
A Simple and Effective Pruning Approach for Large Language Models
por: Sun, Mingjie, et al.
Publicado: (2023)
por: Sun, Mingjie, et al.
Publicado: (2023)
Predicting the Performance of Black-box LLMs through Follow-up Queries
por: Sam, Dylan, et al.
Publicado: (2025)
por: Sam, Dylan, et al.
Publicado: (2025)
Toward Understanding the Transferability of Adversarial Suffixes in Large Language Models
por: Ball, Sarah, et al.
Publicado: (2025)
por: Ball, Sarah, et al.
Publicado: (2025)
Context-Parametric Inversion: Why Instruction Finetuning Can Worsen Context Reliance
por: Goyal, Sachin, et al.
Publicado: (2024)
por: Goyal, Sachin, et al.
Publicado: (2024)
Mimetic Initialization Helps State Space Models Learn to Recall
por: Trockman, Asher, et al.
Publicado: (2024)
por: Trockman, Asher, et al.
Publicado: (2024)
Benchmarking ChatGPT on Algorithmic Reasoning
por: McLeish, Sean, et al.
Publicado: (2024)
por: McLeish, Sean, et al.
Publicado: (2024)
Looking beyond the next token
por: Thankaraj, Abitha, et al.
Publicado: (2025)
por: Thankaraj, Abitha, et al.
Publicado: (2025)
Base Models Look Human To AI Detectors
por: Xu, Yixuan Even, et al.
Publicado: (2026)
por: Xu, Yixuan Even, et al.
Publicado: (2026)
LMD3: Language Model Data Density Dependence
por: Kirchenbauer, John, et al.
Publicado: (2024)
por: Kirchenbauer, John, et al.
Publicado: (2024)
Not All Rollouts are Useful: Down-Sampling Rollouts in LLM Reinforcement Learning
por: Xu, Yixuan Even, et al.
Publicado: (2025)
por: Xu, Yixuan Even, et al.
Publicado: (2025)
One-Step Diffusion Distillation via Deep Equilibrium Models
por: Geng, Zhengyang, et al.
Publicado: (2023)
por: Geng, Zhengyang, et al.
Publicado: (2023)
FictionalQA: A Dataset for Studying Memorization and Knowledge Acquisition
por: Kirchenbauer, John, et al.
Publicado: (2025)
por: Kirchenbauer, John, et al.
Publicado: (2025)
Diffusing Differentiable Representations
por: Savani, Yash, et al.
Publicado: (2024)
por: Savani, Yash, et al.
Publicado: (2024)
Command-V: Pasting LLM Behaviors via Activation Profiles
por: Wang, Barry, et al.
Publicado: (2025)
por: Wang, Barry, et al.
Publicado: (2025)
T-MARS: Improving Visual Representations by Circumventing Text Feature Learning
por: Maini, Pratyush, et al.
Publicado: (2023)
por: Maini, Pratyush, et al.
Publicado: (2023)
AcceleratedLiNGAM: Learning Causal DAGs at the speed of GPUs
por: Akinwande, Victor, et al.
Publicado: (2024)
por: Akinwande, Victor, et al.
Publicado: (2024)
Teaching Pretrained Language Models to Think Deeper with Retrofitted Recurrence
por: McLeish, Sean, et al.
Publicado: (2025)
por: McLeish, Sean, et al.
Publicado: (2025)
CIE: Controlling Language Model Text Generations Using Continuous Signals
por: Samuel, Vinay, et al.
Publicado: (2025)
por: Samuel, Vinay, et al.
Publicado: (2025)
ImpossibleBench: Measuring LLMs' Propensity of Exploiting Test Cases
por: Zhong, Ziqian, et al.
Publicado: (2025)
por: Zhong, Ziqian, et al.
Publicado: (2025)
Training a Generally Curious Agent
por: Tajwar, Fahim, et al.
Publicado: (2025)
por: Tajwar, Fahim, et al.
Publicado: (2025)
Mimetic Initialization of MLPs
por: Trockman, Asher, et al.
Publicado: (2026)
por: Trockman, Asher, et al.
Publicado: (2026)
Antidistillation Sampling
por: Savani, Yash, et al.
Publicado: (2025)
por: Savani, Yash, et al.
Publicado: (2025)
Spotting LLMs With Binoculars: Zero-Shot Detection of Machine-Generated Text
por: Hans, Abhimanyu, et al.
Publicado: (2024)
por: Hans, Abhimanyu, et al.
Publicado: (2024)
Are aligned neural networks adversarially aligned?
por: Carlini, Nicholas, et al.
Publicado: (2023)
por: Carlini, Nicholas, et al.
Publicado: (2023)
Antidistillation Fingerprinting
por: Xu, Yixuan Even, et al.
Publicado: (2026)
por: Xu, Yixuan Even, et al.
Publicado: (2026)
Customizing Large Language Model Generation Style using Parameter-Efficient Finetuning
por: Liu, Xinyue, et al.
Publicado: (2024)
por: Liu, Xinyue, et al.
Publicado: (2024)
The CLRS-Text Algorithmic Reasoning Language Benchmark
por: Markeeva, Larisa, et al.
Publicado: (2024)
por: Markeeva, Larisa, et al.
Publicado: (2024)
Large Language Diffusion Models
por: Nie, Shen, et al.
Publicado: (2025)
por: Nie, Shen, et al.
Publicado: (2025)
Sequential Diffusion Language Models
por: Liu, Yangzhou, et al.
Publicado: (2025)
por: Liu, Yangzhou, et al.
Publicado: (2025)
Correlated Errors in Large Language Models
por: Kim, Elliot, et al.
Publicado: (2025)
por: Kim, Elliot, et al.
Publicado: (2025)
Compressed Sensing for Capability Localization in Large Language Models
por: Bair, Anna, et al.
Publicado: (2026)
por: Bair, Anna, et al.
Publicado: (2026)
Idiosyncrasies in Large Language Models
por: Sun, Mingjie, et al.
Publicado: (2025)
por: Sun, Mingjie, et al.
Publicado: (2025)
Ejemplares similares
-
TOFU: A Task of Fictitious Unlearning for LLMs
por: Maini, Pratyush, et al.
Publicado: (2024) -
Rethinking LLM Memorization through the Lens of Adversarial Compression
por: Schwarzschild, Avi, et al.
Publicado: (2024) -
Effective Prompt Extraction from Language Models
por: Zhang, Yiming, et al.
Publicado: (2023) -
Existing Large Language Model Unlearning Evaluations Are Inconclusive
por: Feng, Zhili, et al.
Publicado: (2025) -
Measuring Non-Adversarial Reproduction of Training Data in Large Language Models
por: Aerni, Michael, et al.
Publicado: (2024)