Guardado en:
| Autores principales: | McKinney, Lev, Thudi, Anvith, Bae, Juhan, Rezaei, Tara, Papernot, Nicolas, McIlraith, Sheila A., Grosse, Roger |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2602.10568 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Better Training Data Attribution via Better Inverse Hessian-Vector Products
por: Wang, Andrew, et al.
Publicado: (2025)
por: Wang, Andrew, et al.
Publicado: (2025)
Fast Exact Unlearning for In-Context Learning Data for LLMs
por: Muresanu, Andrei I., et al.
Publicado: (2024)
por: Muresanu, Andrei I., et al.
Publicado: (2024)
Gradients Look Alike: Sensitivity is Often Overestimated in DP-SGD
por: Thudi, Anvith, et al.
Publicado: (2023)
por: Thudi, Anvith, et al.
Publicado: (2023)
Efficient Public Verification of Private ML via Regularization
por: Bell, Zoë Ruha, et al.
Publicado: (2025)
por: Bell, Zoë Ruha, et al.
Publicado: (2025)
Leveraging Per-Instance Privacy for Machine Unlearning
por: Sepahvand, Nazanin Mohammadi, et al.
Publicado: (2025)
por: Sepahvand, Nazanin Mohammadi, et al.
Publicado: (2025)
MixMax: Distributional Robustness in Function Space via Optimal Data Mixtures
por: Thudi, Anvith, et al.
Publicado: (2024)
por: Thudi, Anvith, et al.
Publicado: (2024)
Pluralistic Alignment Over Time
por: Klassen, Toryn Q., et al.
Publicado: (2024)
por: Klassen, Toryn Q., et al.
Publicado: (2024)
Formal Methods Meet LLMs: Auditing, Monitoring, and Intervention for Compliance of Advanced AI Systems
por: Alamdari, Parand A., et al.
Publicado: (2026)
por: Alamdari, Parand A., et al.
Publicado: (2026)
STEVE-1: A Generative Model for Text-to-Behavior in Minecraft
por: Lifshitz, Shalev, et al.
Publicado: (2023)
por: Lifshitz, Shalev, et al.
Publicado: (2023)
Remembering to Be Fair: Non-Markovian Fairness in Sequential Decision Making
por: Alamdari, Parand A., et al.
Publicado: (2023)
por: Alamdari, Parand A., et al.
Publicado: (2023)
Selective Prediction via Training Dynamics
por: Rabanser, Stephan, et al.
Publicado: (2022)
por: Rabanser, Stephan, et al.
Publicado: (2022)
Being Considerate as a Pathway Towards Pluralistic Alignment for Agentic AI
por: Alamdari, Parand A., et al.
Publicado: (2024)
por: Alamdari, Parand A., et al.
Publicado: (2024)
Pushdown Reward Machines for Reinforcement Learning
por: Varricchione, Giovanni, et al.
Publicado: (2025)
por: Varricchione, Giovanni, et al.
Publicado: (2025)
Ground-Compose-Reinforce: Grounding Language in Agentic Behaviours using Limited Data
por: Li, Andrew C., et al.
Publicado: (2025)
por: Li, Andrew C., et al.
Publicado: (2025)
MixMin: Finding Data Mixtures via Convex Minimization
por: Thudi, Anvith, et al.
Publicado: (2025)
por: Thudi, Anvith, et al.
Publicado: (2025)
Training Data Attribution via Approximate Unrolled Differentiation
por: Bae, Juhan, et al.
Publicado: (2024)
por: Bae, Juhan, et al.
Publicado: (2024)
Multi-Agent Verification: Scaling Test-Time Compute with Multiple Verifiers
por: Lifshitz, Shalev, et al.
Publicado: (2025)
por: Lifshitz, Shalev, et al.
Publicado: (2025)
Leakage Safe Graph Features for Interpretable Fraud Detection in Temporal Transaction Networks
por: Khaleghpour, Hamideh, et al.
Publicado: (2026)
por: Khaleghpour, Hamideh, et al.
Publicado: (2026)
Optimizing Neuro-Fuzzy and Colonial Competition Algorithms for Skin Cancer Diagnosis in Dermatoscopic Images
por: Khaleghpour, Hamideh, et al.
Publicado: (2025)
por: Khaleghpour, Hamideh, et al.
Publicado: (2025)
Unified AI for Accurate Audio Anomaly Detection
por: Khaleghpour, Hamideh, et al.
Publicado: (2025)
por: Khaleghpour, Hamideh, et al.
Publicado: (2025)
Now, Later, and Lasting: Ten Priorities for AI Research, Policy, and Practice
por: Horvitz, Eric, et al.
Publicado: (2024)
por: Horvitz, Eric, et al.
Publicado: (2024)
Reward Machines for Deep RL in Noisy and Uncertain Environments
por: Li, Andrew C., et al.
Publicado: (2024)
por: Li, Andrew C., et al.
Publicado: (2024)
Negation Neglect: When models fail to learn negations in training
por: Mayne, Harry, et al.
Publicado: (2026)
por: Mayne, Harry, et al.
Publicado: (2026)
Verifiable and Provably Secure Machine Unlearning
por: Eisenhofer, Thorsten, et al.
Publicado: (2022)
por: Eisenhofer, Thorsten, et al.
Publicado: (2022)
Error whitening: Why Gauss-Newton outperforms Newton
por: McKay, Maricela Best, et al.
Publicado: (2026)
por: McKay, Maricela Best, et al.
Publicado: (2026)
Language Models For Generalised PDDL Planning: Synthesising Sound and Programmatic Policies
por: Chen, Dillon Z., et al.
Publicado: (2025)
por: Chen, Dillon Z., et al.
Publicado: (2025)
Eliciting Latent Predictions from Transformers with the Tuned Lens
por: Belrose, Nora, et al.
Publicado: (2023)
por: Belrose, Nora, et al.
Publicado: (2023)
GULPS: Two-Qubit Gate Synthesis via Linear Programming for Heterogeneous Instruction Sets
por: McKinney, Evan, et al.
Publicado: (2025)
por: McKinney, Evan, et al.
Publicado: (2025)
Spectral-factorized Positive-definite Curvature Learning for NN Training
por: Lin, Wu, et al.
Publicado: (2025)
por: Lin, Wu, et al.
Publicado: (2025)
Inexact Unlearning Needs More Careful Evaluations to Avoid a False Sense of Privacy
por: Hayes, Jamie, et al.
Publicado: (2024)
por: Hayes, Jamie, et al.
Publicado: (2024)
Satisficing and Optimal Generalised Planning via Goal Regression (Extended Version)
por: Chen, Dillon Z., et al.
Publicado: (2025)
por: Chen, Dillon Z., et al.
Publicado: (2025)
Learning Bilevel Policies over Symbolic World Models for Long-Horizon Planning
por: Chen, Dillon Z., et al.
Publicado: (2026)
por: Chen, Dillon Z., et al.
Publicado: (2026)
What Does It Take to Build a Performant Selective Classifier?
por: Rabanser, Stephan, et al.
Publicado: (2025)
por: Rabanser, Stephan, et al.
Publicado: (2025)
Demystify Protein Generation with Hierarchical Conditional Diffusion Models
por: Ling, Zinan, et al.
Publicado: (2025)
por: Ling, Zinan, et al.
Publicado: (2025)
AutoPrognosis 2.0: Democratizing Diagnostic and Prognostic Modeling in Healthcare with Automated Machine Learning
por: Imrie, Fergus, et al.
Publicado: (2022)
por: Imrie, Fergus, et al.
Publicado: (2022)
LLM Dataset Inference: Did you train on my dataset?
por: Maini, Pratyush, et al.
Publicado: (2024)
por: Maini, Pratyush, et al.
Publicado: (2024)
Fairness Feedback Loops: Training on Synthetic Data Amplifies Bias
por: Wyllie, Sierra, et al.
Publicado: (2024)
por: Wyllie, Sierra, et al.
Publicado: (2024)
Concept Influence: Leveraging Interpretability to Improve Performance and Efficiency in Training Data Attribution
por: Kowal, Matthew, et al.
Publicado: (2026)
por: Kowal, Matthew, et al.
Publicado: (2026)
UnUnlearning: Unlearning is not sufficient for content regulation in advanced generative AI
por: Shumailov, Ilia, et al.
Publicado: (2024)
por: Shumailov, Ilia, et al.
Publicado: (2024)
Tighter Privacy Auditing of DP-SGD in the Hidden State Threat Model
por: Cebere, Tudor, et al.
Publicado: (2024)
por: Cebere, Tudor, et al.
Publicado: (2024)
Ejemplares similares
-
Better Training Data Attribution via Better Inverse Hessian-Vector Products
por: Wang, Andrew, et al.
Publicado: (2025) -
Fast Exact Unlearning for In-Context Learning Data for LLMs
por: Muresanu, Andrei I., et al.
Publicado: (2024) -
Gradients Look Alike: Sensitivity is Often Overestimated in DP-SGD
por: Thudi, Anvith, et al.
Publicado: (2023) -
Efficient Public Verification of Private ML via Regularization
por: Bell, Zoë Ruha, et al.
Publicado: (2025) -
Leveraging Per-Instance Privacy for Machine Unlearning
por: Sepahvand, Nazanin Mohammadi, et al.
Publicado: (2025)