Measuring Stochastic Data Complexity with Boltzmann Influence Functions
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ng, Nathan, Grosse, Roger, Ghassemi, Marzyeh |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Improving Mutual Information Estimation with Annealed and Energy-Based Bounds
par: Brekelmans, Rob, et autres
Publié: (2023)
par: Brekelmans, Rob, et autres
Publié: (2023)
MaskMedPaint: Masked Medical Image Inpainting with Diffusion Models for Mitigation of Spurious Correlations
par: Jin, Qixuan, et autres
Publié: (2024)
par: Jin, Qixuan, et autres
Publié: (2024)
Improving Black-box Robustness with In-Context Rewriting
par: O'Brien, Kyle, et autres
Publié: (2024)
par: O'Brien, Kyle, et autres
Publié: (2024)
Data Debiasing with Datamodels (D3M): Improving Subgroup Robustness via Data Selection
par: Jain, Saachi, et autres
Publié: (2024)
par: Jain, Saachi, et autres
Publié: (2024)
An Investigation of Memorization Risk in Healthcare Foundation Models
par: Tonekaboni, Sana, et autres
Publié: (2025)
par: Tonekaboni, Sana, et autres
Publié: (2025)
Aggregation Hides Out-of-Distribution Generalization Failures from Spurious Correlations
par: Salaudeen, Olawale, et autres
Publié: (2025)
par: Salaudeen, Olawale, et autres
Publié: (2025)
Robustness Beyond Known Groups with Low-rank Adaptation
par: Gourabathina, Abinitha, et autres
Publié: (2026)
par: Gourabathina, Abinitha, et autres
Publié: (2026)
Views Can Be Deceiving: Improved SSL Through Feature Space Augmentation
par: Hamidieh, Kimia, et autres
Publié: (2024)
par: Hamidieh, Kimia, et autres
Publié: (2024)
What's in a Query: Polarity-Aware Distribution-Based Fair Ranking
par: Balagopalan, Aparna, et autres
Publié: (2025)
par: Balagopalan, Aparna, et autres
Publié: (2025)
Speak Easy: Eliciting Harmful Jailbreaks from LLMs with Simple Interactions
par: Chan, Yik Siu, et autres
Publié: (2025)
par: Chan, Yik Siu, et autres
Publié: (2025)
In the Name of Fairness: Assessing the Bias in Clinical Record De-identification
par: Xiao, Yuxin, et autres
Publié: (2023)
par: Xiao, Yuxin, et autres
Publié: (2023)
SFTMix: Elevating Language Model Instruction Tuning with Mixup Recipe
par: Xiao, Yuxin, et autres
Publié: (2024)
par: Xiao, Yuxin, et autres
Publié: (2024)
Distributional Training Data Attribution: What do Influence Functions Sample?
par: Mlodozeniec, Bruno, et autres
Publié: (2025)
par: Mlodozeniec, Bruno, et autres
Publié: (2025)
When Style Breaks Safety: Defending LLMs Against Superficial Style Alignment
par: Xiao, Yuxin, et autres
Publié: (2025)
par: Xiao, Yuxin, et autres
Publié: (2025)
Event-Based Contrastive Learning for Medical Time Series
par: Jeong, Hyewon, et autres
Publié: (2023)
par: Jeong, Hyewon, et autres
Publié: (2023)
Reaching Beyond the Mode: RL for Distributional Reasoning in Language Models
par: Puri, Isha, et autres
Publié: (2026)
par: Puri, Isha, et autres
Publié: (2026)
KScope: A Framework for Characterizing the Knowledge Status of Language Models
par: Xiao, Yuxin, et autres
Publié: (2025)
par: Xiao, Yuxin, et autres
Publié: (2025)
LEMoN: Label Error Detection using Multimodal Neighbors
par: Zhang, Haoran, et autres
Publié: (2024)
par: Zhang, Haoran, et autres
Publié: (2024)
BendVLM: Test-Time Debiasing of Vision-Language Embeddings
par: Gerych, Walter, et autres
Publié: (2024)
par: Gerych, Walter, et autres
Publié: (2024)
Training Data Attribution via Approximate Unrolled Differentiation
par: Bae, Juhan, et autres
Publié: (2024)
par: Bae, Juhan, et autres
Publié: (2024)
What is Your Data Worth to GPT? LLM-Scale Data Valuation with Influence Functions
par: Choe, Sang Keun, et autres
Publié: (2024)
par: Choe, Sang Keun, et autres
Publié: (2024)
Train Long, Think Short: Curriculum Learning for Efficient Reasoning
par: Hammoud, Hasan Abed Al Kader, et autres
Publié: (2025)
par: Hammoud, Hasan Abed Al Kader, et autres
Publié: (2025)
Evaluation without Generation: Non-Generative Assessment of Harmful Model Specialization with Applications to CSAM
par: Suriyakumar, Vinith M., et autres
Publié: (2026)
par: Suriyakumar, Vinith M., et autres
Publié: (2026)
Asymmetry in Low-Rank Adapters of Foundation Models
par: Zhu, Jiacheng, et autres
Publié: (2024)
par: Zhu, Jiacheng, et autres
Publié: (2024)
Generative AI in Medicine
par: Shanmugam, Divya, et autres
Publié: (2024)
par: Shanmugam, Divya, et autres
Publié: (2024)
On the Sample Complexity of Quantum Boltzmann Machine Learning
par: Coopmans, Luuk, et autres
Publié: (2023)
par: Coopmans, Luuk, et autres
Publié: (2023)
Backdoor Learning Curves: Explaining Backdoor Poisoning Beyond Influence Functions
par: Cinà, Antonio Emanuele, et autres
Publié: (2021)
par: Cinà, Antonio Emanuele, et autres
Publié: (2021)
Bayesian Influence Functions for Hessian-Free Data Attribution
par: Kreer, Philipp Alexander, et autres
Publié: (2025)
par: Kreer, Philipp Alexander, et autres
Publié: (2025)
A Comprehensive Forecasting-Based Framework for Time Series Anomaly Detection: Benchmarking on the Numenta Anomaly Benchmark (NAB)
par: Karami, Mohammad, et autres
Publié: (2025)
par: Karami, Mohammad, et autres
Publié: (2025)
On the Complexity of Learning Sparse Functions with Statistical and Gradient Queries
par: Joshi, Nirmit, et autres
Publié: (2024)
par: Joshi, Nirmit, et autres
Publié: (2024)
Revisiting Data Attribution for Influence Functions
par: Zhu, Hongbo, et autres
Publié: (2025)
par: Zhu, Hongbo, et autres
Publié: (2025)
Better Training Data Attribution via Better Inverse Hessian-Vector Products
par: Wang, Andrew, et autres
Publié: (2025)
par: Wang, Andrew, et autres
Publié: (2025)
Rescaled Influence Functions: Accurate Data Attribution in High Dimension
par: Rubinstein, Ittai, et autres
Publié: (2025)
par: Rubinstein, Ittai, et autres
Publié: (2025)
Distribution-Free Uncertainty Quantification in Mechanical Ventilation Treatment: A Conformal Deep Q-Learning Framework
par: Eghbali, Niloufar, et autres
Publié: (2024)
par: Eghbali, Niloufar, et autres
Publié: (2024)
Influence Functions for Efficient Data Selection in Reasoning
par: Humane, Prateek, et autres
Publié: (2025)
par: Humane, Prateek, et autres
Publié: (2025)
Application-Driven Innovation in Machine Learning
par: Rolnick, David, et autres
Publié: (2024)
par: Rolnick, David, et autres
Publié: (2024)
BoltzNCE: Learning Likelihoods for Boltzmann Generation with Stochastic Interpolants and Noise Contrastive Estimation
par: Aggarwal, Rishal, et autres
Publié: (2025)
par: Aggarwal, Rishal, et autres
Publié: (2025)
Theoretical Analysis of Submodular Information Measures for Targeted Data Subset Selection
par: Beck, Nathan, et autres
Publié: (2024)
par: Beck, Nathan, et autres
Publié: (2024)
A Versatile Influence Function for Data Attribution with Non-Decomposable Loss
par: Deng, Junwei, et autres
Publié: (2024)
par: Deng, Junwei, et autres
Publié: (2024)
TimeInf: Time Series Data Contribution via Influence Functions
par: Zhang, Yizi, et autres
Publié: (2024)
par: Zhang, Yizi, et autres
Publié: (2024)
Documents similaires
-
Improving Mutual Information Estimation with Annealed and Energy-Based Bounds
par: Brekelmans, Rob, et autres
Publié: (2023) -
MaskMedPaint: Masked Medical Image Inpainting with Diffusion Models for Mitigation of Spurious Correlations
par: Jin, Qixuan, et autres
Publié: (2024) -
Improving Black-box Robustness with In-Context Rewriting
par: O'Brien, Kyle, et autres
Publié: (2024) -
Data Debiasing with Datamodels (D3M): Improving Subgroup Robustness via Data Selection
par: Jain, Saachi, et autres
Publié: (2024) -
An Investigation of Memorization Risk in Healthcare Foundation Models
par: Tonekaboni, Sana, et autres
Publié: (2025)