A Snapshot of Influence: A Local Data Attribution Framework for Online Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Hu, Yuzheng, Wu, Fan, Ye, Haotian, Forsyth, David, Zou, James, Jiang, Nan, Ma, Jiaqi W., Zhao, Han |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
A Unified Theory of Random Projection for Influence Functions
di: Hu, Pingbang, et al.
Pubblicazione: (2026)
di: Hu, Pingbang, et al.
Pubblicazione: (2026)
Taming Hyperparameter Sensitivity in Data Attribution: Practical Selection Without Costly Retraining
di: Wang, Weiyi, et al.
Pubblicazione: (2025)
di: Wang, Weiyi, et al.
Pubblicazione: (2025)
Most Influential Subset Selection: Challenges, Promises, and Beyond
di: Hu, Yuzheng, et al.
Pubblicazione: (2024)
di: Hu, Yuzheng, et al.
Pubblicazione: (2024)
A Versatile Influence Function for Data Attribution with Non-Decomposable Loss
di: Deng, Junwei, et al.
Pubblicazione: (2024)
di: Deng, Junwei, et al.
Pubblicazione: (2024)
GraSS: Scalable Data Attribution with Gradient Sparsification and Sparse Projection
di: Hu, Pingbang, et al.
Pubblicazione: (2025)
di: Hu, Pingbang, et al.
Pubblicazione: (2025)
Adversarial Attacks on Data Attribution
di: Wang, Xinhe, et al.
Pubblicazione: (2024)
di: Wang, Xinhe, et al.
Pubblicazione: (2024)
Imperfect Influence, Preserved Rankings: A Theory of TRAK for Data Attribution
di: Tong, Han, et al.
Pubblicazione: (2026)
di: Tong, Han, et al.
Pubblicazione: (2026)
Daunce: Data Attribution through Uncertainty Estimation
di: Pan, Xingyuan, et al.
Pubblicazione: (2025)
di: Pan, Xingyuan, et al.
Pubblicazione: (2025)
Detecting and Filtering Unsafe Training Data via Data Attribution with Denoised Representation
di: Pan, Yijun, et al.
Pubblicazione: (2025)
di: Pan, Yijun, et al.
Pubblicazione: (2025)
Localize-and-Stitch: Efficient Model Merging via Sparse Task Arithmetic
di: He, Yifei, et al.
Pubblicazione: (2024)
di: He, Yifei, et al.
Pubblicazione: (2024)
Empirical Privacy Variance
di: Hu, Yuzheng, et al.
Pubblicazione: (2025)
di: Hu, Yuzheng, et al.
Pubblicazione: (2025)
CHORDS: Diffusion Sampling Accelerator with Multi-core Hierarchical ODE Solvers
di: Han, Jiaqi, et al.
Pubblicazione: (2025)
di: Han, Jiaqi, et al.
Pubblicazione: (2025)
$\texttt{dattri}$: A Library for Efficient Data Attribution
di: Deng, Junwei, et al.
Pubblicazione: (2024)
di: Deng, Junwei, et al.
Pubblicazione: (2024)
RLOMM: An Efficient and Robust Online Map Matching Framework with Reinforcement Learning
di: Chen, Minxiao, et al.
Pubblicazione: (2025)
di: Chen, Minxiao, et al.
Pubblicazione: (2025)
Measuring Fine-Grained Relatedness in Multitask Learning via Data Attribution
di: Tu, Yiwen, et al.
Pubblicazione: (2025)
di: Tu, Yiwen, et al.
Pubblicazione: (2025)
SG-OIF: A Stability-Guided Online Influence Framework for Reliable Vision Data
di: Rao, Penghao, et al.
Pubblicazione: (2025)
di: Rao, Penghao, et al.
Pubblicazione: (2025)
TransMI: A Framework to Create Strong Baselines from Multilingual Pretrained Language Models for Transliterated Data
di: Liu, Yihong, et al.
Pubblicazione: (2024)
di: Liu, Yihong, et al.
Pubblicazione: (2024)
Bayesian Design Principles for Offline-to-Online Reinforcement Learning
di: Hu, Hao, et al.
Pubblicazione: (2024)
di: Hu, Hao, et al.
Pubblicazione: (2024)
Freeze then Train: Towards Provable Representation Learning under Spurious Correlations and Feature Noise
di: Ye, Haotian, et al.
Pubblicazione: (2022)
di: Ye, Haotian, et al.
Pubblicazione: (2022)
Snapshot Reinforcement Learning: Leveraging Prior Trajectories for Efficiency
di: Zhao, Yanxiao, et al.
Pubblicazione: (2024)
di: Zhao, Yanxiao, et al.
Pubblicazione: (2024)
Efficient Ensembles Improve Training Data Attribution
di: Deng, Junwei, et al.
Pubblicazione: (2024)
di: Deng, Junwei, et al.
Pubblicazione: (2024)
ARIA: A Diagnostic Framework for Music Training Data Attribution
di: Han, Changheon, et al.
Pubblicazione: (2026)
di: Han, Changheon, et al.
Pubblicazione: (2026)
OATS: Online Data Augmentation for Time Series Foundation Models
di: Deng, Junwei, et al.
Pubblicazione: (2026)
di: Deng, Junwei, et al.
Pubblicazione: (2026)
How Faithful Is Trajectory-Based Data Attribution? Error Sources, Remedies, and Practical Guidelines
di: Deng, Junwei, et al.
Pubblicazione: (2026)
di: Deng, Junwei, et al.
Pubblicazione: (2026)
A Bird that flies with two wings
di: Forsyth, Miranda
Pubblicazione: (2013)
di: Forsyth, Miranda
Pubblicazione: (2013)
Exploring Training Data Attribution under Limited Access Constraints
di: Zhang, Shiyuan, et al.
Pubblicazione: (2025)
di: Zhang, Shiyuan, et al.
Pubblicazione: (2025)
A Nonlinear Multiscale Computational Framework for Fiber‐Reinforced Liners in Pipeline Rehabilitation
di: Yahong Zhao, et al.
Pubblicazione: (2026)
di: Yahong Zhao, et al.
Pubblicazione: (2026)
TFG: Unified Training-Free Guidance for Diffusion Models
di: Ye, Haotian, et al.
Pubblicazione: (2024)
di: Ye, Haotian, et al.
Pubblicazione: (2024)
Single-Snapshot Localization Using Sparse Extremely Large Aperture Arrays
di: Hu, Yunqiao, et al.
Pubblicazione: (2025)
di: Hu, Yunqiao, et al.
Pubblicazione: (2025)
Data-regularized Reinforcement Learning for Diffusion Models at Scale
di: Ye, Haotian, et al.
Pubblicazione: (2025)
di: Ye, Haotian, et al.
Pubblicazione: (2025)
Online Iterative Reinforcement Learning from Human Feedback with General Preference Model
di: Ye, Chenlu, et al.
Pubblicazione: (2024)
di: Ye, Chenlu, et al.
Pubblicazione: (2024)
DataInf: Efficiently Estimating Data Influence in LoRA-tuned LLMs and Diffusion Models
di: Kwon, Yongchan, et al.
Pubblicazione: (2023)
di: Kwon, Yongchan, et al.
Pubblicazione: (2023)
ReSPEC: A Framework for Online Multispectral Sensor Reconfiguration in Dynamic Environments
di: Liu, Yanchen, et al.
Pubblicazione: (2026)
di: Liu, Yanchen, et al.
Pubblicazione: (2026)
Stochastic Amortization: A Unified Approach to Accelerate Feature and Data Attribution
di: Covert, Ian, et al.
Pubblicazione: (2024)
di: Covert, Ian, et al.
Pubblicazione: (2024)
The Susceptibility Paradox in Online Social Influence
di: Luceri, Luca, et al.
Pubblicazione: (2024)
di: Luceri, Luca, et al.
Pubblicazione: (2024)
DiffusionNFT: Online Diffusion Reinforcement with Forward Process
di: Zheng, Kaiwen, et al.
Pubblicazione: (2025)
di: Zheng, Kaiwen, et al.
Pubblicazione: (2025)
DATE-LM: Benchmarking Data Attribution Evaluation for Large Language Models
di: Jiao, Cathy, et al.
Pubblicazione: (2025)
di: Jiao, Cathy, et al.
Pubblicazione: (2025)
Bayesian Influence Functions for Hessian-Free Data Attribution
di: Kreer, Philipp Alexander, et al.
Pubblicazione: (2025)
di: Kreer, Philipp Alexander, et al.
Pubblicazione: (2025)
SDF-TopoNet: A Two-Stage Framework for Tubular Structure Segmentation via SDF Pre-training and Topology-Aware Fine-Tuning
di: Wu, Siyi, et al.
Pubblicazione: (2025)
di: Wu, Siyi, et al.
Pubblicazione: (2025)
A Reliable Cryptographic Framework for Empirical Machine Unlearning Evaluation
di: Tu, Yiwen, et al.
Pubblicazione: (2024)
di: Tu, Yiwen, et al.
Pubblicazione: (2024)
Documenti analoghi
-
A Unified Theory of Random Projection for Influence Functions
di: Hu, Pingbang, et al.
Pubblicazione: (2026) -
Taming Hyperparameter Sensitivity in Data Attribution: Practical Selection Without Costly Retraining
di: Wang, Weiyi, et al.
Pubblicazione: (2025) -
Most Influential Subset Selection: Challenges, Promises, and Beyond
di: Hu, Yuzheng, et al.
Pubblicazione: (2024) -
A Versatile Influence Function for Data Attribution with Non-Decomposable Loss
di: Deng, Junwei, et al.
Pubblicazione: (2024) -
GraSS: Scalable Data Attribution with Gradient Sparsification and Sparse Projection
di: Hu, Pingbang, et al.
Pubblicazione: (2025)