Sketching the Readout of Large Language Models for Scalable Data Attribution and Valuation
Fuente:
arXiv
Saved in:
| Main Authors: | Ran, Yide, Xie, Jianwen, Wang, Minghui, Zheng, Wenjin, Zhang, Denghui, Li, Chuan, Xu, Zhaozhuo |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
ALinFiK: Learning to Approximate Linearized Future Influence Kernel for Scalable Third-Party LLM Data Valuation
by: Pan, Yanzhou, et al.
Published: (2025)
by: Pan, Yanzhou, et al.
Published: (2025)
Randomized Antipodal Search Done Right for Data Pareto Improvement of LLM Unlearning
by: Liu, Ziwen, et al.
Published: (2026)
by: Liu, Ziwen, et al.
Published: (2026)
Mitigating Non-IID Drift in Zeroth-Order Federated LLM Fine-Tuning with Transferable Sparsity
by: Ran, Yide, et al.
Published: (2025)
by: Ran, Yide, et al.
Published: (2025)
To Compress or Not? Pushing the Frontier of Lossless GenAI Model Weights Compression with Exponent Concentration
by: Yang, Zeyu, et al.
Published: (2025)
by: Yang, Zeyu, et al.
Published: (2025)
Sketch to Adapt: Fine-Tunable Sketches for Efficient LLM Adaptation
by: Zhang, Tianyi, et al.
Published: (2024)
by: Zhang, Tianyi, et al.
Published: (2024)
OAT-Rephrase: Optimization-Aware Training Data Rephrasing for Zeroth-Order LLM Fine-Tuning
by: Long, Jikai, et al.
Published: (2025)
by: Long, Jikai, et al.
Published: (2025)
Data Distribution Valuation
by: Xu, Xinyi, et al.
Published: (2024)
by: Xu, Xinyi, et al.
Published: (2024)
Lego Sketch: A Scalable Memory-augmented Neural Network for Sketching Data Streams
by: Feng, Yuan, et al.
Published: (2025)
by: Feng, Yuan, et al.
Published: (2025)
KAIROS: Scalable Model-Agnostic Data Valuation
by: Zhu, Jiongli, et al.
Published: (2025)
by: Zhu, Jiongli, et al.
Published: (2025)
KV Cache is 1 Bit Per Channel: Efficient Large Language Model Inference with Coupled Quantization
by: Zhang, Tianyi, et al.
Published: (2024)
by: Zhang, Tianyi, et al.
Published: (2024)
Learning from the Right Rollouts: Data Attribution for PPO-based LLM Post-Training
by: Shu, Dong, et al.
Published: (2026)
by: Shu, Dong, et al.
Published: (2026)
DEL-ToM: Inference-Time Scaling for Theory-of-Mind Reasoning via Dynamic Epistemic Logic
by: Wu, Yuheng, et al.
Published: (2025)
by: Wu, Yuheng, et al.
Published: (2025)
Source Attribution for Large Language Model-Generated Data
by: Wang, Jingtan, et al.
Published: (2023)
by: Wang, Jingtan, et al.
Published: (2023)
Attribution-Guided Continual Learning for Large Language Models
by: Liu, Yazheng, et al.
Published: (2026)
by: Liu, Yazheng, et al.
Published: (2026)
SAVA: Scalable Learning-Agnostic Data Valuation
by: Kessler, Samuel, et al.
Published: (2024)
by: Kessler, Samuel, et al.
Published: (2024)
Efficient Sketches for Training Data Attribution and Studying the Loss Landscape
by: Schioppa, Andrea
Published: (2024)
by: Schioppa, Andrea
Published: (2024)
Scout Before You Attend: Sketch-and-Walk Sparse Attention for Efficient LLM Inference
by: Le, Hoang Anh Duy, et al.
Published: (2026)
by: Le, Hoang Anh Duy, et al.
Published: (2026)
Synthetic Interaction Data for Scalable Personalization in Large Language Models
by: Ma, Yuchen, et al.
Published: (2026)
by: Ma, Yuchen, et al.
Published: (2026)
Data Overvaluation Attack and Truthful Data Valuation in Federated Learning
by: Zheng, Shuyuan, et al.
Published: (2025)
by: Zheng, Shuyuan, et al.
Published: (2025)
Distilling Large Language Models for Text-Attributed Graph Learning
by: Pan, Bo, et al.
Published: (2024)
by: Pan, Bo, et al.
Published: (2024)
LoRIF: Low-Rank Influence Functions for Scalable Training Data Attribution
by: Li, Shuangqi, et al.
Published: (2026)
by: Li, Shuangqi, et al.
Published: (2026)
Model Generalization on Text Attribute Graphs: Principles with Large Language Models
by: Wang, Haoyu, et al.
Published: (2025)
by: Wang, Haoyu, et al.
Published: (2025)
2D-OOB: Attributing Data Contribution Through Joint Valuation Framework
by: Sun, Yifan, et al.
Published: (2024)
by: Sun, Yifan, et al.
Published: (2024)
InstructPro: Natural Language Guided Ligand-Binding Protein Design
by: Song, Zhenqiao, et al.
Published: (2025)
by: Song, Zhenqiao, et al.
Published: (2025)
Influence Functions for Scalable Data Attribution in Diffusion Models
by: Mlodozeniec, Bruno, et al.
Published: (2024)
by: Mlodozeniec, Bruno, et al.
Published: (2024)
Fast-DataShapley: Neural Modeling for Training Data Valuation
by: Sun, Haifeng, et al.
Published: (2025)
by: Sun, Haifeng, et al.
Published: (2025)
Neural Dynamic Data Valuation: A Stochastic Optimal Control Approach
by: Liang, Zhangyong, et al.
Published: (2024)
by: Liang, Zhangyong, et al.
Published: (2024)
Helpful or Harmful Data? Fine-tuning-free Shapley Attribution for Explaining Language Model Predictions
by: Wang, Jingtan, et al.
Published: (2024)
by: Wang, Jingtan, et al.
Published: (2024)
Robust and Scalable Model Editing for Large Language Models
by: Chen, Yingfa, et al.
Published: (2024)
by: Chen, Yingfa, et al.
Published: (2024)
Beyond Models! Explainable Data Valuation and Metric Adaption for Recommendation
by: Jia, Renqi, et al.
Published: (2025)
by: Jia, Renqi, et al.
Published: (2025)
ScaleLLM: A Resource-Frugal LLM Serving Framework by Optimizing End-to-End Efficiency
by: Yao, Yuhang, et al.
Published: (2024)
by: Yao, Yuhang, et al.
Published: (2024)
Dynamic Maintenance of Kernel Density Estimation Data Structure: From Practice to Theory
by: Liang, Jiehao, et al.
Published: (2022)
by: Liang, Jiehao, et al.
Published: (2022)
Is Data Valuation Learnable and Interpretable?
by: Wu, Ou, et al.
Published: (2024)
by: Wu, Ou, et al.
Published: (2024)
CAFL-L: Constraint-Aware Federated Learning with Lagrangian Dual Optimization for On-Device Language Models
by: Zheng, Dongqi, et al.
Published: (2025)
by: Zheng, Dongqi, et al.
Published: (2025)
Error Estimate and Convergence Analysis for Data Valuation
by: Liang, Zhangyong, et al.
Published: (2025)
by: Liang, Zhangyong, et al.
Published: (2025)
QLESS: A Quantized Approach for Data Valuation and Selection in Large Language Model Fine-Tuning
by: Ananta, Moses, et al.
Published: (2025)
by: Ananta, Moses, et al.
Published: (2025)
Scalable Property Valuation Models via Graph-based Deep Learning
by: Riveros, Enrique, et al.
Published: (2024)
by: Riveros, Enrique, et al.
Published: (2024)
Scalable Valuation of Human Feedback through Provably Robust Model Alignment
by: Fujisawa, Masahiro, et al.
Published: (2025)
by: Fujisawa, Masahiro, et al.
Published: (2025)
Data Valuation and Selection in a Federated Model Marketplace
by: Li, Wenqian, et al.
Published: (2025)
by: Li, Wenqian, et al.
Published: (2025)
Data-centric Federated Graph Learning with Large Language Models
by: Yan, Bo, et al.
Published: (2025)
by: Yan, Bo, et al.
Published: (2025)
Similar Items
-
ALinFiK: Learning to Approximate Linearized Future Influence Kernel for Scalable Third-Party LLM Data Valuation
by: Pan, Yanzhou, et al.
Published: (2025) -
Randomized Antipodal Search Done Right for Data Pareto Improvement of LLM Unlearning
by: Liu, Ziwen, et al.
Published: (2026) -
Mitigating Non-IID Drift in Zeroth-Order Federated LLM Fine-Tuning with Transferable Sparsity
by: Ran, Yide, et al.
Published: (2025) -
To Compress or Not? Pushing the Frontier of Lossless GenAI Model Weights Compression with Exponent Concentration
by: Yang, Zeyu, et al.
Published: (2025) -
Sketch to Adapt: Fine-Tunable Sketches for Efficient LLM Adaptation
by: Zhang, Tianyi, et al.
Published: (2024)