Greedy Information Projection for LLM Data Selection
Fuente:
arXiv
Salvato in:
| Autori principali: | Dong, Victor Ye, Lee, Kuan-Yun, Shuai, Jiamei, Liu, Shengfei, Liu, Yi, Jiao, Jian |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
PMSS: Pretrained Matrices Skeleton Selection for LLM Fine-tuning
di: Wang, Qibin, et al.
Pubblicazione: (2024)
di: Wang, Qibin, et al.
Pubblicazione: (2024)
CDQuant: Greedy Coordinate Descent for Accurate LLM Quantization
di: Nair, Pranav Ajit, et al.
Pubblicazione: (2024)
di: Nair, Pranav Ajit, et al.
Pubblicazione: (2024)
ROSE: A Reward-Oriented Data Selection Framework for LLM Task-Specific Instruction Tuning
di: Wu, Yang, et al.
Pubblicazione: (2024)
di: Wu, Yang, et al.
Pubblicazione: (2024)
Two Calls, Two Moments, and the Vote-Accuracy Curve of Repeated LLM Inference
di: Liu, Yi
Pubblicazione: (2026)
di: Liu, Yi
Pubblicazione: (2026)
Learn More, Forget Less: A Gradient-Aware Data Selection Approach for LLM
di: Liu, Yibai, et al.
Pubblicazione: (2025)
di: Liu, Yibai, et al.
Pubblicazione: (2025)
When Greedy Wins: Emergent Exploitation Bias in Meta-Bandit LLM Training
di: Chen, Sanxing, et al.
Pubblicazione: (2025)
di: Chen, Sanxing, et al.
Pubblicazione: (2025)
Enhancing Multilingual LLM Pretraining with Model-Based Data Selection
di: Messmer, Bettina, et al.
Pubblicazione: (2025)
di: Messmer, Bettina, et al.
Pubblicazione: (2025)
UFO-RL: Uncertainty-Focused Optimization for Efficient Reinforcement Learning Data Selection
di: Zhao, Yang, et al.
Pubblicazione: (2025)
di: Zhao, Yang, et al.
Pubblicazione: (2025)
Strategic Demonstration Selection for Improved Fairness in LLM In-Context Learning
di: Hu, Jingyu, et al.
Pubblicazione: (2024)
di: Hu, Jingyu, et al.
Pubblicazione: (2024)
SPIO: Ensemble and Selective Strategies via LLM-Based Multi-Agent Planning in Automated Data Science
di: Seo, Wonduk, et al.
Pubblicazione: (2025)
di: Seo, Wonduk, et al.
Pubblicazione: (2025)
From Alignment to Advancement: Bootstrapping Audio-Language Alignment with Synthetic Data
di: Kuan, Chun-Yi, et al.
Pubblicazione: (2025)
di: Kuan, Chun-Yi, et al.
Pubblicazione: (2025)
Not All LLM-Generated Data Are Equal: Rethinking Data Weighting in Text Classification
di: Kuo, Hsun-Yu, et al.
Pubblicazione: (2024)
di: Kuo, Hsun-Yu, et al.
Pubblicazione: (2024)
LoopTool: Closing the Data-Training Loop for Robust LLM Tool Calls
di: Zhang, Kangning, et al.
Pubblicazione: (2025)
di: Zhang, Kangning, et al.
Pubblicazione: (2025)
Disentangling the Roles of Representation and Selection in Data Pruning
di: Du, Yupei, et al.
Pubblicazione: (2025)
di: Du, Yupei, et al.
Pubblicazione: (2025)
Gender Bias in Instruction-Guided Speech Synthesis Models
di: Kuan, Chun-Yi, et al.
Pubblicazione: (2025)
di: Kuan, Chun-Yi, et al.
Pubblicazione: (2025)
PEDAL: Enhancing Greedy Decoding with Large Language Models using Diverse Exemplars
di: Prabhu, Sumanth
Pubblicazione: (2024)
di: Prabhu, Sumanth
Pubblicazione: (2024)
LCSB: Layer-Cyclic Selective Backpropagation for Memory-Efficient On-Device LLM Fine-Tuning
di: Park, Juneyoung, et al.
Pubblicazione: (2026)
di: Park, Juneyoung, et al.
Pubblicazione: (2026)
Enhancing LLM Tool Use with High-quality Instruction Data from Knowledge Graph
di: Wang, Jingwei, et al.
Pubblicazione: (2025)
di: Wang, Jingwei, et al.
Pubblicazione: (2025)
Efficient RLVR Training via Weighted Mutual Information Data Selection
di: Zhou, Xinyu, et al.
Pubblicazione: (2026)
di: Zhou, Xinyu, et al.
Pubblicazione: (2026)
Comparative Analysis of Demonstration Selection Algorithms for LLM In-Context Learning
di: Shu, Dong, et al.
Pubblicazione: (2024)
di: Shu, Dong, et al.
Pubblicazione: (2024)
Selective Reflection-Tuning: Student-Selected Data Recycling for LLM Instruction-Tuning
di: Li, Ming, et al.
Pubblicazione: (2024)
di: Li, Ming, et al.
Pubblicazione: (2024)
When Scaling Meets LLM Finetuning: The Effect of Data, Model and Finetuning Method
di: Zhang, Biao, et al.
Pubblicazione: (2024)
di: Zhang, Biao, et al.
Pubblicazione: (2024)
vLLM Hook v0: A Plug-in for Programming Model Internals on vLLM
di: Ko, Ching-Yun, et al.
Pubblicazione: (2026)
di: Ko, Ching-Yun, et al.
Pubblicazione: (2026)
SEEKR: Selective Attention-Guided Knowledge Retention for Continual Learning of Large Language Models
di: He, Jinghan, et al.
Pubblicazione: (2024)
di: He, Jinghan, et al.
Pubblicazione: (2024)
TRACES: Proactive Safety Auditing for Multi-Turn LLM Agents via Trajectory-State Modeling
di: Li, Jiaqian, et al.
Pubblicazione: (2026)
di: Li, Jiaqian, et al.
Pubblicazione: (2026)
Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing
di: Liu, Tianci, et al.
Pubblicazione: (2025)
di: Liu, Tianci, et al.
Pubblicazione: (2025)
Selection of LLM Fine-Tuning Data based on Orthogonal Rules
di: Li, Xiaomin, et al.
Pubblicazione: (2024)
di: Li, Xiaomin, et al.
Pubblicazione: (2024)
Utility-Diversity Aware Online Batch Selection for LLM Supervised Fine-tuning
di: Zou, Heming, et al.
Pubblicazione: (2025)
di: Zou, Heming, et al.
Pubblicazione: (2025)
GRIP: Geometric Refinement and Adaptive Information Potential for Data Efficiency
di: Wang, Changhao, et al.
Pubblicazione: (2026)
di: Wang, Changhao, et al.
Pubblicazione: (2026)
Entropy Law: The Story Behind Data Compression and LLM Performance
di: Yin, Mingjia, et al.
Pubblicazione: (2024)
di: Yin, Mingjia, et al.
Pubblicazione: (2024)
One Token to Fool LLM-as-a-Judge
di: Zhao, Yulai, et al.
Pubblicazione: (2025)
di: Zhao, Yulai, et al.
Pubblicazione: (2025)
Sparse Attention Remapping with Clustering for Efficient LLM Decoding on PIM
di: Fan, Zehao, et al.
Pubblicazione: (2025)
di: Fan, Zehao, et al.
Pubblicazione: (2025)
Freshness-Aware Prioritized Experience Replay for LLM/VLM Reinforcement Learning
di: Ma, Weiyu, et al.
Pubblicazione: (2026)
di: Ma, Weiyu, et al.
Pubblicazione: (2026)
Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples
di: Gao, Chengqian, et al.
Pubblicazione: (2025)
di: Gao, Chengqian, et al.
Pubblicazione: (2025)
Adaptive Layer Selection for Layer-Wise Token Pruning in LLM Inference
di: Taniguchi, Rei, et al.
Pubblicazione: (2026)
di: Taniguchi, Rei, et al.
Pubblicazione: (2026)
Filter-then-Weight: Online Data Selection and Reweighting for LLM Fine-Tuning
di: Wang, Fangxin, et al.
Pubblicazione: (2026)
di: Wang, Fangxin, et al.
Pubblicazione: (2026)
GradAlign: Gradient-Aligned Data Selection for LLM Reinforcement Learning
di: Yang, Ningyuan, et al.
Pubblicazione: (2026)
di: Yang, Ningyuan, et al.
Pubblicazione: (2026)
Less is More: Improving LLM Alignment via Preference Data Selection
di: Deng, Xun, et al.
Pubblicazione: (2025)
di: Deng, Xun, et al.
Pubblicazione: (2025)
$\textbf{AGT$^{AO}$}$: Robust and Stabilized LLM Unlearning via Adversarial Gating Training with Adaptive Orthogonality
di: Li, Pengyu, et al.
Pubblicazione: (2026)
di: Li, Pengyu, et al.
Pubblicazione: (2026)
Knowledge-Driven Feature Selection and Engineering for Genotype Data with Large Language Models
di: Lee, Joseph, et al.
Pubblicazione: (2024)
di: Lee, Joseph, et al.
Pubblicazione: (2024)
Documenti analoghi
-
PMSS: Pretrained Matrices Skeleton Selection for LLM Fine-tuning
di: Wang, Qibin, et al.
Pubblicazione: (2024) -
CDQuant: Greedy Coordinate Descent for Accurate LLM Quantization
di: Nair, Pranav Ajit, et al.
Pubblicazione: (2024) -
ROSE: A Reward-Oriented Data Selection Framework for LLM Task-Specific Instruction Tuning
di: Wu, Yang, et al.
Pubblicazione: (2024) -
Two Calls, Two Moments, and the Vote-Accuracy Curve of Repeated LLM Inference
di: Liu, Yi
Pubblicazione: (2026) -
Learn More, Forget Less: A Gradient-Aware Data Selection Approach for LLM
di: Liu, Yibai, et al.
Pubblicazione: (2025)