Clustering and Ranking: Diversity-preserved Instruction Selection through Expert-aligned Quality Estimation
Fuente:
arXiv
Salvato in:
| Autori principali: | Ge, Yuan, Liu, Yilun, Hu, Chi, Meng, Weibin, Tao, Shimin, Zhao, Xiaofeng, Ma, Hongxia, Zhang, Li, Chen, Boxing, Yang, Hao, Li, Bei, Xiao, Tong, Zhu, Jingbo |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
M-DaQ: Retrieving Samples with Multilingual Diversity and Quality for Instruction Fine-Tuning Datasets
di: Zhao, Chunguang, et al.
Pubblicazione: (2025)
di: Zhao, Chunguang, et al.
Pubblicazione: (2025)
MIDB: Multilingual Instruction Data Booster for Enhancing Cultural Equality in Multilingual Instruction Synthesis
di: Liu, Yilun, et al.
Pubblicazione: (2025)
di: Liu, Yilun, et al.
Pubblicazione: (2025)
LogLM: From Task-based to Instruction-based Automated Log Analysis
di: Liu, Yilun, et al.
Pubblicazione: (2024)
di: Liu, Yilun, et al.
Pubblicazione: (2024)
ELSPR: Evaluator LLM Training Data Self-Purification on Non-Transitive Preferences via Tournament Graph Reconstruction
di: Yu, Yan, et al.
Pubblicazione: (2025)
di: Yu, Yan, et al.
Pubblicazione: (2025)
CoachLM: Automatic Instruction Revisions Improve the Data Quality in LLM Instruction Tuning
di: Liu, Yilun, et al.
Pubblicazione: (2023)
di: Liu, Yilun, et al.
Pubblicazione: (2023)
From Handcrafted Features to LLMs: A Brief Survey for Machine Translation Quality Estimation
di: Zhao, Haofei, et al.
Pubblicazione: (2024)
di: Zhao, Haofei, et al.
Pubblicazione: (2024)
R1-T1: Fully Incentivizing Translation Capability in LLMs via Reasoning Learning
di: He, Minggui, et al.
Pubblicazione: (2025)
di: He, Minggui, et al.
Pubblicazione: (2025)
Adapting Large Language Models to Log Analysis with Interpretable Domain Knowledge
di: Ji, Yuhe, et al.
Pubblicazione: (2024)
di: Ji, Yuhe, et al.
Pubblicazione: (2024)
C-Mining: Unsupervised Discovery of Seeds for Cultural Data Synthesis via Geometric Misalignment
di: Zeng, Pufan, et al.
Pubblicazione: (2026)
di: Zeng, Pufan, et al.
Pubblicazione: (2026)
RationAnomaly: Log Anomaly Detection with Rationality via Chain-of-Thought and Reinforcement Learning
di: Xu, Song, et al.
Pubblicazione: (2025)
di: Xu, Song, et al.
Pubblicazione: (2025)
RankPrompt: Step-by-Step Comparisons Make Language Models Better Reasoners
di: Hu, Chi, et al.
Pubblicazione: (2024)
di: Hu, Chi, et al.
Pubblicazione: (2024)
Optimizing Speech Multi-View Feature Fusion through Conditional Computation
di: Shan, Weiqiao, et al.
Pubblicazione: (2025)
di: Shan, Weiqiao, et al.
Pubblicazione: (2025)
EIT: Enhanced Interactive Transformer
di: Zheng, Tong, et al.
Pubblicazione: (2022)
di: Zheng, Tong, et al.
Pubblicazione: (2022)
Interpretable Online Log Analysis Using Large Language Models with Prompt Strategies
di: Liu, Yilun, et al.
Pubblicazione: (2023)
di: Liu, Yilun, et al.
Pubblicazione: (2023)
Taming Text-to-Image Synthesis for Novices: User-centric Prompt Generation via Multi-turn Guidance
di: Liu, Yilun, et al.
Pubblicazione: (2024)
di: Liu, Yilun, et al.
Pubblicazione: (2024)
Unlocking Fine-Grained Translation Quality Estimation in LRMs through Synergistically Evolving Implicit and Explicit Reasoning
di: Dang, Renfei, et al.
Pubblicazione: (2026)
di: Dang, Renfei, et al.
Pubblicazione: (2026)
LogEval: A Comprehensive Benchmark Suite for Large Language Models In Log Analysis
di: Cui, Tianyu, et al.
Pubblicazione: (2024)
di: Cui, Tianyu, et al.
Pubblicazione: (2024)
Early Exit Is a Natural Capability in Transformer-based Models: An Empirical Study on Early Exit without Joint Optimization
di: Shan, Weiqiao, et al.
Pubblicazione: (2024)
di: Shan, Weiqiao, et al.
Pubblicazione: (2024)
IFIR: A Comprehensive Benchmark for Evaluating Instruction-Following in Expert-Domain Information Retrieval
di: Song, Tingyu, et al.
Pubblicazione: (2025)
di: Song, Tingyu, et al.
Pubblicazione: (2025)
Lifelong Knowledge Editing for Vision Language Models with Low-Rank Mixture-of-Experts
di: Chen, Qizhou, et al.
Pubblicazione: (2024)
di: Chen, Qizhou, et al.
Pubblicazione: (2024)
Mixture-of-Clustered-Experts: Advancing Expert Specialization and Generalization in Instruction Tuning
di: Eo, Sugyeong, et al.
Pubblicazione: (2025)
di: Eo, Sugyeong, et al.
Pubblicazione: (2025)
Instruction-following Evaluation through Verbalizer Manipulation
di: Li, Shiyang, et al.
Pubblicazione: (2023)
di: Li, Shiyang, et al.
Pubblicazione: (2023)
Monitoring Alien Species Diversity in Ballast Water Based on Environmental DNA Metabarcoding
di: Hanglei Li, et al.
Pubblicazione: (2025)
di: Hanglei Li, et al.
Pubblicazione: (2025)
DCHO: A Decomposition-Composition Framework for Predicting Higher-Order Brain Connectivity to Enhance Diverse Downstream Applications
di: Li, Weibin, et al.
Pubblicazione: (2025)
di: Li, Weibin, et al.
Pubblicazione: (2025)
EndoGMDE: Generalizable Monocular Depth Estimation with Mixture of Low-Rank Experts for Diverse Endoscopic Scenes
di: Shao, Liangjing, et al.
Pubblicazione: (2025)
di: Shao, Liangjing, et al.
Pubblicazione: (2025)
R-Log: Incentivizing Log Analysis Capability in LLMs via Reasoning-based Reinforcement Learning
di: Liu, Yilun, et al.
Pubblicazione: (2025)
di: Liu, Yilun, et al.
Pubblicazione: (2025)
Rapid and Safe Trajectory Planning over Diverse Scenes through Diffusion Composition
di: Mao, Wule, et al.
Pubblicazione: (2025)
di: Mao, Wule, et al.
Pubblicazione: (2025)
Ranking Perspective for Tree-based Methods with Applications to Symbolic Feature Selection
di: Luo, Hengrui, et al.
Pubblicazione: (2024)
di: Luo, Hengrui, et al.
Pubblicazione: (2024)
Mixture of Cluster-conditional LoRA Experts for Vision-language Instruction Tuning
di: Gou, Yunhao, et al.
Pubblicazione: (2023)
di: Gou, Yunhao, et al.
Pubblicazione: (2023)
PartialFormer: Modeling Part Instead of Whole for Machine Translation
di: Zheng, Tong, et al.
Pubblicazione: (2023)
di: Zheng, Tong, et al.
Pubblicazione: (2023)
Instructional Responses to the Presence and Potential of Diversity: Toward Expert Collaboration.
di: Huston, Mary M.
Pubblicazione: (1994)
di: Huston, Mary M.
Pubblicazione: (1994)
TAGCOS: Task-agnostic Gradient Clustered Coreset Selection for Instruction Tuning Data
di: Zhang, Jipeng, et al.
Pubblicazione: (2024)
di: Zhang, Jipeng, et al.
Pubblicazione: (2024)
Each Rank Could be an Expert: Single-Ranked Mixture of Experts LoRA for Multi-Task Learning
di: Zhao, Ziyu, et al.
Pubblicazione: (2025)
di: Zhao, Ziyu, et al.
Pubblicazione: (2025)
Parameter-Efficient Sparsity Crafting from Dense to Mixture-of-Experts for Instruction Tuning on General Tasks
di: Wu, Haoyuan, et al.
Pubblicazione: (2024)
di: Wu, Haoyuan, et al.
Pubblicazione: (2024)
Dissecting Long-Chain-of-Thought Reasoning Models: An Empirical Study
di: Mu, Yongyu, et al.
Pubblicazione: (2025)
di: Mu, Yongyu, et al.
Pubblicazione: (2025)
A novel algorithm for optimizing bundle adjustment in image sequence alignment
di: Xu, Hailin, et al.
Pubblicazione: (2024)
di: Xu, Hailin, et al.
Pubblicazione: (2024)
Early and Late Mechanisms of Object‐Based Attention: Dissociation Between Faces and Non‐Face Objects
di: Tong Xie, et al.
Pubblicazione: (2025)
di: Tong Xie, et al.
Pubblicazione: (2025)
SLAM: Towards Efficient Multilingual Reasoning via Selective Language Alignment
di: Fan, Yuchun, et al.
Pubblicazione: (2025)
di: Fan, Yuchun, et al.
Pubblicazione: (2025)
Unveiling Instruction-Specific Neurons & Experts: An Analytical Framework for LLM's Instruction-Following Capabilities
di: Zhang, Junyan, et al.
Pubblicazione: (2025)
di: Zhang, Junyan, et al.
Pubblicazione: (2025)
GuiLoMo: Allocating Expert Number and Rank for LoRA-MoE via Bilevel Optimization with GuidedSelection Vectors
di: Zhang, Hengyuan, et al.
Pubblicazione: (2025)
di: Zhang, Hengyuan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
M-DaQ: Retrieving Samples with Multilingual Diversity and Quality for Instruction Fine-Tuning Datasets
di: Zhao, Chunguang, et al.
Pubblicazione: (2025) -
MIDB: Multilingual Instruction Data Booster for Enhancing Cultural Equality in Multilingual Instruction Synthesis
di: Liu, Yilun, et al.
Pubblicazione: (2025) -
LogLM: From Task-based to Instruction-based Automated Log Analysis
di: Liu, Yilun, et al.
Pubblicazione: (2024) -
ELSPR: Evaluator LLM Training Data Self-Purification on Non-Transitive Preferences via Tournament Graph Reconstruction
di: Yu, Yan, et al.
Pubblicazione: (2025) -
CoachLM: Automatic Instruction Revisions Improve the Data Quality in LLM Instruction Tuning
di: Liu, Yilun, et al.
Pubblicazione: (2023)