Mosaic-IT: Cost-Free Compositional Data Synthesis for Instruction Tuning
Fuente:
arXiv
Guardado en:
| Autores principales: | Li, Ming, Chen, Pei, Wang, Chenguang, Zhao, Hongyu, Liang, Yijun, Hou, Yupeng, Liu, Fuxiao, Zhou, Tianyi |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Superfiltering: Weak-to-Strong Data Filtering for Fast Instruction-Tuning
por: Li, Ming, et al.
Publicado: (2024)
por: Li, Ming, et al.
Publicado: (2024)
Selective Reflection-Tuning: Student-Selected Data Recycling for LLM Instruction-Tuning
por: Li, Ming, et al.
Publicado: (2024)
por: Li, Ming, et al.
Publicado: (2024)
InstructGraph: Boosting Large Language Models via Graph-centric Instruction Tuning and Preference Alignment
por: Wang, Jianing, et al.
Publicado: (2024)
por: Wang, Jianing, et al.
Publicado: (2024)
From Quantity to Quality: Boosting LLM Performance with Self-Guided Data Selection for Instruction Tuning
por: Li, Ming, et al.
Publicado: (2023)
por: Li, Ming, et al.
Publicado: (2023)
MMC: Advancing Multimodal Chart Understanding with Large-scale Instruction Tuning
por: Liu, Fuxiao, et al.
Publicado: (2023)
por: Liu, Fuxiao, et al.
Publicado: (2023)
RuleR: Improving LLM Controllability by Rule-based Data Recycling
por: Li, Ming, et al.
Publicado: (2024)
por: Li, Ming, et al.
Publicado: (2024)
ColorBench: Can VLMs See and Understand the Colorful World? A Comprehensive Benchmark for Color Perception, Reasoning, and Robustness
por: Liang, Yijun, et al.
Publicado: (2025)
por: Liang, Yijun, et al.
Publicado: (2025)
Mitigating Hallucination in Large Multi-Modal Models via Robust Instruction Tuning
por: Liu, Fuxiao, et al.
Publicado: (2023)
por: Liu, Fuxiao, et al.
Publicado: (2023)
BenTo: Benchmark Task Reduction with In-Context Transferability
por: Zhao, Hongyu, et al.
Publicado: (2024)
por: Zhao, Hongyu, et al.
Publicado: (2024)
CaughtCheating: Is Your MLLM a Good Cheating Detective? Exploring the Boundary of Visual Perception and Reasoning
por: Li, Ming, et al.
Publicado: (2025)
por: Li, Ming, et al.
Publicado: (2025)
CoachLM: Automatic Instruction Revisions Improve the Data Quality in LLM Instruction Tuning
por: Liu, Yilun, et al.
Publicado: (2023)
por: Liu, Yilun, et al.
Publicado: (2023)
How Instruction and Reasoning Data shape Post-Training: Data Quality through the Lens of Layer-wise Gradients
por: Li, Ming, et al.
Publicado: (2025)
por: Li, Ming, et al.
Publicado: (2025)
System-2 Mathematical Reasoning via Enriched Instruction Tuning
por: Cai, Huanqia, et al.
Publicado: (2024)
por: Cai, Huanqia, et al.
Publicado: (2024)
Facilitating Multi-turn Function Calling for LLMs via Compositional Instruction Tuning
por: Chen, Mingyang, et al.
Publicado: (2024)
por: Chen, Mingyang, et al.
Publicado: (2024)
Contrastive Instruction Tuning
por: Yan, Tianyi Lorena, et al.
Publicado: (2024)
por: Yan, Tianyi Lorena, et al.
Publicado: (2024)
Instruction-Tuning Data Synthesis from Scratch via Web Reconstruction
por: Jiang, Yuxin, et al.
Publicado: (2025)
por: Jiang, Yuxin, et al.
Publicado: (2025)
ClimateChat: Designing Data and Methods for Instruction Tuning LLMs to Answer Climate Change Queries
por: Chen, Zhou, et al.
Publicado: (2025)
por: Chen, Zhou, et al.
Publicado: (2025)
Re-Tuning: Overcoming the Compositionality Limits of Large Language Models with Recursive Tuning
por: Pasewark, Eric, et al.
Publicado: (2024)
por: Pasewark, Eric, et al.
Publicado: (2024)
Instruction Following without Instruction Tuning
por: Hewitt, John, et al.
Publicado: (2024)
por: Hewitt, John, et al.
Publicado: (2024)
Data Diversity Matters for Robust Instruction Tuning
por: Bukharin, Alexander, et al.
Publicado: (2023)
por: Bukharin, Alexander, et al.
Publicado: (2023)
Your Vision-Language Model Itself Is a Strong Filter: Towards High-Quality Instruction Tuning with Data Selection
por: Chen, Ruibo, et al.
Publicado: (2024)
por: Chen, Ruibo, et al.
Publicado: (2024)
Can LLMs Speak For Diverse People? Tuning LLMs via Debate to Generate Controllable Controversial Statements
por: Li, Ming, et al.
Publicado: (2024)
por: Li, Ming, et al.
Publicado: (2024)
Chain-of-Instructions: Compositional Instruction Tuning on Large Language Models
por: Hayati, Shirley Anugrah, et al.
Publicado: (2024)
por: Hayati, Shirley Anugrah, et al.
Publicado: (2024)
RECOST: External Knowledge Guided Data-efficient Instruction Tuning
por: Zhang, Qi, et al.
Publicado: (2024)
por: Zhang, Qi, et al.
Publicado: (2024)
TS-Reasoner: Aligning Time Series Foundation Models with LLM Reasoning
por: Yu, Fangxu, et al.
Publicado: (2025)
por: Yu, Fangxu, et al.
Publicado: (2025)
Toward Secure Tuning: Mitigating Security Risks from Instruction Fine-Tuning
por: Du, Yanrui, et al.
Publicado: (2024)
por: Du, Yanrui, et al.
Publicado: (2024)
Less is More: High-value Data Selection for Visual Instruction Tuning
por: Liu, Zikang, et al.
Publicado: (2024)
por: Liu, Zikang, et al.
Publicado: (2024)
DS$^2$-Instruct: Domain-Specific Data Synthesis for Large Language Models Instruction Tuning
por: Xu, Ruiyao, et al.
Publicado: (2026)
por: Xu, Ruiyao, et al.
Publicado: (2026)
FedMosaic: Federated Retrieval-Augmented Generation via Parametric Adapters
por: Liang, Zhilin, et al.
Publicado: (2026)
por: Liang, Zhilin, et al.
Publicado: (2026)
Importance-Aware Data Selection for Efficient LLM Instruction Tuning
por: Jiang, Tingyu, et al.
Publicado: (2025)
por: Jiang, Tingyu, et al.
Publicado: (2025)
Generalizing From Short to Long: Effective Data Synthesis for Long-Context Instruction Tuning
por: Zhu, Wenhao, et al.
Publicado: (2025)
por: Zhu, Wenhao, et al.
Publicado: (2025)
MIDB: Multilingual Instruction Data Booster for Enhancing Cultural Equality in Multilingual Instruction Synthesis
por: Liu, Yilun, et al.
Publicado: (2025)
por: Liu, Yilun, et al.
Publicado: (2025)
Dual Instruction Tuning with Large Language Models for Mathematical Reasoning
por: Zhou, Yongwei, et al.
Publicado: (2024)
por: Zhou, Yongwei, et al.
Publicado: (2024)
MLAN: Language-Based Instruction Tuning Preserves and Transfers Knowledge in Multimodal Language Models
por: Tu, Jianhong, et al.
Publicado: (2024)
por: Tu, Jianhong, et al.
Publicado: (2024)
AzeroS: Extending LLM to Speech with Self-Generated Instruction-Free Tuning
por: Shao, Yiwen, et al.
Publicado: (2025)
por: Shao, Yiwen, et al.
Publicado: (2025)
GIFT: Guided Fine-Tuning and Transfer for Enhancing Instruction-Tuned Language Models
por: Ruan, Zhiwen, et al.
Publicado: (2026)
por: Ruan, Zhiwen, et al.
Publicado: (2026)
Beyond Similarity: A Gradient-based Graph Method for Instruction Tuning Data Selection
por: Zhao, Yang, et al.
Publicado: (2025)
por: Zhao, Yang, et al.
Publicado: (2025)
Exploring Format Consistency for Instruction Tuning
por: Liang, Shihao, et al.
Publicado: (2023)
por: Liang, Shihao, et al.
Publicado: (2023)
ATLaS: Agent Tuning via Learning Critical Steps
por: Chen, Zhixun, et al.
Publicado: (2025)
por: Chen, Zhixun, et al.
Publicado: (2025)
IterSelectTune: An Iterative Training Framework for Efficient Instruction-Tuning Data Selection
por: Song, Jielin, et al.
Publicado: (2024)
por: Song, Jielin, et al.
Publicado: (2024)
Ejemplares similares
-
Superfiltering: Weak-to-Strong Data Filtering for Fast Instruction-Tuning
por: Li, Ming, et al.
Publicado: (2024) -
Selective Reflection-Tuning: Student-Selected Data Recycling for LLM Instruction-Tuning
por: Li, Ming, et al.
Publicado: (2024) -
InstructGraph: Boosting Large Language Models via Graph-centric Instruction Tuning and Preference Alignment
por: Wang, Jianing, et al.
Publicado: (2024) -
From Quantity to Quality: Boosting LLM Performance with Self-Guided Data Selection for Instruction Tuning
por: Li, Ming, et al.
Publicado: (2023) -
MMC: Advancing Multimodal Chart Understanding with Large-scale Instruction Tuning
por: Liu, Fuxiao, et al.
Publicado: (2023)