Scaling Towards the Information Boundary of Instruction Sets: The Infinity Instruct Subject Technical Report
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Du, Li, Zhao, Hanyu, Ju, Yiming, Pan, Tengfei |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Infinity Instruct: Scaling Instruction Selection and Synthesis to Enhance Language Models
par: Li, Jijie, et autres
Publié: (2025)
par: Li, Jijie, et autres
Publié: (2025)
Beyond IID: Optimizing Instruction Learning from the Perspective of Instruction Interaction and Dependency
par: Zhao, Hanyu, et autres
Publié: (2024)
par: Zhao, Hanyu, et autres
Publié: (2024)
VisualWebInstruct: Scaling up Multimodal Instruction Data through Web Search
par: Jia, Yiming, et autres
Publié: (2025)
par: Jia, Yiming, et autres
Publié: (2025)
Accelerate Scaling of LLM Finetuning via Quantifying the Coverage and Depth of Instruction Set
par: Wu, Chengwei, et autres
Publié: (2025)
par: Wu, Chengwei, et autres
Publié: (2025)
Ada-Instruct: Adapting Instruction Generators for Complex Reasoning
par: Cui, Wanyun, et autres
Publié: (2023)
par: Cui, Wanyun, et autres
Publié: (2023)
InstructIE: A Bilingual Instruction-based Information Extraction Dataset
par: Gui, Honghao, et autres
Publié: (2023)
par: Gui, Honghao, et autres
Publié: (2023)
Hala Technical Report: Building Arabic-Centric Instruction & Translation Models at Scale
par: Hammoud, Hasan Abed Al Kader, et autres
Publié: (2025)
par: Hammoud, Hasan Abed Al Kader, et autres
Publié: (2025)
Instruct-Imagen: Image Generation with Multi-modal Instruction
par: Hu, Hexiang, et autres
Publié: (2024)
par: Hu, Hexiang, et autres
Publié: (2024)
Robo-Instruct: Simulator-Augmented Instruction Alignment For Finetuning Code LLMs
par: Hu, Zichao, et autres
Publié: (2024)
par: Hu, Zichao, et autres
Publié: (2024)
LuxInstruct: A Cross-Lingual Instruction Tuning Dataset For Luxembourgish
par: Philippy, Fred, et autres
Publié: (2025)
par: Philippy, Fred, et autres
Publié: (2025)
Baichuan4-Finance Technical Report
par: Zhang, Hanyu, et autres
Publié: (2024)
par: Zhang, Hanyu, et autres
Publié: (2024)
RAG-Instruct: Boosting LLMs with Diverse Retrieval-Augmented Instructions
par: Liu, Wanlong, et autres
Publié: (2024)
par: Liu, Wanlong, et autres
Publié: (2024)
LexInstructEval: Lexical Instruction Following Evaluation for Large Language Models
par: Ren, Huimin, et autres
Publié: (2025)
par: Ren, Huimin, et autres
Publié: (2025)
Learning to Instruct for Visual Instruction Tuning
par: Zhou, Zhihan, et autres
Publié: (2025)
par: Zhou, Zhihan, et autres
Publié: (2025)
Tele-FLM Technical Report
par: Li, Xiang, et autres
Publié: (2024)
par: Li, Xiang, et autres
Publié: (2024)
OpenMathInstruct-2: Accelerating AI for Math with Massive Open-Source Instruction Data
par: Toshniwal, Shubham, et autres
Publié: (2024)
par: Toshniwal, Shubham, et autres
Publié: (2024)
Instruction Embedding: Latent Representations of Instructions Towards Task Identification
par: Li, Yiwei, et autres
Publié: (2024)
par: Li, Yiwei, et autres
Publié: (2024)
Knowledge-Instruct: Effective Continual Pre-training from Limited Data using Instructions
par: Ovadia, Oded, et autres
Publié: (2025)
par: Ovadia, Oded, et autres
Publié: (2025)
BioInstruct: Instruction Tuning of Large Language Models for Biomedical Natural Language Processing
par: Tran, Hieu, et autres
Publié: (2023)
par: Tran, Hieu, et autres
Publié: (2023)
InverseCoder: Self-improving Instruction-Tuned Code LLMs with Inverse-Instruct
par: Wu, Yutong, et autres
Publié: (2024)
par: Wu, Yutong, et autres
Publié: (2024)
Responsible AI Technical Report
par: KT, et autres
Publié: (2025)
par: KT, et autres
Publié: (2025)
InternLM2 Technical Report
par: Cai, Zheng, et autres
Publié: (2024)
par: Cai, Zheng, et autres
Publié: (2024)
Ruyi2 Technical Report
par: Song, Huan, et autres
Publié: (2026)
par: Song, Huan, et autres
Publié: (2026)
InstructRetro: Instruction Tuning post Retrieval-Augmented Pretraining
par: Wang, Boxin, et autres
Publié: (2023)
par: Wang, Boxin, et autres
Publié: (2023)
Safer-Instruct: Aligning Language Models with Automated Preference Data
par: Shi, Taiwei, et autres
Publié: (2023)
par: Shi, Taiwei, et autres
Publié: (2023)
InstructAV: Instruction Fine-tuning Large Language Models for Authorship Verification
par: Hu, Yujia, et autres
Publié: (2024)
par: Hu, Yujia, et autres
Publié: (2024)
Qwen2 Technical Report
par: Yang, An, et autres
Publié: (2024)
par: Yang, An, et autres
Publié: (2024)
AquilaMoE: Efficient Training for MoE Models with Scale-Up and Scale-Out Strategies
par: Zhang, Bo-Wen, et autres
Publié: (2024)
par: Zhang, Bo-Wen, et autres
Publié: (2024)
Self-Instructed Derived Prompt Generation Meets In-Context Learning: Unlocking New Potential of Black-Box LLMs
par: Li, Zhuo, et autres
Publié: (2024)
par: Li, Zhuo, et autres
Publié: (2024)
DeepSeek-V3 Technical Report
par: DeepSeek-AI, et autres
Publié: (2024)
par: DeepSeek-AI, et autres
Publié: (2024)
AgentInstruct: Toward Generative Teaching with Agentic Flows
par: Mitra, Arindam, et autres
Publié: (2024)
par: Mitra, Arindam, et autres
Publié: (2024)
Phi-4 Technical Report
par: Abdin, Marah, et autres
Publié: (2024)
par: Abdin, Marah, et autres
Publié: (2024)
Gemma 3 Technical Report
par: Gemma Team, et autres
Publié: (2025)
par: Gemma Team, et autres
Publié: (2025)
EchoQA: A Large Collection of Instruction Tuning Data for Echocardiogram Reports
par: Moukheiber, Lama, et autres
Publié: (2025)
par: Moukheiber, Lama, et autres
Publié: (2025)
dots.llm1 Technical Report
par: Huo, Bi, et autres
Publié: (2025)
par: Huo, Bi, et autres
Publié: (2025)
MOSS-TTS Technical Report
par: Gong, Yitian, et autres
Publié: (2026)
par: Gong, Yitian, et autres
Publié: (2026)
Documents similaires
-
Infinity Instruct: Scaling Instruction Selection and Synthesis to Enhance Language Models
par: Li, Jijie, et autres
Publié: (2025) -
Beyond IID: Optimizing Instruction Learning from the Perspective of Instruction Interaction and Dependency
par: Zhao, Hanyu, et autres
Publié: (2024) -
VisualWebInstruct: Scaling up Multimodal Instruction Data through Web Search
par: Jia, Yiming, et autres
Publié: (2025) -
Accelerate Scaling of LLM Finetuning via Quantifying the Coverage and Depth of Instruction Set
par: Wu, Chengwei, et autres
Publié: (2025) -
Ada-Instruct: Adapting Instruction Generators for Complex Reasoning
par: Cui, Wanyun, et autres
Publié: (2023)