RedStone: Curating General, Code, Math, and QA Data for Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chang, Yaoyao, Cui, Lei, Dong, Li, Huang, Shaohan, Huang, Yangyu, Huang, Yupan, Li, Scarlett, Lv, Tengchao, Ma, Shuming, Sun, Qinzheng, Wang, Wenhui, Wei, Furu, Xin, Ying, Yang, Mao, Yin, Qiufeng, Zhang, Xingxing |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Scaling Data Difficulty: Improving Coding Models via Reinforcement Learning on Fresh and Challenging Problems
par: Li, Zongqian, et autres
Publié: (2026)
par: Li, Zongqian, et autres
Publié: (2026)
MMLU-CF: A Contamination-free Multi-task Language Understanding Benchmark
par: Zhao, Qihao, et autres
Publié: (2024)
par: Zhao, Qihao, et autres
Publié: (2024)
Code Aesthetics with Agentic Reward Feedback
par: Xiao, Bang, et autres
Publié: (2025)
par: Xiao, Bang, et autres
Publié: (2025)
KOSMOS-2.5: A Multimodal Literate Model
par: Lv, Tengchao, et autres
Publié: (2023)
par: Lv, Tengchao, et autres
Publié: (2023)
Model as a Game: On Numerical and Spatial Consistency for Generative Games
par: Chen, Jingye, et autres
Publié: (2025)
par: Chen, Jingye, et autres
Publié: (2025)
MH-MoE: Multi-Head Mixture-of-Experts
par: Huang, Shaohan, et autres
Publié: (2024)
par: Huang, Shaohan, et autres
Publié: (2024)
Think Only When You Need with Large Hybrid-Reasoning Models
par: Jiang, Lingjie, et autres
Publié: (2025)
par: Jiang, Lingjie, et autres
Publié: (2025)
PEACE: Empowering Geologic Map Holistic Understanding with MLLMs
par: Huang, Yangyu, et autres
Publié: (2025)
par: Huang, Yangyu, et autres
Publié: (2025)
Multi-Head Mixture-of-Experts
par: Wu, Xun, et autres
Publié: (2024)
par: Wu, Xun, et autres
Publié: (2024)
BitNet b1.58 2B4T Technical Report
par: Ma, Shuming, et autres
Publié: (2025)
par: Ma, Shuming, et autres
Publié: (2025)
Adapting Large Language Models to Domains via Reading Comprehension
par: Cheng, Daixuan, et autres
Publié: (2023)
par: Cheng, Daixuan, et autres
Publié: (2023)
Multimodal Large Language Model is a Human-Aligned Annotator for Text-to-Image Generation
par: Wu, Xun, et autres
Publié: (2024)
par: Wu, Xun, et autres
Publié: (2024)
Mixture of LoRA Experts
par: Wu, Xun, et autres
Publié: (2024)
par: Wu, Xun, et autres
Publié: (2024)
You Only Cache Once: Decoder-Decoder Architectures for Language Models
par: Sun, Yutao, et autres
Publié: (2024)
par: Sun, Yutao, et autres
Publié: (2024)
VisCodex: Unified Multimodal Code Generation via Merging Vision and Coding Models
par: Jiang, Lingjie, et autres
Publié: (2025)
par: Jiang, Lingjie, et autres
Publié: (2025)
The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits
par: Ma, Shuming, et autres
Publié: (2024)
par: Ma, Shuming, et autres
Publié: (2024)
FEA-Bench: A Benchmark for Evaluating Repository-Level Code Generation for Feature Implementation
par: Li, Wei, et autres
Publié: (2025)
par: Li, Wei, et autres
Publié: (2025)
DocReward: A Document Reward Model for Structuring and Stylizing
par: Liu, Junpeng, et autres
Publié: (2025)
par: Liu, Junpeng, et autres
Publié: (2025)
BitNet Distillation
par: Wu, Xun, et autres
Publié: (2025)
par: Wu, Xun, et autres
Publié: (2025)
Can MLLMs Absorb Math Reasoning Abilities from LLMs as Free Lunch?
par: Hu, Yijie, et autres
Publié: (2025)
par: Hu, Yijie, et autres
Publié: (2025)
WaveCoder: Widespread And Versatile Enhancement For Code Large Language Models By Instruction Tuning
par: Yu, Zhaojian, et autres
Publié: (2023)
par: Yu, Zhaojian, et autres
Publié: (2023)
MathScale: Scaling Instruction Tuning for Mathematical Reasoning
par: Tang, Zhengyang, et autres
Publié: (2024)
par: Tang, Zhengyang, et autres
Publié: (2024)
Textual Aesthetics in Large Language Models
par: Jiang, Lingjie, et autres
Publié: (2024)
par: Jiang, Lingjie, et autres
Publié: (2024)
Thinking Augmented Pre-training
par: Wang, Liang, et autres
Publié: (2025)
par: Wang, Liang, et autres
Publié: (2025)
On-Policy Context Distillation for Language Models
par: Ye, Tianzhu, et autres
Publié: (2026)
par: Ye, Tianzhu, et autres
Publié: (2026)
Geometric-Mean Policy Optimization
par: Zhao, Yuzhong, et autres
Publié: (2025)
par: Zhao, Yuzhong, et autres
Publié: (2025)
Data Efficacy for Language Model Training
par: Dai, Yalun, et autres
Publié: (2025)
par: Dai, Yalun, et autres
Publié: (2025)
Breaking Training Bottlenecks: Effective and Stable Reinforcement Learning for Coding Models
par: Li, Zongqian, et autres
Publié: (2026)
par: Li, Zongqian, et autres
Publié: (2026)
Multimodal Latent Language Modeling with Next-Token Diffusion
par: Sun, Yutao, et autres
Publié: (2024)
par: Sun, Yutao, et autres
Publié: (2024)
Instruction Pre-Training: Language Models are Supervised Multitask Learners
par: Cheng, Daixuan, et autres
Publié: (2024)
par: Cheng, Daixuan, et autres
Publié: (2024)
Online Experiential Learning for Language Models
par: Ye, Tianzhu, et autres
Publié: (2026)
par: Ye, Tianzhu, et autres
Publié: (2026)
Black-Box On-Policy Distillation of Large Language Models
par: Ye, Tianzhu, et autres
Publié: (2025)
par: Ye, Tianzhu, et autres
Publié: (2025)
Universal YOCO for Efficient Depth Scaling
par: Sun, Yutao, et autres
Publié: (2026)
par: Sun, Yutao, et autres
Publié: (2026)
On-Policy RL with Optimal Reward Baseline
par: Hao, Yaru, et autres
Publié: (2025)
par: Hao, Yaru, et autres
Publié: (2025)
Kosmos-G: Generating Images in Context with Multimodal Large Language Models
par: Pan, Xichen, et autres
Publié: (2023)
par: Pan, Xichen, et autres
Publié: (2023)
VibeVoice Technical Report
par: Peng, Zhiliang, et autres
Publié: (2025)
par: Peng, Zhiliang, et autres
Publié: (2025)
Teaching Your Models to Understand Code via Focal Preference Alignment
par: Wu, Jie, et autres
Publié: (2025)
par: Wu, Jie, et autres
Publié: (2025)
Template-Driven LLM-Paraphrased Framework for Tabular Math Word Problem Generation
par: Kang, Xiaoqiang, et autres
Publié: (2024)
par: Kang, Xiaoqiang, et autres
Publié: (2024)
Reward Reasoning Model
par: Guo, Jiaxin, et autres
Publié: (2025)
par: Guo, Jiaxin, et autres
Publié: (2025)
The Era of Agentic Organization: Learning to Organize with Language Models
par: Chi, Zewen, et autres
Publié: (2025)
par: Chi, Zewen, et autres
Publié: (2025)
Documents similaires
-
Scaling Data Difficulty: Improving Coding Models via Reinforcement Learning on Fresh and Challenging Problems
par: Li, Zongqian, et autres
Publié: (2026) -
MMLU-CF: A Contamination-free Multi-task Language Understanding Benchmark
par: Zhao, Qihao, et autres
Publié: (2024) -
Code Aesthetics with Agentic Reward Feedback
par: Xiao, Bang, et autres
Publié: (2025) -
KOSMOS-2.5: A Multimodal Literate Model
par: Lv, Tengchao, et autres
Publié: (2023) -
Model as a Game: On Numerical and Spatial Consistency for Generative Games
par: Chen, Jingye, et autres
Publié: (2025)