Mastering Text, Code and Math Simultaneously via Fusing Highly Specialized Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Ding, Ning, Chen, Yulin, Cui, Ganqu, Lv, Xingtai, Zhao, Weilin, Xie, Ruobing, Zhou, Bowen, Liu, Zhiyuan, Sun, Maosong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Scalable Efficient Training of Large Language Models with Low-dimensional Projected Attention
di: Lv, Xingtai, et al.
Pubblicazione: (2024)
di: Lv, Xingtai, et al.
Pubblicazione: (2024)
UltraMedical: Building Specialized Generalists in Biomedicine
di: Zhang, Kaiyan, et al.
Pubblicazione: (2024)
di: Zhang, Kaiyan, et al.
Pubblicazione: (2024)
Controllable Preference Optimization: Toward Controllable Multi-Objective Alignment
di: Guo, Yiju, et al.
Pubblicazione: (2024)
di: Guo, Yiju, et al.
Pubblicazione: (2024)
Empowering Private Tutoring by Chaining Large Language Models
di: Chen, Yulin, et al.
Pubblicazione: (2023)
di: Chen, Yulin, et al.
Pubblicazione: (2023)
UltraFeedback: Boosting Language Models with Scaled AI Feedback
di: Cui, Ganqu, et al.
Pubblicazione: (2023)
di: Cui, Ganqu, et al.
Pubblicazione: (2023)
INTERVENOR: Prompting the Coding Ability of Large Language Models with the Interactive Chain of Repair
di: Wang, Hanbin, et al.
Pubblicazione: (2023)
di: Wang, Hanbin, et al.
Pubblicazione: (2023)
Advancing LLM Reasoning Generalists with Preference Trees
di: Yuan, Lifan, et al.
Pubblicazione: (2024)
di: Yuan, Lifan, et al.
Pubblicazione: (2024)
Fast and Slow Generating: An Empirical Study on Large and Small Language Models Collaborative Decoding
di: Zhang, Kaiyan, et al.
Pubblicazione: (2024)
di: Zhang, Kaiyan, et al.
Pubblicazione: (2024)
Intuitive Fine-Tuning: Towards Simplifying Alignment into a Single Process
di: Hua, Ermo, et al.
Pubblicazione: (2024)
di: Hua, Ermo, et al.
Pubblicazione: (2024)
From $f(x)$ and $g(x)$ to $f(g(x))$: LLMs Learn New Skills in RL by Composing Old Ones
di: Yuan, Lifan, et al.
Pubblicazione: (2025)
di: Yuan, Lifan, et al.
Pubblicazione: (2025)
How to Synthesize Text Data without Model Collapse?
di: Zhu, Xuekai, et al.
Pubblicazione: (2024)
di: Zhu, Xuekai, et al.
Pubblicazione: (2024)
Free Process Rewards without Process Labels
di: Yuan, Lifan, et al.
Pubblicazione: (2024)
di: Yuan, Lifan, et al.
Pubblicazione: (2024)
V-GameGym: Visual Game Generation for Code Large Language Models
di: Zhang, Wei, et al.
Pubblicazione: (2025)
di: Zhang, Wei, et al.
Pubblicazione: (2025)
Post-Trained MoE Can Skip Half Experts via Self-Distillation
di: Lv, Xingtai, et al.
Pubblicazione: (2026)
di: Lv, Xingtai, et al.
Pubblicazione: (2026)
AIR: A Systematic Analysis of Annotations, Instructions, and Response Pairs in Preference Dataset
di: He, Bingxiang, et al.
Pubblicazione: (2025)
di: He, Bingxiang, et al.
Pubblicazione: (2025)
Towards a Unified View of Large Language Model Post-Training
di: Lv, Xingtai, et al.
Pubblicazione: (2025)
di: Lv, Xingtai, et al.
Pubblicazione: (2025)
Seq1F1B: Efficient Sequence-Level Pipeline Parallelism for Large Language Model Training
di: Sun, Ao, et al.
Pubblicazione: (2024)
di: Sun, Ao, et al.
Pubblicazione: (2024)
Representation Learning for Natural Language Processing
di: Liu, Zhiyuan, et al.
Pubblicazione: (2020)
di: Liu, Zhiyuan, et al.
Pubblicazione: (2020)
BurstAttention: An Efficient Distributed Attention Framework for Extremely Long Sequences
di: Sun, Ao, et al.
Pubblicazione: (2024)
di: Sun, Ao, et al.
Pubblicazione: (2024)
Beyond Natural Language: LLMs Leveraging Alternative Formats for Enhanced Reasoning and Communication
di: Chen, Weize, et al.
Pubblicazione: (2024)
di: Chen, Weize, et al.
Pubblicazione: (2024)
ChartCoder: Advancing Multimodal Large Language Model for Chart-to-Code Generation
di: Zhao, Xuanle, et al.
Pubblicazione: (2025)
di: Zhao, Xuanle, et al.
Pubblicazione: (2025)
Fourier Position Embedding: Enhancing Attention's Periodic Extension for Length Generalization
di: Hua, Ermo, et al.
Pubblicazione: (2024)
di: Hua, Ermo, et al.
Pubblicazione: (2024)
RLPR: Extrapolating RLVR to General Domains without Verifiers
di: Yu, Tianyu, et al.
Pubblicazione: (2025)
di: Yu, Tianyu, et al.
Pubblicazione: (2025)
Exploring the Benefit of Activation Sparsity in Pre-training
di: Zhang, Zhengyan, et al.
Pubblicazione: (2024)
di: Zhang, Zhengyan, et al.
Pubblicazione: (2024)
BurstEngine: an Efficient Distributed Framework for Training Transformers on Extremely Long Sequences of over 1M Tokens
di: Sun, Ao, et al.
Pubblicazione: (2025)
di: Sun, Ao, et al.
Pubblicazione: (2025)
Code2Math: Can Your Code Agent Effectively Evolve Math Problems Through Exploration?
di: Guo, Dadi, et al.
Pubblicazione: (2026)
di: Guo, Dadi, et al.
Pubblicazione: (2026)
How Far Can Unsupervised RLVR Scale LLM Training?
di: He, Bingxiang, et al.
Pubblicazione: (2026)
di: He, Bingxiang, et al.
Pubblicazione: (2026)
Language Models "Grok" to Copy
di: Lv, Ang, et al.
Pubblicazione: (2024)
di: Lv, Ang, et al.
Pubblicazione: (2024)
Process Reinforcement through Implicit Rewards
di: Cui, Ganqu, et al.
Pubblicazione: (2025)
di: Cui, Ganqu, et al.
Pubblicazione: (2025)
The Right Time Matters: Data Arrangement Affects Zero-Shot Generalization in Instruction Tuning
di: He, Bingxiang, et al.
Pubblicazione: (2024)
di: He, Bingxiang, et al.
Pubblicazione: (2024)
rStar-Math: Small LLMs Can Master Math Reasoning with Self-Evolved Deep Thinking
di: Guan, Xinyu, et al.
Pubblicazione: (2025)
di: Guan, Xinyu, et al.
Pubblicazione: (2025)
Technologies on Effectiveness and Efficiency: A Survey of State Spaces Models
di: Lv, Xingtai, et al.
Pubblicazione: (2025)
di: Lv, Xingtai, et al.
Pubblicazione: (2025)
APB: Accelerating Distributed Long-Context Inference by Passing Compressed Context Blocks across GPUs
di: Huang, Yuxiang, et al.
Pubblicazione: (2025)
di: Huang, Yuxiang, et al.
Pubblicazione: (2025)
Label Dependencies-aware Set Prediction Networks for Multi-label Text Classification
di: Xinkai, Du, et al.
Pubblicazione: (2023)
di: Xinkai, Du, et al.
Pubblicazione: (2023)
Automating Exploratory Proteomics Research via Language Models
di: Ding, Ning, et al.
Pubblicazione: (2024)
di: Ding, Ning, et al.
Pubblicazione: (2024)
Automating Exploratory Multiomics Research via Language Models
di: Qu, Shang, et al.
Pubblicazione: (2025)
di: Qu, Shang, et al.
Pubblicazione: (2025)
BlockFFN: Towards End-Side Acceleration-Friendly Mixture-of-Experts with Chunk-Level Activation Sparsity
di: Song, Chenyang, et al.
Pubblicazione: (2025)
di: Song, Chenyang, et al.
Pubblicazione: (2025)
MiniCPM: Unveiling the Potential of Small Language Models with Scalable Training Strategies
di: Hu, Shengding, et al.
Pubblicazione: (2024)
di: Hu, Shengding, et al.
Pubblicazione: (2024)
LoRA-Flow: Dynamic LoRA Fusion for Large Language Models in Generative Tasks
di: Wang, Hanqing, et al.
Pubblicazione: (2024)
di: Wang, Hanqing, et al.
Pubblicazione: (2024)
RedStone: Curating General, Code, Math, and QA Data for Large Language Models
di: Chang, Yaoyao, et al.
Pubblicazione: (2024)
di: Chang, Yaoyao, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Scalable Efficient Training of Large Language Models with Low-dimensional Projected Attention
di: Lv, Xingtai, et al.
Pubblicazione: (2024) -
UltraMedical: Building Specialized Generalists in Biomedicine
di: Zhang, Kaiyan, et al.
Pubblicazione: (2024) -
Controllable Preference Optimization: Toward Controllable Multi-Objective Alignment
di: Guo, Yiju, et al.
Pubblicazione: (2024) -
Empowering Private Tutoring by Chaining Large Language Models
di: Chen, Yulin, et al.
Pubblicazione: (2023) -
UltraFeedback: Boosting Language Models with Scaled AI Feedback
di: Cui, Ganqu, et al.
Pubblicazione: (2023)