OctoPack: Instruction Tuning Code Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Muennighoff, Niklas, Liu, Qian, Zebaze, Armel, Zheng, Qinkai, Hui, Binyuan, Zhuo, Terry Yue, Singh, Swayam, Tang, Xiangru, von Werra, Leandro, Longpre, Shayne |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Astraios: Parameter-Efficient Instruction Tuning Code Large Language Models
di: Zhuo, Terry Yue, et al.
Pubblicazione: (2024)
di: Zhuo, Terry Yue, et al.
Pubblicazione: (2024)
BigCodeBench: Benchmarking Code Generation with Diverse Function Calls and Complex Instructions
di: Zhuo, Terry Yue, et al.
Pubblicazione: (2024)
di: Zhuo, Terry Yue, et al.
Pubblicazione: (2024)
Future and AI-Ready Data Strategies: Response to DOC RFI on AI and Open Government Data Assets
di: Oderinwale, Hamidah, et al.
Pubblicazione: (2024)
di: Oderinwale, Hamidah, et al.
Pubblicazione: (2024)
Tree of Problems: Improving structured problem solving with compositionality
di: Zebaze, Armel, et al.
Pubblicazione: (2024)
di: Zebaze, Armel, et al.
Pubblicazione: (2024)
In-Context Example Selection via Similarity Search Improves Low-Resource Machine Translation
di: Zebaze, Armel, et al.
Pubblicazione: (2024)
di: Zebaze, Armel, et al.
Pubblicazione: (2024)
LLM Reasoning for Machine Translation: Synthetic Data Generation over Thinking Tokens
di: Zebaze, Armel, et al.
Pubblicazione: (2025)
di: Zebaze, Armel, et al.
Pubblicazione: (2025)
TopXGen: Topic-Diverse Parallel Data Generation for Low-Resource Machine Translation
di: Zebaze, Armel, et al.
Pubblicazione: (2025)
di: Zebaze, Armel, et al.
Pubblicazione: (2025)
Compositional Translation: A Novel LLM-based Approach for Low-resource Machine Translation
di: Zebaze, Armel, et al.
Pubblicazione: (2025)
di: Zebaze, Armel, et al.
Pubblicazione: (2025)
Generative Representational Instruction Tuning
di: Muennighoff, Niklas, et al.
Pubblicazione: (2024)
di: Muennighoff, Niklas, et al.
Pubblicazione: (2024)
XFT: Unlocking the Power of Code Instruction Tuning by Simply Merging Upcycled Mixture-of-Experts
di: Ding, Yifeng, et al.
Pubblicazione: (2024)
di: Ding, Yifeng, et al.
Pubblicazione: (2024)
C-Pack: Packed Resources For General Chinese Embeddings
di: Xiao, Shitao, et al.
Pubblicazione: (2023)
di: Xiao, Shitao, et al.
Pubblicazione: (2023)
ATLAS: Adaptive Transfer Scaling Laws for Multilingual Pretraining, Finetuning, and Decoding the Curse of Multilinguality
di: Longpre, Shayne, et al.
Pubblicazione: (2025)
di: Longpre, Shayne, et al.
Pubblicazione: (2025)
OctoBench: Benchmarking Scaffold-Aware Instruction Following in Repository-Grounded Agentic Coding
di: Ding, Deming, et al.
Pubblicazione: (2026)
di: Ding, Deming, et al.
Pubblicazione: (2026)
ICE-Score: Instructing Large Language Models to Evaluate Code
di: Zhuo, Terry Yue
Pubblicazione: (2023)
di: Zhuo, Terry Yue
Pubblicazione: (2023)
A Systematic Review of NeurIPS Dataset Management Practices
di: Wu, Yiwei, et al.
Pubblicazione: (2024)
di: Wu, Yiwei, et al.
Pubblicazione: (2024)
Aya Model: An Instruction Finetuned Open-Access Multilingual Language Model
di: Üstün, Ahmet, et al.
Pubblicazione: (2024)
di: Üstün, Ahmet, et al.
Pubblicazione: (2024)
Multi-Agent Collaboration for Multilingual Code Instruction Tuning
di: Yang, Jian, et al.
Pubblicazione: (2025)
di: Yang, Jian, et al.
Pubblicazione: (2025)
Disentangling meaning from language in LLM-based machine translation
di: Lasnier, Théo, et al.
Pubblicazione: (2026)
di: Lasnier, Théo, et al.
Pubblicazione: (2026)
A-OctoMap: An Adaptive OctoMap for Online Path Planning
di: Mao, Yihui, et al.
Pubblicazione: (2024)
di: Mao, Yihui, et al.
Pubblicazione: (2024)
AI-Powered Autonomous Weapons Risk Geopolitical Instability and Threaten AI Research
di: Simmons-Edler, Riley, et al.
Pubblicazione: (2024)
di: Simmons-Edler, Riley, et al.
Pubblicazione: (2024)
OctoNav: Towards Generalist Embodied Navigation
di: Gao, Chen, et al.
Pubblicazione: (2025)
di: Gao, Chen, et al.
Pubblicazione: (2025)
Speedrunning ImageNet Diffusion
di: Bhanded, Swayam
Pubblicazione: (2025)
di: Bhanded, Swayam
Pubblicazione: (2025)
Robust Learning of Diverse Code Edits
di: Aggarwal, Tushar, et al.
Pubblicazione: (2025)
di: Aggarwal, Tushar, et al.
Pubblicazione: (2025)
The Octo-Rail Lattice: a four-dimensional cluster state design
di: Østergaard, Emil E. B., et al.
Pubblicazione: (2025)
di: Østergaard, Emil E. B., et al.
Pubblicazione: (2025)
From Completion to Editing: Unlocking Context-Aware Code Infilling via Search-and-Replace Instruction Tuning
di: Zhang, Jiajun, et al.
Pubblicazione: (2026)
di: Zhang, Jiajun, et al.
Pubblicazione: (2026)
Humanline: Online Alignment as Perceptual Loss
di: Liu, Sijia, et al.
Pubblicazione: (2025)
di: Liu, Sijia, et al.
Pubblicazione: (2025)
The Sustainability Gap in Robotics: A Large-Scale Survey of Sustainability Awareness in 50,000 Research Articles
di: Skuric, Antun, et al.
Pubblicazione: (2026)
di: Skuric, Antun, et al.
Pubblicazione: (2026)
Octo: An Open-Source Generalist Robot Policy
di: Octo Model Team, et al.
Pubblicazione: (2024)
di: Octo Model Team, et al.
Pubblicazione: (2024)
A Survey on Data Selection for Language Models
di: Albalak, Alon, et al.
Pubblicazione: (2024)
di: Albalak, Alon, et al.
Pubblicazione: (2024)
SelfCodeAlign: Self-Alignment for Code Generation
di: Wei, Yuxiang, et al.
Pubblicazione: (2024)
di: Wei, Yuxiang, et al.
Pubblicazione: (2024)
Obsidian : 3D documentation
di: Werra, Dagmara H.
Pubblicazione: (2026)
di: Werra, Dagmara H.
Pubblicazione: (2026)
Obsidian : 3D documentation
di: Werra, Dagmara H.
Pubblicazione: (2026)
di: Werra, Dagmara H.
Pubblicazione: (2026)
Obsidian : 3D documentation
di: Werra, Dagmara H.
Pubblicazione: (2026)
di: Werra, Dagmara H.
Pubblicazione: (2026)
Świeciechów flint : 3D documentation
di: Werra, Dagmara H.
Pubblicazione: (2026)
di: Werra, Dagmara H.
Pubblicazione: (2026)
Obsidian : 3D documentation
di: Werra, Dagmara H.
Pubblicazione: (2026)
di: Werra, Dagmara H.
Pubblicazione: (2026)
Świeciechów flint : 3D documentation
di: Werra, Dagmara H.
Pubblicazione: (2026)
di: Werra, Dagmara H.
Pubblicazione: (2026)
Obsidian : 3D documentation
di: Werra, Dagmara H.
Pubblicazione: (2026)
di: Werra, Dagmara H.
Pubblicazione: (2026)
Towards Better Correctness and Efficiency in Code Generation
di: Feng, Yunlong, et al.
Pubblicazione: (2025)
di: Feng, Yunlong, et al.
Pubblicazione: (2025)
The 2024 Foundation Model Transparency Index
di: Bommasani, Rishi, et al.
Pubblicazione: (2024)
di: Bommasani, Rishi, et al.
Pubblicazione: (2024)
OctoThinker: Mid-training Incentivizes Reinforcement Learning Scaling
di: Wang, Zengzhi, et al.
Pubblicazione: (2025)
di: Wang, Zengzhi, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Astraios: Parameter-Efficient Instruction Tuning Code Large Language Models
di: Zhuo, Terry Yue, et al.
Pubblicazione: (2024) -
BigCodeBench: Benchmarking Code Generation with Diverse Function Calls and Complex Instructions
di: Zhuo, Terry Yue, et al.
Pubblicazione: (2024) -
Future and AI-Ready Data Strategies: Response to DOC RFI on AI and Open Government Data Assets
di: Oderinwale, Hamidah, et al.
Pubblicazione: (2024) -
Tree of Problems: Improving structured problem solving with compositionality
di: Zebaze, Armel, et al.
Pubblicazione: (2024) -
In-Context Example Selection via Similarity Search Improves Low-Resource Machine Translation
di: Zebaze, Armel, et al.
Pubblicazione: (2024)