Aya 23: Open Weight Releases to Further Multilingual Progress
Fuente:
arXiv
Salvato in:
| Autori principali: | Aryabumi, Viraat, Dang, John, Talupuru, Dwarak, Dash, Saurabh, Cairuz, David, Lin, Hangyu, Venkitesh, Bharat, Smith, Madeline, Campos, Jon Ander, Tan, Yi Chern, Marchisio, Kelly, Bartolo, Max, Ruder, Sebastian, Locatelli, Acyr, Kreutzer, Julia, Frosst, Nick, Gomez, Aidan, Blunsom, Phil, Fadaee, Marzieh, Üstün, Ahmet, Hooker, Sara |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Rope to Nope and Back Again: A New Hybrid Attention Strategy
di: Yang, Bowen, et al.
Pubblicazione: (2025)
di: Yang, Bowen, et al.
Pubblicazione: (2025)
Aya Vision: Advancing the Frontier of Multilingual Multimodality
di: Dash, Saurabh, et al.
Pubblicazione: (2025)
di: Dash, Saurabh, et al.
Pubblicazione: (2025)
Tiny Aya: Bridging Scale and Multilingual Depth
di: Salamanca, Alejandro R., et al.
Pubblicazione: (2026)
di: Salamanca, Alejandro R., et al.
Pubblicazione: (2026)
To Code, or Not To Code? Exploring Impact of Code in Pre-training
di: Aryabumi, Viraat, et al.
Pubblicazione: (2024)
di: Aryabumi, Viraat, et al.
Pubblicazione: (2024)
BAM! Just Like That: Simple and Efficient Parameter Upcycling for Mixture of Experts
di: Zhang, Qizhen, et al.
Pubblicazione: (2024)
di: Zhang, Qizhen, et al.
Pubblicazione: (2024)
The Art of Asking: Multilingual Prompt Optimization for Synthetic Data
di: Mora, David, et al.
Pubblicazione: (2025)
di: Mora, David, et al.
Pubblicazione: (2025)
Aya Expanse: Combining Research Breakthroughs for a New Multilingual Frontier
di: Dang, John, et al.
Pubblicazione: (2024)
di: Dang, John, et al.
Pubblicazione: (2024)
Aya Model: An Instruction Finetuned Open-Access Multilingual Language Model
di: Üstün, Ahmet, et al.
Pubblicazione: (2024)
di: Üstün, Ahmet, et al.
Pubblicazione: (2024)
LLM See, LLM Do: Guiding Data Generation to Target Non-Differentiable Objectives
di: Shimabucoro, Luísa, et al.
Pubblicazione: (2024)
di: Shimabucoro, Luísa, et al.
Pubblicazione: (2024)
A Post-trainer's Guide to Multilingual Training Data: Uncovering Cross-lingual Transfer Dynamics
di: Shimabucoro, Luisa, et al.
Pubblicazione: (2025)
di: Shimabucoro, Luisa, et al.
Pubblicazione: (2025)
One Tokenizer To Rule Them All: Emergent Language Plasticity via Multilingual Tokenizers
di: Abagyan, Diana, et al.
Pubblicazione: (2025)
di: Abagyan, Diana, et al.
Pubblicazione: (2025)
Nexus: Specialization meets Adaptability for Efficiently Training Mixture of Experts
di: Gritsch, Nikolas, et al.
Pubblicazione: (2024)
di: Gritsch, Nikolas, et al.
Pubblicazione: (2024)
How Does Quantization Affect Multilingual LLMs?
di: Marchisio, Kelly, et al.
Pubblicazione: (2024)
di: Marchisio, Kelly, et al.
Pubblicazione: (2024)
The Multilingual Divide and Its Impact on Global AI Safety
di: Peppin, Aidan, et al.
Pubblicazione: (2025)
di: Peppin, Aidan, et al.
Pubblicazione: (2025)
Procedural Knowledge in Pretraining Drives Reasoning in Large Language Models
di: Ruis, Laura, et al.
Pubblicazione: (2024)
di: Ruis, Laura, et al.
Pubblicazione: (2024)
Back to Basics: Revisiting REINFORCE Style Optimization for Learning from Human Feedback in LLMs
di: Ahmadian, Arash, et al.
Pubblicazione: (2024)
di: Ahmadian, Arash, et al.
Pubblicazione: (2024)
Aya Dataset: An Open-Access Collection for Multilingual Instruction Tuning
di: Singh, Shivalika, et al.
Pubblicazione: (2024)
di: Singh, Shivalika, et al.
Pubblicazione: (2024)
RLHF Can Speak Many Languages: Unlocking Multilingual Preference Optimization for LLMs
di: Dang, John, et al.
Pubblicazione: (2024)
di: Dang, John, et al.
Pubblicazione: (2024)
The Multilingual Alignment Prism: Aligning Global and Local Preferences to Reduce Harm
di: Aakanksha, et al.
Pubblicazione: (2024)
di: Aakanksha, et al.
Pubblicazione: (2024)
Automatic WordNet Construction Using Markov Chain Monte Carlo
di: Marzieh Fadaee
Pubblicazione: (2013)
di: Marzieh Fadaee
Pubblicazione: (2013)
SnapKV: LLM Knows What You are Looking for Before Generation
di: Li, Yuhong, et al.
Pubblicazione: (2024)
di: Li, Yuhong, et al.
Pubblicazione: (2024)
Making, not Taking, the Best of N
di: Khairi, Ammar, et al.
Pubblicazione: (2025)
di: Khairi, Ammar, et al.
Pubblicazione: (2025)
Understanding Likelihood Over-optimisation in Direct Alignment Algorithms
di: Shi, Zhengyan, et al.
Pubblicazione: (2024)
di: Shi, Zhengyan, et al.
Pubblicazione: (2024)
Déjà Vu: Multilingual LLM Evaluation through the Lens of Machine Translation Evaluation
di: Kreutzer, Julia, et al.
Pubblicazione: (2025)
di: Kreutzer, Julia, et al.
Pubblicazione: (2025)
Human Feedback is not Gold Standard
di: Hosking, Tom, et al.
Pubblicazione: (2023)
di: Hosking, Tom, et al.
Pubblicazione: (2023)
Treasure Hunt: Real-time Targeting of the Long Tail using Training-Time Markers
di: D'souza, Daniel, et al.
Pubblicazione: (2025)
di: D'souza, Daniel, et al.
Pubblicazione: (2025)
Efficient Benchmarking Is Just Feature Selection and Multiple Regression
di: Bowyer, Sam, et al.
Pubblicazione: (2026)
di: Bowyer, Sam, et al.
Pubblicazione: (2026)
Unlocking Reasoning Capability on Machine Translation in Large Language Models
di: Rajaee, Sara, et al.
Pubblicazione: (2026)
di: Rajaee, Sara, et al.
Pubblicazione: (2026)
SimMerge: Learning to Select Merge Operators from Similarity Signals
di: Bolton, Oliver, et al.
Pubblicazione: (2026)
di: Bolton, Oliver, et al.
Pubblicazione: (2026)
The State of Multilingual LLM Safety Research: From Measuring the Language Gap to Mitigating It
di: Yong, Zheng-Xin, et al.
Pubblicazione: (2025)
di: Yong, Zheng-Xin, et al.
Pubblicazione: (2025)
Improving Reward Models with Synthetic Critiques
di: Ye, Zihuiwen, et al.
Pubblicazione: (2024)
di: Ye, Zihuiwen, et al.
Pubblicazione: (2024)
Verification Limits Code LLM Training
di: Gureja, Srishti, et al.
Pubblicazione: (2025)
di: Gureja, Srishti, et al.
Pubblicazione: (2025)
Mix Data or Merge Models? Optimizing for Diverse Multi-Task Learning
di: Aakanksha, et al.
Pubblicazione: (2024)
di: Aakanksha, et al.
Pubblicazione: (2024)
M-RewardBench: Evaluating Reward Models in Multilingual Settings
di: Gureja, Srishti, et al.
Pubblicazione: (2024)
di: Gureja, Srishti, et al.
Pubblicazione: (2024)
Polynomials, Divided Differences, and Codes
di: Venkitesh, S.
Pubblicazione: (2024)
di: Venkitesh, S.
Pubblicazione: (2024)
AL-QASIDA: Analyzing LLM Quality and Accuracy Systematically in Dialectal Arabic
di: Robinson, Nathaniel R., et al.
Pubblicazione: (2024)
di: Robinson, Nathaniel R., et al.
Pubblicazione: (2024)
O que os analistas pensam sobre a homossexualidade?
di: Acyr Maya
Pubblicazione: (2007)
di: Acyr Maya
Pubblicazione: (2007)
Reverse Engineering Human Preferences with Reinforcement Learning
di: Alazraki, Lisa, et al.
Pubblicazione: (2025)
di: Alazraki, Lisa, et al.
Pubblicazione: (2025)
No Need for Explanations: LLMs can implicitly learn from mistakes in-context
di: Alazraki, Lisa, et al.
Pubblicazione: (2025)
di: Alazraki, Lisa, et al.
Pubblicazione: (2025)
Diversify and Conquer: Diversity-Centric Data Selection with Iterative Refinement
di: Yu, Simon, et al.
Pubblicazione: (2024)
di: Yu, Simon, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Rope to Nope and Back Again: A New Hybrid Attention Strategy
di: Yang, Bowen, et al.
Pubblicazione: (2025) -
Aya Vision: Advancing the Frontier of Multilingual Multimodality
di: Dash, Saurabh, et al.
Pubblicazione: (2025) -
Tiny Aya: Bridging Scale and Multilingual Depth
di: Salamanca, Alejandro R., et al.
Pubblicazione: (2026) -
To Code, or Not To Code? Exploring Impact of Code in Pre-training
di: Aryabumi, Viraat, et al.
Pubblicazione: (2024) -
BAM! Just Like That: Simple and Efficient Parameter Upcycling for Mixture of Experts
di: Zhang, Qizhen, et al.
Pubblicazione: (2024)