Aurora-M: Open Source Continual Pre-training for Multilingual Language and Code
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Nakamura, Taishi, Mishra, Mayank, Tedeschi, Simone, Chai, Yekun, Stillerman, Jason T, Friedrich, Felix, Yadav, Prateek, Laud, Tanmay, Chien, Vu Minh, Zhuo, Terry Yue, Misra, Diganta, Bogin, Ben, Vu, Xuan-Son, Karpinska, Marzena, Dantuluri, Arnav Varma, Kusa, Wojciech, Furlanello, Tommaso, Yokota, Rio, Muennighoff, Niklas, Pai, Suhas, Adewumi, Tosin, Laippala, Veronika, Yao, Xiaozhe, Junior, Adalberto, Ariyak, Alpay, Drozd, Aleksandr, Clive, Jordan, Gupta, Kshitij, Chen, Liangyu, Sun, Qi, Tsui, Ken, Persaud, Noah, Fahmy, Nour, Chen, Tianlong, Bansal, Mohit, Monti, Nicolo, Dang, Tai, Luo, Ziyang, Bui, Tien-Tung, Navigli, Roberto, Mehta, Virendra, Blumberg, Matthew, May, Victor, Nguyen, Huu, Pyysalo, Sampo |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Register Always Matters: Analysis of LLM Pretraining Data Through the Lens of Language Variation
par: Myntti, Amanda, et autres
Publié: (2025)
par: Myntti, Amanda, et autres
Publié: (2025)
A Survey of Large Language Models for European Languages
par: Ali, Wazir, et autres
Publié: (2024)
par: Ali, Wazir, et autres
Publié: (2024)
Got Compute, but No Data: Lessons From Post-training a Finnish LLM
par: Zosa, Elaine, et autres
Publié: (2025)
par: Zosa, Elaine, et autres
Publié: (2025)
Pretraining Finnish ModernBERTs
par: Reunamo, Akseli, et autres
Publié: (2025)
par: Reunamo, Akseli, et autres
Publié: (2025)
A Novel Preprocessing-Driven Approach to Remaining Useful Life (RUL) Prediction Using Temporal Convolutional Networks (TCN)
par: Imbert, Florent, et autres
Publié: (2026)
par: Imbert, Florent, et autres
Publié: (2026)
Scaling Data-Constrained Language Models
par: Muennighoff, Niklas, et autres
Publié: (2023)
par: Muennighoff, Niklas, et autres
Publié: (2023)
Educar a niñas y niños de clase media en Santiago: capital cultural y segregación socioterritorial en la formación de mercados locales de educación
par: Joel Stillerman
Publié: (2016)
par: Joel Stillerman
Publié: (2016)
Continuidades, rupturas y coyunturas en la transformación de los obreros de MADECO S.A. 1973-2003
par: Joel Stillerman
Publié: (2005)
par: Joel Stillerman
Publié: (2005)
Es mucho más que comprar… Discursos y prácticas espaciales cotidianas en Malls de Santiago.
par: Joel Stillerman
Publié: (2010)
par: Joel Stillerman
Publié: (2010)
Instruction Makes a Difference
par: Adewumi, Tosin, et autres
Publié: (2024)
par: Adewumi, Tosin, et autres
Publié: (2024)
Trends and Challenges in Authorship Analysis: A Review of ML, DL, and LLM Approaches
par: Habib, Nudrat, et autres
Publié: (2025)
par: Habib, Nudrat, et autres
Publié: (2025)
Generative AI and Teachers -- For Us or Against Us? A Case Study
par: Pettersson, Jenny, et autres
Publié: (2024)
par: Pettersson, Jenny, et autres
Publié: (2024)
On the Limitations of Large Language Models (LLMs): False Attribution
par: Adewumi, Tosin, et autres
Publié: (2024)
par: Adewumi, Tosin, et autres
Publié: (2024)
BatteryPass-12K: The First Dataset for the Novel Digital Battery Passport Conformance Task
par: Adewumi, Tosin, et autres
Publié: (2026)
par: Adewumi, Tosin, et autres
Publié: (2026)
FIN-bench-v2: A Unified and Robust Benchmark Suite for Evaluating Finnish Large Language Models
par: Kytöniemi, Joona, et autres
Publié: (2025)
par: Kytöniemi, Joona, et autres
Publié: (2025)
Format for Library Instruction; Stated Student Preferences at a Community College.
par: Stillerman, Sophia J.
Publié: (1975)
par: Stillerman, Sophia J.
Publié: (1975)
Fairness and Bias in Multimodal AI: A Survey
par: Adewumi, Tosin, et autres
Publié: (2024)
par: Adewumi, Tosin, et autres
Publié: (2024)
Poro 34B and the Blessing of Multilinguality
par: Luukkonen, Risto, et autres
Publié: (2024)
par: Luukkonen, Risto, et autres
Publié: (2024)
AI Must not be Fully Autonomous
par: Adewumi, Tosin, et autres
Publié: (2025)
par: Adewumi, Tosin, et autres
Publié: (2025)
Unmasking the Canvas: A Dynamic Benchmark for Image Generation Jailbreaking and LLM Content Safety
par: Nair, Variath Madhupal Gautham, et autres
Publié: (2025)
par: Nair, Variath Madhupal Gautham, et autres
Publié: (2025)
Ruling Violently: The exercise of criminal governance by the Mexican Cartel Jalisco Nueva Generación (CJNG)
par: Carolina Sampó
Publié: (2023)
par: Carolina Sampó
Publié: (2023)
La Guerra Urbana en Río de Janeiro: de las Unidades de Policia Pacificadora a la militarización (2008-2018)
par: Carolina Sampó
Publié: (2019)
par: Carolina Sampó
Publié: (2019)
El rol de las mujeres en las maras: una aproximación a la violencia que sufren e infringen
par: Carolina Sampó
Publié: (2016)
par: Carolina Sampó
Publié: (2016)
LA VIOLENCIA VINCULADA A LA CRIMINALIDAD EN BRASIL Y EL PAPEL DE LAS FUERZAS ARMADAS EN LA BÚSQUEDA DE LA SEGURIDAD PÚBLICA
par: Carolina Sampó
Publié: (2015)
par: Carolina Sampó
Publié: (2015)
El tráfico de cocaína entre América Latina y África Occidental
par: Carolina Sampó
Publié: (2019)
par: Carolina Sampó
Publié: (2019)
NARCOTRÁFICO Y TRATA DE PERSONAS, UNA MUESTRA DE CÓMO EL CRIMEN ORGANIZADO AVANZA EN ARGENTINA
par: Carolina Sampó
Publié: (2017)
par: Carolina Sampó
Publié: (2017)
An Overview of Recent Developments on Electrodes Modified with Bacteriophages
par: Katarzyna Szot‐Karpińska
Publié: (2025)
par: Katarzyna Szot‐Karpińska
Publié: (2025)
Do you need to chew? A case report on dogs’ behavioural needs
par: Stefania Uccheddu, et autres
Publié: (2024)
par: Stefania Uccheddu, et autres
Publié: (2024)
Evolution of the Human Life Cycle, Revisited
par: Barry Bogin, et autres
Publié: (2025)
par: Barry Bogin, et autres
Publié: (2025)
Multi-agent Deep Reinforcement Learning for Distributed Load Restoration
par: Vu, Linh, et autres
Publié: (2023)
par: Vu, Linh, et autres
Publié: (2023)
Findings of MEGA: Maths Explanation with LLMs using the Socratic Method for Active Learning
par: Adewumi, Tosin, et autres
Publié: (2025)
par: Adewumi, Tosin, et autres
Publié: (2025)
Modal Logic for Distributed Trust
par: Voorneveld, Niels, et autres
Publié: (2026)
par: Voorneveld, Niels, et autres
Publié: (2026)
Caracterización sociodemográfica y epidemiológica de niños y adolescentes con intento de suicidio en el municipio de Santiago de Cuba
par: Anan Persaud
Publié: (2023)
par: Anan Persaud
Publié: (2023)
Clinical practice guideline recommendations can promote or undermine health equity
par: Nav Persaud
Publié: (2025)
par: Nav Persaud
Publié: (2025)
Caste criminalisation in South India and permanent migration to Fiji, 1903–1927
par: Alexander Persaud
Publié: (2025)
par: Alexander Persaud
Publié: (2025)
Offshoring and Outsourcing of R&D and Business Activities in Canadian Technology Firm
par: Ajax Persaud
Publié: (2013)
par: Ajax Persaud
Publié: (2013)
Counterargument for Critical Thinking as Judged by AI and Humans
par: Adewumi, Tosin, et autres
Publié: (2026)
par: Adewumi, Tosin, et autres
Publié: (2026)
VAI TRÒ CỦA TÀI NGUYÊN GIÁO DỤC MỞ TRONG HỌC TẬP HIỆN ĐẠI
par: Vu, Đức
Publié: (2026)
par: Vu, Đức
Publié: (2026)
On the functor relating Harish-Chandra bimodules and Soergel bimodules
par: Vu, Trung
Publié: (2025)
par: Vu, Trung
Publié: (2025)
Truxonchus quangi Vu 2021
par: Vu, Tam T. T.
Publié: (2021)
par: Vu, Tam T. T.
Publié: (2021)
Documents similaires
-
Register Always Matters: Analysis of LLM Pretraining Data Through the Lens of Language Variation
par: Myntti, Amanda, et autres
Publié: (2025) -
A Survey of Large Language Models for European Languages
par: Ali, Wazir, et autres
Publié: (2024) -
Got Compute, but No Data: Lessons From Post-training a Finnish LLM
par: Zosa, Elaine, et autres
Publié: (2025) -
Pretraining Finnish ModernBERTs
par: Reunamo, Akseli, et autres
Publié: (2025) -
A Novel Preprocessing-Driven Approach to Remaining Useful Life (RUL) Prediction Using Temporal Convolutional Networks (TCN)
par: Imbert, Florent, et autres
Publié: (2026)