Tucano 2 Cool: Better Open Source LLMs for Portuguese
Fuente:
arXiv
Salvato in:
| Autori principali: | Corrêa, Nicholas Kluge, Sen, Aniket, Fatimah, Shiza, Falk, Sophia, Landgraf, Lennard, Kastner, Julia, Flek, Lucie |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Tucano: Advancing Neural Text Generation for Portuguese
di: Corrêa, Nicholas Kluge, et al.
Pubblicazione: (2024)
di: Corrêa, Nicholas Kluge, et al.
Pubblicazione: (2024)
Raising Bars, Not Parameters: LilMoo Compact Language Model for Hindi
di: Fatimah, Shiza, et al.
Pubblicazione: (2026)
di: Fatimah, Shiza, et al.
Pubblicazione: (2026)
TeenyTinyLlama: open-source tiny language models trained in Brazilian Portuguese
di: Corrêa, Nicholas Kluge, et al.
Pubblicazione: (2024)
di: Corrêa, Nicholas Kluge, et al.
Pubblicazione: (2024)
Reasoning Primitives in Hybrid and Non-Hybrid LLMs: Do Architectural Differences Yield Advantages in State-Tracking and Recall?
di: Rawat, Shivam, et al.
Pubblicazione: (2026)
di: Rawat, Shivam, et al.
Pubblicazione: (2026)
Superalignment with Dynamic Human Values
di: Mai, Florian, et al.
Pubblicazione: (2025)
di: Mai, Florian, et al.
Pubblicazione: (2025)
Pitfalls of Conversational LLMs on News Debiasing
di: Schlicht, Ipek Baris, et al.
Pubblicazione: (2024)
di: Schlicht, Ipek Baris, et al.
Pubblicazione: (2024)
IKnow: Instruction-Knowledge-Aware Continual Pretraining for Effective Domain Adaptation
di: Zhang, Tianyi, et al.
Pubblicazione: (2025)
di: Zhang, Tianyi, et al.
Pubblicazione: (2025)
Multi-Hop Reasoning for Question Answering with Hyperbolic Representations
di: Welz, Simon, et al.
Pubblicazione: (2025)
di: Welz, Simon, et al.
Pubblicazione: (2025)
Probing the Robustness of Theory of Mind in Large Language Models
di: Nickel, Christian, et al.
Pubblicazione: (2024)
di: Nickel, Christian, et al.
Pubblicazione: (2024)
Understanding Artificial Theory of Mind: Perturbed Tasks and Reasoning in Large Language Models
di: Nickel, Christian, et al.
Pubblicazione: (2026)
di: Nickel, Christian, et al.
Pubblicazione: (2026)
More Agents Improve Math Problem Solving but Adversarial Robustness Gap Persists
di: Alavi, Khashayar, et al.
Pubblicazione: (2025)
di: Alavi, Khashayar, et al.
Pubblicazione: (2025)
Can Stories Help LLMs Reason? Curating Information Space Through Narrative
di: Javadi, Vahid Sadiri, et al.
Pubblicazione: (2024)
di: Javadi, Vahid Sadiri, et al.
Pubblicazione: (2024)
Do LLMs Provide Consistent Answers to Health-Related Questions across Languages?
di: Schlicht, Ipek Baris, et al.
Pubblicazione: (2025)
di: Schlicht, Ipek Baris, et al.
Pubblicazione: (2025)
On the Limitations of Language Targeted Pruning: Investigating the Calibration Language Impact in Multilingual LLM Pruning
di: Kurz, Simon, et al.
Pubblicazione: (2024)
di: Kurz, Simon, et al.
Pubblicazione: (2024)
USDC: A Dataset of $\underline{U}$ser $\underline{S}$tance and $\underline{D}$ogmatism in Long $\underline{C}$onversations
di: Marreddy, Mounika, et al.
Pubblicazione: (2024)
di: Marreddy, Mounika, et al.
Pubblicazione: (2024)
Improving Low-Resource Dialect Classification Using Retrieval-based Voice Conversion
di: Fischbach, Lea, et al.
Pubblicazione: (2025)
di: Fischbach, Lea, et al.
Pubblicazione: (2025)
YouTube Comments Decoded: Leveraging LLMs for Low Resource Language Classification
di: Deroy, Aniket, et al.
Pubblicazione: (2024)
di: Deroy, Aniket, et al.
Pubblicazione: (2024)
Plausible but Wrong: A case study on Agentic Failures in Astrophysical Workflows
di: Rawat, Shivam, et al.
Pubblicazione: (2026)
di: Rawat, Shivam, et al.
Pubblicazione: (2026)
ToxiLab: How Well Do Open-Source LLMs Generate Synthetic Toxicity Data?
di: Hui, Zheng, et al.
Pubblicazione: (2024)
di: Hui, Zheng, et al.
Pubblicazione: (2024)
Dynamic Normativity: Necessary and Sufficient Conditions for Value Alignment
di: Corrêa, Nicholas Kluge
Pubblicazione: (2024)
di: Corrêa, Nicholas Kluge
Pubblicazione: (2024)
Is Open-Source There Yet? A Comparative Study on Commercial and Open-Source LLMs in Their Ability to Label Chest X-Ray Reports
di: Dorfner, Felix J., et al.
Pubblicazione: (2024)
di: Dorfner, Felix J., et al.
Pubblicazione: (2024)
Multilingual Mathematical Reasoning: Advancing Open-Source LLMs in Hindi and English
di: Anand, Avinash, et al.
Pubblicazione: (2024)
di: Anand, Avinash, et al.
Pubblicazione: (2024)
MIRROR: A Novel Approach for the Automated Evaluation of Open-Ended Question Generation
di: Deroy, Aniket, et al.
Pubblicazione: (2024)
di: Deroy, Aniket, et al.
Pubblicazione: (2024)
Fabricator: An Open Source Toolkit for Generating Labeled Training Data with Teacher LLMs
di: Golde, Jonas, et al.
Pubblicazione: (2023)
di: Golde, Jonas, et al.
Pubblicazione: (2023)
ToolBridge: An Open-Source Dataset to Equip LLMs with External Tool Capabilities
di: Jin, Zhenchao, et al.
Pubblicazione: (2024)
di: Jin, Zhenchao, et al.
Pubblicazione: (2024)
Extreme Speech Classification in the Era of LLMs: Exploring Open-Source and Proprietary Models
di: Mahajan, Sarthak, et al.
Pubblicazione: (2025)
di: Mahajan, Sarthak, et al.
Pubblicazione: (2025)
Do language models practice what they preach? Examining language ideologies about gendered language reform encoded in LLMs
di: Watson, Julia, et al.
Pubblicazione: (2024)
di: Watson, Julia, et al.
Pubblicazione: (2024)
ExaRanker-Open: Synthetic Explanation for IR using Open-Source LLMs
di: Ferraretto, Fernando, et al.
Pubblicazione: (2024)
di: Ferraretto, Fernando, et al.
Pubblicazione: (2024)
Tailored Conversations beyond LLMs: A RL-Based Dialogue Manager
di: Galland, Lucie, et al.
Pubblicazione: (2025)
di: Galland, Lucie, et al.
Pubblicazione: (2025)
Towards Smarter Hiring: Are Zero-Shot and Few-Shot Pre-trained LLMs Ready for HR Spoken Interview Transcript Analysis?
di: Maity, Subhankar, et al.
Pubblicazione: (2025)
di: Maity, Subhankar, et al.
Pubblicazione: (2025)
How Trustworthy are Open-Source LLMs? An Assessment under Malicious Demonstrations Shows their Vulnerabilities
di: Mo, Lingbo, et al.
Pubblicazione: (2023)
di: Mo, Lingbo, et al.
Pubblicazione: (2023)
From FLOPs to Footprints: The Resource Cost of Artificial Intelligence
di: Falk, Sophia, et al.
Pubblicazione: (2025)
di: Falk, Sophia, et al.
Pubblicazione: (2025)
GlórIA -- A Generative and Open Large Language Model for Portuguese
di: Lopes, Ricardo, et al.
Pubblicazione: (2024)
di: Lopes, Ricardo, et al.
Pubblicazione: (2024)
From Building Blocks to Planning: Multi-Step Spatial Reasoning in LLMs with Reinforcement Learning
di: Tahmasbi, Amir, et al.
Pubblicazione: (2025)
di: Tahmasbi, Amir, et al.
Pubblicazione: (2025)
LLMs Can Teach Themselves to Better Predict the Future
di: Turtel, Benjamin, et al.
Pubblicazione: (2025)
di: Turtel, Benjamin, et al.
Pubblicazione: (2025)
Prosa: Rubric-Based Evaluation of LLMs on Real User Chats in Brazilian Portuguese
di: Junior, Roseval Malaquias, et al.
Pubblicazione: (2026)
di: Junior, Roseval Malaquias, et al.
Pubblicazione: (2026)
Adapting LLMs for the Medical Domain in Portuguese: A Study on Fine-Tuning and Model Evaluation
di: Paiola, Pedro Henrique, et al.
Pubblicazione: (2024)
di: Paiola, Pedro Henrique, et al.
Pubblicazione: (2024)
Exploring Robustness of LLMs to Paraphrasing Based on Sociodemographic Factors
di: Arora, Pulkit, et al.
Pubblicazione: (2025)
di: Arora, Pulkit, et al.
Pubblicazione: (2025)
AMALIA Technical Report: A Fully Open Source Large Language Model for European Portuguese
di: Simplício, Afonso, et al.
Pubblicazione: (2026)
di: Simplício, Afonso, et al.
Pubblicazione: (2026)
Exploring Robustness of Multilingual LLMs on Real-World Noisy Data
di: Aliakbarzadeh, Amirhossein, et al.
Pubblicazione: (2025)
di: Aliakbarzadeh, Amirhossein, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Tucano: Advancing Neural Text Generation for Portuguese
di: Corrêa, Nicholas Kluge, et al.
Pubblicazione: (2024) -
Raising Bars, Not Parameters: LilMoo Compact Language Model for Hindi
di: Fatimah, Shiza, et al.
Pubblicazione: (2026) -
TeenyTinyLlama: open-source tiny language models trained in Brazilian Portuguese
di: Corrêa, Nicholas Kluge, et al.
Pubblicazione: (2024) -
Reasoning Primitives in Hybrid and Non-Hybrid LLMs: Do Architectural Differences Yield Advantages in State-Tracking and Recall?
di: Rawat, Shivam, et al.
Pubblicazione: (2026) -
Superalignment with Dynamic Human Values
di: Mai, Florian, et al.
Pubblicazione: (2025)