RightNow-Arabic-0.5B-Turbo: An Open Sub-1B Arabic Language Model via Vocabulary Injection and Edge-First Deployment
Fuente:
arXiv
Salvato in:
| Autori principali: | Jaber, Jaber, Jaber, Osama |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Ouroboros: Dynamic Weight Generation for Recursive Transformers via Input-Conditioned LoRA Modulation
di: Jaber, Jaber, et al.
Pubblicazione: (2026)
di: Jaber, Jaber, et al.
Pubblicazione: (2026)
StreamIndex: Memory-Bounded Compressed Sparse Attention via Streaming Top-k
di: Jaber, Jaber, et al.
Pubblicazione: (2026)
di: Jaber, Jaber, et al.
Pubblicazione: (2026)
Beyond Arabic: Software for Perso-Arabic Script Manipulation
di: Gutkin, Alexander, et al.
Pubblicazione: (2023)
di: Gutkin, Alexander, et al.
Pubblicazione: (2023)
Graphemic Normalization of the Perso-Arabic Script
di: Doctor, Raiomond, et al.
Pubblicazione: (2022)
di: Doctor, Raiomond, et al.
Pubblicazione: (2022)
HCLSM: Hierarchical Causal Latent State Machines for Object-Centric World Modeling
di: Jaber, Jaber, et al.
Pubblicazione: (2026)
di: Jaber, Jaber, et al.
Pubblicazione: (2026)
Arabic Hate Speech Identification and Masking in Social Media using Deep Learning Models and Pre-trained Models Fine-tuning
di: Doghmash, Salam Thabet, et al.
Pubblicazione: (2025)
di: Doghmash, Salam Thabet, et al.
Pubblicazione: (2025)
Cultural Benchmarking of LLMs in Standard and Dialectal Arabic Dialogues
di: Kautsar, Muhammad Dehan Al, et al.
Pubblicazione: (2026)
di: Kautsar, Muhammad Dehan Al, et al.
Pubblicazione: (2026)
AraToken: Optimizing Arabic Tokenization with Normalization Pipeline and Language Extension for Qwen3
di: Kashirskiy, Mark, et al.
Pubblicazione: (2025)
di: Kashirskiy, Mark, et al.
Pubblicazione: (2025)
REVS: Unlearning Sensitive Information in Language Models via Rank Editing in the Vocabulary Space
di: Ashuach, Tomer, et al.
Pubblicazione: (2024)
di: Ashuach, Tomer, et al.
Pubblicazione: (2024)
Right for Right Reasons: Large Language Models for Verifiable Commonsense Knowledge Graph Question Answering
di: Toroghi, Armin, et al.
Pubblicazione: (2024)
di: Toroghi, Armin, et al.
Pubblicazione: (2024)
The Syntax of qulk-clauses in Yemeni Ibbi Arabic: A Minimalist Approach
di: Albadani, Zubaida Mohammed, et al.
Pubblicazione: (2025)
di: Albadani, Zubaida Mohammed, et al.
Pubblicazione: (2025)
LAraBench: Benchmarking Arabic AI with Large Language Models
di: Abdelali, Ahmed, et al.
Pubblicazione: (2023)
di: Abdelali, Ahmed, et al.
Pubblicazione: (2023)
WASIL: In-the-Wild Arabic Spoken Interactions with LLMs
di: Ali, Zien Sheikh, et al.
Pubblicazione: (2026)
di: Ali, Zien Sheikh, et al.
Pubblicazione: (2026)
Revisiting the syntax of imperatives in Yemeni Arabic: An Agree across phases approach
di: Shormani, Mohammed Q.
Pubblicazione: (2026)
di: Shormani, Mohammed Q.
Pubblicazione: (2026)
Optimizing What We Trust: Reliability-Guided QUBO Selection of Multi-Agent Weak Framing Signals for Arabic Sentiment Prediction
di: Alkhalifa, Rabab
Pubblicazione: (2026)
di: Alkhalifa, Rabab
Pubblicazione: (2026)
CRISP: Persistent Concept Unlearning via Sparse Autoencoders
di: Ashuach, Tomer, et al.
Pubblicazione: (2025)
di: Ashuach, Tomer, et al.
Pubblicazione: (2025)
The acquisition of English irregular inflections by Yemeni L1 Arabic learners: A Universal Grammar approach
di: Alsawsh, Muneef Y., et al.
Pubblicazione: (2026)
di: Alsawsh, Muneef Y., et al.
Pubblicazione: (2026)
Beyond MCQ: An Open-Ended Arabic Cultural QA Benchmark with Dialect Variants
di: Bhatti, Hunzalah Hassan, et al.
Pubblicazione: (2025)
di: Bhatti, Hunzalah Hassan, et al.
Pubblicazione: (2025)
TIDE: Token-Informed Depth Execution for Per-Token Early Exit in LLM Inference
di: Jaber, Jaber, et al.
Pubblicazione: (2026)
di: Jaber, Jaber, et al.
Pubblicazione: (2026)
Towards Fundamental Language Models: Does Linguistic Competence Scale with Model Size?
di: Collado-Montañez, Jaime, et al.
Pubblicazione: (2025)
di: Collado-Montañez, Jaime, et al.
Pubblicazione: (2025)
Thaka at KSAA-2026 Task 2: Regularized Fine-Tuning for Arabic Speech Diacritization
di: Alamr, Meshal, et al.
Pubblicazione: (2026)
di: Alamr, Meshal, et al.
Pubblicazione: (2026)
HYPEROFA: Expanding LLM Vocabulary to New Languages via Hypernetwork-Based Embedding Initialization
di: Özeren, Enes, et al.
Pubblicazione: (2025)
di: Özeren, Enes, et al.
Pubblicazione: (2025)
Vocabulary Transfer for Biomedical Texts: Add Tokens if You Can Not Add Data
di: Singh, Priyanka, et al.
Pubblicazione: (2022)
di: Singh, Priyanka, et al.
Pubblicazione: (2022)
Tokenization and Morphology in Multilingual Language Models: A Comparative Analysis of mT5 and ByT5
di: Dang, Thao Anh, et al.
Pubblicazione: (2024)
di: Dang, Thao Anh, et al.
Pubblicazione: (2024)
Bielik 7B v0.1: A Polish Language Model -- Development, Insights, and Evaluation
di: Ociepa, Krzysztof, et al.
Pubblicazione: (2024)
di: Ociepa, Krzysztof, et al.
Pubblicazione: (2024)
Can ChatGPT capture swearing nuances? Evidence from translating Arabic oaths
di: Shormani, Mohammed Q.
Pubblicazione: (2024)
di: Shormani, Mohammed Q.
Pubblicazione: (2024)
ThatiAR: Subjectivity Detection in Arabic News Sentences
di: Suwaileh, Reem, et al.
Pubblicazione: (2024)
di: Suwaileh, Reem, et al.
Pubblicazione: (2024)
OpenMap: Instruction Grounding via Open-Vocabulary Visual-Language Mapping
di: Li, Danyang, et al.
Pubblicazione: (2025)
di: Li, Danyang, et al.
Pubblicazione: (2025)
Enhancing the Reasoning Capabilities of Small Language Models via Solution Guidance Fine-Tuning
di: Bi, Jing, et al.
Pubblicazione: (2024)
di: Bi, Jing, et al.
Pubblicazione: (2024)
ArMeme: Propagandistic Content in Arabic Memes
di: Alam, Firoj, et al.
Pubblicazione: (2024)
di: Alam, Firoj, et al.
Pubblicazione: (2024)
Bielik-Minitron-7B: Compressing Large Language Models via Structured Pruning and Knowledge Distillation for the Polish Language
di: Kinas, Remigiusz, et al.
Pubblicazione: (2026)
di: Kinas, Remigiusz, et al.
Pubblicazione: (2026)
RTI-Bench: A Structured Dataset for Indian Right-to-Information Decision Analysis
di: Bose, Joy
Pubblicazione: (2026)
di: Bose, Joy
Pubblicazione: (2026)
Enhancing Software-Related Information Extraction via Single-Choice Question Answering with Large Language Models
di: Otto, Wolfgang, et al.
Pubblicazione: (2024)
di: Otto, Wolfgang, et al.
Pubblicazione: (2024)
The Open Source Advantage in Large Language Models (LLMs)
di: Manchanda, Jiya, et al.
Pubblicazione: (2024)
di: Manchanda, Jiya, et al.
Pubblicazione: (2024)
Text-Based Approaches to Item Difficulty Modeling in Large-Scale Assessments: A Systematic Review
di: Peters, Sydney, et al.
Pubblicazione: (2025)
di: Peters, Sydney, et al.
Pubblicazione: (2025)
Assessing RAG and HyDE on 1B vs. 4B-Parameter Gemma LLMs for Personal Assistants Integretion
di: Sorstkins, Andrejs
Pubblicazione: (2025)
di: Sorstkins, Andrejs
Pubblicazione: (2025)
Bielik 11B v3: Multilingual Large Language Model for European Languages
di: Ociepa, Krzysztof, et al.
Pubblicazione: (2025)
di: Ociepa, Krzysztof, et al.
Pubblicazione: (2025)
MedAide: Leveraging Large Language Models for On-Premise Medical Assistance on Edge Devices
di: Basit, Abdul, et al.
Pubblicazione: (2024)
di: Basit, Abdul, et al.
Pubblicazione: (2024)
Precise Length Control in Large Language Models
di: Butcher, Bradley, et al.
Pubblicazione: (2024)
di: Butcher, Bradley, et al.
Pubblicazione: (2024)
What Drives Performance in Multilingual Language Models?
di: Nezhad, Sina Bagheri, et al.
Pubblicazione: (2024)
di: Nezhad, Sina Bagheri, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Ouroboros: Dynamic Weight Generation for Recursive Transformers via Input-Conditioned LoRA Modulation
di: Jaber, Jaber, et al.
Pubblicazione: (2026) -
StreamIndex: Memory-Bounded Compressed Sparse Attention via Streaming Top-k
di: Jaber, Jaber, et al.
Pubblicazione: (2026) -
Beyond Arabic: Software for Perso-Arabic Script Manipulation
di: Gutkin, Alexander, et al.
Pubblicazione: (2023) -
Graphemic Normalization of the Perso-Arabic Script
di: Doctor, Raiomond, et al.
Pubblicazione: (2022) -
HCLSM: Hierarchical Causal Latent State Machines for Object-Centric World Modeling
di: Jaber, Jaber, et al.
Pubblicazione: (2026)