The Open Source Advantage in Large Language Models (LLMs)
Fuente:
arXiv
Guardado en:
| Autores principales: | Manchanda, Jiya, Boettcher, Laura, Westphalen, Matheus, Jasser, Jasser |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Concept Navigation and Classification via Open-Source Large Language Model Processing
por: Kubli, Maël
Publicado: (2025)
por: Kubli, Maël
Publicado: (2025)
AMALIA Technical Report: A Fully Open Source Large Language Model for European Portuguese
por: Simplício, Afonso, et al.
Publicado: (2026)
por: Simplício, Afonso, et al.
Publicado: (2026)
Engineering A Large Language Model From Scratch
por: Oketunji, Abiodun Finbarrs
Publicado: (2024)
por: Oketunji, Abiodun Finbarrs
Publicado: (2024)
Large Language Model (LLM) Bias Index -- LLMBI
por: Oketunji, Abiodun Finbarrs, et al.
Publicado: (2023)
por: Oketunji, Abiodun Finbarrs, et al.
Publicado: (2023)
Beyond Hallucinations: A Composite Score for Measuring Reliability in Open-Source Large Language Models
por: Salla, Rohit Kumar, et al.
Publicado: (2025)
por: Salla, Rohit Kumar, et al.
Publicado: (2025)
Scaling Laws for Forgetting When Fine-Tuning Large Language Models
por: Kalajdzievski, Damjan
Publicado: (2024)
por: Kalajdzievski, Damjan
Publicado: (2024)
Sparsing Law: Towards Large Language Models with Greater Activation Sparsity
por: Luo, Yuqi, et al.
Publicado: (2024)
por: Luo, Yuqi, et al.
Publicado: (2024)
MedFuzz: Exploring the Robustness of Large Language Models in Medical Question Answering
por: Ness, Robert Osazuwa, et al.
Publicado: (2024)
por: Ness, Robert Osazuwa, et al.
Publicado: (2024)
From Facts to Folklore: Evaluating Large Language Models on Bengali Cultural Knowledge
por: Chowdhury, Nafis, et al.
Publicado: (2025)
por: Chowdhury, Nafis, et al.
Publicado: (2025)
Context-Aware Clustering using Large Language Models
por: Tipirneni, Sindhu, et al.
Publicado: (2024)
por: Tipirneni, Sindhu, et al.
Publicado: (2024)
Entropy-Based Measurement of Value Drift and Alignment Work in Large Language Models
por: Fadli, Samih
Publicado: (2025)
por: Fadli, Samih
Publicado: (2025)
Constraint-Driven Small Language Models Based on Agent and OpenAlex Knowledge Graph: Mining Conceptual Pathways and Discovering Innovation Points in Academic Papers
por: Xia, Ziye, et al.
Publicado: (2025)
por: Xia, Ziye, et al.
Publicado: (2025)
Memory Bank Compression for Continual Adaptation of Large Language Models
por: Katraouras, Thomas, et al.
Publicado: (2026)
por: Katraouras, Thomas, et al.
Publicado: (2026)
RightNow-Arabic-0.5B-Turbo: An Open Sub-1B Arabic Language Model via Vocabulary Injection and Edge-First Deployment
por: Jaber, Jaber, et al.
Publicado: (2026)
por: Jaber, Jaber, et al.
Publicado: (2026)
Hardware Co-Design Scaling Laws via Roofline Modelling for On-Device LLMs
por: Sun, Luoyang, et al.
Publicado: (2026)
por: Sun, Luoyang, et al.
Publicado: (2026)
Decoding-Time Debiasing via Process Reward Models: From Controlled Fill-in to Open-Ended Generation
por: Khan, Muneeb Ur Raheem
Publicado: (2026)
por: Khan, Muneeb Ur Raheem
Publicado: (2026)
Evaluating the Efficacy of Hybrid Deep Learning Models in Distinguishing AI-Generated Text
por: Oketunji, Abiodun Finbarrs
Publicado: (2023)
por: Oketunji, Abiodun Finbarrs
Publicado: (2023)
Ensemble Language Models for Multilingual Sentiment Analysis
por: Hasan, Md Arid
Publicado: (2024)
por: Hasan, Md Arid
Publicado: (2024)
On the Effect of (Near) Duplicate Subwords in Language Modelling
por: Schäfer, Anton, et al.
Publicado: (2024)
por: Schäfer, Anton, et al.
Publicado: (2024)
RBCorr: Response Bias Correction in Language Models
por: Bhatt, Om, et al.
Publicado: (2026)
por: Bhatt, Om, et al.
Publicado: (2026)
Compact Example-Based Explanations for Language Models
por: Schoenegger, Loris, et al.
Publicado: (2026)
por: Schoenegger, Loris, et al.
Publicado: (2026)
Improving the Capabilities of Large Language Model Based Marketing Analytics Copilots With Semantic Search And Fine-Tuning
por: Gao, Yilin, et al.
Publicado: (2024)
por: Gao, Yilin, et al.
Publicado: (2024)
Ambiguity in LLMs is a concept missing problem
por: Hu, Zhibo, et al.
Publicado: (2025)
por: Hu, Zhibo, et al.
Publicado: (2025)
Reinforcement Learning for Latent-Space Thinking in LLMs
por: Özeren, Enes, et al.
Publicado: (2025)
por: Özeren, Enes, et al.
Publicado: (2025)
Efficient Solutions For An Intriguing Failure of LLMs: Long Context Window Does Not Mean LLMs Can Analyze Long Sequences Flawlessly
por: Hosseini, Peyman, et al.
Publicado: (2024)
por: Hosseini, Peyman, et al.
Publicado: (2024)
ArcheType: A Novel Framework for Open-Source Column Type Annotation using Large Language Models
por: Feuer, Benjamin, et al.
Publicado: (2023)
por: Feuer, Benjamin, et al.
Publicado: (2023)
A Framework for Fine-Tuning LLMs using Heterogeneous Feedback
por: Aponte, Ryan, et al.
Publicado: (2024)
por: Aponte, Ryan, et al.
Publicado: (2024)
Token Erasure as a Footprint of Implicit Vocabulary Items in LLMs
por: Feucht, Sheridan, et al.
Publicado: (2024)
por: Feucht, Sheridan, et al.
Publicado: (2024)
PowLU: An Activation Function for Stable Pre-Training of LLMs
por: Jiang, Peijie, et al.
Publicado: (2026)
por: Jiang, Peijie, et al.
Publicado: (2026)
Metaphors are a Source of Cross-Domain Misalignment of Large Reasoning Models
por: Hu, Zhibo, et al.
Publicado: (2026)
por: Hu, Zhibo, et al.
Publicado: (2026)
When Models Can't Follow: Testing Instruction Adherence Across 256 LLMs
por: Young, Richard J., et al.
Publicado: (2025)
por: Young, Richard J., et al.
Publicado: (2025)
MMSciBench: Benchmarking Language Models on Chinese Multimodal Scientific Problems
por: Ye, Xinwu, et al.
Publicado: (2025)
por: Ye, Xinwu, et al.
Publicado: (2025)
Distilling Robustness into Natural Language Inference Models with Domain-Targeted Augmentation
por: Stacey, Joe, et al.
Publicado: (2023)
por: Stacey, Joe, et al.
Publicado: (2023)
Amulet: ReAlignment During Test Time for Personalized Preference Adaptation of LLMs
por: Zhang, Zhaowei, et al.
Publicado: (2025)
por: Zhang, Zhaowei, et al.
Publicado: (2025)
Language Models Are Implicitly Continuous
por: Marro, Samuele, et al.
Publicado: (2025)
por: Marro, Samuele, et al.
Publicado: (2025)
Where Should LoRA Go? Component-Type Placement in Hybrid Language Models
por: Borobia, Hector, et al.
Publicado: (2026)
por: Borobia, Hector, et al.
Publicado: (2026)
Structure-Guided Entity Resolution: Fine-Tuning LLMs for Robust Name Matching in Complex Linguistic Contexts
por: Chourasia, Shivam, et al.
Publicado: (2026)
por: Chourasia, Shivam, et al.
Publicado: (2026)
Danoliteracy of Generative Large Language Models
por: Holm, Søren Vejlgaard, et al.
Publicado: (2024)
por: Holm, Søren Vejlgaard, et al.
Publicado: (2024)
Random-Set Large Language Models
por: Mubashar, Muhammad, et al.
Publicado: (2025)
por: Mubashar, Muhammad, et al.
Publicado: (2025)
PersonalLLM: Tailoring LLMs to Individual Preferences
por: Zollo, Thomas P., et al.
Publicado: (2024)
por: Zollo, Thomas P., et al.
Publicado: (2024)
Ejemplares similares
-
Concept Navigation and Classification via Open-Source Large Language Model Processing
por: Kubli, Maël
Publicado: (2025) -
AMALIA Technical Report: A Fully Open Source Large Language Model for European Portuguese
por: Simplício, Afonso, et al.
Publicado: (2026) -
Engineering A Large Language Model From Scratch
por: Oketunji, Abiodun Finbarrs
Publicado: (2024) -
Large Language Model (LLM) Bias Index -- LLMBI
por: Oketunji, Abiodun Finbarrs, et al.
Publicado: (2023) -
Beyond Hallucinations: A Composite Score for Measuring Reliability in Open-Source Large Language Models
por: Salla, Rohit Kumar, et al.
Publicado: (2025)