Engineering A Large Language Model From Scratch
Fuente:
arXiv
Gespeichert in:
| 1. Verfasser: | Oketunji, Abiodun Finbarrs |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Predicting 3D Rigid Body Dynamics with Deep Residual Network
von: Oketunji, Abiodun Finbarrs
Veröffentlicht: (2024)
von: Oketunji, Abiodun Finbarrs
Veröffentlicht: (2024)
Evaluating the Efficacy of Hybrid Deep Learning Models in Distinguishing AI-Generated Text
von: Oketunji, Abiodun Finbarrs
Veröffentlicht: (2023)
von: Oketunji, Abiodun Finbarrs
Veröffentlicht: (2023)
Large Language Model (LLM) Bias Index -- LLMBI
von: Oketunji, Abiodun Finbarrs, et al.
Veröffentlicht: (2023)
von: Oketunji, Abiodun Finbarrs, et al.
Veröffentlicht: (2023)
Automated Bug Triaging using Instruction-Tuned Large Language Models
von: Kiashemshaki, Kiana, et al.
Veröffentlicht: (2025)
von: Kiashemshaki, Kiana, et al.
Veröffentlicht: (2025)
Comparative Analysis of LLM Abliteration Methods: A Cross-Architecture Evaluation
von: Young, Richard J.
Veröffentlicht: (2025)
von: Young, Richard J.
Veröffentlicht: (2025)
Toward Architecture-Aware Evaluation Metrics for LLM Agents
von: Souza, Débora, et al.
Veröffentlicht: (2026)
von: Souza, Débora, et al.
Veröffentlicht: (2026)
Entropy-Based Measurement of Value Drift and Alignment Work in Large Language Models
von: Fadli, Samih
Veröffentlicht: (2025)
von: Fadli, Samih
Veröffentlicht: (2025)
Automated Web Application Testing: End-to-End Test Case Generation with Large Language Models and Screen Transition Graphs
von: Le, Nguyen-Khang, et al.
Veröffentlicht: (2025)
von: Le, Nguyen-Khang, et al.
Veröffentlicht: (2025)
CRISP: Persistent Concept Unlearning via Sparse Autoencoders
von: Ashuach, Tomer, et al.
Veröffentlicht: (2025)
von: Ashuach, Tomer, et al.
Veröffentlicht: (2025)
TRACE: A taxonomy-grounded synthetic dataset for teaching-program generation and session interpretation in Applied Behavior Analysis
von: Kahunla, Festus
Veröffentlicht: (2026)
von: Kahunla, Festus
Veröffentlicht: (2026)
Mechanistic Understanding of Language Models in Syntactic Code Completion
von: Miller, Samuel, et al.
Veröffentlicht: (2025)
von: Miller, Samuel, et al.
Veröffentlicht: (2025)
From Facts to Folklore: Evaluating Large Language Models on Bengali Cultural Knowledge
von: Chowdhury, Nafis, et al.
Veröffentlicht: (2025)
von: Chowdhury, Nafis, et al.
Veröffentlicht: (2025)
Improving Existing Optimization Algorithms with LLMs
von: Sartori, Camilo Chacón, et al.
Veröffentlicht: (2025)
von: Sartori, Camilo Chacón, et al.
Veröffentlicht: (2025)
The Appeal and Reality of Recycling LoRAs with Adaptive Merging
von: Liu, Haokun, et al.
Veröffentlicht: (2026)
von: Liu, Haokun, et al.
Veröffentlicht: (2026)
Advances and Frontiers of LLM-based Issue Resolution in Software Engineering: A Comprehensive Survey
von: Li, Caihua, et al.
Veröffentlicht: (2026)
von: Li, Caihua, et al.
Veröffentlicht: (2026)
Safety Under Scaffolding: How Evaluation Conditions Shape Measured Safety
von: Gringras, David
Veröffentlicht: (2026)
von: Gringras, David
Veröffentlicht: (2026)
Failure by Interference: Language Models Make Balanced Parentheses Errors When Faulty Mechanisms Overshadow Sound Ones
von: Rai, Daking, et al.
Veröffentlicht: (2025)
von: Rai, Daking, et al.
Veröffentlicht: (2025)
Text-Based Approaches to Item Difficulty Modeling in Large-Scale Assessments: A Systematic Review
von: Peters, Sydney, et al.
Veröffentlicht: (2025)
von: Peters, Sydney, et al.
Veröffentlicht: (2025)
LLMORPH: Automated Metamorphic Testing of Large Language Models
von: Cho, Steven, et al.
Veröffentlicht: (2026)
von: Cho, Steven, et al.
Veröffentlicht: (2026)
Large Language Models as Software Components: A Taxonomy for LLM-Integrated Applications
von: Weber, Irene
Veröffentlicht: (2024)
von: Weber, Irene
Veröffentlicht: (2024)
The Need for Guardrails with Large Language Models in Medical Safety-Critical Settings: An Artificial Intelligence Application in the Pharmacovigilance Ecosystem
von: Hakim, Joe B, et al.
Veröffentlicht: (2024)
von: Hakim, Joe B, et al.
Veröffentlicht: (2024)
A Comparative Study of DSL Code Generation: Fine-Tuning vs. Optimized Retrieval Augmentation
von: Bassamzadeh, Nastaran, et al.
Veröffentlicht: (2024)
von: Bassamzadeh, Nastaran, et al.
Veröffentlicht: (2024)
Leveraging Test Driven Development with Large Language Models for Reliable and Verifiable Spreadsheet Code Generation: A Research Framework
von: Thorne, Simon, et al.
Veröffentlicht: (2025)
von: Thorne, Simon, et al.
Veröffentlicht: (2025)
The Open Source Advantage in Large Language Models (LLMs)
von: Manchanda, Jiya, et al.
Veröffentlicht: (2024)
von: Manchanda, Jiya, et al.
Veröffentlicht: (2024)
When Retrieval Hurts Code Completion: A Diagnostic Study of Stale Repository Context
von: Weng, Haojun, et al.
Veröffentlicht: (2026)
von: Weng, Haojun, et al.
Veröffentlicht: (2026)
Reducing Maintenance Burden in Behaviour-Driven Development: A Paraphrase-Robust Duplicate-Step Detector with a 1.1M-Step Open Benchmark
von: Mughal, Ali Hassaan, et al.
Veröffentlicht: (2026)
von: Mughal, Ali Hassaan, et al.
Veröffentlicht: (2026)
Plan with Code: Comparing approaches for robust NL to DSL generation
von: Bassamzadeh, Nastaran, et al.
Veröffentlicht: (2024)
von: Bassamzadeh, Nastaran, et al.
Veröffentlicht: (2024)
Scaling Laws for Forgetting When Fine-Tuning Large Language Models
von: Kalajdzievski, Damjan
Veröffentlicht: (2024)
von: Kalajdzievski, Damjan
Veröffentlicht: (2024)
Sparsing Law: Towards Large Language Models with Greater Activation Sparsity
von: Luo, Yuqi, et al.
Veröffentlicht: (2024)
von: Luo, Yuqi, et al.
Veröffentlicht: (2024)
Vibe Code Bench: Evaluating AI Models on End-to-End Web Application Development
von: Tran, Hung, et al.
Veröffentlicht: (2026)
von: Tran, Hung, et al.
Veröffentlicht: (2026)
Context-Aware Clustering using Large Language Models
von: Tipirneni, Sindhu, et al.
Veröffentlicht: (2024)
von: Tipirneni, Sindhu, et al.
Veröffentlicht: (2024)
Anka: A Domain-Specific Language for Reliable LLM Code Generation
von: Mazrouei, Saif Khalfan Saif Al
Veröffentlicht: (2025)
von: Mazrouei, Saif Khalfan Saif Al
Veröffentlicht: (2025)
MedFuzz: Exploring the Robustness of Large Language Models in Medical Question Answering
von: Ness, Robert Osazuwa, et al.
Veröffentlicht: (2024)
von: Ness, Robert Osazuwa, et al.
Veröffentlicht: (2024)
Memory Bank Compression for Continual Adaptation of Large Language Models
von: Katraouras, Thomas, et al.
Veröffentlicht: (2026)
von: Katraouras, Thomas, et al.
Veröffentlicht: (2026)
Fane at SemEval-2025 Task 10: Zero-Shot Entity Framing with Large Language Models
von: Fane, Enfa, et al.
Veröffentlicht: (2025)
von: Fane, Enfa, et al.
Veröffentlicht: (2025)
ReDel: A Toolkit for LLM-Powered Recursive Multi-Agent Systems
von: Zhu, Andrew, et al.
Veröffentlicht: (2024)
von: Zhu, Andrew, et al.
Veröffentlicht: (2024)
AgentAtlas: Beyond Outcome Leaderboards for LLM Agents
von: Mazaheri, Parsa, et al.
Veröffentlicht: (2026)
von: Mazaheri, Parsa, et al.
Veröffentlicht: (2026)
Conceptual Engineering Using Large Language Models
von: Allen, Bradley P.
Veröffentlicht: (2023)
von: Allen, Bradley P.
Veröffentlicht: (2023)
Towards Fundamental Language Models: Does Linguistic Competence Scale with Model Size?
von: Collado-Montañez, Jaime, et al.
Veröffentlicht: (2025)
von: Collado-Montañez, Jaime, et al.
Veröffentlicht: (2025)
Merge-Bench: Resolve Merge Conflicts with Large Language Models
von: Schesch, Benedikt, et al.
Veröffentlicht: (2026)
von: Schesch, Benedikt, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
Predicting 3D Rigid Body Dynamics with Deep Residual Network
von: Oketunji, Abiodun Finbarrs
Veröffentlicht: (2024) -
Evaluating the Efficacy of Hybrid Deep Learning Models in Distinguishing AI-Generated Text
von: Oketunji, Abiodun Finbarrs
Veröffentlicht: (2023) -
Large Language Model (LLM) Bias Index -- LLMBI
von: Oketunji, Abiodun Finbarrs, et al.
Veröffentlicht: (2023) -
Automated Bug Triaging using Instruction-Tuned Large Language Models
von: Kiashemshaki, Kiana, et al.
Veröffentlicht: (2025) -
Comparative Analysis of LLM Abliteration Methods: A Cross-Architecture Evaluation
von: Young, Richard J.
Veröffentlicht: (2025)