LLaMA-NAS: Efficient Neural Architecture Search for Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Sarah, Anthony, Sridhar, Sharath Nittur, Szankin, Maciej, Sundaresan, Sairam |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Tailored-LLaMA: Optimizing Few-Shot Learning in Pruned LLaMA Models with Task-Specific Prompts
por: Aftab, Danyal, et al.
Publicado: (2024)
por: Aftab, Danyal, et al.
Publicado: (2024)
Me LLaMA: Foundation Large Language Models for Medical Applications
por: Xie, Qianqian, et al.
Publicado: (2024)
por: Xie, Qianqian, et al.
Publicado: (2024)
BanglaLlama: LLaMA for Bangla Language
por: Zehady, Abdullah Khan, et al.
Publicado: (2024)
por: Zehady, Abdullah Khan, et al.
Publicado: (2024)
LLaMAs Have Feelings Too: Unveiling Sentiment and Emotion Representations in LLaMA Models Through Probing
por: Di Palma, Dario, et al.
Publicado: (2025)
por: Di Palma, Dario, et al.
Publicado: (2025)
LLaMA-Omni: Seamless Speech Interaction with Large Language Models
por: Fang, Qingkai, et al.
Publicado: (2024)
por: Fang, Qingkai, et al.
Publicado: (2024)
Dia-LLaMA: Towards Large Language Model-driven CT Report Generation
por: Chen, Zhixuan, et al.
Publicado: (2024)
por: Chen, Zhixuan, et al.
Publicado: (2024)
LLaMA Beyond English: An Empirical Study on Language Capability Transfer
por: Zhao, Jun, et al.
Publicado: (2024)
por: Zhao, Jun, et al.
Publicado: (2024)
How Vocabulary Sharing Facilitates Multilingualism in LLaMA?
por: Yuan, Fei, et al.
Publicado: (2023)
por: Yuan, Fei, et al.
Publicado: (2023)
Metamorphic Testing for Fairness Evaluation in Large Language Models: Identifying Intersectional Bias in LLaMA and GPT
por: Reddy, Harishwar, et al.
Publicado: (2025)
por: Reddy, Harishwar, et al.
Publicado: (2025)
CUBETESTERAI: Automated JUnit Test Generation using the LLaMA Model
por: Gorla, Daniele, et al.
Publicado: (2025)
por: Gorla, Daniele, et al.
Publicado: (2025)
FedSEA-LLaMA: A Secure, Efficient and Adaptive Federated Splitting Framework for Large Language Models
por: Zhang, Zishuai, et al.
Publicado: (2025)
por: Zhang, Zishuai, et al.
Publicado: (2025)
LLaMA-Adapter: Efficient Fine-tuning of Language Models with Zero-init Attention
por: Zhang, Renrui, et al.
Publicado: (2023)
por: Zhang, Renrui, et al.
Publicado: (2023)
LLaMA-XR: A Novel Framework for Radiology Report Generation using LLaMA and QLoRA Fine Tuning
por: Jahangir, Md. Zihad Bin, et al.
Publicado: (2025)
por: Jahangir, Md. Zihad Bin, et al.
Publicado: (2025)
Smart-LLaMA-DPO: Reinforced Large Language Model for Explainable Smart Contract Vulnerability Detection
por: Yu, Lei, et al.
Publicado: (2025)
por: Yu, Lei, et al.
Publicado: (2025)
EDVD-LLaMA: Explainable Deepfake Video Detection via Multimodal Large Language Model Reasoning
por: Sun, Haoran, et al.
Publicado: (2025)
por: Sun, Haoran, et al.
Publicado: (2025)
Sheared LLaMA: Accelerating Language Model Pre-training via Structured Pruning
por: Xia, Mengzhou, et al.
Publicado: (2023)
por: Xia, Mengzhou, et al.
Publicado: (2023)
Emotion-LLaMA: Multimodal Emotion Recognition and Reasoning with Instruction Tuning
por: Cheng, Zebang, et al.
Publicado: (2024)
por: Cheng, Zebang, et al.
Publicado: (2024)
Multimodal Medical Disease Classification with LLaMA II
por: Gapp, Christian, et al.
Publicado: (2024)
por: Gapp, Christian, et al.
Publicado: (2024)
Evaluating LLaMA 3.2 for Software Vulnerability Detection
por: Gonçalves, José, et al.
Publicado: (2025)
por: Gonçalves, José, et al.
Publicado: (2025)
Smart-LLaMA: Two-Stage Post-Training of Large Language Models for Smart Contract Vulnerability Detection and Explanation
por: Yu, Lei, et al.
Publicado: (2024)
por: Yu, Lei, et al.
Publicado: (2024)
The Uniqueness of LLaMA3-70B Series with Per-Channel Quantization
por: Qin, Minghai
Publicado: (2024)
por: Qin, Minghai
Publicado: (2024)
ChatGPT vs Gemini vs LLaMA on Multilingual Sentiment Analysis
por: Buscemi, Alessio, et al.
Publicado: (2024)
por: Buscemi, Alessio, et al.
Publicado: (2024)
Fine-Tuning a Local LLaMA-3 Large Language Model for Automated Privacy-Preserving Physician Letter Generation in Radiation Oncology
por: Hou, Yihao, et al.
Publicado: (2024)
por: Hou, Yihao, et al.
Publicado: (2024)
Seeing the Signs: A Survey of Edge-Deployable OCR Models for Billboard Visibility Analysis
por: Szankin, Maciej, et al.
Publicado: (2025)
por: Szankin, Maciej, et al.
Publicado: (2025)
Generating Knowledge Graphs from Large Language Models: A Comparative Study of GPT-4, LLaMA 2, and BERT
por: Bhatt, Ahan, et al.
Publicado: (2024)
por: Bhatt, Ahan, et al.
Publicado: (2024)
Empowering Smaller Models: Tuning LLaMA and Gemma with Chain-of-Thought for Ukrainian Exam Tasks
por: Syromiatnikov, Mykyta, et al.
Publicado: (2025)
por: Syromiatnikov, Mykyta, et al.
Publicado: (2025)
LLaSE-G1: Incentivizing Generalization Capability for LLaMA-based Speech Enhancement
por: Kang, Boyi, et al.
Publicado: (2025)
por: Kang, Boyi, et al.
Publicado: (2025)
The impact of fine tuning in LLaMA on hallucinations for named entity extraction in legal documentation
por: Vargas, Francisco, et al.
Publicado: (2025)
por: Vargas, Francisco, et al.
Publicado: (2025)
Resource-Efficient Fine-Tuning of LLaMA-3.2-3B for Medical Chain-of-Thought Reasoning
por: Mansha, Imran
Publicado: (2025)
por: Mansha, Imran
Publicado: (2025)
LLM Benchmarking with LLaMA2: Evaluating Code Development Performance Across Multiple Programming Languages
por: Diehl, Patrick, et al.
Publicado: (2025)
por: Diehl, Patrick, et al.
Publicado: (2025)
LLaMA-Berry: Pairwise Optimization for O1-like Olympiad-Level Mathematical Reasoning
por: Zhang, Di, et al.
Publicado: (2024)
por: Zhang, Di, et al.
Publicado: (2024)
LLaMA-Excitor: General Instruction Tuning via Indirect Feature Interaction
por: Zou, Bo, et al.
Publicado: (2024)
por: Zou, Bo, et al.
Publicado: (2024)
LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models
por: Wang, Zhengyi, et al.
Publicado: (2024)
por: Wang, Zhengyi, et al.
Publicado: (2024)
LLaMA-E: Empowering E-commerce Authoring with Object-Interleaved Instruction Following
por: Shi, Kaize, et al.
Publicado: (2023)
por: Shi, Kaize, et al.
Publicado: (2023)
SkipKV: Selective Skipping of KV Generation and Storage for Efficient Inference with Large Reasoning Models
por: Tian, Jiayi, et al.
Publicado: (2025)
por: Tian, Jiayi, et al.
Publicado: (2025)
Fine-tuning LLaMA 2 interference: a comparative study of language implementations for optimal efficiency
por: Hossain, Sazzad, et al.
Publicado: (2025)
por: Hossain, Sazzad, et al.
Publicado: (2025)
MusiScene: Leveraging MU-LLaMA for Scene Imagination and Enhanced Video Background Music Generation
por: Izzati, Fathinah, et al.
Publicado: (2025)
por: Izzati, Fathinah, et al.
Publicado: (2025)
An Automated Retrieval-Augmented Generation LLaMA-4 109B-based System for Evaluating Radiotherapy Treatment Plans
por: Cui, Junjie, et al.
Publicado: (2025)
por: Cui, Junjie, et al.
Publicado: (2025)
ECHO-LLaMA: Efficient Caching for High-Performance LLaMA Training
por: Dialameh, Maryam, et al.
Publicado: (2025)
por: Dialameh, Maryam, et al.
Publicado: (2025)
LVLM-Compress-Bench: Benchmarking the Broader Impact of Large Vision-Language Model Compression
por: Kundu, Souvik, et al.
Publicado: (2025)
por: Kundu, Souvik, et al.
Publicado: (2025)
Ejemplares similares
-
Tailored-LLaMA: Optimizing Few-Shot Learning in Pruned LLaMA Models with Task-Specific Prompts
por: Aftab, Danyal, et al.
Publicado: (2024) -
Me LLaMA: Foundation Large Language Models for Medical Applications
por: Xie, Qianqian, et al.
Publicado: (2024) -
BanglaLlama: LLaMA for Bangla Language
por: Zehady, Abdullah Khan, et al.
Publicado: (2024) -
LLaMAs Have Feelings Too: Unveiling Sentiment and Emotion Representations in LLaMA Models Through Probing
por: Di Palma, Dario, et al.
Publicado: (2025) -
LLaMA-Omni: Seamless Speech Interaction with Large Language Models
por: Fang, Qingkai, et al.
Publicado: (2024)