Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Shao, Minghao, Basit, Abdul, Karri, Ramesh, Shafique, Muhammad |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MetaCipher: A Time-Persistent and Universal Multi-Agent Framework for Cipher-Based Jailbreak Attacks for LLMs
par: Chen, Boyuan, et autres
Publié: (2025)
par: Chen, Boyuan, et autres
Publié: (2025)
From Trace to Line: LLM Agent for Real-World OSS Vulnerability Localization
par: Xi, Haoran, et autres
Publié: (2025)
par: Xi, Haoran, et autres
Publié: (2025)
VeriDispatcher: Multi-Model Dispatching through Pre-Inference Difficulty Prediction for RTL Generation Optimization
par: Wang, Zeng, et autres
Publié: (2025)
par: Wang, Zeng, et autres
Publié: (2025)
Focus Session: Hardware and Software Techniques for Accelerating Multimodal Foundation Models
par: Shafique, Muhammad, et autres
Publié: (2026)
par: Shafique, Muhammad, et autres
Publié: (2026)
QHackBench: Benchmarking Large Language Models for Quantum Code Generation Using PennyLane Hackathon Challenges
par: Basit, Abdul, et autres
Publié: (2025)
par: Basit, Abdul, et autres
Publié: (2025)
VeriContaminated: Assessing LLM-Driven Verilog Coding for Data Contamination
par: Wang, Zeng, et autres
Publié: (2025)
par: Wang, Zeng, et autres
Publié: (2025)
A Survey on Quantum Machine Learning: Current Trends, Challenges, Opportunities, and the Road Ahead
par: Zaman, Kamila, et autres
Publié: (2023)
par: Zaman, Kamila, et autres
Publié: (2023)
Neuromorphic Computing for Embodied Intelligence in Autonomous Systems: Current Trends, Challenges, and Future Directions
par: Marchisio, Alberto, et autres
Publié: (2025)
par: Marchisio, Alberto, et autres
Publié: (2025)
SALAD: Systematic Assessment of Machine Unlearning on LLM-Aided Hardware Design
par: Wang, Zeng, et autres
Publié: (2025)
par: Wang, Zeng, et autres
Publié: (2025)
GroundCount: Grounding Vision-Language Models with Object Detection for Mitigating Counting Hallucinations
par: Chen, Boyuan, et autres
Publié: (2026)
par: Chen, Boyuan, et autres
Publié: (2026)
A Comprehensive Survey of Convolutions in Deep Learning: Applications, Challenges, and Future Trends
par: Younesi, Abolfazl, et autres
Publié: (2024)
par: Younesi, Abolfazl, et autres
Publié: (2024)
VeriLeaky: Navigating IP Protection vs Utility in Fine-Tuning for LLM-Driven Verilog Coding
par: Wang, Zeng, et autres
Publié: (2025)
par: Wang, Zeng, et autres
Publié: (2025)
LLMs for Secure Hardware Design and Related Problems: Opportunities and Challenges
par: Knechtel, Johann, et autres
Publié: (2026)
par: Knechtel, Johann, et autres
Publié: (2026)
NYU CTF Bench: A Scalable Open-Source Benchmark Dataset for Evaluating LLMs in Offensive Security
par: Shao, Minghao, et autres
Publié: (2024)
par: Shao, Minghao, et autres
Publié: (2024)
A Survey of Adversarial Defenses in Vision-based Systems: Categorization, Methods and Challenges
par: Chattopadhyay, Nandish, et autres
Publié: (2025)
par: Chattopadhyay, Nandish, et autres
Publié: (2025)
Hybrid Quantum-Classical Neural Architecture Search
par: Marchisio, Alberto, et autres
Publié: (2026)
par: Marchisio, Alberto, et autres
Publié: (2026)
MedAide: Leveraging Large Language Models for On-Premise Medical Assistance on Edge Devices
par: Basit, Abdul, et autres
Publié: (2024)
par: Basit, Abdul, et autres
Publié: (2024)
ESM: A Framework for Building Effective Surrogate Models for Hardware-Aware Neural Architecture Search
par: Nasir, Azaz-Ur-Rehman, et autres
Publié: (2025)
par: Nasir, Azaz-Ur-Rehman, et autres
Publié: (2025)
Code for All: Educational Applications of the "Vibe Coding" Hackathon in Programming Education across All Skill Levels
par: Chen, Ashley J., et autres
Publié: (2026)
par: Chen, Ashley J., et autres
Publié: (2026)
On Efficient Real-Time Semantic Segmentation: A Survey
par: Holder, Christopher J., et autres
Publié: (2022)
par: Holder, Christopher J., et autres
Publié: (2022)
QNAS: A Neural Architecture Search Framework for Accurate and Efficient Quantum Neural Networks
par: Maleki, Kooshan, et autres
Publié: (2026)
par: Maleki, Kooshan, et autres
Publié: (2026)
FAQNAS: FLOPs-aware Hybrid Quantum Neural Architecture Search using Genetic Algorithm
par: Kashif, Muhammad, et autres
Publié: (2025)
par: Kashif, Muhammad, et autres
Publié: (2025)
Quantum vs. Classical Machine Learning: A Benchmark Study for Financial Prediction
par: Ahmad, Rehan, et autres
Publié: (2026)
par: Ahmad, Rehan, et autres
Publié: (2026)
An Empirical Evaluation of LLMs for Solving Offensive Security Challenges
par: Shao, Minghao, et autres
Publié: (2024)
par: Shao, Minghao, et autres
Publié: (2024)
TinyCL: An Efficient Hardware Architecture for Continual Learning on Autonomous Systems
par: Ressa, Eugenio, et autres
Publié: (2024)
par: Ressa, Eugenio, et autres
Publié: (2024)
Scale-Gest: Scalable Model-Space Synthesis and Runtime Selection for On-Device Gesture Detection
par: Basit, Abdul, et autres
Publié: (2026)
par: Basit, Abdul, et autres
Publié: (2026)
CRAKEN: Cybersecurity LLM Agent with Knowledge-Based Execution
par: Shao, Minghao, et autres
Publié: (2025)
par: Shao, Minghao, et autres
Publié: (2025)
IQNN-CS: Interpretable Quantum Neural Network for Credit Scoring
par: Khan, Abdul Samad, et autres
Publié: (2025)
par: Khan, Abdul Samad, et autres
Publié: (2025)
Memory-Augmented Architecture for Long-Term Context Handling in Large Language Models
par: Shinwari, Haseeb Ullah Khan, et autres
Publié: (2025)
par: Shinwari, Haseeb Ullah Khan, et autres
Publié: (2025)
Benchmarking VQE Configurations: Architectures, Initializations, and Optimizers for Silicon Ground State Energy
par: Boutakka, Zakaria, et autres
Publié: (2025)
par: Boutakka, Zakaria, et autres
Publié: (2025)
Comparative Performance Analysis of Quantum Machine Learning Architectures for Credit Card Fraud Detection
par: Alami, Mansour El, et autres
Publié: (2024)
par: Alami, Mansour El, et autres
Publié: (2024)
A Survey of Large Language Models for Data Challenges in Graphs
par: Li, Mengran, et autres
Publié: (2025)
par: Li, Mengran, et autres
Publié: (2025)
ResQuNNs: Towards Enabling Deep Learning in Quantum Convolution Neural Networks
par: Kashif, Muhammad, et autres
Publié: (2024)
par: Kashif, Muhammad, et autres
Publié: (2024)
Tiny-VBF: Resource-Efficient Vision Transformer based Lightweight Beamformer for Ultrasound Single-Angle Plane Wave Imaging
par: Rahoof, Abdul, et autres
Publié: (2023)
par: Rahoof, Abdul, et autres
Publié: (2023)
SpikeNAS: A Fast Memory-Aware Neural Architecture Search Framework for Spiking Neural Network-based Embedded AI Systems
par: Putra, Rachmad Vidya Wicaksana, et autres
Publié: (2024)
par: Putra, Rachmad Vidya Wicaksana, et autres
Publié: (2024)
Q-PhotoNAS: Hybrid Quantum Neural Architecture Search Framework on Photonic Devices
par: Elnakhal, Farah, et autres
Publié: (2026)
par: Elnakhal, Farah, et autres
Publié: (2026)
Domain Specific Benchmarks for Evaluating Multimodal Large Language Models
par: Anjum, Khizar, et autres
Publié: (2025)
par: Anjum, Khizar, et autres
Publié: (2025)
Examining Changes in Internal Representations of Continual Learning Models Through Tensor Decomposition
par: Aswani, Nishant Suresh, et autres
Publié: (2024)
par: Aswani, Nishant Suresh, et autres
Publié: (2024)
MindArm: Mechanized Intelligent Non-Invasive Neuro-Driven Prosthetic Arm System
par: Nawaz, Maha, et autres
Publié: (2024)
par: Nawaz, Maha, et autres
Publié: (2024)
MVB-Grasp: Minimum-Volume-Box Filtering of Diffusion-based Grasps for Frontal Manipulation
par: Poudel, Bibek, et autres
Publié: (2026)
par: Poudel, Bibek, et autres
Publié: (2026)
Documents similaires
-
MetaCipher: A Time-Persistent and Universal Multi-Agent Framework for Cipher-Based Jailbreak Attacks for LLMs
par: Chen, Boyuan, et autres
Publié: (2025) -
From Trace to Line: LLM Agent for Real-World OSS Vulnerability Localization
par: Xi, Haoran, et autres
Publié: (2025) -
VeriDispatcher: Multi-Model Dispatching through Pre-Inference Difficulty Prediction for RTL Generation Optimization
par: Wang, Zeng, et autres
Publié: (2025) -
Focus Session: Hardware and Software Techniques for Accelerating Multimodal Foundation Models
par: Shafique, Muhammad, et autres
Publié: (2026) -
QHackBench: Benchmarking Large Language Models for Quantum Code Generation Using PennyLane Hackathon Challenges
par: Basit, Abdul, et autres
Publié: (2025)