Understanding LLMs: A Comprehensive Overview from Training to Inference
Fuente:
arXiv
Saved in:
| Main Authors: | Liu, Yiheng, He, Hao, Han, Tianle, Zhang, Xu, Liu, Mengyuan, Tian, Jiaming, Zhang, Yutong, Wang, Jiaqi, Gao, Xiaohui, Zhong, Tianyang, Pan, Yi, Xu, Shaochen, Wu, Zihao, Liu, Zhengliang, Zhang, Xin, Zhang, Shu, Hu, Xintao, Zhang, Tuo, Qiang, Ning, Liu, Tianming, Ge, Bao |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
A Comprehensive Review of Multimodal Large Language Models: Performance and Challenges Across Different Tasks
by: Wang, Jiaqi, et al.
Published: (2024)
by: Wang, Jiaqi, et al.
Published: (2024)
Brain-Inspired Exploration of Functional Networks and Key Neurons in Large Language Models
by: Liu, Yiheng, et al.
Published: (2025)
by: Liu, Yiheng, et al.
Published: (2025)
An Iterative Optimizing Framework for Radiology Report Summarization with ChatGPT
by: Ma, Chong, et al.
Published: (2023)
by: Ma, Chong, et al.
Published: (2023)
Revolutionizing Finance with LLMs: An Overview of Applications and Insights
by: Zhao, Huaqin, et al.
Published: (2024)
by: Zhao, Huaqin, et al.
Published: (2024)
Pruning Large Language Models by Identifying and Preserving Functional Networks
by: Liu, Yiheng, et al.
Published: (2025)
by: Liu, Yiheng, et al.
Published: (2025)
Reasoning before Comparison: LLM-Enhanced Semantic Similarity Metrics for Domain Specialized Text Analysis
by: Xu, Shaochen, et al.
Published: (2024)
by: Xu, Shaochen, et al.
Published: (2024)
Potential of Multimodal Large Language Models for Data Mining of Medical Images and Free-text Reports
by: Zhang, Yutong, et al.
Published: (2024)
by: Zhang, Yutong, et al.
Published: (2024)
Differentiate ChatGPT-generated and Human-written Medical Texts
by: Liao, Wenxiong, et al.
Published: (2023)
by: Liao, Wenxiong, et al.
Published: (2023)
MKRAG: Medical Knowledge Retrieval Augmented Generation for Medical Question Answering
by: Shi, Yucheng, et al.
Published: (2023)
by: Shi, Yucheng, et al.
Published: (2023)
HARP: Human-Assisted Regrouping with Permutation Invariant Critic for Multi-Agent Reinforcement Learning
by: Hu, Huawen, et al.
Published: (2024)
by: Hu, Huawen, et al.
Published: (2024)
Mathematics and Machine Creativity: A Survey on Bridging Mathematics with AI
by: Liang, Shizhe, et al.
Published: (2024)
by: Liang, Shizhe, et al.
Published: (2024)
Legal Evalutions and Challenges of Large Language Models
by: Wang, Jiaqi, et al.
Published: (2024)
by: Wang, Jiaqi, et al.
Published: (2024)
Towards Next-Generation Medical Agent: How o1 is Reshaping Decision-Making in Medical Scenarios
by: Xu, Shaochen, et al.
Published: (2024)
by: Xu, Shaochen, et al.
Published: (2024)
Evaluating Large Language Models for Radiology Natural Language Processing
by: Liu, Zhengliang, et al.
Published: (2023)
by: Liu, Zhengliang, et al.
Published: (2023)
Analyzing Nobel Prize Literature with Large Language Models
by: Yang, Zhenyuan, et al.
Published: (2024)
by: Yang, Zhenyuan, et al.
Published: (2024)
MGH Radiology Llama: A Llama 3 70B Model for Radiology
by: Shi, Yucheng, et al.
Published: (2024)
by: Shi, Yucheng, et al.
Published: (2024)
Large Language Models for Robotics: Opportunities, Challenges, and Perspectives
by: Wang, Jiaqi, et al.
Published: (2024)
by: Wang, Jiaqi, et al.
Published: (2024)
LLMs for Coding and Robotics Education
by: Shu, Peng, et al.
Published: (2024)
by: Shu, Peng, et al.
Published: (2024)
FNF: Functional Network Fingerprint for Large Language Models
by: Liu, Yiheng, et al.
Published: (2026)
by: Liu, Yiheng, et al.
Published: (2026)
Bayesian Cramér-Rao Bound for Sensing Performance in Meta-Backscatter Systems
by: Cao, Mengyuan, et al.
Published: (2026)
by: Cao, Mengyuan, et al.
Published: (2026)
Survey of HPC in US Research Institutions
by: Shu, Peng, et al.
Published: (2025)
by: Shu, Peng, et al.
Published: (2025)
Opportunities and Challenges of Large Language Models for Low-Resource Languages in Humanities Research
by: Zhong, Tianyang, et al.
Published: (2024)
by: Zhong, Tianyang, et al.
Published: (2024)
Brain-like Functional Organization within Large Language Models
by: Sun, Haiyang, et al.
Published: (2024)
by: Sun, Haiyang, et al.
Published: (2024)
Are Highly Intelligent People More Likely to Tolerate Risk in China? Evidence from China Family Panel Studies
by: Jing Zhang, et al.
Published: (2024)
by: Jing Zhang, et al.
Published: (2024)
LLM-POTUS Score: A Framework of Analyzing Presidential Debates with Large Language Models
by: Liu, Zhengliang, et al.
Published: (2024)
by: Liu, Zhengliang, et al.
Published: (2024)
Brain Dialogue Interface (BDI): A User-Friendly fMRI Model for Interactive Brain Decoding
by: Huang, Heng, et al.
Published: (2024)
by: Huang, Heng, et al.
Published: (2024)
Eye-gaze Guided Multi-modal Alignment for Medical Representation Learning
by: Ma, Chong, et al.
Published: (2024)
by: Ma, Chong, et al.
Published: (2024)
ALDM-Grasping: Diffusion-aided Zero-Shot Sim-to-Real Transfer for Robot Grasping
by: Li, Yiwei, et al.
Published: (2024)
by: Li, Yiwei, et al.
Published: (2024)
GP-GPT: Large Language Model for Gene-Phenotype Mapping
by: Lyu, Yanjun, et al.
Published: (2024)
by: Lyu, Yanjun, et al.
Published: (2024)
Self-reconfiguration Strategies for Space-distributed Spacecraft
by: Liu, Tianle, et al.
Published: (2024)
by: Liu, Tianle, et al.
Published: (2024)
Exploring the changes in brain network SC-FC coupling patterns of partial sleep deprivation based on DTI-fMRI fusion analysis
by: Liu, Mengyuan, et al.
Published: (2025)
by: Liu, Mengyuan, et al.
Published: (2025)
Evolvable Graph Diffusion Optimal Transport with Pattern-Specific Alignment for Brain Connectome Modeling
by: Sheng, Xiaoqi, et al.
Published: (2025)
by: Sheng, Xiaoqi, et al.
Published: (2025)
Prompt Engineering for Healthcare: Methodologies and Applications
by: Wang, Jiaqi, et al.
Published: (2023)
by: Wang, Jiaqi, et al.
Published: (2023)
Artificial General Intelligence for Medical Imaging Analysis
by: Li, Xiang, et al.
Published: (2023)
by: Li, Xiang, et al.
Published: (2023)
A Dynamical Model for Spatio-Temporal Processes Motivated by Second-Order Partial Differential Equations
by: Zhang, Yutong, et al.
Published: (2025)
by: Zhang, Yutong, et al.
Published: (2025)
Trustworthy Evaluation of Robotic Manipulation: A New Benchmark and AutoEval Methods
by: Liu, Mengyuan, et al.
Published: (2026)
by: Liu, Mengyuan, et al.
Published: (2026)
From Motivation to Commitment: The Role of High‐Performance Work Systems and Workplace Sense of Gain in Shaping Teachers' Affective Commitment
by: Yutong Liu, et al.
Published: (2025)
by: Yutong Liu, et al.
Published: (2025)
Solid Solution Derived Cu Clusters on Partially Reduced CuCeO 2 with Abundant Oxygen Vacancies Enable Efficient Reverse Water Gas Reaction
by: Jianhong Xu, et al.
Published: (2025)
by: Jianhong Xu, et al.
Published: (2025)
Memory Injection Attacks on LLM Agents via Query-Only Interaction
by: Dong, Shen, et al.
Published: (2025)
by: Dong, Shen, et al.
Published: (2025)
Learning from Mistakes: Iterative Prompt Relabeling for Text-to-Image Diffusion Model Training
by: Chen, Xinyan, et al.
Published: (2023)
by: Chen, Xinyan, et al.
Published: (2023)
Similar Items
-
A Comprehensive Review of Multimodal Large Language Models: Performance and Challenges Across Different Tasks
by: Wang, Jiaqi, et al.
Published: (2024) -
Brain-Inspired Exploration of Functional Networks and Key Neurons in Large Language Models
by: Liu, Yiheng, et al.
Published: (2025) -
An Iterative Optimizing Framework for Radiology Report Summarization with ChatGPT
by: Ma, Chong, et al.
Published: (2023) -
Revolutionizing Finance with LLMs: An Overview of Applications and Insights
by: Zhao, Huaqin, et al.
Published: (2024) -
Pruning Large Language Models by Identifying and Preserving Functional Networks
by: Liu, Yiheng, et al.
Published: (2025)