A Survey on Large Language Models from Concept to Implementation
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Chen, Zhao, Jin, Gong, Jiaqi |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
The Information of Large Language Model Geometry
por: Tan, Zhiquan, et al.
Publicado: (2024)
por: Tan, Zhiquan, et al.
Publicado: (2024)
Diff-eRank: A Novel Rank-Based Metric for Evaluating Large Language Models
por: Wei, Lai, et al.
Publicado: (2024)
por: Wei, Lai, et al.
Publicado: (2024)
Geometric Signatures of Compositionality Across a Language Model's Lifetime
por: Lee, Jin Hwa, et al.
Publicado: (2024)
por: Lee, Jin Hwa, et al.
Publicado: (2024)
Language Modeling Is Compression
por: Delétang, Grégoire, et al.
Publicado: (2023)
por: Delétang, Grégoire, et al.
Publicado: (2023)
PaCE: Parsimonious Concept Engineering for Large Language Models
por: Luo, Jinqi, et al.
Publicado: (2024)
por: Luo, Jinqi, et al.
Publicado: (2024)
The Detection-Extraction Gap: Models Know the Answer Before They Can Say It
por: Wang, Hanyang, et al.
Publicado: (2026)
por: Wang, Hanyang, et al.
Publicado: (2026)
Survey on Large Language Model-Enhanced Reinforcement Learning: Concept, Taxonomy, and Methods
por: Cao, Yuji, et al.
Publicado: (2024)
por: Cao, Yuji, et al.
Publicado: (2024)
Understanding Survey Paper Taxonomy about Large Language Models via Graph Representation Learning
por: Zhuang, Jun, et al.
Publicado: (2024)
por: Zhuang, Jun, et al.
Publicado: (2024)
Demystifying and Enhancing the Efficiency of Large Language Model Based Search Agents
por: Yang, Tiannuo, et al.
Publicado: (2025)
por: Yang, Tiannuo, et al.
Publicado: (2025)
How Many Features Can a Language Model Store Under the Linear Representation Hypothesis?
por: Garg, Nikhil, et al.
Publicado: (2026)
por: Garg, Nikhil, et al.
Publicado: (2026)
Know Your Limits: Entropy Estimation Modeling for Compression and Generalization
por: Badger, Benjamin L., et al.
Publicado: (2025)
por: Badger, Benjamin L., et al.
Publicado: (2025)
Uncertainty-Aware Explainable Recommendation with Large Language Models
por: Peng, Yicui, et al.
Publicado: (2024)
por: Peng, Yicui, et al.
Publicado: (2024)
Exploring Concept Depth: How Large Language Models Acquire Knowledge and Concept at Different Layers?
por: Jin, Mingyu, et al.
Publicado: (2024)
por: Jin, Mingyu, et al.
Publicado: (2024)
BadRAG: Identifying Vulnerabilities in Retrieval Augmented Generation of Large Language Models
por: Xue, Jiaqi, et al.
Publicado: (2024)
por: Xue, Jiaqi, et al.
Publicado: (2024)
SQuat: Subspace-orthogonal KV Cache Quantization
por: Wang, Hao, et al.
Publicado: (2025)
por: Wang, Hao, et al.
Publicado: (2025)
LORE: A Large Generative Model for Search Relevance
por: Lu, Chenji, et al.
Publicado: (2025)
por: Lu, Chenji, et al.
Publicado: (2025)
Subjective Depth and Timescale Transformers: Learning Where and When to Compute
por: Wieser, Frederico, et al.
Publicado: (2025)
por: Wieser, Frederico, et al.
Publicado: (2025)
Graph-based Confidence Calibration for Large Language Models
por: Li, Yukun, et al.
Publicado: (2024)
por: Li, Yukun, et al.
Publicado: (2024)
Improving Crash Data Quality with Large Language Models: Evidence from Secondary Crash Narratives in Kentucky
por: Zhang, Xu, et al.
Publicado: (2025)
por: Zhang, Xu, et al.
Publicado: (2025)
A Training-free Method for LLM Text Attribution
por: Radvand, Tara, et al.
Publicado: (2025)
por: Radvand, Tara, et al.
Publicado: (2025)
AgentMove: A Large Language Model based Agentic Framework for Zero-shot Next Location Prediction
por: Feng, Jie, et al.
Publicado: (2024)
por: Feng, Jie, et al.
Publicado: (2024)
A Communication-Theoretic Framework for LLM Agents: Cost-Aware Adaptive Reliability
por: Omidvar, Hamed, et al.
Publicado: (2026)
por: Omidvar, Hamed, et al.
Publicado: (2026)
L$^2$M: Mutual Information Scaling Law for Long-Context Language Modeling
por: Chen, Zhuo, et al.
Publicado: (2025)
por: Chen, Zhuo, et al.
Publicado: (2025)
Retrieval meets Long Context Large Language Models
por: Xu, Peng, et al.
Publicado: (2023)
por: Xu, Peng, et al.
Publicado: (2023)
Interpreting Language Models Through Concept Descriptions: A Survey
por: Feldhus, Nils, et al.
Publicado: (2025)
por: Feldhus, Nils, et al.
Publicado: (2025)
Soft Prompt Tuning for Augmenting Dense Retrieval with Large Language Models
por: Peng, Zhiyuan, et al.
Publicado: (2023)
por: Peng, Zhiyuan, et al.
Publicado: (2023)
Unified Hallucination Detection for Multimodal Large Language Models
por: Chen, Xiang, et al.
Publicado: (2024)
por: Chen, Xiang, et al.
Publicado: (2024)
Large Language Models are Learnable Planners for Long-Term Recommendation
por: Shi, Wentao, et al.
Publicado: (2024)
por: Shi, Wentao, et al.
Publicado: (2024)
Delta Activations: A Representation for Finetuned Large Language Models
por: Xu, Zhiqiu, et al.
Publicado: (2025)
por: Xu, Zhiqiu, et al.
Publicado: (2025)
Editing Conceptual Knowledge for Large Language Models
por: Wang, Xiaohan, et al.
Publicado: (2024)
por: Wang, Xiaohan, et al.
Publicado: (2024)
LLMInit: A Free Lunch from Large Language Models for Selective Initialization of Recommendation
por: Zhang, Weizhi, et al.
Publicado: (2025)
por: Zhang, Weizhi, et al.
Publicado: (2025)
Ensemble Learning for Large Language Models in Text and Code Generation: A Survey
por: Ashiga, Mari, et al.
Publicado: (2025)
por: Ashiga, Mari, et al.
Publicado: (2025)
The Factuality of Large Language Models in the Legal Domain
por: Hamdani, Rajaa El, et al.
Publicado: (2024)
por: Hamdani, Rajaa El, et al.
Publicado: (2024)
On Bilingual Lexicon Induction with Large Language Models
por: Li, Yaoyiran, et al.
Publicado: (2023)
por: Li, Yaoyiran, et al.
Publicado: (2023)
Large Language Model Augmented Exercise Retrieval for Personalized Language Learning
por: Xu, Austin, et al.
Publicado: (2024)
por: Xu, Austin, et al.
Publicado: (2024)
OAEI-LLM-T: A TBox Benchmark Dataset for Understanding Large Language Model Hallucinations in Ontology Matching
por: Qiang, Zhangcheng, et al.
Publicado: (2025)
por: Qiang, Zhangcheng, et al.
Publicado: (2025)
Visual Language Model based Cross-modal Semantic Communication Systems
por: Jiang, Feibo, et al.
Publicado: (2024)
por: Jiang, Feibo, et al.
Publicado: (2024)
Optimal Quantization for Matrix Multiplication
por: Ordentlich, Or, et al.
Publicado: (2024)
por: Ordentlich, Or, et al.
Publicado: (2024)
Compression Represents Intelligence Linearly
por: Huang, Yuzhen, et al.
Publicado: (2024)
por: Huang, Yuzhen, et al.
Publicado: (2024)
Self-Play Only Evolves When Self-Synthetic Pipeline Ensures Learnable Information Gain
por: Liu, Wei, et al.
Publicado: (2026)
por: Liu, Wei, et al.
Publicado: (2026)
Ejemplares similares
-
The Information of Large Language Model Geometry
por: Tan, Zhiquan, et al.
Publicado: (2024) -
Diff-eRank: A Novel Rank-Based Metric for Evaluating Large Language Models
por: Wei, Lai, et al.
Publicado: (2024) -
Geometric Signatures of Compositionality Across a Language Model's Lifetime
por: Lee, Jin Hwa, et al.
Publicado: (2024) -
Language Modeling Is Compression
por: Delétang, Grégoire, et al.
Publicado: (2023) -
PaCE: Parsimonious Concept Engineering for Large Language Models
por: Luo, Jinqi, et al.
Publicado: (2024)