A Survey on Large Language Models with some Insights on their Capabilities and Limitations
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Matarazzo, Andrea, Torlone, Riccardo |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Interactive LLM-assisted Curriculum Learning for Multi-Task Evolutionary Policy Search
par: Sakallioglu, Berfin, et autres
Publié: (2026)
par: Sakallioglu, Berfin, et autres
Publié: (2026)
Entropy-Based Measurement of Value Drift and Alignment Work in Large Language Models
par: Fadli, Samih
Publié: (2025)
par: Fadli, Samih
Publié: (2025)
CoupleEvo: Evolving Heuristics for Coupled Optimization Problems Using Large Language Models
par: Bömer, Thomas, et autres
Publié: (2026)
par: Bömer, Thomas, et autres
Publié: (2026)
Cognitive Load Limits in Large Language Models: Benchmarking Multi-Hop Reasoning
par: Adapala, Sai Teja Reddy
Publié: (2025)
par: Adapala, Sai Teja Reddy
Publié: (2025)
Neural Attention: A Novel Mechanism for Enhanced Expressive Power in Transformer Models
par: DiGiugno, Andrew, et autres
Publié: (2025)
par: DiGiugno, Andrew, et autres
Publié: (2025)
Assessing Large Language Models on Islamic Legal Reasoning: Evidence from Inheritance Law Evaluation
par: Bouchekif, Abdessalam, et autres
Publié: (2025)
par: Bouchekif, Abdessalam, et autres
Publié: (2025)
Turning the TIDE: Cross-Architecture Distillation for Diffusion Large Language Models
par: Zhang, Gongbo, et autres
Publié: (2026)
par: Zhang, Gongbo, et autres
Publié: (2026)
SECURA: Sigmoid-Enhanced CUR Decomposition with Uninterrupted Retention and Low-Rank Adaptation in Large Language Models
par: Zhang, Yuxuan
Publié: (2025)
par: Zhang, Yuxuan
Publié: (2025)
Painless Activation Steering: An Automated, Lightweight Approach for Post-Training Large Language Models
par: Cui, Sasha, et autres
Publié: (2025)
par: Cui, Sasha, et autres
Publié: (2025)
Beyond Hallucinations: A Composite Score for Measuring Reliability in Open-Source Large Language Models
par: Salla, Rohit Kumar, et autres
Publié: (2025)
par: Salla, Rohit Kumar, et autres
Publié: (2025)
Machine Unlearning for Masked Diffusion Language Models
par: Lee, Georu, et autres
Publié: (2026)
par: Lee, Georu, et autres
Publié: (2026)
Truth as a Compression Artifact in Language Model Training
par: Krestnikov, Konstantin
Publié: (2026)
par: Krestnikov, Konstantin
Publié: (2026)
Intention Collapse: Intention-Level Metrics for Reasoning in Language Models
par: Vera, Patricio
Publié: (2026)
par: Vera, Patricio
Publié: (2026)
Exemplar Retrieval Without Overhypothesis Induction: Limits of Distributional Sequence Learning in Early Word Learning
par: Cacioli, Jon-Paul
Publié: (2026)
par: Cacioli, Jon-Paul
Publié: (2026)
Towards Alignment-Centric Paradigm: A Survey of Instruction Tuning in Large Language Models
par: Han, Xudong, et autres
Publié: (2025)
par: Han, Xudong, et autres
Publié: (2025)
Prototype Transformer: Towards Language Model Architectures Interpretable by Design
par: Yordanov, Yordan, et autres
Publié: (2026)
par: Yordanov, Yordan, et autres
Publié: (2026)
Domain-Specific Pretraining of Language Models: A Comparative Study in the Medical Field
par: Kerner, Tobias
Publié: (2024)
par: Kerner, Tobias
Publié: (2024)
GraphEval36K: Benchmarking Coding and Reasoning Capabilities of Large Language Models on Graph Datasets
par: Wu, Qiming, et autres
Publié: (2024)
par: Wu, Qiming, et autres
Publié: (2024)
The Readout Shortcut: Positional Number Copying Dominates Arithmetic CoT Readout in Small Language Models
par: Liu, Ming
Publié: (2026)
par: Liu, Ming
Publié: (2026)
Alif: Advancing Urdu Large Language Models via Multilingual Synthetic Data Distillation
par: Shafique, Muhammad Ali, et autres
Publié: (2025)
par: Shafique, Muhammad Ali, et autres
Publié: (2025)
Evolutionary Computation and Large Language Models: A Survey of Methods, Synergies, and Applications
par: Chauhan, Dikshit, et autres
Publié: (2025)
par: Chauhan, Dikshit, et autres
Publié: (2025)
Are Large Language Models In-Context Personalized Summarizers? Get an iCOPERNICUS Test Done!
par: Patel, Divya, et autres
Publié: (2024)
par: Patel, Divya, et autres
Publié: (2024)
MeMo: Towards Language Models with Associative Memory Mechanisms
par: Zanzotto, Fabio Massimo, et autres
Publié: (2025)
par: Zanzotto, Fabio Massimo, et autres
Publié: (2025)
Behavioural vs. Representational Systematicity in End-to-End Models: An Opinionated Survey
par: Vegner, Ivan, et autres
Publié: (2025)
par: Vegner, Ivan, et autres
Publié: (2025)
Why Models Know But Don't Say: Chain-of-Thought Faithfulness Divergence Between Thinking Tokens and Answers in Open-Weight Reasoning Models
par: Young, Richard J.
Publié: (2026)
par: Young, Richard J.
Publié: (2026)
RMGAP: Benchmarking the Generalization of Reward Models across Diverse Preferences
par: Zhou, Yangyang, et autres
Publié: (2026)
par: Zhou, Yangyang, et autres
Publié: (2026)
Efficient Strategy for Improving Large Language Model (LLM) Capabilities
par: Gutiérrez, Julián Camilo Velandia
Publié: (2025)
par: Gutiérrez, Julián Camilo Velandia
Publié: (2025)
Language as a Wave Phenomenon: Semantic Phase Locking and Interference in Neural Networks
par: Yıldırım, Alper, et autres
Publié: (2025)
par: Yıldırım, Alper, et autres
Publié: (2025)
Adaptive Activation Cancellation for Hallucination Mitigation in Large Language Models
par: Yocam, Eric, et autres
Publié: (2026)
par: Yocam, Eric, et autres
Publié: (2026)
ImmigrationQA: A Source-Grounded Dataset and Small-Model Adaptation for U.S. Immigration Law
par: Shportun, Nazarii
Publié: (2026)
par: Shportun, Nazarii
Publié: (2026)
Self-Training Doesn't Flatten Language -- It Restructures It: Surface Markers Amplify While Deep Syntax Dies
par: Liu, Ming
Publié: (2026)
par: Liu, Ming
Publié: (2026)
On the Infinite Width and Depth Limits of Predictive Coding Networks
par: Innocenti, Francesco, et autres
Publié: (2026)
par: Innocenti, Francesco, et autres
Publié: (2026)
Model Collapse as Cultural Evolution
par: Guo, Dongxin, et autres
Publié: (2026)
par: Guo, Dongxin, et autres
Publié: (2026)
CodeEvolve: an open source evolutionary coding agent for algorithmic discovery and optimization
par: Assumpção, Henrique, et autres
Publié: (2025)
par: Assumpção, Henrique, et autres
Publié: (2025)
LLMs as Meta-Reviewers' Assistants: A Case Study
par: Hossain, Eftekhar, et autres
Publié: (2024)
par: Hossain, Eftekhar, et autres
Publié: (2024)
Towards Ontology-Enhanced Representation Learning for Large Language Models
par: Ronzano, Francesco, et autres
Publié: (2024)
par: Ronzano, Francesco, et autres
Publié: (2024)
Memory Bank Compression for Continual Adaptation of Large Language Models
par: Katraouras, Thomas, et autres
Publié: (2026)
par: Katraouras, Thomas, et autres
Publié: (2026)
Evaluating Large Language Models for IUCN Red List Species Information
par: Uryu, Shinya
Publié: (2025)
par: Uryu, Shinya
Publié: (2025)
Advancing Transformer Architecture in Long-Context Large Language Models: A Comprehensive Survey
par: Huang, Yunpeng, et autres
Publié: (2023)
par: Huang, Yunpeng, et autres
Publié: (2023)
Integrating External Tools with Large Language Models to Improve Accuracy
par: Niketan, Nripesh, et autres
Publié: (2025)
par: Niketan, Nripesh, et autres
Publié: (2025)
Documents similaires
-
Interactive LLM-assisted Curriculum Learning for Multi-Task Evolutionary Policy Search
par: Sakallioglu, Berfin, et autres
Publié: (2026) -
Entropy-Based Measurement of Value Drift and Alignment Work in Large Language Models
par: Fadli, Samih
Publié: (2025) -
CoupleEvo: Evolving Heuristics for Coupled Optimization Problems Using Large Language Models
par: Bömer, Thomas, et autres
Publié: (2026) -
Cognitive Load Limits in Large Language Models: Benchmarking Multi-Hop Reasoning
par: Adapala, Sai Teja Reddy
Publié: (2025) -
Neural Attention: A Novel Mechanism for Enhanced Expressive Power in Transformer Models
par: DiGiugno, Andrew, et autres
Publié: (2025)