The Architecture of Errors: From Universal Impossibility to Patch-Local LLM Reliability
Fuente:
arXiv
Salvato in:
| Autori principali: | Arbuzov, Mikhail L., Mosbacker, Lee, Bei, Sisong, Dong, Ziwei, Kalaev, Dmitri, Shvets, Alexey |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Toward Architecture-Aware Evaluation Metrics for LLM Agents
di: Souza, Débora, et al.
Pubblicazione: (2026)
di: Souza, Débora, et al.
Pubblicazione: (2026)
Interactive LLM-assisted Curriculum Learning for Multi-Task Evolutionary Policy Search
di: Sakallioglu, Berfin, et al.
Pubblicazione: (2026)
di: Sakallioglu, Berfin, et al.
Pubblicazione: (2026)
Recurrent Memory-Augmented Transformers with Chunked Attention for Long-Context Language Modeling
di: Kashyap, Ankit
Pubblicazione: (2025)
di: Kashyap, Ankit
Pubblicazione: (2025)
Random Heterogeneous Neurochaos Learning Architecture for Data Classification
di: S, Remya Ajai A, et al.
Pubblicazione: (2024)
di: S, Remya Ajai A, et al.
Pubblicazione: (2024)
Evaluating the efficacy of LLM Safety Solutions : The Palit Benchmark Dataset
di: Palit, Sayon, et al.
Pubblicazione: (2025)
di: Palit, Sayon, et al.
Pubblicazione: (2025)
Exploring LLM-based Verilog Code Generation with Data-Efficient Fine-Tuning and Testbench Automation
di: Chen, Mu-Chi, et al.
Pubblicazione: (2026)
di: Chen, Mu-Chi, et al.
Pubblicazione: (2026)
CBR -- Boosting Adaptive Classification By Retrieval of Encrypted Network Traffic with Out-of-distribution
di: Lukach, Amir, et al.
Pubblicazione: (2024)
di: Lukach, Amir, et al.
Pubblicazione: (2024)
Circularity and Symmetries of $p$ and $p^{2}$-polygons
di: Haag, Rolf
Pubblicazione: (2025)
di: Haag, Rolf
Pubblicazione: (2025)
Grammatically-Guided Sparse Attention for Efficient and Interpretable Transformers
di: Pratyush, Spandan
Pubblicazione: (2026)
di: Pratyush, Spandan
Pubblicazione: (2026)
Time-to-Injury Forecasting in Elite Female Football: A DeepHit Survival Approach
di: Catterall, Victoria, et al.
Pubblicazione: (2026)
di: Catterall, Victoria, et al.
Pubblicazione: (2026)
Mobile Phone Sensor-based Nigerian Driving Dataset to Detect Alcohol-influenced Behaviours
di: Thompson, Iniakpokeikiye Peter, et al.
Pubblicazione: (2025)
di: Thompson, Iniakpokeikiye Peter, et al.
Pubblicazione: (2025)
PromptSAM+: Malware Detection based on Prompt Segment Anything Model
di: Wei, Xingyuan, et al.
Pubblicazione: (2024)
di: Wei, Xingyuan, et al.
Pubblicazione: (2024)
The Hidden Attention of Mamba Models
di: Ali, Ameen, et al.
Pubblicazione: (2024)
di: Ali, Ameen, et al.
Pubblicazione: (2024)
Entropy-Based Measurement of Value Drift and Alignment Work in Large Language Models
di: Fadli, Samih
Pubblicazione: (2025)
di: Fadli, Samih
Pubblicazione: (2025)
Active Context Compression: Autonomous Memory Management in LLM Agents
di: Verma, Nikhil
Pubblicazione: (2026)
di: Verma, Nikhil
Pubblicazione: (2026)
The Limits of Obliviate: Evaluating Unlearning in LLMs via Stimulus-Knowledge Entanglement-Behavior Framework
di: Shah, Aakriti, et al.
Pubblicazione: (2025)
di: Shah, Aakriti, et al.
Pubblicazione: (2025)
A Prescriptive Framework for Determining Optimal Days for Short-Term Traffic Counts
di: Mukwaya, Arthur, et al.
Pubblicazione: (2025)
di: Mukwaya, Arthur, et al.
Pubblicazione: (2025)
From Pixels to Privacy: Temporally Consistent Video Anonymization via Token Pruning for Privacy Preserving Action Recognition
di: Aslam, Nazia, et al.
Pubblicazione: (2026)
di: Aslam, Nazia, et al.
Pubblicazione: (2026)
Survey Transfer Learning: Recycling Data with Silicon Responses
di: Amini, Ali
Pubblicazione: (2025)
di: Amini, Ali
Pubblicazione: (2025)
AdaDec: A Uncertainty-Guided Lookahead Decoding Framework for LLM-Based Code Generation
di: He, Kaifeng, et al.
Pubblicazione: (2025)
di: He, Kaifeng, et al.
Pubblicazione: (2025)
Automated Bug Triaging using Instruction-Tuned Large Language Models
di: Kiashemshaki, Kiana, et al.
Pubblicazione: (2025)
di: Kiashemshaki, Kiana, et al.
Pubblicazione: (2025)
Merge-Bench: Resolve Merge Conflicts with Large Language Models
di: Schesch, Benedikt, et al.
Pubblicazione: (2026)
di: Schesch, Benedikt, et al.
Pubblicazione: (2026)
R-Genie: Reasoning-Guided Generative Image Editing
di: Zhang, Dong, et al.
Pubblicazione: (2025)
di: Zhang, Dong, et al.
Pubblicazione: (2025)
A Hierarchical Error Framework for Reliable Automated Coding in Communication Research: Applications to Health and Political Communication
di: Zhao, Zhilong, et al.
Pubblicazione: (2025)
di: Zhao, Zhilong, et al.
Pubblicazione: (2025)
Software Implementation of Digital Filtering via Tustin's Bilinear Transform
di: Herron, Connor W.
Pubblicazione: (2024)
di: Herron, Connor W.
Pubblicazione: (2024)
CoE: Collaborative Entropy for Uncertainty Quantification in Agentic Multi-LLM Systems
di: Sun, Kangkang, et al.
Pubblicazione: (2026)
di: Sun, Kangkang, et al.
Pubblicazione: (2026)
ACE: Exploring Activation Cosine Similarity and Variance for Accurate and Calibration-Efficient LLM Pruning
di: Mi, Zhendong, et al.
Pubblicazione: (2025)
di: Mi, Zhendong, et al.
Pubblicazione: (2025)
Synergy over Discrepancy: A Partition-Based Approach to Multi-Domain LLM Fine-Tuning
di: Ye, Hua, et al.
Pubblicazione: (2025)
di: Ye, Hua, et al.
Pubblicazione: (2025)
Emergent Lexical Semantics in Neural Language Models: Testing Martin's Law on LLM-Generated Text
di: Kugler, Kai
Pubblicazione: (2025)
di: Kugler, Kai
Pubblicazione: (2025)
KerZOO: Kernel Function Informed Zeroth-Order Optimization for Accurate and Accelerated LLM Fine-Tuning
di: Mi, Zhendong, et al.
Pubblicazione: (2025)
di: Mi, Zhendong, et al.
Pubblicazione: (2025)
LLM-Rubric: A Multidimensional, Calibrated Approach to Automated Evaluation of Natural Language Texts
di: Hashemi, Helia, et al.
Pubblicazione: (2024)
di: Hashemi, Helia, et al.
Pubblicazione: (2024)
HyDRA: Hybrid Dynamic Routing Architecture for Heterogeneous LLM Pools
di: Garg, Aashna, et al.
Pubblicazione: (2026)
di: Garg, Aashna, et al.
Pubblicazione: (2026)
TwinVoice: A Multi-dimensional Benchmark Towards Digital Twins via LLM Persona Simulation
di: Du, Bangde, et al.
Pubblicazione: (2025)
di: Du, Bangde, et al.
Pubblicazione: (2025)
Induce, Align, Predict: Zero-Shot Stance Detection via Cognitive Inductive Reasoning
di: Zhang, Bowen, et al.
Pubblicazione: (2025)
di: Zhang, Bowen, et al.
Pubblicazione: (2025)
Train to Defend: First Defense Against Cryptanalytic Neural Network Parameter Extraction Attacks
di: Kurian, Ashley, et al.
Pubblicazione: (2025)
di: Kurian, Ashley, et al.
Pubblicazione: (2025)
SiliconMind-V1: Multi-Agent Distillation and Debug-Reasoning Workflows for Verilog Code Generation
di: Chen, Mu-Chi, et al.
Pubblicazione: (2026)
di: Chen, Mu-Chi, et al.
Pubblicazione: (2026)
LLM-Guided Task- and Affordance-Level Exploration in Reinforcement Learning
di: Luijkx, Jelle, et al.
Pubblicazione: (2025)
di: Luijkx, Jelle, et al.
Pubblicazione: (2025)
TRIM: Achieving Extreme Sparsity with Targeted Row-wise Iterative Metric-driven Pruning
di: Beck, Florentin, et al.
Pubblicazione: (2025)
di: Beck, Florentin, et al.
Pubblicazione: (2025)
Eyla: Toward an Identity-Anchored LLM Architecture with Integrated Biological Priors -- Vision, Implementation Attempt, and Lessons from AI-Assisted Development
di: Aditto, Arif
Pubblicazione: (2026)
di: Aditto, Arif
Pubblicazione: (2026)
CortexCompile: Harnessing Cortical-Inspired Architectures for Enhanced Multi-Agent NLP Code Synthesis
di: Ramachandran, Gautham, et al.
Pubblicazione: (2024)
di: Ramachandran, Gautham, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Toward Architecture-Aware Evaluation Metrics for LLM Agents
di: Souza, Débora, et al.
Pubblicazione: (2026) -
Interactive LLM-assisted Curriculum Learning for Multi-Task Evolutionary Policy Search
di: Sakallioglu, Berfin, et al.
Pubblicazione: (2026) -
Recurrent Memory-Augmented Transformers with Chunked Attention for Long-Context Language Modeling
di: Kashyap, Ankit
Pubblicazione: (2025) -
Random Heterogeneous Neurochaos Learning Architecture for Data Classification
di: S, Remya Ajai A, et al.
Pubblicazione: (2024) -
Evaluating the efficacy of LLM Safety Solutions : The Palit Benchmark Dataset
di: Palit, Sayon, et al.
Pubblicazione: (2025)