The Range Shrinks, the Threat Remains: Re-evaluating LLM Package Hallucinations on the 2026 Frontier-Model Cohort
Fuente:
arXiv
Salvato in:
| Autore principale: | Churilov, Aleksandr |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
A Practical Approach to Formal Methods: An Eclipse Integrated Development Environment (IDE) for Security Protocols
di: Garcia, Rémi, et al.
Pubblicazione: (2024)
di: Garcia, Rémi, et al.
Pubblicazione: (2024)
Model checking of hyperproperties for high-level relational models
di: Macedo, Nuno, et al.
Pubblicazione: (2025)
di: Macedo, Nuno, et al.
Pubblicazione: (2025)
CovRL: Fuzzing JavaScript Engines with Coverage-Guided Reinforcement Learning for LLM-based Mutation
di: Eom, Jueon, et al.
Pubblicazione: (2024)
di: Eom, Jueon, et al.
Pubblicazione: (2024)
Constitutional Spec-Driven Development: Enforcing Security by Construction in AI-Assisted Code Generation
di: Marri, Srinivas Rao
Pubblicazione: (2026)
di: Marri, Srinivas Rao
Pubblicazione: (2026)
PSR2: A Phase-based Semantic Reasoning Framework for Atomicity Violation Detection via Contract Refinement
di: Li, Xiaoqi, et al.
Pubblicazione: (2026)
di: Li, Xiaoqi, et al.
Pubblicazione: (2026)
LibLMFuzz: LLM-Augmented Fuzz Target Generation for Black-box Libraries
di: Hardgrove, Ian, et al.
Pubblicazione: (2025)
di: Hardgrove, Ian, et al.
Pubblicazione: (2025)
SeMA: Extending and Analyzing Storyboards to Develop Secure Android Apps
di: Mitra, Joydeep, et al.
Pubblicazione: (2020)
di: Mitra, Joydeep, et al.
Pubblicazione: (2020)
The Cost of Convenience: Identifying, Analyzing, and Mitigating Predatory Loan Applications on Android
di: Akanji, Olawale Amos, et al.
Pubblicazione: (2026)
di: Akanji, Olawale Amos, et al.
Pubblicazione: (2026)
ZTD$_{JAVA}$: Mitigating Software Supply Chain Vulnerabilities via Zero-Trust Dependencies
di: Amusuo, Paschal C., et al.
Pubblicazione: (2023)
di: Amusuo, Paschal C., et al.
Pubblicazione: (2023)
Provable Repair of Deep Neural Network Defects by Preimage Synthesis and Property Refinement
di: Ma, Jianan, et al.
Pubblicazione: (2025)
di: Ma, Jianan, et al.
Pubblicazione: (2025)
Secure IVSHMEM: End-to-End Shared-Memory Protocol with Hypervisor-CA Handshake and In-Kernel Access Control
di: Kim, Hyunwoo, et al.
Pubblicazione: (2025)
di: Kim, Hyunwoo, et al.
Pubblicazione: (2025)
Swarm Contract: A Multi-Sovereign Agent Consensus Mechanism
di: Yang, Haowei
Pubblicazione: (2024)
di: Yang, Haowei
Pubblicazione: (2024)
EXHIB: A Benchmark for Realistic and Diverse Evaluation of Function Similarity in the Wild
di: Fan, Yiming, et al.
Pubblicazione: (2026)
di: Fan, Yiming, et al.
Pubblicazione: (2026)
Anumati: Proof of Adherence as a Formal Consent Model for Autonomous Agent Protocols
di: Kadaboina, Ravi Kiran
Pubblicazione: (2026)
di: Kadaboina, Ravi Kiran
Pubblicazione: (2026)
Secure and Scalable Blockchain Voting: A Comparative Framework and the Role of Large Language Models
di: Kiashemshaki, Kiana, et al.
Pubblicazione: (2025)
di: Kiashemshaki, Kiana, et al.
Pubblicazione: (2025)
C8s: A Confidential Kubernetes Architecture
di: Asad, Amean, et al.
Pubblicazione: (2026)
di: Asad, Amean, et al.
Pubblicazione: (2026)
VehiclePassport: A GAIA-X-Aligned, Blockchain-Anchored Privacy-Preserving, Zero-Knowledge Digital Passport for Smart Vehicles
di: Kaushal, Pradyumna
Pubblicazione: (2025)
di: Kaushal, Pradyumna
Pubblicazione: (2025)
Control Flow Graph Recovery for Dynamically Loaded Code via Symbolic Library Resolution
di: Mostovyi, Oleksandr
Pubblicazione: (2026)
di: Mostovyi, Oleksandr
Pubblicazione: (2026)
Towards Socio-Technical Topology-Aware Adaptive Threat Detection in Software Supply Chains
di: Welsh, Thomas, et al.
Pubblicazione: (2025)
di: Welsh, Thomas, et al.
Pubblicazione: (2025)
Secure coding for web applications: Frameworks, challenges, and the role of LLMs
di: Kiashemshaki, Kiana, et al.
Pubblicazione: (2025)
di: Kiashemshaki, Kiana, et al.
Pubblicazione: (2025)
A Self-Improving Architecture for Dynamic Safety in Large Language Models
di: Slater, Tyler
Pubblicazione: (2025)
di: Slater, Tyler
Pubblicazione: (2025)
Verifying Device Drivers with Pancake
di: Zhao, Junming, et al.
Pubblicazione: (2025)
di: Zhao, Junming, et al.
Pubblicazione: (2025)
Continuous Discovery of Vulnerabilities in LLM Serving Systems with Fuzzing
di: Zhao, Yunze, et al.
Pubblicazione: (2026)
di: Zhao, Yunze, et al.
Pubblicazione: (2026)
Evaluating Cryptographic API Misuse Detectors for Go
di: Andersson, Vivi, et al.
Pubblicazione: (2026)
di: Andersson, Vivi, et al.
Pubblicazione: (2026)
HSM and TPM Failures in Cloud: A Real-World Taxonomy and Emerging Defenses
di: Shaikh, Shams, et al.
Pubblicazione: (2025)
di: Shaikh, Shams, et al.
Pubblicazione: (2025)
Firmware Distribution as Attack Surface: A Security Study of ASIC Cryptocurrency Miners
di: Pouliquen, Pierre, et al.
Pubblicazione: (2026)
di: Pouliquen, Pierre, et al.
Pubblicazione: (2026)
Toward Cybersecurity Testing and Monitoring of IoT Ecosystems
di: Taylor, Steve, et al.
Pubblicazione: (2025)
di: Taylor, Steve, et al.
Pubblicazione: (2025)
From Multi-sig to DLCs: Modern Oracle Designs on Bitcoin
di: Caldarelli, Giulio
Pubblicazione: (2026)
di: Caldarelli, Giulio
Pubblicazione: (2026)
Privacy-Aware Split Inference with Speculative Decoding for Large Language Models over Wide-Area Networks
di: Cunningham, Michael
Pubblicazione: (2026)
di: Cunningham, Michael
Pubblicazione: (2026)
Device Context Protocol: A Compact, Safety-First Architecture for LLM-Driven Control of Constrained Devices
di: Yang, Dongxu
Pubblicazione: (2026)
di: Yang, Dongxu
Pubblicazione: (2026)
FORGE: An LLM-driven Framework for Large-Scale Smart Contract Vulnerability Dataset Construction
di: Chen, Jiachi, et al.
Pubblicazione: (2025)
di: Chen, Jiachi, et al.
Pubblicazione: (2025)
Secure IAM on AWS with Multi-Account Strategy
di: Yi, Sungchan
Pubblicazione: (2025)
di: Yi, Sungchan
Pubblicazione: (2025)
Decentralized COVID-19 Health System Leveraging Blockchain
di: Chen, Lingsheng, et al.
Pubblicazione: (2025)
di: Chen, Lingsheng, et al.
Pubblicazione: (2025)
VIC: Evasive Video Game Cheating via Virtual Machine Introspection
di: Karkallis, Panicos, et al.
Pubblicazione: (2025)
di: Karkallis, Panicos, et al.
Pubblicazione: (2025)
SETC: A Vulnerability Telemetry Collection Framework
di: Holeman, Ryan, et al.
Pubblicazione: (2024)
di: Holeman, Ryan, et al.
Pubblicazione: (2024)
Owner-Harm: A Missing Threat Model for AI Agent Safety
di: Zhang, Dongcheng, et al.
Pubblicazione: (2026)
di: Zhang, Dongcheng, et al.
Pubblicazione: (2026)
Orion: Fuzzing Workflow Automation
di: Bazalii, Max, et al.
Pubblicazione: (2025)
di: Bazalii, Max, et al.
Pubblicazione: (2025)
ClawHub Security Signals: When VirusTotal, Static Analysis, and SkillSpector Disagree
di: Koc, Vincent, et al.
Pubblicazione: (2026)
di: Koc, Vincent, et al.
Pubblicazione: (2026)
Walma: Learning to See Memory Corruption in WebAssembly
di: Draissi, Oussama, et al.
Pubblicazione: (2026)
di: Draissi, Oussama, et al.
Pubblicazione: (2026)
Cyber Threats in Financial Transactions -- Addressing the Dual Challenge of AI and Quantum Computing
di: Elmisery, Ahmed M., et al.
Pubblicazione: (2025)
di: Elmisery, Ahmed M., et al.
Pubblicazione: (2025)
Documenti analoghi
-
A Practical Approach to Formal Methods: An Eclipse Integrated Development Environment (IDE) for Security Protocols
di: Garcia, Rémi, et al.
Pubblicazione: (2024) -
Model checking of hyperproperties for high-level relational models
di: Macedo, Nuno, et al.
Pubblicazione: (2025) -
CovRL: Fuzzing JavaScript Engines with Coverage-Guided Reinforcement Learning for LLM-based Mutation
di: Eom, Jueon, et al.
Pubblicazione: (2024) -
Constitutional Spec-Driven Development: Enforcing Security by Construction in AI-Assisted Code Generation
di: Marri, Srinivas Rao
Pubblicazione: (2026) -
PSR2: A Phase-based Semantic Reasoning Framework for Atomicity Violation Detection via Contract Refinement
di: Li, Xiaoqi, et al.
Pubblicazione: (2026)