Quant Fever, Reasoning Blackholes, Schrodinger's Compliance, and More: Probing GPT-OSS-20B
Fuente:
arXiv
Salvato in:
| Autori principali: | Lin, Shuyi, Lu, Tian, Wang, Zikai, Wen, Bo, Zhao, Yibo, Tan, Cheng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Toward a Principled Framework for Agent Safety Measurement
di: Lin, Shuyi, et al.
Pubblicazione: (2026)
di: Lin, Shuyi, et al.
Pubblicazione: (2026)
Hey GPT-OSS, Looks Like You Got It -- Now Walk Me Through It! An Assessment of the Reasoning Language Models Chain of Thought Mechanism for Digital Forensics
di: Michelet, Gaëtan, et al.
Pubblicazione: (2025)
di: Michelet, Gaëtan, et al.
Pubblicazione: (2025)
Security-by-Design at the Telco Edge with OSS: Challenges and Lessons Learned
di: Cesarano, Carmine, et al.
Pubblicazione: (2025)
di: Cesarano, Carmine, et al.
Pubblicazione: (2025)
OSS-CRS: Liberating AIxCC Cyber Reasoning Systems for Real-World Open-Source Security
di: Chin, Andrew, et al.
Pubblicazione: (2026)
di: Chin, Andrew, et al.
Pubblicazione: (2026)
Prompt Injection Evaluations: Refusal Boundary Instability and Artifact-Dependent Compliance in GPT-4-Series Models
di: Heverin, Thomas
Pubblicazione: (2026)
di: Heverin, Thomas
Pubblicazione: (2026)
Fixing Security Vulnerabilities with AI in OSS-Fuzz
di: Zhang, Yuntong, et al.
Pubblicazione: (2024)
di: Zhang, Yuntong, et al.
Pubblicazione: (2024)
Toward Principled LLM Safety Testing: Solving the Jailbreak Oracle Problem
di: Lin, Shuyi, et al.
Pubblicazione: (2025)
di: Lin, Shuyi, et al.
Pubblicazione: (2025)
QuantTM: Business-Centric Threat Quantification for Risk Management and Cyber Resilience
di: von der Assen, Jan, et al.
Pubblicazione: (2024)
di: von der Assen, Jan, et al.
Pubblicazione: (2024)
PUMA: Secure Inference of LLaMA-7B in Five Minutes
di: Dong, Ye, et al.
Pubblicazione: (2023)
di: Dong, Ye, et al.
Pubblicazione: (2023)
Compliance as a Trust Metric
di: Wu, Wenbo, et al.
Pubblicazione: (2026)
di: Wu, Wenbo, et al.
Pubblicazione: (2026)
No More Trade-Offs. GPT and Fully Informative Privacy Policies
di: Pałka, Przemysław, et al.
Pubblicazione: (2023)
di: Pałka, Przemysław, et al.
Pubblicazione: (2023)
Measuring Compliance of Consent Revocation on the Web
di: Kancherla, Gayatri Priyadarsini, et al.
Pubblicazione: (2024)
di: Kancherla, Gayatri Priyadarsini, et al.
Pubblicazione: (2024)
Exploring the Security Threats of Retriever Backdoors in Retrieval-Augmented Code Generation
di: Li, Tian, et al.
Pubblicazione: (2025)
di: Li, Tian, et al.
Pubblicazione: (2025)
An Ontological Approach to Compliance Verification of the NIS 2 Directive
di: Castiglione, Gianpietro, et al.
Pubblicazione: (2023)
di: Castiglione, Gianpietro, et al.
Pubblicazione: (2023)
Amulet: Fast TEE-Shielded Inference for On-Device Model Protection
di: Mao, Zikai, et al.
Pubblicazione: (2025)
di: Mao, Zikai, et al.
Pubblicazione: (2025)
Privacy Amplification via Shuffling: Unified, Simplified, and Tightened
di: Wang, Shaowei, et al.
Pubblicazione: (2023)
di: Wang, Shaowei, et al.
Pubblicazione: (2023)
SiGRRW: A Single-Watermark Robust Reversible Watermarking Framework with Guiding Strategy
di: Xu, Zikai, et al.
Pubblicazione: (2026)
di: Xu, Zikai, et al.
Pubblicazione: (2026)
Less Is More: Sparse and Cooperative Perturbation for Point Cloud Attacks
di: Tang, Keke, et al.
Pubblicazione: (2025)
di: Tang, Keke, et al.
Pubblicazione: (2025)
SOCpilot: Verifying Policy Compliance for LLM-Assisted Incident Response
di: Barbieri, Sidnei, et al.
Pubblicazione: (2026)
di: Barbieri, Sidnei, et al.
Pubblicazione: (2026)
Hybrid-DAOs: Enhancing Governance, Scalability, and Compliance in Decentralized Systems
di: Shah, Neil
Pubblicazione: (2024)
di: Shah, Neil
Pubblicazione: (2024)
Privacy as Permissible Operations: An ABAC Framework for Policy-Law Compliance
di: Dhakar, Ajay, et al.
Pubblicazione: (2026)
di: Dhakar, Ajay, et al.
Pubblicazione: (2026)
DROIDCCT: Cryptographic Compliance Test via Trillion-Scale Measurement
di: Moghimi, Daniel, et al.
Pubblicazione: (2026)
di: Moghimi, Daniel, et al.
Pubblicazione: (2026)
GuardReasoner-Omni: A Reasoning-based Multi-modal Guardrail for Text, Image, Video, and Audio
di: Zhu, Zhenhao, et al.
Pubblicazione: (2026)
di: Zhu, Zhenhao, et al.
Pubblicazione: (2026)
Compliance-Aware Agentic Payments on Stablecoin Rails
di: See, Kenneth, et al.
Pubblicazione: (2026)
di: See, Kenneth, et al.
Pubblicazione: (2026)
Confused ChatGPT: Cross-App Context Poisoning via First-Party APIs
di: Wang, Chao, et al.
Pubblicazione: (2026)
di: Wang, Chao, et al.
Pubblicazione: (2026)
Evaluating and Enhancing the Vulnerability Reasoning Capabilities of Large Language Models
di: Lu, Li, et al.
Pubblicazione: (2026)
di: Lu, Li, et al.
Pubblicazione: (2026)
On the Compliance of Self-Sovereign Identity with GDPR Principles: A Critical Review
di: Shehu, Abubakar-Sadiq
Pubblicazione: (2024)
di: Shehu, Abubakar-Sadiq
Pubblicazione: (2024)
CBCMS: A Compliance Management System for Cross-Border Data Transfer
di: Zhuang, Zhixian, et al.
Pubblicazione: (2024)
di: Zhuang, Zhixian, et al.
Pubblicazione: (2024)
TRUCE: TRUsted Compliance Enforcement Service for Secure Health Data Exchange
di: Kim, Dae-young, et al.
Pubblicazione: (2025)
di: Kim, Dae-young, et al.
Pubblicazione: (2025)
Zero-Knowledge Proof-of-Location Protocols for Vehicle Subsidies and Taxation Compliance
di: Bogdanov, Dan, et al.
Pubblicazione: (2025)
di: Bogdanov, Dan, et al.
Pubblicazione: (2025)
Differential Privacy for Regulatory Compliance in Cyberattack Detection on Critical Infrastructure Systems
di: Ramanan, Paritosh, et al.
Pubblicazione: (2025)
di: Ramanan, Paritosh, et al.
Pubblicazione: (2025)
The Road to Compliance: Executive Federal Agencies and the NIST Risk Management Framework
di: Stoltz, Michael
Pubblicazione: (2024)
di: Stoltz, Michael
Pubblicazione: (2024)
On the Out-of-Distribution Backdoor Attack for Federated Learning
di: Xu, Jiahao, et al.
Pubblicazione: (2025)
di: Xu, Jiahao, et al.
Pubblicazione: (2025)
Compatibility at a Cost: Systematic Discovery and Exploitation of MCP Clause-Compliance Vulnerabilities
di: Yang, Nanzi, et al.
Pubblicazione: (2026)
di: Yang, Nanzi, et al.
Pubblicazione: (2026)
CellularSpecSec-Bench: A Staged Benchmark for Evidence-Grounded Interpretation and Security Reasoning over 3GPP Specifications
di: Xie, Ke, et al.
Pubblicazione: (2026)
di: Xie, Ke, et al.
Pubblicazione: (2026)
An Automated Framework for Cybersecurity Policy Compliance Assessment Against Security Control Standards
di: Saha, Bikash, et al.
Pubblicazione: (2026)
di: Saha, Bikash, et al.
Pubblicazione: (2026)
Automated Cybersecurity Compliance and Threat Response Using AI, Blockchain & Smart Contracts
di: Alevizos, Lampis, et al.
Pubblicazione: (2024)
di: Alevizos, Lampis, et al.
Pubblicazione: (2024)
From Paranoia to Compliance: The Bumpy Road of System Hardening Practices on Stack Exchange
di: Busch, Niklas, et al.
Pubblicazione: (2025)
di: Busch, Niklas, et al.
Pubblicazione: (2025)
Hybrid Cloud Security: Balancing Performance, Cost, and Compliance in Multi-Cloud Deployments
di: Polinati, Anjani kumar
Pubblicazione: (2025)
di: Polinati, Anjani kumar
Pubblicazione: (2025)
RADS-Checker: Measuring Compliance with Right of Access by the Data Subject in Android Markets
di: Li, Zhenhua, et al.
Pubblicazione: (2024)
di: Li, Zhenhua, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Toward a Principled Framework for Agent Safety Measurement
di: Lin, Shuyi, et al.
Pubblicazione: (2026) -
Hey GPT-OSS, Looks Like You Got It -- Now Walk Me Through It! An Assessment of the Reasoning Language Models Chain of Thought Mechanism for Digital Forensics
di: Michelet, Gaëtan, et al.
Pubblicazione: (2025) -
Security-by-Design at the Telco Edge with OSS: Challenges and Lessons Learned
di: Cesarano, Carmine, et al.
Pubblicazione: (2025) -
OSS-CRS: Liberating AIxCC Cyber Reasoning Systems for Real-World Open-Source Security
di: Chin, Andrew, et al.
Pubblicazione: (2026) -
Prompt Injection Evaluations: Refusal Boundary Instability and Artifact-Dependent Compliance in GPT-4-Series Models
di: Heverin, Thomas
Pubblicazione: (2026)