Quantifying Self-Preservation Bias in Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Migliarini, Matteo, Pizzini, Joaquin Pereira, Moresca, Luca, Santini, Valerio, Spinelli, Indro, Galasso, Fabio |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SeRpEnt: Selective Resampling for Expressive State Space Models
par: Rando, Stefano, et autres
Publié: (2025)
par: Rando, Stefano, et autres
Publié: (2025)
Large Language Model (LLM) Bias Index -- LLMBI
par: Oketunji, Abiodun Finbarrs, et autres
Publié: (2023)
par: Oketunji, Abiodun Finbarrs, et autres
Publié: (2023)
The Generation Gap: Exploring Age Bias in the Value Systems of Large Language Models
par: Liu, Siyang, et autres
Publié: (2024)
par: Liu, Siyang, et autres
Publié: (2024)
RAudit: A Blind Auditing Protocol for Large Language Model Reasoning
par: Chang, Edward Y., et autres
Publié: (2026)
par: Chang, Edward Y., et autres
Publié: (2026)
Executing Arithmetic: Fine-Tuning Large Language Models as Turing Machines
par: Lai, Junyu, et autres
Publié: (2024)
par: Lai, Junyu, et autres
Publié: (2024)
Persuasiveness and Bias in LLM: Investigating the Impact of Persuasiveness and Reinforcement of Bias in Language Models
par: Roy, Saumya
Publié: (2025)
par: Roy, Saumya
Publié: (2025)
Text-Based Approaches to Item Difficulty Modeling in Large-Scale Assessments: A Systematic Review
par: Peters, Sydney, et autres
Publié: (2025)
par: Peters, Sydney, et autres
Publié: (2025)
Unlocking the Wisdom of Large Language Models: An Introduction to The Path to Artificial General Intelligence
par: Chang, Edward Y.
Publié: (2024)
par: Chang, Edward Y.
Publié: (2024)
ToolWeaver: Weaving Collaborative Semantics for Scalable Tool Use in Large Language Models
par: Fang, Bowen, et autres
Publié: (2026)
par: Fang, Bowen, et autres
Publié: (2026)
Preventing Safety Drift in Large Language Models via Coupled Weight and Activation Constraints
par: Peng, Songping, et autres
Publié: (2026)
par: Peng, Songping, et autres
Publié: (2026)
A Fuzzy Logic Prompting Framework for Large Language Models in Adaptive and Uncertain Tasks
par: Figueiredo, Vanessa
Publié: (2025)
par: Figueiredo, Vanessa
Publié: (2025)
AI-Powered Annotation Pipelines for Stabilizing Large Language Models: A Human-AI Synergy Approach
par: Pathak, Gangesh, et autres
Publié: (2025)
par: Pathak, Gangesh, et autres
Publié: (2025)
A Closer Look at Bias and Chain-of-Thought Faithfulness of Large (Vision) Language Models
par: Balasubramanian, Sriram, et autres
Publié: (2025)
par: Balasubramanian, Sriram, et autres
Publié: (2025)
Large Language Models as Oracles for Ontology Alignment
par: Lushnei, Sviatoslav, et autres
Publié: (2025)
par: Lushnei, Sviatoslav, et autres
Publié: (2025)
KemenkeuGPT: Leveraging a Large Language Model on Indonesia's Government Financial Data and Regulations to Enhance Decision Making
par: Febrian, Gilang Fajar, et autres
Publié: (2024)
par: Febrian, Gilang Fajar, et autres
Publié: (2024)
Robustness of Large Language Models to Perturbations in Text
par: Singh, Ayush, et autres
Publié: (2024)
par: Singh, Ayush, et autres
Publié: (2024)
A Benchmark for Audio Reasoning Capabilities of Multimodal Large Language Models
par: Christop, Iwona, et autres
Publié: (2026)
par: Christop, Iwona, et autres
Publié: (2026)
PhysNote: Self-Knowledge Notes for Evolvable Physical Reasoning in Vision-Language Model
par: Zhang, Sinin, et autres
Publié: (2026)
par: Zhang, Sinin, et autres
Publié: (2026)
Predictive Simultaneous Interpretation: Harnessing Large Language Models for Democratizing Real-Time Multilingual Communication
par: Iida, Kurando, et autres
Publié: (2024)
par: Iida, Kurando, et autres
Publié: (2024)
UA-Legal-Bench: A Benchmark for Evaluating Large Language Models on Ukrainian Legal Reasoning
par: Ovcharov, Volodymyr
Publié: (2026)
par: Ovcharov, Volodymyr
Publié: (2026)
Random-Set Large Language Models
par: Mubashar, Muhammad, et autres
Publié: (2025)
par: Mubashar, Muhammad, et autres
Publié: (2025)
Thought-Like-Pro: Enhancing Reasoning of Large Language Models through Self-Driven Prolog-based Chain-of-Thought
par: Tan, Xiaoyu, et autres
Publié: (2024)
par: Tan, Xiaoyu, et autres
Publié: (2024)
Automated CAD Modeling Sequence Generation from Text Descriptions via Transformer-Based Large Language Models
par: Liao, Jianxing, et autres
Publié: (2025)
par: Liao, Jianxing, et autres
Publié: (2025)
OntoLogX: Ontology-Guided Knowledge Graph Extraction from Cybersecurity Logs with Large Language Models
par: Cotti, Luca, et autres
Publié: (2025)
par: Cotti, Luca, et autres
Publié: (2025)
Inference to the Best Explanation in Large Language Models
par: Dalal, Dhairya, et autres
Publié: (2024)
par: Dalal, Dhairya, et autres
Publié: (2024)
Do Language Models Mirror Human Confidence? Exploring Psychological Insights to Address Overconfidence in LLMs
par: Xu, Chenjun, et autres
Publié: (2025)
par: Xu, Chenjun, et autres
Publié: (2025)
The Unified Cognitive Consciousness Theory for Language Models: Anchoring Semantics, Thresholds of Activation, and Emergent Reasoning
par: Chang, Edward Y., et autres
Publié: (2025)
par: Chang, Edward Y., et autres
Publié: (2025)
The use of GPT-4o and Other Large Language Models for the Improvement and Design of Self-Assessment Scales for Measurement of Interpersonal Communication Skills
par: Bubaš, Goran
Publié: (2024)
par: Bubaš, Goran
Publié: (2024)
Component-Aware Self-Speculative Decoding in Hybrid Language Models
par: Borobia, Hector, et autres
Publié: (2026)
par: Borobia, Hector, et autres
Publié: (2026)
Entropy-Based Measurement of Value Drift and Alignment Work in Large Language Models
par: Fadli, Samih
Publié: (2025)
par: Fadli, Samih
Publié: (2025)
Self-Supervised Position Debiasing for Large Language Models
par: Liu, Zhongkun, et autres
Publié: (2024)
par: Liu, Zhongkun, et autres
Publié: (2024)
Streamlining Redundant Layers to Compress Large Language Models
par: Chen, Xiaodong, et autres
Publié: (2024)
par: Chen, Xiaodong, et autres
Publié: (2024)
A comprehensive taxonomy of hallucinations in Large Language Models
par: Cossio, Manuel
Publié: (2025)
par: Cossio, Manuel
Publié: (2025)
Integrating Emotional and Linguistic Models for Ethical Compliance in Large Language Models
par: Chang, Edward Y.
Publié: (2024)
par: Chang, Edward Y.
Publié: (2024)
Bielik 11B v3: Multilingual Large Language Model for European Languages
par: Ociepa, Krzysztof, et autres
Publié: (2025)
par: Ociepa, Krzysztof, et autres
Publié: (2025)
Quantifying Cognitive Bias Induction in LLM-Generated Content
par: Alessa, Abeer, et autres
Publié: (2025)
par: Alessa, Abeer, et autres
Publié: (2025)
Prompt-Time Symbolic Knowledge Capture with Large Language Models
par: Çöplü, Tolga, et autres
Publié: (2024)
par: Çöplü, Tolga, et autres
Publié: (2024)
Artificial Phantasia: Emergent Mental Imagery in Large Language Models
par: McCarty, Morgan, et autres
Publié: (2025)
par: McCarty, Morgan, et autres
Publié: (2025)
Argumentative Large Language Models for Explainable and Contestable Claim Verification
par: Freedman, Gabriel, et autres
Publié: (2024)
par: Freedman, Gabriel, et autres
Publié: (2024)
PatentGPT: A Large Language Model for Intellectual Property
par: Bai, Zilong, et autres
Publié: (2024)
par: Bai, Zilong, et autres
Publié: (2024)
Documents similaires
-
SeRpEnt: Selective Resampling for Expressive State Space Models
par: Rando, Stefano, et autres
Publié: (2025) -
Large Language Model (LLM) Bias Index -- LLMBI
par: Oketunji, Abiodun Finbarrs, et autres
Publié: (2023) -
The Generation Gap: Exploring Age Bias in the Value Systems of Large Language Models
par: Liu, Siyang, et autres
Publié: (2024) -
RAudit: A Blind Auditing Protocol for Large Language Model Reasoning
par: Chang, Edward Y., et autres
Publié: (2026) -
Executing Arithmetic: Fine-Tuning Large Language Models as Turing Machines
par: Lai, Junyu, et autres
Publié: (2024)