Propaganda AI: An Analysis of Semantic Divergence in Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Min, Nay Myat, Pham, Long H., Li, Yige, Sun, Jun |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
CROW: Eliminating Backdoors from Large Language Models via Internal Consistency Regularization
por: Min, Nay Myat, et al.
Publicado: (2024)
por: Min, Nay Myat, et al.
Publicado: (2024)
Layerwise Convergence Fingerprints for Runtime Misbehavior Detection in Large Language Models
por: Min, Nay Myat, et al.
Publicado: (2026)
por: Min, Nay Myat, et al.
Publicado: (2026)
CORVUS: Red-Teaming Hallucination Detectors via Internal Signal Camouflage in Large Language Models
por: Min, Nay Myat, et al.
Publicado: (2026)
por: Min, Nay Myat, et al.
Publicado: (2026)
Unified Neural Backdoor Removal with Only Few Clean Samples through Unlearning and Relearning
por: Min, Nay Myat, et al.
Publicado: (2024)
por: Min, Nay Myat, et al.
Publicado: (2024)
Do Influence Functions Work on Large Language Models?
por: Li, Zhe, et al.
Publicado: (2024)
por: Li, Zhe, et al.
Publicado: (2024)
AUTOLAW: Enhancing Legal Compliance in Large Language Models via Case Law Generation and Jury-Inspired Deliberation
por: Nguyen, Tai D., et al.
Publicado: (2025)
por: Nguyen, Tai D., et al.
Publicado: (2025)
Unleashing the Unseen: Harnessing Benign Datasets for Jailbreaking Large Language Models
por: Zhao, Wei, et al.
Publicado: (2024)
por: Zhao, Wei, et al.
Publicado: (2024)
Graph Fusion Across Languages using Large Language Models
por: Kyaw, Kaung Myat, et al.
Publicado: (2026)
por: Kyaw, Kaung Myat, et al.
Publicado: (2026)
Adaptive Content Restriction for Large Language Models via Suffix Optimization
por: Li, Yige, et al.
Publicado: (2025)
por: Li, Yige, et al.
Publicado: (2025)
Are Large Language Models Good at Detecting Propaganda?
por: Jose, Julia, et al.
Publicado: (2025)
por: Jose, Julia, et al.
Publicado: (2025)
Large Language Models for Propaganda Span Annotation
por: Hasanain, Maram, et al.
Publicado: (2023)
por: Hasanain, Maram, et al.
Publicado: (2023)
LLMs Can Also Do Well! Breaking Barriers in Semantic Role Labeling via Large Language Models
por: Li, Xinxin, et al.
Publicado: (2025)
por: Li, Xinxin, et al.
Publicado: (2025)
Divergent Creativity in Humans and Large Language Models
por: Bellemare-Pepin, Antoine, et al.
Publicado: (2024)
por: Bellemare-Pepin, Antoine, et al.
Publicado: (2024)
"Understanding AI": Semantic Grounding in Large Language Models
por: Lyre, Holger
Publicado: (2024)
por: Lyre, Holger
Publicado: (2024)
Prompt-Response Semantic Divergence Metrics for Faithfulness Hallucination and Misalignment Detection in Large Language Models
por: Halperin, Igor
Publicado: (2025)
por: Halperin, Igor
Publicado: (2025)
D2LLM: Decomposed and Distilled Large Language Models for Semantic Search
por: Liao, Zihan, et al.
Publicado: (2024)
por: Liao, Zihan, et al.
Publicado: (2024)
Structured Semantic Cloaking for Jailbreak Attacks on Large Language Models
por: Sun, Xiaobing, et al.
Publicado: (2026)
por: Sun, Xiaobing, et al.
Publicado: (2026)
AutoBackdoor: Automating Backdoor Attacks via LLM Agents
por: Li, Yige, et al.
Publicado: (2025)
por: Li, Yige, et al.
Publicado: (2025)
RKLD: Reverse KL-Divergence-based Knowledge Distillation for Unlearning Personal Information in Large Language Models
por: Wang, Bichen, et al.
Publicado: (2024)
por: Wang, Bichen, et al.
Publicado: (2024)
Prompt Compression in Diffusion Large Language Models: Evaluating LLMLingua-2 on LLaDA
por: Huang, Sterling, et al.
Publicado: (2026)
por: Huang, Sterling, et al.
Publicado: (2026)
Where Did It Go Wrong? Attributing Undesirable LLM Behaviors via Representation Gradient Tracing
por: Li, Zhe, et al.
Publicado: (2025)
por: Li, Zhe, et al.
Publicado: (2025)
Enhancing Semantic Consistency of Large Language Models through Model Editing: An Interpretability-Oriented Approach
por: Yang, Jingyuan, et al.
Publicado: (2025)
por: Yang, Jingyuan, et al.
Publicado: (2025)
A Benchmark Dataset and Evaluation Framework for Vietnamese Large Language Models in Customer Support
por: Nguyen, Long S. T., et al.
Publicado: (2025)
por: Nguyen, Long S. T., et al.
Publicado: (2025)
From Voices to Validity: Leveraging Large Language Models (LLMs) for Textual Analysis of Policy Stakeholder Interviews
por: Liu, Alex, et al.
Publicado: (2023)
por: Liu, Alex, et al.
Publicado: (2023)
Semantic Consistency Regularization with Large Language Models for Semi-supervised Sentiment Analysis
por: Li, Kunrong, et al.
Publicado: (2025)
por: Li, Kunrong, et al.
Publicado: (2025)
Zero-Shot Defense Against Toxic Images via Inherent Multimodal Alignment in LVLMs
por: Zhao, Wei, et al.
Publicado: (2025)
por: Zhao, Wei, et al.
Publicado: (2025)
Structural Reformation of Large Language Model Neuron Encapsulation for Divergent Information Aggregation
por: Bakushev, Denis, et al.
Publicado: (2025)
por: Bakushev, Denis, et al.
Publicado: (2025)
Detecting Hallucinations in Large Language Models via Internal Attention Divergence Signals
por: van Dijk, Gijs
Publicado: (2026)
por: van Dijk, Gijs
Publicado: (2026)
Encouraging Divergent Thinking in Large Language Models through Multi-Agent Debate
por: Liang, Tian, et al.
Publicado: (2023)
por: Liang, Tian, et al.
Publicado: (2023)
Semantic Pivots Enable Cross-Lingual Transfer in Large Language Models
por: He, Kaiyu, et al.
Publicado: (2025)
por: He, Kaiyu, et al.
Publicado: (2025)
Semantic and Structural Analysis of Implicit Biases in Large Language Models: An Interpretable Approach
por: Zhang, Renhan, et al.
Publicado: (2025)
por: Zhang, Renhan, et al.
Publicado: (2025)
How to Leverage Demonstration Data in Alignment for Large Language Model? A Self-Imitation Learning Perspective
por: Xiao, Teng, et al.
Publicado: (2024)
por: Xiao, Teng, et al.
Publicado: (2024)
Exploring Solution Divergence and Its Effect on Large Language Model Problem Solving
por: Li, Hang, et al.
Publicado: (2025)
por: Li, Hang, et al.
Publicado: (2025)
When Can Large Reasoning Models Save Thinking? Mechanistic Analysis of Behavioral Divergence in Reasoning
por: Zhu, Rongzhi, et al.
Publicado: (2025)
por: Zhu, Rongzhi, et al.
Publicado: (2025)
Generator-Assistant Stepwise Rollback Framework for Large Language Model Agent
por: Li, Xingzuo, et al.
Publicado: (2025)
por: Li, Xingzuo, et al.
Publicado: (2025)
XIFBench: Evaluating Large Language Models on Multilingual Instruction Following
por: Li, Zhenyu, et al.
Publicado: (2025)
por: Li, Zhenyu, et al.
Publicado: (2025)
Can GPT-4 Identify Propaganda? Annotation and Detection of Propaganda Spans in News Articles
por: Hasanain, Maram, et al.
Publicado: (2024)
por: Hasanain, Maram, et al.
Publicado: (2024)
Multi-Granularity Semantic Revision for Large Language Model Distillation
por: Liu, Xiaoyu, et al.
Publicado: (2024)
por: Liu, Xiaoyu, et al.
Publicado: (2024)
On the Semantics of Large Language Models
por: Schuele, Martin
Publicado: (2025)
por: Schuele, Martin
Publicado: (2025)
Beyond Divergent Creativity: A Human-Based Evaluation of Creativity in Large Language Models
por: Nakajima, Kumiko, et al.
Publicado: (2026)
por: Nakajima, Kumiko, et al.
Publicado: (2026)
Ejemplares similares
-
CROW: Eliminating Backdoors from Large Language Models via Internal Consistency Regularization
por: Min, Nay Myat, et al.
Publicado: (2024) -
Layerwise Convergence Fingerprints for Runtime Misbehavior Detection in Large Language Models
por: Min, Nay Myat, et al.
Publicado: (2026) -
CORVUS: Red-Teaming Hallucination Detectors via Internal Signal Camouflage in Large Language Models
por: Min, Nay Myat, et al.
Publicado: (2026) -
Unified Neural Backdoor Removal with Only Few Clean Samples through Unlearning and Relearning
por: Min, Nay Myat, et al.
Publicado: (2024) -
Do Influence Functions Work on Large Language Models?
por: Li, Zhe, et al.
Publicado: (2024)