Invisible Safety Threat: Malicious Finetuning for LLM via Steganography
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Wan, Guangnian, Ma, Xinyin, Fang, Gongfan, Wang, Xinchao |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Self-Purification Mitigates Backdoors in Multimodal Diffusion Language Models
von: Wan, Guangnian, et al.
Veröffentlicht: (2026)
von: Wan, Guangnian, et al.
Veröffentlicht: (2026)
CoT-Valve: Length-Compressible Chain-of-Thought Tuning
von: Ma, Xinyin, et al.
Veröffentlicht: (2025)
von: Ma, Xinyin, et al.
Veröffentlicht: (2025)
Learning-to-Cache: Accelerating Diffusion Transformer via Layer Caching
von: Ma, Xinyin, et al.
Veröffentlicht: (2024)
von: Ma, Xinyin, et al.
Veröffentlicht: (2024)
TinyFusion: Diffusion Transformers Learned Shallow
von: Fang, Gongfan, et al.
Veröffentlicht: (2024)
von: Fang, Gongfan, et al.
Veröffentlicht: (2024)
VeriThinker: Learning to Verify Makes Reasoning Model Efficient
von: Chen, Zigeng, et al.
Veröffentlicht: (2025)
von: Chen, Zigeng, et al.
Veröffentlicht: (2025)
DMax: Aggressive Parallel Decoding for dLLMs
von: Chen, Zigeng, et al.
Veröffentlicht: (2026)
von: Chen, Zigeng, et al.
Veröffentlicht: (2026)
Isomorphic Pruning for Vision Models
von: Fang, Gongfan, et al.
Veröffentlicht: (2024)
von: Fang, Gongfan, et al.
Veröffentlicht: (2024)
Thinkless: LLM Learns When to Think
von: Fang, Gongfan, et al.
Veröffentlicht: (2025)
von: Fang, Gongfan, et al.
Veröffentlicht: (2025)
In-Video Instructions: Visual Signals as Generative Control
von: Fang, Gongfan, et al.
Veröffentlicht: (2025)
von: Fang, Gongfan, et al.
Veröffentlicht: (2025)
Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising
von: Fang, Gongfan, et al.
Veröffentlicht: (2024)
von: Fang, Gongfan, et al.
Veröffentlicht: (2024)
ConciseHint: Boosting Efficient Reasoning via Continuous Concise Hints during Generation
von: Tang, Siao, et al.
Veröffentlicht: (2025)
von: Tang, Siao, et al.
Veröffentlicht: (2025)
Introducing Visual Perception Token into Multimodal Large Language Model
von: Yu, Runpeng, et al.
Veröffentlicht: (2025)
von: Yu, Runpeng, et al.
Veröffentlicht: (2025)
Efficient Reasoning Models: A Survey
von: Feng, Sicheng, et al.
Veröffentlicht: (2025)
von: Feng, Sicheng, et al.
Veröffentlicht: (2025)
SlimSAM: 0.1% Data Makes Segment Anything Slim
von: Chen, Zigeng, et al.
Veröffentlicht: (2023)
von: Chen, Zigeng, et al.
Veröffentlicht: (2023)
dKV-Cache: The Cache for Diffusion Language Models
von: Ma, Xinyin, et al.
Veröffentlicht: (2025)
von: Ma, Xinyin, et al.
Veröffentlicht: (2025)
Collaborative Decoding Makes Visual Auto-Regressive Modeling Efficient
von: Chen, Zigeng, et al.
Veröffentlicht: (2024)
von: Chen, Zigeng, et al.
Veröffentlicht: (2024)
LiteFocus: Accelerated Diffusion Inference for Long Audio Synthesis
von: Tan, Zhenxiong, et al.
Veröffentlicht: (2024)
von: Tan, Zhenxiong, et al.
Veröffentlicht: (2024)
Covert Malicious Finetuning: Challenges in Safeguarding LLM Adaptation
von: Halawi, Danny, et al.
Veröffentlicht: (2024)
von: Halawi, Danny, et al.
Veröffentlicht: (2024)
Diversity-Guided MLP Reduction for Efficient Large Vision Transformers
von: Shen, Chengchao, et al.
Veröffentlicht: (2025)
von: Shen, Chengchao, et al.
Veröffentlicht: (2025)
SparseD: Sparse Attention for Diffusion Language Models
von: Wang, Zeqing, et al.
Veröffentlicht: (2025)
von: Wang, Zeqing, et al.
Veröffentlicht: (2025)
dMoE: dLLMs with Learnable Block Experts
von: Feng, Sicheng, et al.
Veröffentlicht: (2026)
von: Feng, Sicheng, et al.
Veröffentlicht: (2026)
Q-ARVD: Quantizing Autoregressive Video Diffusion Models
von: Tang, Siao, et al.
Veröffentlicht: (2026)
von: Tang, Siao, et al.
Veröffentlicht: (2026)
Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs
von: Lu, Haiquan, et al.
Veröffentlicht: (2026)
von: Lu, Haiquan, et al.
Veröffentlicht: (2026)
dVoting: Fast Voting for dLLMs
von: Feng, Sicheng, et al.
Veröffentlicht: (2026)
von: Feng, Sicheng, et al.
Veröffentlicht: (2026)
MixReasoning: Switching Modes to Think
von: Lu, Haiquan, et al.
Veröffentlicht: (2025)
von: Lu, Haiquan, et al.
Veröffentlicht: (2025)
dParallel: Learnable Parallel Decoding for dLLMs
von: Chen, Zigeng, et al.
Veröffentlicht: (2025)
von: Chen, Zigeng, et al.
Veröffentlicht: (2025)
AsyncDiff: Parallelizing Diffusion Models by Asynchronous Denoising
von: Chen, Zigeng, et al.
Veröffentlicht: (2024)
von: Chen, Zigeng, et al.
Veröffentlicht: (2024)
MaskLLM: Learnable Semi-Structured Sparsity for Large Language Models
von: Fang, Gongfan, et al.
Veröffentlicht: (2024)
von: Fang, Gongfan, et al.
Veröffentlicht: (2024)
Shape it Up! Restoring LLM Safety during Finetuning
von: Peng, ShengYun, et al.
Veröffentlicht: (2025)
von: Peng, ShengYun, et al.
Veröffentlicht: (2025)
Uncovering Semantics and Topics Utilized by Threat Actors to Deliver Malicious Attachments and URLs
von: Yakymovych, Andrey, et al.
Veröffentlicht: (2024)
von: Yakymovych, Andrey, et al.
Veröffentlicht: (2024)
One Step to the Side: Why Defenses Against Malicious Finetuning Fail Under Adaptive Adversaries
von: Zloczower, Itay, et al.
Veröffentlicht: (2026)
von: Zloczower, Itay, et al.
Veröffentlicht: (2026)
Refining Hybrid Genetic Search for CVRP via Reinforcement Learning-Finetuned LLM
von: Zhu, Rongjie, et al.
Veröffentlicht: (2025)
von: Zhu, Rongjie, et al.
Veröffentlicht: (2025)
Kolmogorov Complexity Bounds for LLM Steganography and a Perplexity-Based Detection Proxy
von: Shportko, Andrii
Veröffentlicht: (2026)
von: Shportko, Andrii
Veröffentlicht: (2026)
Safety in Graph Machine Learning: Threats and Safeguards
von: Wang, Song, et al.
Veröffentlicht: (2024)
von: Wang, Song, et al.
Veröffentlicht: (2024)
Efficient and Adaptable Detection of Malicious LLM Prompts via Bootstrap Aggregation
von: Hassan, Shayan Ali, et al.
Veröffentlicht: (2026)
von: Hassan, Shayan Ali, et al.
Veröffentlicht: (2026)
Odysseus: Jailbreaking Commercial Multimodal LLM-integrated Systems via Dual Steganography
von: Li, Songze, et al.
Veröffentlicht: (2025)
von: Li, Songze, et al.
Veröffentlicht: (2025)
When Scaling Meets LLM Finetuning: The Effect of Data, Model and Finetuning Method
von: Zhang, Biao, et al.
Veröffentlicht: (2024)
von: Zhang, Biao, et al.
Veröffentlicht: (2024)
Navigating the Safety Landscape: Measuring Risks in Finetuning Large Language Models
von: Peng, ShengYun, et al.
Veröffentlicht: (2024)
von: Peng, ShengYun, et al.
Veröffentlicht: (2024)
The Finetuner's Fallacy: When to Pretrain with Your Finetuning Data
von: Baek, Christina, et al.
Veröffentlicht: (2026)
von: Baek, Christina, et al.
Veröffentlicht: (2026)
Learning Dynamics of LLM Finetuning
von: Ren, Yi, et al.
Veröffentlicht: (2024)
von: Ren, Yi, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Self-Purification Mitigates Backdoors in Multimodal Diffusion Language Models
von: Wan, Guangnian, et al.
Veröffentlicht: (2026) -
CoT-Valve: Length-Compressible Chain-of-Thought Tuning
von: Ma, Xinyin, et al.
Veröffentlicht: (2025) -
Learning-to-Cache: Accelerating Diffusion Transformer via Layer Caching
von: Ma, Xinyin, et al.
Veröffentlicht: (2024) -
TinyFusion: Diffusion Transformers Learned Shallow
von: Fang, Gongfan, et al.
Veröffentlicht: (2024) -
VeriThinker: Learning to Verify Makes Reasoning Model Efficient
von: Chen, Zigeng, et al.
Veröffentlicht: (2025)