Gespeichert in:
| Hauptverfasser: | Jiang, Junyong, Tian, Buwei, Xu, Chenxing, Li, Songze, Dong, Lu |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | https://arxiv.org/abs/2507.18113 |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Rethinking Adversarial Attacks in Reinforcement Learning from Policy Distribution Perspective
von: Duan, Tianyang, et al.
Veröffentlicht: (2025)
von: Duan, Tianyang, et al.
Veröffentlicht: (2025)
Off-Policy Value-Based Reinforcement Learning for Large Language Models
von: Wang, Peng-Yuan, et al.
Veröffentlicht: (2026)
von: Wang, Peng-Yuan, et al.
Veröffentlicht: (2026)
TooBadRL: Trigger Optimization to Boost Effectiveness of Backdoor Attacks on Deep Reinforcement Learning
von: Zhang, Mingxuan, et al.
Veröffentlicht: (2025)
von: Zhang, Mingxuan, et al.
Veröffentlicht: (2025)
Dynamic Adversarial Reinforcement Learning for Robust Multimodal Large Language Models
von: Bao, Yicheng, et al.
Veröffentlicht: (2026)
von: Bao, Yicheng, et al.
Veröffentlicht: (2026)
Constructing Adversarial Examples for Vertical Federated Learning: Optimal Client Corruption through Multi-Armed Bandit
von: Yao, Duanyi, et al.
Veröffentlicht: (2024)
von: Yao, Duanyi, et al.
Veröffentlicht: (2024)
MSfusion: A Dynamic Model Splitting Approach for Resource-Constrained Machines to Collaboratively Train Larger Models
von: Xie, Jin, et al.
Veröffentlicht: (2024)
von: Xie, Jin, et al.
Veröffentlicht: (2024)
Knowledge-Driven Multi-Turn Jailbreaking on Large Language Models
von: Li, Songze, et al.
Veröffentlicht: (2026)
von: Li, Songze, et al.
Veröffentlicht: (2026)
Noise as a Probe: Membership Inference Attacks on Diffusion Models Leveraging Initial Noise
von: Lian, Puwei, et al.
Veröffentlicht: (2026)
von: Lian, Puwei, et al.
Veröffentlicht: (2026)
Enhancing Membership Inference Attacks on Diffusion Models from a Frequency-Domain Perspective
von: Lian, Puwei, et al.
Veröffentlicht: (2025)
von: Lian, Puwei, et al.
Veröffentlicht: (2025)
URVFL: Undetectable Data Reconstruction Attack on Vertical Federated Learning
von: Yao, Duanyi, et al.
Veröffentlicht: (2024)
von: Yao, Duanyi, et al.
Veröffentlicht: (2024)
Towards Robust Policy: Enhancing Offline Reinforcement Learning with Adversarial Attacks and Defenses
von: Nguyen, Thanh, et al.
Veröffentlicht: (2024)
von: Nguyen, Thanh, et al.
Veröffentlicht: (2024)
Adversarial Reinforcement Learning for Large Language Model Agent Safety
von: Wang, Zizhao, et al.
Veröffentlicht: (2025)
von: Wang, Zizhao, et al.
Veröffentlicht: (2025)
TOP-ERL: Transformer-based Off-Policy Episodic Reinforcement Learning
von: Li, Ge, et al.
Veröffentlicht: (2024)
von: Li, Ge, et al.
Veröffentlicht: (2024)
Provably Invincible Adversarial Attacks on Reinforcement Learning Systems: A Rate-Distortion Information-Theoretic Approach
von: Lu, Ziqing, et al.
Veröffentlicht: (2025)
von: Lu, Ziqing, et al.
Veröffentlicht: (2025)
Adversarial Contrastive Learning for LLM Quantization Attacks
von: Song, Dinghong, et al.
Veröffentlicht: (2026)
von: Song, Dinghong, et al.
Veröffentlicht: (2026)
Sampling-aware Adversarial Attacks Against Large Language Models
von: Beyer, Tim, et al.
Veröffentlicht: (2025)
von: Beyer, Tim, et al.
Veröffentlicht: (2025)
Reinforcement Learning with Promising Tokens for Large Language Models
von: Pang, Jing-Cheng, et al.
Veröffentlicht: (2026)
von: Pang, Jing-Cheng, et al.
Veröffentlicht: (2026)
The Resurgence of GCG Adversarial Attacks on Large Language Models
von: Tan, Yuting, et al.
Veröffentlicht: (2025)
von: Tan, Yuting, et al.
Veröffentlicht: (2025)
DarkLLM: Learning Language-Driven Adversarial Attacks with Large Language Models
von: Sun, Ye, et al.
Veröffentlicht: (2026)
von: Sun, Ye, et al.
Veröffentlicht: (2026)
DiffPoGAN: Diffusion Policies with Generative Adversarial Networks for Offline Reinforcement Learning
von: Hu, Xuemin, et al.
Veröffentlicht: (2024)
von: Hu, Xuemin, et al.
Veröffentlicht: (2024)
Towards Client Driven Federated Learning
von: Li, Songze, et al.
Veröffentlicht: (2024)
von: Li, Songze, et al.
Veröffentlicht: (2024)
Adversarial Evasion Attack Efficiency against Large Language Models
von: Vitorino, João, et al.
Veröffentlicht: (2024)
von: Vitorino, João, et al.
Veröffentlicht: (2024)
Attacking Cooperative Multi-Agent Reinforcement Learning by Adversarial Minority Influence
von: Li, Simin, et al.
Veröffentlicht: (2023)
von: Li, Simin, et al.
Veröffentlicht: (2023)
Toward Evaluating Robustness of Reinforcement Learning with Adversarial Policy
von: Zheng, Xiang, et al.
Veröffentlicht: (2023)
von: Zheng, Xiang, et al.
Veröffentlicht: (2023)
Box Thirding: Anytime Best Arm Identification under Insufficient Sampling
von: Hwang, Seohwa, et al.
Veröffentlicht: (2026)
von: Hwang, Seohwa, et al.
Veröffentlicht: (2026)
FedMeS: Personalized Federated Continual Learning Leveraging Local Memory
von: Xie, Jin, et al.
Veröffentlicht: (2024)
von: Xie, Jin, et al.
Veröffentlicht: (2024)
Adversarial Inception Backdoor Attacks against Reinforcement Learning
von: Rathbun, Ethan, et al.
Veröffentlicht: (2024)
von: Rathbun, Ethan, et al.
Veröffentlicht: (2024)
Beyond Suffixes: Token Position in GCG Adversarial Attacks on Large Language Models
von: Eddoubi, Hicham, et al.
Veröffentlicht: (2026)
von: Eddoubi, Hicham, et al.
Veröffentlicht: (2026)
REINFORCE Adversarial Attacks on Large Language Models: An Adaptive, Distributional, and Semantic Objective
von: Geisler, Simon, et al.
Veröffentlicht: (2025)
von: Geisler, Simon, et al.
Veröffentlicht: (2025)
Exploring Modality Disruption in Multimodal Fake News Detection
von: Liu, Moyang, et al.
Veröffentlicht: (2025)
von: Liu, Moyang, et al.
Veröffentlicht: (2025)
TernaryLLM: Ternarized Large Language Model
von: Chen, Tianqi, et al.
Veröffentlicht: (2024)
von: Chen, Tianqi, et al.
Veröffentlicht: (2024)
Causal Policy Learning in Reinforcement Learning: Backdoor-Adjusted Soft Actor-Critic
von: Vo, Thanh Vinh, et al.
Veröffentlicht: (2025)
von: Vo, Thanh Vinh, et al.
Veröffentlicht: (2025)
Break the Visual Perception: Adversarial Attacks Targeting Encoded Visual Tokens of Large Vision-Language Models
von: Wang, Yubo, et al.
Veröffentlicht: (2024)
von: Wang, Yubo, et al.
Veröffentlicht: (2024)
Mildly Constrained Evaluation Policy for Offline Reinforcement Learning
von: Xu, Linjie, et al.
Veröffentlicht: (2023)
von: Xu, Linjie, et al.
Veröffentlicht: (2023)
Attributing and Exploiting Safety Vectors through Global Optimization in Large Language Models
von: Chu, Fengheng, et al.
Veröffentlicht: (2026)
von: Chu, Fengheng, et al.
Veröffentlicht: (2026)
Adversarially Trained Weighted Actor-Critic for Safe Offline Reinforcement Learning
von: Wei, Honghao, et al.
Veröffentlicht: (2024)
von: Wei, Honghao, et al.
Veröffentlicht: (2024)
Universal and Transferable Adversarial Attack on Large Language Models Using Exponentiated Gradient Descent
von: Biswas, Sajib, et al.
Veröffentlicht: (2025)
von: Biswas, Sajib, et al.
Veröffentlicht: (2025)
ReMax: A Simple, Effective, and Efficient Reinforcement Learning Method for Aligning Large Language Models
von: Li, Ziniu, et al.
Veröffentlicht: (2023)
von: Li, Ziniu, et al.
Veröffentlicht: (2023)
POLAR: Policy-based Layerwise Reinforcement Learning Method for Stealthy Backdoor Attacks in Federated Learning
von: Yu, Kuai, et al.
Veröffentlicht: (2025)
von: Yu, Kuai, et al.
Veröffentlicht: (2025)
Self-Hinting Language Models Enhance Reinforcement Learning
von: Liao, Baohao, et al.
Veröffentlicht: (2026)
von: Liao, Baohao, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
Rethinking Adversarial Attacks in Reinforcement Learning from Policy Distribution Perspective
von: Duan, Tianyang, et al.
Veröffentlicht: (2025) -
Off-Policy Value-Based Reinforcement Learning for Large Language Models
von: Wang, Peng-Yuan, et al.
Veröffentlicht: (2026) -
TooBadRL: Trigger Optimization to Boost Effectiveness of Backdoor Attacks on Deep Reinforcement Learning
von: Zhang, Mingxuan, et al.
Veröffentlicht: (2025) -
Dynamic Adversarial Reinforcement Learning for Robust Multimodal Large Language Models
von: Bao, Yicheng, et al.
Veröffentlicht: (2026) -
Constructing Adversarial Examples for Vertical Federated Learning: Optimal Client Corruption through Multi-Armed Bandit
von: Yao, Duanyi, et al.
Veröffentlicht: (2024)