Exposing and Defending the Achilles' Heel of Video Mixture-of-Experts
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Songping, Liu, Qinglong, Lyu, Yueming, Li, Ning, He, Ziwen, Shan, Caifeng |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
An Effective End-to-End Solution for Multimodal Action Recognition
par: Wang, Songping, et autres
Publié: (2025)
par: Wang, Songping, et autres
Publié: (2025)
Exploring Adversarial Transferability between Kolmogorov-arnold Networks
par: Wang, Songping, et autres
Publié: (2025)
par: Wang, Songping, et autres
Publié: (2025)
RunawayEvil: Jailbreaking the Image-to-Video Generative Models
par: Wang, Songping, et autres
Publié: (2025)
par: Wang, Songping, et autres
Publié: (2025)
Fast Adversarial Training with Weak-to-Strong Spatial-Temporal Consistency in the Frequency Domain on Videos
par: Wang, Songping, et autres
Publié: (2025)
par: Wang, Songping, et autres
Publié: (2025)
Anti-Aesthetics: Protecting Facial Privacy against Customized Text-to-Image Synthesis
par: Wang, Songping, et autres
Publié: (2025)
par: Wang, Songping, et autres
Publié: (2025)
Images are Achilles' Heel of Alignment: Exploiting Visual Vulnerabilities for Jailbreaking Multimodal Large Language Models
par: Li, Yifan, et autres
Publié: (2024)
par: Li, Yifan, et autres
Publié: (2024)
VideoDetective: Clue Hunting via both Extrinsic Query and Intrinsic Relevance for Long Video Understanding
par: Yang, Ruoliu, et autres
Publié: (2026)
par: Yang, Ruoliu, et autres
Publié: (2026)
Uncertainty-Aware Concept and Motion Segmentation for Semi-Supervised Angiography Videos
par: Luo, Yu, et autres
Publié: (2026)
par: Luo, Yu, et autres
Publié: (2026)
Exposing Lip-syncing Deepfakes from Mouth Inconsistencies
par: Datta, Soumyya Kanti, et autres
Publié: (2024)
par: Datta, Soumyya Kanti, et autres
Publié: (2024)
DeltaSpace: A Semantic-aligned Feature Space for Flexible Text-guided Image Editing
par: Lyu, Yueming, et autres
Publié: (2023)
par: Lyu, Yueming, et autres
Publié: (2023)
DiffusionAgent: Navigating Expert Models for Agentic Image Generation
par: Qin, Jie, et autres
Publié: (2024)
par: Qin, Jie, et autres
Publié: (2024)
GOOD: Training-Free Guided Diffusion Sampling for Out-of-Distribution Detection
par: Gao, Xin, et autres
Publié: (2025)
par: Gao, Xin, et autres
Publié: (2025)
Exposing Text-Image Inconsistency Using Diffusion Models
par: Huang, Mingzhen, et autres
Publié: (2024)
par: Huang, Mingzhen, et autres
Publié: (2024)
NOVA: Sparse Control, Dense Synthesis for Pair-Free Video Editing
par: Pan, Tianlin, et autres
Publié: (2026)
par: Pan, Tianlin, et autres
Publié: (2026)
HAMoBE: Hierarchical and Adaptive Mixture of Biometric Experts for Video-based Person ReID
par: Su, Yiyang, et autres
Publié: (2025)
par: Su, Yiyang, et autres
Publié: (2025)
Towards Vision Mixture of Experts for Wildlife Monitoring on the Edge
par: Mensah, Emmanuel Azuh, et autres
Publié: (2024)
par: Mensah, Emmanuel Azuh, et autres
Publié: (2024)
Frequency-Adaptive Pan-Sharpening with Mixture of Experts
par: He, Xuanhua, et autres
Publié: (2024)
par: He, Xuanhua, et autres
Publié: (2024)
UniPaint: Unified Space-time Video Inpainting via Mixture-of-Experts
par: Wan, Zhen, et autres
Publié: (2024)
par: Wan, Zhen, et autres
Publié: (2024)
One-to-More: High-Fidelity Training-Free Anomaly Generation with Attention Control
par: Rao, Haoxiang, et autres
Publié: (2026)
par: Rao, Haoxiang, et autres
Publié: (2026)
MoRE: 3D Visual Geometry Reconstruction Meets Mixture-of-Experts
par: Gao, Jingnan, et autres
Publié: (2025)
par: Gao, Jingnan, et autres
Publié: (2025)
Aria: An Open Multimodal Native Mixture-of-Experts Model
par: Li, Dongxu, et autres
Publié: (2024)
par: Li, Dongxu, et autres
Publié: (2024)
DiffHDR: Re-Exposing LDR Videos with Video Diffusion Models
par: Yu, Zhengming, et autres
Publié: (2026)
par: Yu, Zhengming, et autres
Publié: (2026)
Mixture of Scale Experts for Alignment-free RGBT Video Object Detection and A Unified Benchmark
par: Wang, Qishun, et autres
Publié: (2024)
par: Wang, Qishun, et autres
Publié: (2024)
Video Relationship Detection Using Mixture of Experts
par: Shaabana, Ala, et autres
Publié: (2024)
par: Shaabana, Ala, et autres
Publié: (2024)
VidPrism: Heterogeneous Mixture of Experts for Image-to-Video Transfer
par: Lin, Rui, et autres
Publié: (2026)
par: Lin, Rui, et autres
Publié: (2026)
AvatarBack: Back-Head Generation for Complete 3D Avatars from Front-View Images
par: Xin, Shiqi, et autres
Publié: (2025)
par: Xin, Shiqi, et autres
Publié: (2025)
Exposing AI-generated Videos: A Benchmark Dataset and a Local-and-Global Temporal Defect Based Detection Method
par: He, Peisong, et autres
Publié: (2024)
par: He, Peisong, et autres
Publié: (2024)
T2IShield: Defending Against Backdoors on Text-to-Image Diffusion Models
par: Wang, Zhongqi, et autres
Publié: (2024)
par: Wang, Zhongqi, et autres
Publié: (2024)
Optimize-at-Capture: Highly-adaptive Exposure Controlling for In-Vehicle Non-contact Heart-rate Monitoring
par: Wang, Jieying, et autres
Publié: (2026)
par: Wang, Jieying, et autres
Publié: (2026)
Mixture of Style Experts for Diverse Image Stylization
par: Zhu, Shihao, et autres
Publié: (2026)
par: Zhu, Shihao, et autres
Publié: (2026)
Mixture-of-Experts in Remote Sensing: A Survey
par: Cui, Yongchuan, et autres
Publié: (2026)
par: Cui, Yongchuan, et autres
Publié: (2026)
LoVoRA: Text-guided and Mask-free Video Object Removal and Addition with Learnable Object-aware Localization
par: Xiao, Zhihan, et autres
Publié: (2025)
par: Xiao, Zhihan, et autres
Publié: (2025)
Lifelong Knowledge Editing for Vision Language Models with Low-Rank Mixture-of-Experts
par: Chen, Qizhou, et autres
Publié: (2024)
par: Chen, Qizhou, et autres
Publié: (2024)
Mixture of Low-rank Experts for Transferable AI-Generated Image Detection
par: Liu, Zihan, et autres
Publié: (2024)
par: Liu, Zihan, et autres
Publié: (2024)
Hierarchically Decoupled Mixture-of-Experts for Robust Traffic Sign Recognition in Complex Driving Scenarios
par: Wang, Mingxiao, et autres
Publié: (2026)
par: Wang, Mingxiao, et autres
Publié: (2026)
Sparse-Dense Mixture of Experts Adapter for Multi-Modal Tracking
par: Zhu, Yabin, et autres
Publié: (2026)
par: Zhu, Yabin, et autres
Publié: (2026)
Neural Experts: Mixture of Experts for Implicit Neural Representations
par: Ben-Shabat, Yizhak, et autres
Publié: (2024)
par: Ben-Shabat, Yizhak, et autres
Publié: (2024)
MoE-LLaVA: Mixture of Experts for Large Vision-Language Models
par: Lin, Bin, et autres
Publié: (2024)
par: Lin, Bin, et autres
Publié: (2024)
Fair-MoE: Fairness-Oriented Mixture of Experts in Vision-Language Models
par: Wang, Peiran, et autres
Publié: (2025)
par: Wang, Peiran, et autres
Publié: (2025)
DeltaEdit: Exploring Text-free Training for Text-Driven Image Manipulation
par: Lyu, Yueming, et autres
Publié: (2023)
par: Lyu, Yueming, et autres
Publié: (2023)
Documents similaires
-
An Effective End-to-End Solution for Multimodal Action Recognition
par: Wang, Songping, et autres
Publié: (2025) -
Exploring Adversarial Transferability between Kolmogorov-arnold Networks
par: Wang, Songping, et autres
Publié: (2025) -
RunawayEvil: Jailbreaking the Image-to-Video Generative Models
par: Wang, Songping, et autres
Publié: (2025) -
Fast Adversarial Training with Weak-to-Strong Spatial-Temporal Consistency in the Frequency Domain on Videos
par: Wang, Songping, et autres
Publié: (2025) -
Anti-Aesthetics: Protecting Facial Privacy against Customized Text-to-Image Synthesis
par: Wang, Songping, et autres
Publié: (2025)