Fast Adversarial Training with Weak-to-Strong Spatial-Temporal Consistency in the Frequency Domain on Videos
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Songping, Liu, Hanqing, Lyu, Yueming, Hu, Xiantao, He, Ziwen, Wang, Wei, Shan, Caifeng, Wang, Liang |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
An Effective End-to-End Solution for Multimodal Action Recognition
par: Wang, Songping, et autres
Publié: (2025)
par: Wang, Songping, et autres
Publié: (2025)
Exploring Adversarial Transferability between Kolmogorov-arnold Networks
par: Wang, Songping, et autres
Publié: (2025)
par: Wang, Songping, et autres
Publié: (2025)
Exposing and Defending the Achilles' Heel of Video Mixture-of-Experts
par: Wang, Songping, et autres
Publié: (2026)
par: Wang, Songping, et autres
Publié: (2026)
RunawayEvil: Jailbreaking the Image-to-Video Generative Models
par: Wang, Songping, et autres
Publié: (2025)
par: Wang, Songping, et autres
Publié: (2025)
Anti-Aesthetics: Protecting Facial Privacy against Customized Text-to-Image Synthesis
par: Wang, Songping, et autres
Publié: (2025)
par: Wang, Songping, et autres
Publié: (2025)
GOOD: Training-Free Guided Diffusion Sampling for Out-of-Distribution Detection
par: Gao, Xin, et autres
Publié: (2025)
par: Gao, Xin, et autres
Publié: (2025)
Adversarially Masked Video Consistency for Unsupervised Domain Adaptation
par: Zhu, Xiaoyu, et autres
Publié: (2024)
par: Zhu, Xiaoyu, et autres
Publié: (2024)
Low-Light Video Enhancement via Spatial-Temporal Consistent Decomposition
par: Xu, Xiaogang, et autres
Publié: (2024)
par: Xu, Xiaogang, et autres
Publié: (2024)
Evaluating Adversarial Robustness in the Spatial Frequency Domain
par: Liao, Keng-Hsin, et autres
Publié: (2024)
par: Liao, Keng-Hsin, et autres
Publié: (2024)
Diffusion4D: Fast Spatial-temporal Consistent 4D Generation via Video Diffusion Models
par: Liang, Hanwen, et autres
Publié: (2024)
par: Liang, Hanwen, et autres
Publié: (2024)
Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency
par: Wang, Yutong, et autres
Publié: (2024)
par: Wang, Yutong, et autres
Publié: (2024)
One-to-More: High-Fidelity Training-Free Anomaly Generation with Attention Control
par: Rao, Haoxiang, et autres
Publié: (2026)
par: Rao, Haoxiang, et autres
Publié: (2026)
VideoDetective: Clue Hunting via both Extrinsic Query and Intrinsic Relevance for Long Video Understanding
par: Yang, Ruoliu, et autres
Publié: (2026)
par: Yang, Ruoliu, et autres
Publié: (2026)
ABounD: Adversarial Boundary-Driven Few-Shot Learning for Multi-Class Anomaly Detection
par: Deng, Runzhi, et autres
Publié: (2025)
par: Deng, Runzhi, et autres
Publié: (2025)
Consistent Human Image and Video Generation with Spatially Conditioned Diffusion
par: Cao, Mingdeng, et autres
Publié: (2024)
par: Cao, Mingdeng, et autres
Publié: (2024)
Uncertainty-Aware Concept and Motion Segmentation for Semi-Supervised Angiography Videos
par: Luo, Yu, et autres
Publié: (2026)
par: Luo, Yu, et autres
Publié: (2026)
NormalCrafter: Learning Temporally Consistent Normals from Video Diffusion Priors
par: Bin, Yanrui, et autres
Publié: (2025)
par: Bin, Yanrui, et autres
Publié: (2025)
Leveraging Information Consistency in Frequency and Spatial Domain for Adversarial Attacks
par: Jin, Zhibo, et autres
Publié: (2024)
par: Jin, Zhibo, et autres
Publié: (2024)
Salt: Self-Consistent Distribution Matching with Cache-Aware Training for Fast Video Generation
par: Ge, Xingtong, et autres
Publié: (2026)
par: Ge, Xingtong, et autres
Publié: (2026)
Frequency-Guided Diffusion Model with Perturbation Training for Skeleton-Based Video Anomaly Detection
par: Tan, Xiaofeng, et autres
Publié: (2024)
par: Tan, Xiaofeng, et autres
Publié: (2024)
Optimize-at-Capture: Highly-adaptive Exposure Controlling for In-Vehicle Non-contact Heart-rate Monitoring
par: Wang, Jieying, et autres
Publié: (2026)
par: Wang, Jieying, et autres
Publié: (2026)
Spatial-Frequency Discriminability for Revealing Adversarial Perturbations
par: Wang, Chao, et autres
Publié: (2023)
par: Wang, Chao, et autres
Publié: (2023)
FastInit: Fast Noise Initialization for Temporally Consistent Video Generation
par: Bai, Chengyu, et autres
Publié: (2025)
par: Bai, Chengyu, et autres
Publié: (2025)
DeltaSpace: A Semantic-aligned Feature Space for Flexible Text-guided Image Editing
par: Lyu, Yueming, et autres
Publié: (2023)
par: Lyu, Yueming, et autres
Publié: (2023)
Spatial-Temporal Decoupled Reference Conditioning for Identity-Preserving Text-to-Video Generation
par: Chen, Yuheng, et autres
Publié: (2026)
par: Chen, Yuheng, et autres
Publié: (2026)
Self-Supervised Representation Learning with Spatial-Temporal Consistency for Sign Language Recognition
par: Zhao, Weichao, et autres
Publié: (2024)
par: Zhao, Weichao, et autres
Publié: (2024)
VideoCompressa: Data-Efficient Video Understanding via Joint Temporal Compression and Spatial Reconstruction
par: Wang, Shaobo, et autres
Publié: (2025)
par: Wang, Shaobo, et autres
Publié: (2025)
InstaVSR: Taming Diffusion for Efficient and Temporally Consistent Video Super-Resolution
par: Hu, Jintong, et autres
Publié: (2026)
par: Hu, Jintong, et autres
Publié: (2026)
PosterCopilot: Toward Layout Reasoning and Controllable Editing for Professional Graphic Design
par: Wei, Jiazhe, et autres
Publié: (2025)
par: Wei, Jiazhe, et autres
Publié: (2025)
Temporal-Consistent Video Restoration with Pre-trained Diffusion Models
par: Wang, Hengkang, et autres
Publié: (2025)
par: Wang, Hengkang, et autres
Publié: (2025)
Robust Alignment: Harmonizing Clean Accuracy and Adversarial Robustness in Adversarial Training
par: Wang, Yanyun, et autres
Publié: (2026)
par: Wang, Yanyun, et autres
Publié: (2026)
VideoLoom: A Video Large Language Model for Joint Spatial-Temporal Understanding
par: Shi, Jiapeng, et autres
Publié: (2026)
par: Shi, Jiapeng, et autres
Publié: (2026)
Counterfactual Explanations for Face Forgery Detection via Adversarial Removal of Artifacts
par: Li, Yang, et autres
Publié: (2024)
par: Li, Yang, et autres
Publié: (2024)
Self-Attentive Spatio-Temporal Calibration for Precise Intermediate Layer Matching in ANN-to-SNN Distillation
par: Hong, Di, et autres
Publié: (2025)
par: Hong, Di, et autres
Publié: (2025)
Weak to Strong: VLM-Based Pseudo-Labeling as a Weakly Supervised Training Strategy in Multimodal Video-based Hidden Emotion Understanding Tasks
par: Wang, Yufei, et autres
Publié: (2026)
par: Wang, Yufei, et autres
Publié: (2026)
DirectSwap: Mask-Free Cross-Identity Training and Benchmarking for Expression-Consistent Video Head Swapping
par: Wang, Yanan, et autres
Publié: (2025)
par: Wang, Yanan, et autres
Publié: (2025)
VideoLifter: Lifting Videos to 3D with Fast Hierarchical Stereo Alignment
par: Cong, Wenyan, et autres
Publié: (2025)
par: Cong, Wenyan, et autres
Publié: (2025)
Video Forgery Detection with Optical Flow Residuals and Spatial-Temporal Consistency
par: Xue, Xi, et autres
Publié: (2025)
par: Xue, Xi, et autres
Publié: (2025)
Mixture of Weak & Strong Experts on Graphs
par: Zeng, Hanqing, et autres
Publié: (2023)
par: Zeng, Hanqing, et autres
Publié: (2023)
Trans-defense: Transformer-based Denoiser for Adversarial Defense with Spatial-Frequency Domain Representation
par: Pramanick, Alik, et autres
Publié: (2025)
par: Pramanick, Alik, et autres
Publié: (2025)
Documents similaires
-
An Effective End-to-End Solution for Multimodal Action Recognition
par: Wang, Songping, et autres
Publié: (2025) -
Exploring Adversarial Transferability between Kolmogorov-arnold Networks
par: Wang, Songping, et autres
Publié: (2025) -
Exposing and Defending the Achilles' Heel of Video Mixture-of-Experts
par: Wang, Songping, et autres
Publié: (2026) -
RunawayEvil: Jailbreaking the Image-to-Video Generative Models
par: Wang, Songping, et autres
Publié: (2025) -
Anti-Aesthetics: Protecting Facial Privacy against Customized Text-to-Image Synthesis
par: Wang, Songping, et autres
Publié: (2025)