LAMM-ViT: AI Face Detection via Layer-Aware Modulation of Region-Guided Attention
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Jiangling, Zhu, Weijie, Huang, Jirui, Chen, Yaxiong |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Detecting AI-Generated Forgeries via Iterative Manifold Deviation Amplification
par: Zhang, Jiangling, et autres
Publié: (2026)
par: Zhang, Jiangling, et autres
Publié: (2026)
Alias-Free ViT: Fractional Shift Invariance via Linear Attention
par: Michaeli, Hagay, et autres
Publié: (2025)
par: Michaeli, Hagay, et autres
Publié: (2025)
ViT-FIQA: Assessing Face Image Quality using Vision Transformers
par: Atzori, Andrea, et autres
Publié: (2025)
par: Atzori, Andrea, et autres
Publié: (2025)
Modulating CNN Features with Pre-Trained ViT Representations for Open-Vocabulary Object Detection
par: Gao, Xiangyu, et autres
Publié: (2025)
par: Gao, Xiangyu, et autres
Publié: (2025)
I&S-ViT: An Inclusive & Stable Method for Pushing the Limit of Post-Training ViTs Quantization
par: Zhong, Yunshan, et autres
Publié: (2023)
par: Zhong, Yunshan, et autres
Publié: (2023)
ViT-AdaLA: Adapting Vision Transformers with Linear Attention
par: Li, Yifan, et autres
Publié: (2026)
par: Li, Yifan, et autres
Publié: (2026)
Castling-ViT: Compressing Self-Attention via Switching Towards Linear-Angular Attention at Vision Transformer Inference
par: You, Haoran, et autres
Publié: (2022)
par: You, Haoran, et autres
Publié: (2022)
Exploring Plain ViT Reconstruction for Multi-class Unsupervised Anomaly Detection
par: Zhang, Jiangning, et autres
Publié: (2023)
par: Zhang, Jiangning, et autres
Publié: (2023)
RepViT: Revisiting Mobile CNN From ViT Perspective
par: Wang, Ao, et autres
Publié: (2023)
par: Wang, Ao, et autres
Publié: (2023)
DC-ViT: Modulating Spatial and Channel Interactions for Multi-Channel Images
par: Marikkar, Umar, et autres
Publié: (2026)
par: Marikkar, Umar, et autres
Publié: (2026)
Deeper Inside Deep ViT
par: Hong, Sungrae
Publié: (2025)
par: Hong, Sungrae
Publié: (2025)
EA-ViT: Efficient Adaptation for Elastic Vision Transformer
par: Zhu, Chen, et autres
Publié: (2025)
par: Zhu, Chen, et autres
Publié: (2025)
OSR-ViT: A Simple and Modular Framework for Open-Set Object Detection and Discovery
par: Inkawhich, Matthew, et autres
Publié: (2024)
par: Inkawhich, Matthew, et autres
Publié: (2024)
MSCViT: A Small-size ViT architecture with Multi-Scale Self-Attention Mechanism for Tiny Datasets
par: Zhang, Bowei, et autres
Publié: (2025)
par: Zhang, Bowei, et autres
Publié: (2025)
How to train your ViT for OOD Detection
par: Mueller, Maximilian, et autres
Publié: (2024)
par: Mueller, Maximilian, et autres
Publié: (2024)
ViT-5: Vision Transformers for The Mid-2020s
par: Wang, Feng, et autres
Publié: (2026)
par: Wang, Feng, et autres
Publié: (2026)
Harnessing the Computation Redundancy in ViTs to Boost Adversarial Transferability
par: Liu, Jiani, et autres
Publié: (2025)
par: Liu, Jiani, et autres
Publié: (2025)
AFIDAF: Alternating Fourier and Image Domain Adaptive Filters as an Efficient Alternative to Attention in ViTs
par: Zheng, Yunling, et autres
Publié: (2024)
par: Zheng, Yunling, et autres
Publié: (2024)
ViT$^3$: Unlocking Test-Time Training in Vision
par: Han, Dongchen, et autres
Publié: (2025)
par: Han, Dongchen, et autres
Publié: (2025)
Rethinking Random Masking in Self-Distillation on ViT
par: Seong, Jihyeon, et autres
Publié: (2025)
par: Seong, Jihyeon, et autres
Publié: (2025)
YOLO-Former: YOLO Shakes Hand With ViT
par: Khoramdel, Javad, et autres
Publié: (2024)
par: Khoramdel, Javad, et autres
Publié: (2024)
Your ViT is Secretly an Image Segmentation Model
par: Kerssies, Tommie, et autres
Publié: (2025)
par: Kerssies, Tommie, et autres
Publié: (2025)
DeS3: Adaptive Attention-driven Self and Soft Shadow Removal using ViT Similarity
par: Jin, Yeying, et autres
Publié: (2022)
par: Jin, Yeying, et autres
Publié: (2022)
Dynamic Tuning Towards Parameter and Inference Efficiency for ViT Adaptation
par: Zhao, Wangbo, et autres
Publié: (2024)
par: Zhao, Wangbo, et autres
Publié: (2024)
LogitDynamics: Reliable ViT Error Detection from Layerwise Logit Trajectories
par: Beigelman, Ido, et autres
Publié: (2026)
par: Beigelman, Ido, et autres
Publié: (2026)
STRAP-ViT: Segregated Tokens with Randomized -- Transformations for Defense against Adversarial Patches in ViTs
par: Chattopadhyay, Nandish, et autres
Publié: (2026)
par: Chattopadhyay, Nandish, et autres
Publié: (2026)
APHQ-ViT: Post-Training Quantization with Average Perturbation Hessian Based Reconstruction for Vision Transformers
par: Wu, Zhuguanyu, et autres
Publié: (2025)
par: Wu, Zhuguanyu, et autres
Publié: (2025)
Let ViT Speak: Generative Language-Image Pre-training
par: Fang, Yan, et autres
Publié: (2026)
par: Fang, Yan, et autres
Publié: (2026)
ColLab: A Collaborative Spatial Progressive Data Engine for Referring Expression Comprehension and Generation
par: Zhang, Shilan, et autres
Publié: (2025)
par: Zhang, Shilan, et autres
Publié: (2025)
PRANCE: Joint Token-Optimization and Structural Channel-Pruning for Adaptive ViT Inference
par: Li, Ye, et autres
Publié: (2024)
par: Li, Ye, et autres
Publié: (2024)
U-REPA: Aligning Diffusion U-Nets to ViTs
par: Tian, Yuchuan, et autres
Publié: (2025)
par: Tian, Yuchuan, et autres
Publié: (2025)
ViTCAE: ViT-based Class-conditioned Autoencoder
par: Jebraeeli, Vahid, et autres
Publié: (2025)
par: Jebraeeli, Vahid, et autres
Publié: (2025)
SAC-ViT: Semantic-Aware Clustering Vision Transformer with Early Exit
par: Hu, Youbing, et autres
Publié: (2025)
par: Hu, Youbing, et autres
Publié: (2025)
Layer by layer, module by module: Choose both for optimal OOD probing of ViT
par: Odonnat, Ambroise, et autres
Publié: (2026)
par: Odonnat, Ambroise, et autres
Publié: (2026)
Motion Aware ViT-based Framework for Monocular 6-DoF Spacecraft Pose Estimation
par: Sosa, Jose, et autres
Publié: (2025)
par: Sosa, Jose, et autres
Publié: (2025)
Vanilla ViT for Automotive Point Cloud Semantic Segmentation
par: Puy, Gilles, et autres
Publié: (2026)
par: Puy, Gilles, et autres
Publié: (2026)
Applying ViT in Generalized Few-shot Semantic Segmentation
par: Geng, Liyuan, et autres
Publié: (2024)
par: Geng, Liyuan, et autres
Publié: (2024)
One-Shot Multilingual Font Generation Via ViT
par: Wang, Zhiheng, et autres
Publié: (2024)
par: Wang, Zhiheng, et autres
Publié: (2024)
ACC-ViT : Atrous Convolution's Comeback in Vision Transformers
par: Ibtehaz, Nabil, et autres
Publié: (2024)
par: Ibtehaz, Nabil, et autres
Publié: (2024)
ViT-DD: Multi-Task Vision Transformer for Semi-Supervised Driver Distraction Detection
par: Ma, Yunsheng, et autres
Publié: (2022)
par: Ma, Yunsheng, et autres
Publié: (2022)
Documents similaires
-
Detecting AI-Generated Forgeries via Iterative Manifold Deviation Amplification
par: Zhang, Jiangling, et autres
Publié: (2026) -
Alias-Free ViT: Fractional Shift Invariance via Linear Attention
par: Michaeli, Hagay, et autres
Publié: (2025) -
ViT-FIQA: Assessing Face Image Quality using Vision Transformers
par: Atzori, Andrea, et autres
Publié: (2025) -
Modulating CNN Features with Pre-Trained ViT Representations for Open-Vocabulary Object Detection
par: Gao, Xiangyu, et autres
Publié: (2025) -
I&S-ViT: An Inclusive & Stable Method for Pushing the Limit of Post-Training ViTs Quantization
par: Zhong, Yunshan, et autres
Publié: (2023)