Beyond Semantic Priors: Mitigating Optimization Collapse for Generalizable Visual Forensics
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liu, Jipeng, Shi, Haichao, Xing, Siyu, Yin, Rong, Zhang, Xiao-Yu |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Straighter Flow Matching via a Diffusion-Based Coupling Prior
par: Xing, Siyu, et autres
Publié: (2023)
par: Xing, Siyu, et autres
Publié: (2023)
GravCal: Single-Image Calibration of IMU Gravity Priors with Per-Sample Confidence
par: Zhu, Haichao, et autres
Publié: (2026)
par: Zhu, Haichao, et autres
Publié: (2026)
Multimodal Graph Network Modeling for Human-Object Interaction Detection with PDE Graph Diffusion
par: Ji, Wenxuan, et autres
Publié: (2025)
par: Ji, Wenxuan, et autres
Publié: (2025)
When Detectors Forget Forensics: Blocking Semantic Shortcuts for Generalizable AI-Generated Image Detection
par: Shuai, Chao, et autres
Publié: (2026)
par: Shuai, Chao, et autres
Publié: (2026)
Stronger Semantic Encoders Can Harm Relighting Performance: Probing Visual Priors via Augmented Latent Intrinsics
par: Xing, Xiaoyan, et autres
Publié: (2026)
par: Xing, Xiaoyan, et autres
Publié: (2026)
Adaptive Reinforcement for Open-ended Medical Reasoning via Semantic-Guided Reward Collapse Mitigation
par: Liu, Yizhou, et autres
Publié: (2025)
par: Liu, Yizhou, et autres
Publié: (2025)
Cultivating Forensic Reasoning for Generalizable Multimodal Manipulation Detection
par: Zhang, Yuchen, et autres
Publié: (2026)
par: Zhang, Yuchen, et autres
Publié: (2026)
Semantic Segmentation Prior for Diffusion-Based Real-World Super-Resolution
par: Xiao, Jiahua, et autres
Publié: (2024)
par: Xiao, Jiahua, et autres
Publié: (2024)
MiMIC: Mitigating Visual Modality Collapse in Universal Multimodal Retrieval While Avoiding Semantic Misalignment
par: Li, Juan, et autres
Publié: (2026)
par: Li, Juan, et autres
Publié: (2026)
GGTalker: Talking Head Systhesis with Generalizable Gaussian Priors and Identity-Specific Adaptation
par: Hu, Wentao, et autres
Publié: (2025)
par: Hu, Wentao, et autres
Publié: (2025)
Mitigating Mask Prior Drift and Positional Attention Collapse in Large Diffusion Vision-Language Models
par: Hong, Sujung, et autres
Publié: (2026)
par: Hong, Sujung, et autres
Publié: (2026)
Exploiting Diffusion Prior for Generalizable Dense Prediction
par: Lee, Hsin-Ying, et autres
Publié: (2023)
par: Lee, Hsin-Ying, et autres
Publié: (2023)
Mitigating Semantic Collapse in Partially Relevant Video Retrieval
par: Moon, WonJun, et autres
Publié: (2025)
par: Moon, WonJun, et autres
Publié: (2025)
Generalizable Whole Slide Image Classification with Fine-Grained Visual-Semantic Interaction
par: Li, Hao, et autres
Publié: (2024)
par: Li, Hao, et autres
Publié: (2024)
Multimodal Semantic-Aware Automatic Colorization with Diffusion Prior
par: Wang, Han, et autres
Publié: (2024)
par: Wang, Han, et autres
Publié: (2024)
The Devil is in the Statistics: Mitigating and Exploiting Statistics Difference for Generalizable Semi-supervised Medical Image Segmentation
par: Qiu, Muyang, et autres
Publié: (2024)
par: Qiu, Muyang, et autres
Publié: (2024)
SSP-IR: Semantic and Structure Priors for Diffusion-based Realistic Image Restoration
par: Zhang, Yuhong, et autres
Publié: (2024)
par: Zhang, Yuhong, et autres
Publié: (2024)
Every SAM Drop Counts: Embracing Semantic Priors for Multi-Modality Image Fusion and Beyond
par: Wu, Guanyao, et autres
Publié: (2025)
par: Wu, Guanyao, et autres
Publié: (2025)
Pairing Regularization for Mitigating Many-to-One Collapse in GANs
par: Lin, Kuan-Yu, et autres
Publié: (2026)
par: Lin, Kuan-Yu, et autres
Publié: (2026)
Deepfake Forensics Adapter: A Dual-Stream Network for Generalizable Deepfake Detection
par: Liao, Jianfeng, et autres
Publié: (2026)
par: Liao, Jianfeng, et autres
Publié: (2026)
Beyond Visual Cues: Leveraging General Semantics as Support for Few-Shot Segmentation
par: Wang, Jin, et autres
Publié: (2025)
par: Wang, Jin, et autres
Publié: (2025)
Semantics and Content Matter: Towards Multi-Prior Hierarchical Mamba for Image Deraining
par: Yu, Zhaocheng, et autres
Publié: (2025)
par: Yu, Zhaocheng, et autres
Publié: (2025)
Generalizable Non-Line-of-Sight Imaging with Learnable Physical Priors
par: Sun, Shida, et autres
Publié: (2024)
par: Sun, Shida, et autres
Publié: (2024)
Learning What to Trust: Bayesian Prior-Guided Optimization for Visual Generation
par: Liu, Ruiying, et autres
Publié: (2025)
par: Liu, Ruiying, et autres
Publié: (2025)
SCas4D: Structural Cascaded Optimization for Boosting Persistent 4D Novel View Synthesis
par: Lyu, Jipeng, et autres
Publié: (2025)
par: Lyu, Jipeng, et autres
Publié: (2025)
PhysMLE: Generalizable and Priors-Inclusive Multi-task Remote Physiological Measurement
par: Wang, Jiyao, et autres
Publié: (2024)
par: Wang, Jiyao, et autres
Publié: (2024)
Dense Semantic Matching with VGGT Prior
par: Yang, Songlin, et autres
Publié: (2025)
par: Yang, Songlin, et autres
Publié: (2025)
SpeechForensics: Audio-Visual Speech Representation Learning for Face Forgery Detection
par: Liang, Yachao, et autres
Publié: (2025)
par: Liang, Yachao, et autres
Publié: (2025)
CANDLE: Illumination-Invariant Semantic Priors for Color Ambient Lighting Normalization
par: Jian, Rong-Lin, et autres
Publié: (2026)
par: Jian, Rong-Lin, et autres
Publié: (2026)
Advancing Generalizable Remote Physiological Measurement through the Integration of Explicit and Implicit Prior Knowledge
par: Zhang, Yuting, et autres
Publié: (2024)
par: Zhang, Yuting, et autres
Publié: (2024)
Optimizing Diffusion Noise Can Serve As Universal Motion Priors
par: Karunratanakul, Korrawe, et autres
Publié: (2023)
par: Karunratanakul, Korrawe, et autres
Publié: (2023)
DARF: Depth-Aware Generalizable Neural Radiance Field
par: Shi, Yue, et autres
Publié: (2022)
par: Shi, Yue, et autres
Publié: (2022)
Seeing What Matters: Generalizable AI-generated Video Detection with Forensic-Oriented Augmentation
par: Corvi, Riccardo, et autres
Publié: (2025)
par: Corvi, Riccardo, et autres
Publié: (2025)
Mitigating Visual Hallucinations via Semantic Curriculum Preference Optimization in MLLMs
par: Li, Yuanshuai, et autres
Publié: (2025)
par: Li, Yuanshuai, et autres
Publié: (2025)
Personalized Visual Instruction Tuning
par: Pi, Renjie, et autres
Publié: (2024)
par: Pi, Renjie, et autres
Publié: (2024)
HumanSplat: Generalizable Single-Image Human Gaussian Splatting with Structure Priors
par: Pan, Panwang, et autres
Publié: (2024)
par: Pan, Panwang, et autres
Publié: (2024)
Beyond Perceptual Shortcuts: Causal-Inspired Debiasing Optimization for Generalizable Video Reasoning in Lightweight MLLMs
par: Wu, Jingze, et autres
Publié: (2026)
par: Wu, Jingze, et autres
Publié: (2026)
EGFormer: Towards Efficient and Generalizable Multimodal Semantic Segmentation
par: Zhang, Zelin, et autres
Publié: (2025)
par: Zhang, Zelin, et autres
Publié: (2025)
SAILViT: Towards Robust and Generalizable Visual Backbones for MLLMs via Gradual Feature Refinement
par: Yin, Weijie, et autres
Publié: (2025)
par: Yin, Weijie, et autres
Publié: (2025)
Prototypical Progressive Alignment and Reweighting for Generalizable Semantic Segmentation
par: Zhang, Yuhang, et autres
Publié: (2025)
par: Zhang, Yuhang, et autres
Publié: (2025)
Documents similaires
-
Straighter Flow Matching via a Diffusion-Based Coupling Prior
par: Xing, Siyu, et autres
Publié: (2023) -
GravCal: Single-Image Calibration of IMU Gravity Priors with Per-Sample Confidence
par: Zhu, Haichao, et autres
Publié: (2026) -
Multimodal Graph Network Modeling for Human-Object Interaction Detection with PDE Graph Diffusion
par: Ji, Wenxuan, et autres
Publié: (2025) -
When Detectors Forget Forensics: Blocking Semantic Shortcuts for Generalizable AI-Generated Image Detection
par: Shuai, Chao, et autres
Publié: (2026) -
Stronger Semantic Encoders Can Harm Relighting Performance: Probing Visual Priors via Augmented Latent Intrinsics
par: Xing, Xiaoyan, et autres
Publié: (2026)