Component-Based Out-of-Distribution Detection
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liu, Wenrui, Chang, Hong, Hou, Ruibing, Shan, Shiguang, Chen, Xilin |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Revisiting Logit Distributions for Reliable Out-of-Distribution Detection
par: Liang, Jiachen, et autres
Publié: (2025)
par: Liang, Jiachen, et autres
Publié: (2025)
DIVE: Inverting Conditional Diffusion Models for Discriminative Tasks
par: Li, Yinqi, et autres
Publié: (2025)
par: Li, Yinqi, et autres
Publié: (2025)
UniPose: A Unified Multimodal Framework for Human Pose Comprehension, Generation and Editing
par: Li, Yiheng, et autres
Publié: (2024)
par: Li, Yiheng, et autres
Publié: (2024)
un$^2$CLIP: Improving CLIP's Visual Detail Capturing Ability via Inverting unCLIP
par: Li, Yinqi, et autres
Publié: (2025)
par: Li, Yinqi, et autres
Publié: (2025)
UMFC: Unsupervised Multi-Domain Feature Calibration for Vision-Language Models
par: Liang, Jiachen, et autres
Publié: (2024)
par: Liang, Jiachen, et autres
Publié: (2024)
Rethinking the Evaluation of Out-of-Distribution Detection: A Sorites Paradox
par: Long, Xingming, et autres
Publié: (2024)
par: Long, Xingming, et autres
Publié: (2024)
Semantic or Covariate? A Study on the Intractable Case of Out-of-Distribution Detection
par: Long, Xingming, et autres
Publié: (2024)
par: Long, Xingming, et autres
Publié: (2024)
Generalized Semi-Supervised Learning via Self-Supervised Feature Adaptation
par: Liang, Jiachen, et autres
Publié: (2024)
par: Liang, Jiachen, et autres
Publié: (2024)
Clothes-Changing Person Re-Identification with Feasibility-Aware Intermediary Matching
par: Zhao, Jiahe, et autres
Publié: (2024)
par: Zhao, Jiahe, et autres
Publié: (2024)
MotionVerse: A Unified Multimodal Framework for Motion Comprehension, Generation and Editing
par: Hou, Ruibing, et autres
Publié: (2025)
par: Hou, Ruibing, et autres
Publié: (2025)
HIS-GPT: Towards 3D Human-In-Scene Multimodal Understanding
par: Zhao, Jiahe, et autres
Publié: (2025)
par: Zhao, Jiahe, et autres
Publié: (2025)
RefHCM: A Unified Model for Referring Perceptions in Human-Centric Scenarios
par: Huang, Jie, et autres
Publié: (2024)
par: Huang, Jie, et autres
Publié: (2024)
EgoMotion: Hierarchical Reasoning and Diffusion for Egocentric Vision-Language Motion Generation
par: Hou, Ruibing, et autres
Publié: (2026)
par: Hou, Ruibing, et autres
Publié: (2026)
HERM: Benchmarking and Enhancing Multimodal LLMs for Human-Centric Understanding
par: Li, Keliang, et autres
Publié: (2024)
par: Li, Keliang, et autres
Publié: (2024)
CLIP-Guided Adaptable Self-Supervised Learning for Human-Centric Visual Tasks
par: Luo, Mingshuang, et autres
Publié: (2026)
par: Luo, Mingshuang, et autres
Publié: (2026)
M$^3$GPT: An Advanced Multimodal, Multitask Framework for Motion Comprehension and Generation
par: Luo, Mingshuang, et autres
Publié: (2024)
par: Luo, Mingshuang, et autres
Publié: (2024)
Dynamic Attention Analysis for Backdoor Detection in Text-to-Image Diffusion Models
par: Wang, Zhongqi, et autres
Publié: (2025)
par: Wang, Zhongqi, et autres
Publié: (2025)
Assimilation Matters: Model-level Backdoor Detection in Vision-Language Pretrained Models
par: Wang, Zhongqi, et autres
Publié: (2025)
par: Wang, Zhongqi, et autres
Publié: (2025)
AnyMo: Scaling Any-Modality Conditional Motion Generation with Masked Modeling
par: Li, Yiheng, et autres
Publié: (2026)
par: Li, Yiheng, et autres
Publié: (2026)
HumanPCR: Probing MLLM Capabilities in Diverse Human-Centric Scenes
par: Li, Keliang, et autres
Publié: (2025)
par: Li, Keliang, et autres
Publié: (2025)
EntropyScan: Towards Model-level Backdoor Detection in LVLMs via Visual Attention Entropy
par: Ge, Xuanyu, et autres
Publié: (2026)
par: Ge, Xuanyu, et autres
Publié: (2026)
GLip: A Global-Local Integrated Progressive Framework for Robust Visual Speech Recognition
par: Wang, Tianyue, et autres
Publié: (2025)
par: Wang, Tianyue, et autres
Publié: (2025)
CtrLoRA: An Extensible and Efficient Framework for Controllable Image Generation
par: Xu, Yifeng, et autres
Publié: (2024)
par: Xu, Yifeng, et autres
Publié: (2024)
VOPE: Revisiting Hallucination of Vision-Language Models in Voluntary Imagination Task
par: Long, Xingming, et autres
Publié: (2025)
par: Long, Xingming, et autres
Publié: (2025)
T2IShield: Defending Against Backdoors on Text-to-Image Diffusion Models
par: Wang, Zhongqi, et autres
Publié: (2024)
par: Wang, Zhongqi, et autres
Publié: (2024)
FullLoRA: Efficiently Boosting the Robustness of Pretrained Vision Transformers
par: Yuan, Zheng, et autres
Publié: (2024)
par: Yuan, Zheng, et autres
Publié: (2024)
Trigger without Trace: Towards Stealthy Backdoor Attack on Text-to-Image Diffusion Models
par: Zhang, Jie, et autres
Publié: (2025)
par: Zhang, Jie, et autres
Publié: (2025)
Contrastive Spectral Rectification: Test-Time Defense towards Zero-shot Adversarial Robustness of CLIP
par: Nie, Sen, et autres
Publié: (2026)
par: Nie, Sen, et autres
Publié: (2026)
ACT Now: Preempting LVLM Hallucinations via Adaptive Context Integration
par: Yan, Bei, et autres
Publié: (2026)
par: Yan, Bei, et autres
Publié: (2026)
Neural Gate: Mitigating Privacy Risks in LVLMs via Neuron-Level Gradient Gating
par: Cao, Xiangkui, et autres
Publié: (2026)
par: Cao, Xiangkui, et autres
Publié: (2026)
EfficientMT: Efficient Temporal Adaptation for Motion Transfer in Text-to-Video Diffusion Models
par: Cai, Yufei, et autres
Publié: (2025)
par: Cai, Yufei, et autres
Publié: (2025)
Towards Robust Semantic Segmentation against Patch-based Attack via Attention Refinement
par: Yuan, Zheng, et autres
Publié: (2024)
par: Yuan, Zheng, et autres
Publié: (2024)
V-Attack: Targeting Disentangled Value Features for Controllable Adversarial Attacks on LVLMs
par: Nie, Sen, et autres
Publié: (2025)
par: Nie, Sen, et autres
Publié: (2025)
Task-adaptive Q-Face
par: Sun, Haomiao, et autres
Publié: (2024)
par: Sun, Haomiao, et autres
Publié: (2024)
Contrastive Learning of Person-independent Representations for Facial Action Unit Detection
par: Li, Yong, et autres
Publié: (2024)
par: Li, Yong, et autres
Publié: (2024)
ProtInvTree: Deliberate Protein Inverse Folding with Reward-guided Tree Search
par: Liu, Mengdi, et autres
Publié: (2025)
par: Liu, Mengdi, et autres
Publié: (2025)
MM-MoralBench: A MultiModal Moral Evaluation Benchmark for Large Vision-Language Models
par: Yan, Bei, et autres
Publié: (2024)
par: Yan, Bei, et autres
Publié: (2024)
What Makes VLMs Robust? Towards Reconciling Robustness and Accuracy in Vision-Language Models
par: Nie, Sen, et autres
Publié: (2026)
par: Nie, Sen, et autres
Publié: (2026)
HPNet: Dynamic Trajectory Forecasting with Historical Prediction Attention
par: Tang, Xiaolong, et autres
Publié: (2024)
par: Tang, Xiaolong, et autres
Publié: (2024)
T2VAttack: Adversarial Attack on Text-to-Video Diffusion Models
par: Li, Changzhen, et autres
Publié: (2025)
par: Li, Changzhen, et autres
Publié: (2025)
Documents similaires
-
Revisiting Logit Distributions for Reliable Out-of-Distribution Detection
par: Liang, Jiachen, et autres
Publié: (2025) -
DIVE: Inverting Conditional Diffusion Models for Discriminative Tasks
par: Li, Yinqi, et autres
Publié: (2025) -
UniPose: A Unified Multimodal Framework for Human Pose Comprehension, Generation and Editing
par: Li, Yiheng, et autres
Publié: (2024) -
un$^2$CLIP: Improving CLIP's Visual Detail Capturing Ability via Inverting unCLIP
par: Li, Yinqi, et autres
Publié: (2025) -
UMFC: Unsupervised Multi-Domain Feature Calibration for Vision-Language Models
par: Liang, Jiachen, et autres
Publié: (2024)