Vision-Language Feature Alignment for Road Anomaly Segmentation
Fuente:
arXiv
Salvato in:
| Autori principali: | He, Zhuolin, Tang, Jiacheng, Pu, Jian, Xue, Xiangyang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Multi-modality Anomaly Segmentation on the Road
di: Gao, Heng, et al.
Pubblicazione: (2025)
di: Gao, Heng, et al.
Pubblicazione: (2025)
Towards Camera Open-set 3D Object Detection for Autonomous Driving Scenarios
di: He, Zhuolin, et al.
Pubblicazione: (2024)
di: He, Zhuolin, et al.
Pubblicazione: (2024)
Automated Label Unification for Multi-Dataset Semantic Segmentation with GNNs
di: Ma, Rong, et al.
Pubblicazione: (2024)
di: Ma, Rong, et al.
Pubblicazione: (2024)
CausalVAD: De-confounding End-to-End Autonomous Driving via Causal Intervention
di: Tang, Jiacheng, et al.
Pubblicazione: (2026)
di: Tang, Jiacheng, et al.
Pubblicazione: (2026)
DynamicVGGT: Learning Dynamic Point Maps for 4D Scene Reconstruction in Autonomous Driving
di: He, Zhuolin, et al.
Pubblicazione: (2026)
di: He, Zhuolin, et al.
Pubblicazione: (2026)
Detecting OOD Samples via Optimal Transport Scoring Function
di: Gao, Heng, et al.
Pubblicazione: (2025)
di: Gao, Heng, et al.
Pubblicazione: (2025)
Make a Strong Teacher with Label Assistance: A Novel Knowledge Distillation Approach for Semantic Segmentation
di: Qiu, Shoumeng, et al.
Pubblicazione: (2024)
di: Qiu, Shoumeng, et al.
Pubblicazione: (2024)
When Large Vision-Language Models Meet Person Re-Identification
di: Wang, Qizao, et al.
Pubblicazione: (2024)
di: Wang, Qizao, et al.
Pubblicazione: (2024)
Towards Fine-Grained Vision-Language Alignment for Few-Shot Anomaly Detection
di: Fan, Yuanting, et al.
Pubblicazione: (2025)
di: Fan, Yuanting, et al.
Pubblicazione: (2025)
MARE: Multimodal Alignment and Reinforcement for Explainable Deepfake Detection via Vision-Language Models
di: Xu, Wenbo, et al.
Pubblicazione: (2026)
di: Xu, Wenbo, et al.
Pubblicazione: (2026)
Anomaly Object Segmentation with Vision-Language Models for Steel Scrap Recycling
di: Tanaka, Daichi, et al.
Pubblicazione: (2025)
di: Tanaka, Daichi, et al.
Pubblicazione: (2025)
Segment Anything Model for Road Network Graph Extraction
di: Hetang, Congrui, et al.
Pubblicazione: (2024)
di: Hetang, Congrui, et al.
Pubblicazione: (2024)
Bootstrap Fine-Grained Vision-Language Alignment for Unified Zero-Shot Anomaly Localization
di: Deng, Hanqiu, et al.
Pubblicazione: (2023)
di: Deng, Hanqiu, et al.
Pubblicazione: (2023)
Decoupling Scene Perception and Ego Status: A Multi-Context Fusion Approach for Enhanced Generalization in End-to-End Autonomous Driving
di: Tang, Jiacheng, et al.
Pubblicazione: (2025)
di: Tang, Jiacheng, et al.
Pubblicazione: (2025)
Sim-to-Real Transfer via 3D Feature Fields for Vision-and-Language Navigation
di: Wang, Zihan, et al.
Pubblicazione: (2024)
di: Wang, Zihan, et al.
Pubblicazione: (2024)
EAFormer: Scene Text Segmentation with Edge-Aware Transformers
di: Yu, Haiyang, et al.
Pubblicazione: (2024)
di: Yu, Haiyang, et al.
Pubblicazione: (2024)
Instruction-Guided Fusion of Multi-Layer Visual Features in Large Vision-Language Models
di: Li, Xu, et al.
Pubblicazione: (2024)
di: Li, Xu, et al.
Pubblicazione: (2024)
PC-BEV: An Efficient Polar-Cartesian BEV Fusion Framework for LiDAR Semantic Segmentation
di: Qiu, Shoumeng, et al.
Pubblicazione: (2024)
di: Qiu, Shoumeng, et al.
Pubblicazione: (2024)
Bridge Feature Matching and Cross-Modal Alignment with Mutual-filtering for Zero-shot Anomaly Detection
di: Bai, Yuhu, et al.
Pubblicazione: (2025)
di: Bai, Yuhu, et al.
Pubblicazione: (2025)
OoDDINO:A Multi-level Framework for Anomaly Segmentation on Complex Road Scenes
di: Liu, Yuxing, et al.
Pubblicazione: (2025)
di: Liu, Yuxing, et al.
Pubblicazione: (2025)
Latency-aware Road Anomaly Segmentation in Videos: A Photorealistic Dataset and New Metrics
di: Tian, Beiwen, et al.
Pubblicazione: (2024)
di: Tian, Beiwen, et al.
Pubblicazione: (2024)
Improving Neural Surface Reconstruction with Feature Priors from Multi-View Image
di: Ren, Xinlin, et al.
Pubblicazione: (2024)
di: Ren, Xinlin, et al.
Pubblicazione: (2024)
Learning Prompt-Enhanced Context Features for Weakly-Supervised Video Anomaly Detection
di: Pu, Yujiang, et al.
Pubblicazione: (2023)
di: Pu, Yujiang, et al.
Pubblicazione: (2023)
Cascade-CLIP: Cascaded Vision-Language Embeddings Alignment for Zero-Shot Semantic Segmentation
di: Li, Yunheng, et al.
Pubblicazione: (2024)
di: Li, Yunheng, et al.
Pubblicazione: (2024)
PointAlign: Feature-Level Alignment Regularization for 3D Vision-Language Models
di: Su, Yuanhao, et al.
Pubblicazione: (2026)
di: Su, Yuanhao, et al.
Pubblicazione: (2026)
Efficient Vision Language Model Fine-tuning for Text-based Person Anomaly Search
di: He, Jiayi, et al.
Pubblicazione: (2025)
di: He, Jiayi, et al.
Pubblicazione: (2025)
Anomaly Detection by Adapting a pre-trained Vision Language Model
di: Cai, Yuxuan, et al.
Pubblicazione: (2024)
di: Cai, Yuxuan, et al.
Pubblicazione: (2024)
Global Semantic-Guided Sub-image Feature Weight Allocation in High-Resolution Large Vision-Language Models
di: Liang, Yuxuan, et al.
Pubblicazione: (2025)
di: Liang, Yuxuan, et al.
Pubblicazione: (2025)
All Roads Lead to Rome: Incentivizing Divergent Thinking in Vision-Language Models
di: Tian, Xinyu, et al.
Pubblicazione: (2026)
di: Tian, Xinyu, et al.
Pubblicazione: (2026)
Enhancing Road Crack Detection Accuracy with BsS-YOLO: Optimizing Feature Fusion and Attention Mechanisms
di: Tang, Jiaze, et al.
Pubblicazione: (2024)
di: Tang, Jiaze, et al.
Pubblicazione: (2024)
HLGFA: High-Low Resolution Guided Feature Alignment for Unsupervised Anomaly Detection
di: Zhou, Han, et al.
Pubblicazione: (2026)
di: Zhou, Han, et al.
Pubblicazione: (2026)
Language-Guided Open-World Anomaly Segmentation
di: Reichard, Klara, et al.
Pubblicazione: (2025)
di: Reichard, Klara, et al.
Pubblicazione: (2025)
Beyond Cross-Modal Alignment: Measuring and Leveraging Modality Gap in Vision-Language Models
di: Yan, Hanqi, et al.
Pubblicazione: (2025)
di: Yan, Hanqi, et al.
Pubblicazione: (2025)
HERO: Rethinking Visual Token Early Dropping in High-Resolution Large Vision-Language Models
di: Li, Xu, et al.
Pubblicazione: (2025)
di: Li, Xu, et al.
Pubblicazione: (2025)
Segmentation-Based Attention Entropy: Detecting and Mitigating Object Hallucinations in Large Vision-Language Models
di: Song, Jiale, et al.
Pubblicazione: (2026)
di: Song, Jiale, et al.
Pubblicazione: (2026)
AGC: Adaptive Geodesic Correction for Adversarial Robustness on Vision-Language Models
di: Li, Zhiwei, et al.
Pubblicazione: (2026)
di: Li, Zhiwei, et al.
Pubblicazione: (2026)
Learning Global Representation from Queries for Vectorized HD Map Construction
di: Qiu, Shoumeng, et al.
Pubblicazione: (2025)
di: Qiu, Shoumeng, et al.
Pubblicazione: (2025)
Decomposed Vision-Language Alignment for Fine-Grained Open-Vocabulary Segmentation
di: Wang, Chenhao, et al.
Pubblicazione: (2026)
di: Wang, Chenhao, et al.
Pubblicazione: (2026)
When Language Overwrites Vision: Over-Alignment and Geometric Debiasing in Vision-Language Models
di: Saini, Harshvardhan, et al.
Pubblicazione: (2026)
di: Saini, Harshvardhan, et al.
Pubblicazione: (2026)
EAVL: Explicitly Align Vision and Language for Referring Image Segmentation
di: Yan, Yichen, et al.
Pubblicazione: (2023)
di: Yan, Yichen, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Multi-modality Anomaly Segmentation on the Road
di: Gao, Heng, et al.
Pubblicazione: (2025) -
Towards Camera Open-set 3D Object Detection for Autonomous Driving Scenarios
di: He, Zhuolin, et al.
Pubblicazione: (2024) -
Automated Label Unification for Multi-Dataset Semantic Segmentation with GNNs
di: Ma, Rong, et al.
Pubblicazione: (2024) -
CausalVAD: De-confounding End-to-End Autonomous Driving via Causal Intervention
di: Tang, Jiacheng, et al.
Pubblicazione: (2026) -
DynamicVGGT: Learning Dynamic Point Maps for 4D Scene Reconstruction in Autonomous Driving
di: He, Zhuolin, et al.
Pubblicazione: (2026)