Seeing is Believing: Robust Vision-Guided Cross-Modal Prompt Learning under Label Noise
Fuente:
arXiv
Guardado en:
| Autores principales: | Geng, Zibin, Jiang, Xuefeng, Li, Jia, Li, Zheng, Wen, Tian, Wu, Lvhua, Sun, Sheng, Wang, Yuwei, Liu, Min |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
ZoFia: Zero-Shot Fake News Detection with Entity-Guided Retrieval and Multi-LLM Interaction
por: Wu, Lvhua, et al.
Publicado: (2025)
por: Wu, Lvhua, et al.
Publicado: (2025)
Robust Federated Learning against Noisy Clients via Masked Optimization
por: Jiang, Xuefeng, et al.
Publicado: (2025)
por: Jiang, Xuefeng, et al.
Publicado: (2025)
Investigating Large Language Models for Code Vulnerability Detection: An Experimental Study
por: Jiang, Xuefeng, et al.
Publicado: (2024)
por: Jiang, Xuefeng, et al.
Publicado: (2024)
FNBench: Benchmarking Robust Federated Learning against Noisy Labels
por: Jiang, Xuefeng, et al.
Publicado: (2025)
por: Jiang, Xuefeng, et al.
Publicado: (2025)
Seeing is Believing? Enhancing Vision-Language Navigation using Visual Perturbations
por: Zhang, Xuesong, et al.
Publicado: (2024)
por: Zhang, Xuesong, et al.
Publicado: (2024)
Tackling Noisy Clients in Federated Learning with End-to-end Label Correction
por: Jiang, Xuefeng, et al.
Publicado: (2024)
por: Jiang, Xuefeng, et al.
Publicado: (2024)
Intrinsic Gradient Suppression for Label-Noise Prompt Tuning in Vision-Language Models
por: Li, Jiayu, et al.
Publicado: (2026)
por: Li, Jiayu, et al.
Publicado: (2026)
Tuning Vision-Language Models with Candidate Labels by Prompt Alignment
por: Zhang, Zhifang, et al.
Publicado: (2024)
por: Zhang, Zhifang, et al.
Publicado: (2024)
Seeing is Believing: Mitigating Hallucination in Large Vision-Language Models via CLIP-Guided Decoding
por: Deng, Ailin, et al.
Publicado: (2024)
por: Deng, Ailin, et al.
Publicado: (2024)
Seeing is not Believing: An Identity Hider for Human Vision Privacy Protection
por: Wang, Tao, et al.
Publicado: (2023)
por: Wang, Tao, et al.
Publicado: (2023)
Building-Guided Pseudo-Label Learning for Cross-Modal Building Damage Mapping
por: Li, Jiepan, et al.
Publicado: (2025)
por: Li, Jiepan, et al.
Publicado: (2025)
Progressive Prompt-Guided Cross-Modal Reasoning for Referring Image Segmentation
por: Li, Jiachen, et al.
Publicado: (2026)
por: Li, Jiachen, et al.
Publicado: (2026)
Seeing is Believing: Vision-driven Non-crash Functional Bug Detection for Mobile Apps
por: Liu, Zhe, et al.
Publicado: (2024)
por: Liu, Zhe, et al.
Publicado: (2024)
NLPrompt: Noise-Label Prompt Learning for Vision-Language Models
por: Pan, Bikang, et al.
Publicado: (2024)
por: Pan, Bikang, et al.
Publicado: (2024)
Believing without Seeing: Quality Scores for Contextualizing Vision-Language Model Explanations
por: He, Keyu, et al.
Publicado: (2025)
por: He, Keyu, et al.
Publicado: (2025)
Seeing Isn't Believing: Uncovering Blind Spots in Evaluator Vision-Language Models
por: Khan, Mohammed Safi Ur Rahman, et al.
Publicado: (2026)
por: Khan, Mohammed Safi Ur Rahman, et al.
Publicado: (2026)
Robust Self-Paced Hashing for Cross-Modal Retrieval with Noisy Labels
por: Pu, Ruitao, et al.
Publicado: (2025)
por: Pu, Ruitao, et al.
Publicado: (2025)
Segment-to-Act: Label-Noise-Robust Action-Prompted Video Segmentation Towards Embodied Intelligence
por: Li, Wenxin, et al.
Publicado: (2025)
por: Li, Wenxin, et al.
Publicado: (2025)
Seeing Is Believing: The Role of Videoconferencing in Distance Learning
por: Martin, Marie
Publicado: (2005)
por: Martin, Marie
Publicado: (2005)
CCSD: Cross-Modal Compositional Self-Distillation for Robust Brain Tumor Segmentation with Missing Modalities
por: Xie, Dongqing, et al.
Publicado: (2025)
por: Xie, Dongqing, et al.
Publicado: (2025)
Robust Prompt Tuning for Vision-Language Models with Mild Semantic Noise
por: Gao, Yansheng, et al.
Publicado: (2025)
por: Gao, Yansheng, et al.
Publicado: (2025)
Diffusion-Based Cross-Modal Feature Extraction for Multi-Label Classification
por: Lan, Tian, et al.
Publicado: (2025)
por: Lan, Tian, et al.
Publicado: (2025)
Holistic Optimal Label Selection for Robust Prompt Learning under Partial Labels
por: Zhao, Yaqi, et al.
Publicado: (2026)
por: Zhao, Yaqi, et al.
Publicado: (2026)
Knowledge Distillation in Federated Edge Learning: A Survey
por: Wu, Zhiyuan, et al.
Publicado: (2023)
por: Wu, Zhiyuan, et al.
Publicado: (2023)
Beyond Seeing Is Believing: On Crowdsourced Detection of Audiovisual Deepfakes
por: Soprano, Michael, et al.
Publicado: (2026)
por: Soprano, Michael, et al.
Publicado: (2026)
Is Seeing Believing? Evaluating Human Sensitivity to Synthetic Video
por: Wegmann, David, et al.
Publicado: (2026)
por: Wegmann, David, et al.
Publicado: (2026)
Seeing is Believing? Mitigating OCR Hallucinations in Multimodal Large Language Models
por: He, Zhentao, et al.
Publicado: (2025)
por: He, Zhentao, et al.
Publicado: (2025)
Seeing is Believing (and Predicting): Context-Aware Multi-Human Behavior Prediction with Vision Language Models
por: Panchal, Utsav, et al.
Publicado: (2025)
por: Panchal, Utsav, et al.
Publicado: (2025)
Seeing is Believing, but How Much? A Comprehensive Analysis of Verbalized Calibration in Vision-Language Models
por: Xuan, Weihao, et al.
Publicado: (2025)
por: Xuan, Weihao, et al.
Publicado: (2025)
Seeing is Believing: Rich-Context Hallucination Detection for MLLMs via Backward Visual Grounding
por: Guo, Pinxue, et al.
Publicado: (2025)
por: Guo, Pinxue, et al.
Publicado: (2025)
Multi-Prompt with Depth Partitioned Cross-Modal Learning
por: Tian, Yingjie, et al.
Publicado: (2023)
por: Tian, Yingjie, et al.
Publicado: (2023)
Cross-Modal Bottleneck Fusion For Noise Robust Audio-Visual Speech Recognition
por: Ok, Seaone, et al.
Publicado: (2026)
por: Ok, Seaone, et al.
Publicado: (2026)
Feature-Label Modal Alignment for Robust Partial Multi-Label Learning
por: Chen, Yu, et al.
Publicado: (2026)
por: Chen, Yu, et al.
Publicado: (2026)
Inaccurate Label Distribution Learning with Dependency Noise
por: Kou, Zhiqiang, et al.
Publicado: (2024)
por: Kou, Zhiqiang, et al.
Publicado: (2024)
Beyond Unimodal Shortcuts: MLLMs as Cross-Modal Reasoners for Grounded Named Entity Recognition
por: Ma, Jinlong, et al.
Publicado: (2026)
por: Ma, Jinlong, et al.
Publicado: (2026)
Learning to Retrieve with Weakened Labels: Robust Training under Label Noise
por: Sharma, Arnab
Publicado: (2025)
por: Sharma, Arnab
Publicado: (2025)
Seeing Isn't Believing: Mitigating Belief Inertia via Active Intervention in Embodied Agents
por: Wang, Hanlin, et al.
Publicado: (2026)
por: Wang, Hanlin, et al.
Publicado: (2026)
Believing is Seeing: Unobserved Object Detection using Generative Models
por: Bhattacharjee, Subhransu S., et al.
Publicado: (2024)
por: Bhattacharjee, Subhransu S., et al.
Publicado: (2024)
RED: Robust Event-Guided Motion Deblurring with Modality-Specific Disentanglement
por: Leng, Yihong, et al.
Publicado: (2025)
por: Leng, Yihong, et al.
Publicado: (2025)
Robust Deep Hawkes Process under Label Noise of Both Event and Occurrence
por: Tan, Xiaoyu, et al.
Publicado: (2024)
por: Tan, Xiaoyu, et al.
Publicado: (2024)
Ejemplares similares
-
ZoFia: Zero-Shot Fake News Detection with Entity-Guided Retrieval and Multi-LLM Interaction
por: Wu, Lvhua, et al.
Publicado: (2025) -
Robust Federated Learning against Noisy Clients via Masked Optimization
por: Jiang, Xuefeng, et al.
Publicado: (2025) -
Investigating Large Language Models for Code Vulnerability Detection: An Experimental Study
por: Jiang, Xuefeng, et al.
Publicado: (2024) -
FNBench: Benchmarking Robust Federated Learning against Noisy Labels
por: Jiang, Xuefeng, et al.
Publicado: (2025) -
Seeing is Believing? Enhancing Vision-Language Navigation using Visual Perturbations
por: Zhang, Xuesong, et al.
Publicado: (2024)