Saliency-R1: Enforcing Interpretable and Faithful Vision-language Reasoning via Saliency-map Alignment Reward
Fuente:
arXiv
Salvato in:
| Autori principali: | Gong, Shizhan, Hu, Minda, Zhang, Qiyuan, Ma, Chen, Dou, Qi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Kernel-based Unsupervised Embedding Alignment for Enhanced Visual Representation in Vision-language Models
di: Gong, Shizhan, et al.
Pubblicazione: (2025)
di: Gong, Shizhan, et al.
Pubblicazione: (2025)
Structured Gradient-based Interpretations via Norm-Regularized Adversarial Training
di: Gong, Shizhan, et al.
Pubblicazione: (2024)
di: Gong, Shizhan, et al.
Pubblicazione: (2024)
Saliency-R1: Incentivizing Unified Saliency Reasoning Capability in MLLM with Confidence-Guided Reinforcement Learning
di: Li, Long, et al.
Pubblicazione: (2025)
di: Li, Long, et al.
Pubblicazione: (2025)
Concepts from Representations: Post-hoc Concept Bottleneck Models via Sparse Decomposition of Visual Representations
di: Gong, Shizhan, et al.
Pubblicazione: (2026)
di: Gong, Shizhan, et al.
Pubblicazione: (2026)
A Super-pixel-based Approach to the Stable Interpretation of Neural Networks
di: Gong, Shizhan, et al.
Pubblicazione: (2024)
di: Gong, Shizhan, et al.
Pubblicazione: (2024)
Salience DETR: Enhancing Detection Transformer with Hierarchical Salience Filtering Refinement
di: Hou, Xiuquan, et al.
Pubblicazione: (2024)
di: Hou, Xiuquan, et al.
Pubblicazione: (2024)
AIM: Adversarial Information Masking for Faithfulness Evaluation of Saliency Maps
di: Hsieh, Chia-Ying, et al.
Pubblicazione: (2026)
di: Hsieh, Chia-Ying, et al.
Pubblicazione: (2026)
Follow the Saliency: Supervised Saliency for Retrieval-augmented Dense Video Captioning
di: Choi, Seung hee, et al.
Pubblicazione: (2026)
di: Choi, Seung hee, et al.
Pubblicazione: (2026)
Saliency-Aware Automatic Buddhas Statue Recognition
di: Qi, Yong, et al.
Pubblicazione: (2024)
di: Qi, Yong, et al.
Pubblicazione: (2024)
Increasing Interpretability of Neural Networks By Approximating Human Visual Saliency
di: Boyd, Aidan, et al.
Pubblicazione: (2024)
di: Boyd, Aidan, et al.
Pubblicazione: (2024)
Smooth Deep Saliency
di: Herdt, Rudolf, et al.
Pubblicazione: (2024)
di: Herdt, Rudolf, et al.
Pubblicazione: (2024)
Grains of Saliency: Optimizing Saliency-based Training of Biometric Attack Detection Models
di: Crum, Colton R., et al.
Pubblicazione: (2024)
di: Crum, Colton R., et al.
Pubblicazione: (2024)
Salience-SGG: Enhancing Unbiased Scene Graph Generation with Iterative Salience Estimation
di: Qu, Runfeng, et al.
Pubblicazione: (2026)
di: Qu, Runfeng, et al.
Pubblicazione: (2026)
VLMQ: Token Saliency-Driven Post-Training Quantization for Vision-language Models
di: Xue, Yufei, et al.
Pubblicazione: (2025)
di: Xue, Yufei, et al.
Pubblicazione: (2025)
SaliencyDecor: Enhancing Neural Network Interpretability through Feature Decorrelation
di: Karkehabadi, Ali, et al.
Pubblicazione: (2026)
di: Karkehabadi, Ali, et al.
Pubblicazione: (2026)
ViASNet: A Video Ad Saliency Network for Predicting Dynamic Saliency and Viewer Engagement
di: Ye, Jianping, et al.
Pubblicazione: (2026)
di: Ye, Jianping, et al.
Pubblicazione: (2026)
Split-Fuse-Transport: Annotation-Free Saliency via Dual Clustering and Optimal Transport Alignment
di: Ramzan, Muhammad Umer, et al.
Pubblicazione: (2025)
di: Ramzan, Muhammad Umer, et al.
Pubblicazione: (2025)
Hallucination Begins Where Saliency Drops
di: Zhang, Xiaofeng, et al.
Pubblicazione: (2026)
di: Zhang, Xiaofeng, et al.
Pubblicazione: (2026)
Saliency Methods are Encoders: Analysing Logical Relations Towards Interpretation
di: Schwenke, Leonid, et al.
Pubblicazione: (2024)
di: Schwenke, Leonid, et al.
Pubblicazione: (2024)
FaceSaliencyAug: Mitigating Geographic, Gender and Stereotypical Biases via Saliency-Based Data Augmentation
di: Kumar, Teerath, et al.
Pubblicazione: (2024)
di: Kumar, Teerath, et al.
Pubblicazione: (2024)
Robust Saliency-Aware Distillation for Few-shot Fine-grained Visual Recognition
di: Liu, Haiqi, et al.
Pubblicazione: (2023)
di: Liu, Haiqi, et al.
Pubblicazione: (2023)
Data Augmentation via Latent Diffusion for Saliency Prediction
di: Aydemir, Bahar, et al.
Pubblicazione: (2024)
di: Aydemir, Bahar, et al.
Pubblicazione: (2024)
Finding Visual Saliency in Continuous Spike Stream
di: Zhu, Lin, et al.
Pubblicazione: (2024)
di: Zhu, Lin, et al.
Pubblicazione: (2024)
Exploring Saliency Bias in Manipulation Detection
di: Krinsky, Joshua, et al.
Pubblicazione: (2024)
di: Krinsky, Joshua, et al.
Pubblicazione: (2024)
SAGE: Saliency-Guided Contrastive Embeddings
di: Crum, Colton R., et al.
Pubblicazione: (2025)
di: Crum, Colton R., et al.
Pubblicazione: (2025)
Saliency Guided Optimization of Diffusion Latents
di: Wang, Xiwen, et al.
Pubblicazione: (2024)
di: Wang, Xiwen, et al.
Pubblicazione: (2024)
SHINE: Saliency-aware HIerarchical NEgative Ranking for Compositional Temporal Grounding
di: Cheng, Zixu, et al.
Pubblicazione: (2024)
di: Cheng, Zixu, et al.
Pubblicazione: (2024)
Saliency Map-based Image Retrieval using Invariant Krawtchouk Moments
di: Nejad, Ashkan, et al.
Pubblicazione: (2024)
di: Nejad, Ashkan, et al.
Pubblicazione: (2024)
Spherical Vision Transformers for Audio-Visual Saliency Prediction in 360-Degree Videos
di: Cokelek, Mert, et al.
Pubblicazione: (2025)
di: Cokelek, Mert, et al.
Pubblicazione: (2025)
Saliency-Aware Model Merging
di: Park, Jungin, et al.
Pubblicazione: (2026)
di: Park, Jungin, et al.
Pubblicazione: (2026)
ViSAGE @ NTIRE 2026 Challenge on Video Saliency Prediction
di: Wang, Kun, et al.
Pubblicazione: (2026)
di: Wang, Kun, et al.
Pubblicazione: (2026)
Graphical Perception of Saliency-based Model Explanations
di: Zhao, Yayan, et al.
Pubblicazione: (2024)
di: Zhao, Yayan, et al.
Pubblicazione: (2024)
VST++: Efficient and Stronger Visual Saliency Transformer
di: Liu, Nian, et al.
Pubblicazione: (2023)
di: Liu, Nian, et al.
Pubblicazione: (2023)
Aesthetic Image Captioning with Saliency Enhanced MLLMs
di: Tao, Yilin, et al.
Pubblicazione: (2025)
di: Tao, Yilin, et al.
Pubblicazione: (2025)
GazeFusion: Saliency-Guided Image Generation
di: Zhang, Yunxiang, et al.
Pubblicazione: (2024)
di: Zhang, Yunxiang, et al.
Pubblicazione: (2024)
Saliency Driven Imagery Preprocessing for Efficient Compression -- Industrial Paper
di: Downes, Justin, et al.
Pubblicazione: (2026)
di: Downes, Justin, et al.
Pubblicazione: (2026)
DiSa: Directional Saliency-Aware Prompt Learning for Generalizable Vision-Language Models
di: Talemi, Niloufar Alipour, et al.
Pubblicazione: (2025)
di: Talemi, Niloufar Alipour, et al.
Pubblicazione: (2025)
ConsensusDrop: Fusing Visual and Cross-Modal Saliency for Efficient Vision Language Models
di: Parikh, Dhruv, et al.
Pubblicazione: (2026)
di: Parikh, Dhruv, et al.
Pubblicazione: (2026)
Spectrum-oriented Point-supervised Saliency Detector for Hyperspectral Images
di: Liu, Peifu, et al.
Pubblicazione: (2024)
di: Liu, Peifu, et al.
Pubblicazione: (2024)
ORSIFlow: Saliency-Guided Rectified Flow for Optical Remote Sensing Salient Object Detection
di: Chen, Haojing, et al.
Pubblicazione: (2026)
di: Chen, Haojing, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Kernel-based Unsupervised Embedding Alignment for Enhanced Visual Representation in Vision-language Models
di: Gong, Shizhan, et al.
Pubblicazione: (2025) -
Structured Gradient-based Interpretations via Norm-Regularized Adversarial Training
di: Gong, Shizhan, et al.
Pubblicazione: (2024) -
Saliency-R1: Incentivizing Unified Saliency Reasoning Capability in MLLM with Confidence-Guided Reinforcement Learning
di: Li, Long, et al.
Pubblicazione: (2025) -
Concepts from Representations: Post-hoc Concept Bottleneck Models via Sparse Decomposition of Visual Representations
di: Gong, Shizhan, et al.
Pubblicazione: (2026) -
A Super-pixel-based Approach to the Stable Interpretation of Neural Networks
di: Gong, Shizhan, et al.
Pubblicazione: (2024)