Saliency-R1: Enforcing Interpretable and Faithful Vision-language Reasoning via Saliency-map Alignment Reward
Fuente:
arXiv
Saved in:
| Main Authors: | Gong, Shizhan, Hu, Minda, Zhang, Qiyuan, Ma, Chen, Dou, Qi |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Kernel-based Unsupervised Embedding Alignment for Enhanced Visual Representation in Vision-language Models
by: Gong, Shizhan, et al.
Published: (2025)
by: Gong, Shizhan, et al.
Published: (2025)
Structured Gradient-based Interpretations via Norm-Regularized Adversarial Training
by: Gong, Shizhan, et al.
Published: (2024)
by: Gong, Shizhan, et al.
Published: (2024)
Saliency-R1: Incentivizing Unified Saliency Reasoning Capability in MLLM with Confidence-Guided Reinforcement Learning
by: Li, Long, et al.
Published: (2025)
by: Li, Long, et al.
Published: (2025)
Concepts from Representations: Post-hoc Concept Bottleneck Models via Sparse Decomposition of Visual Representations
by: Gong, Shizhan, et al.
Published: (2026)
by: Gong, Shizhan, et al.
Published: (2026)
A Super-pixel-based Approach to the Stable Interpretation of Neural Networks
by: Gong, Shizhan, et al.
Published: (2024)
by: Gong, Shizhan, et al.
Published: (2024)
Salience DETR: Enhancing Detection Transformer with Hierarchical Salience Filtering Refinement
by: Hou, Xiuquan, et al.
Published: (2024)
by: Hou, Xiuquan, et al.
Published: (2024)
AIM: Adversarial Information Masking for Faithfulness Evaluation of Saliency Maps
by: Hsieh, Chia-Ying, et al.
Published: (2026)
by: Hsieh, Chia-Ying, et al.
Published: (2026)
Follow the Saliency: Supervised Saliency for Retrieval-augmented Dense Video Captioning
by: Choi, Seung hee, et al.
Published: (2026)
by: Choi, Seung hee, et al.
Published: (2026)
Saliency-Aware Automatic Buddhas Statue Recognition
by: Qi, Yong, et al.
Published: (2024)
by: Qi, Yong, et al.
Published: (2024)
Increasing Interpretability of Neural Networks By Approximating Human Visual Saliency
by: Boyd, Aidan, et al.
Published: (2024)
by: Boyd, Aidan, et al.
Published: (2024)
Smooth Deep Saliency
by: Herdt, Rudolf, et al.
Published: (2024)
by: Herdt, Rudolf, et al.
Published: (2024)
Grains of Saliency: Optimizing Saliency-based Training of Biometric Attack Detection Models
by: Crum, Colton R., et al.
Published: (2024)
by: Crum, Colton R., et al.
Published: (2024)
Salience-SGG: Enhancing Unbiased Scene Graph Generation with Iterative Salience Estimation
by: Qu, Runfeng, et al.
Published: (2026)
by: Qu, Runfeng, et al.
Published: (2026)
VLMQ: Token Saliency-Driven Post-Training Quantization for Vision-language Models
by: Xue, Yufei, et al.
Published: (2025)
by: Xue, Yufei, et al.
Published: (2025)
SaliencyDecor: Enhancing Neural Network Interpretability through Feature Decorrelation
by: Karkehabadi, Ali, et al.
Published: (2026)
by: Karkehabadi, Ali, et al.
Published: (2026)
ViASNet: A Video Ad Saliency Network for Predicting Dynamic Saliency and Viewer Engagement
by: Ye, Jianping, et al.
Published: (2026)
by: Ye, Jianping, et al.
Published: (2026)
Split-Fuse-Transport: Annotation-Free Saliency via Dual Clustering and Optimal Transport Alignment
by: Ramzan, Muhammad Umer, et al.
Published: (2025)
by: Ramzan, Muhammad Umer, et al.
Published: (2025)
Hallucination Begins Where Saliency Drops
by: Zhang, Xiaofeng, et al.
Published: (2026)
by: Zhang, Xiaofeng, et al.
Published: (2026)
Saliency Methods are Encoders: Analysing Logical Relations Towards Interpretation
by: Schwenke, Leonid, et al.
Published: (2024)
by: Schwenke, Leonid, et al.
Published: (2024)
FaceSaliencyAug: Mitigating Geographic, Gender and Stereotypical Biases via Saliency-Based Data Augmentation
by: Kumar, Teerath, et al.
Published: (2024)
by: Kumar, Teerath, et al.
Published: (2024)
Robust Saliency-Aware Distillation for Few-shot Fine-grained Visual Recognition
by: Liu, Haiqi, et al.
Published: (2023)
by: Liu, Haiqi, et al.
Published: (2023)
Data Augmentation via Latent Diffusion for Saliency Prediction
by: Aydemir, Bahar, et al.
Published: (2024)
by: Aydemir, Bahar, et al.
Published: (2024)
Finding Visual Saliency in Continuous Spike Stream
by: Zhu, Lin, et al.
Published: (2024)
by: Zhu, Lin, et al.
Published: (2024)
Exploring Saliency Bias in Manipulation Detection
by: Krinsky, Joshua, et al.
Published: (2024)
by: Krinsky, Joshua, et al.
Published: (2024)
SAGE: Saliency-Guided Contrastive Embeddings
by: Crum, Colton R., et al.
Published: (2025)
by: Crum, Colton R., et al.
Published: (2025)
Saliency Guided Optimization of Diffusion Latents
by: Wang, Xiwen, et al.
Published: (2024)
by: Wang, Xiwen, et al.
Published: (2024)
SHINE: Saliency-aware HIerarchical NEgative Ranking for Compositional Temporal Grounding
by: Cheng, Zixu, et al.
Published: (2024)
by: Cheng, Zixu, et al.
Published: (2024)
Saliency Map-based Image Retrieval using Invariant Krawtchouk Moments
by: Nejad, Ashkan, et al.
Published: (2024)
by: Nejad, Ashkan, et al.
Published: (2024)
Spherical Vision Transformers for Audio-Visual Saliency Prediction in 360-Degree Videos
by: Cokelek, Mert, et al.
Published: (2025)
by: Cokelek, Mert, et al.
Published: (2025)
Saliency-Aware Model Merging
by: Park, Jungin, et al.
Published: (2026)
by: Park, Jungin, et al.
Published: (2026)
ViSAGE @ NTIRE 2026 Challenge on Video Saliency Prediction
by: Wang, Kun, et al.
Published: (2026)
by: Wang, Kun, et al.
Published: (2026)
Graphical Perception of Saliency-based Model Explanations
by: Zhao, Yayan, et al.
Published: (2024)
by: Zhao, Yayan, et al.
Published: (2024)
VST++: Efficient and Stronger Visual Saliency Transformer
by: Liu, Nian, et al.
Published: (2023)
by: Liu, Nian, et al.
Published: (2023)
Aesthetic Image Captioning with Saliency Enhanced MLLMs
by: Tao, Yilin, et al.
Published: (2025)
by: Tao, Yilin, et al.
Published: (2025)
GazeFusion: Saliency-Guided Image Generation
by: Zhang, Yunxiang, et al.
Published: (2024)
by: Zhang, Yunxiang, et al.
Published: (2024)
Saliency Driven Imagery Preprocessing for Efficient Compression -- Industrial Paper
by: Downes, Justin, et al.
Published: (2026)
by: Downes, Justin, et al.
Published: (2026)
DiSa: Directional Saliency-Aware Prompt Learning for Generalizable Vision-Language Models
by: Talemi, Niloufar Alipour, et al.
Published: (2025)
by: Talemi, Niloufar Alipour, et al.
Published: (2025)
ConsensusDrop: Fusing Visual and Cross-Modal Saliency for Efficient Vision Language Models
by: Parikh, Dhruv, et al.
Published: (2026)
by: Parikh, Dhruv, et al.
Published: (2026)
Spectrum-oriented Point-supervised Saliency Detector for Hyperspectral Images
by: Liu, Peifu, et al.
Published: (2024)
by: Liu, Peifu, et al.
Published: (2024)
ORSIFlow: Saliency-Guided Rectified Flow for Optical Remote Sensing Salient Object Detection
by: Chen, Haojing, et al.
Published: (2026)
by: Chen, Haojing, et al.
Published: (2026)
Similar Items
-
Kernel-based Unsupervised Embedding Alignment for Enhanced Visual Representation in Vision-language Models
by: Gong, Shizhan, et al.
Published: (2025) -
Structured Gradient-based Interpretations via Norm-Regularized Adversarial Training
by: Gong, Shizhan, et al.
Published: (2024) -
Saliency-R1: Incentivizing Unified Saliency Reasoning Capability in MLLM with Confidence-Guided Reinforcement Learning
by: Li, Long, et al.
Published: (2025) -
Concepts from Representations: Post-hoc Concept Bottleneck Models via Sparse Decomposition of Visual Representations
by: Gong, Shizhan, et al.
Published: (2026) -
A Super-pixel-based Approach to the Stable Interpretation of Neural Networks
by: Gong, Shizhan, et al.
Published: (2024)