SalFoM: Dynamic Saliency Prediction with Video Foundation Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Moradi, Morteza, Moradi, Mohammad, Rundo, Francesco, Spampinato, Concetto, Borji, Ali, Palazzo, Simone |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Transformer-based Video Saliency Prediction with High Temporal Dimension Decoding
por: Moradi, Morteza, et al.
Publicado: (2024)
por: Moradi, Morteza, et al.
Publicado: (2024)
Global-Local Feature Decoding with Adapter-Guided SAMv2 for Salient Object Detection
por: Moradi, Morteza, et al.
Publicado: (2026)
por: Moradi, Morteza, et al.
Publicado: (2026)
MatFuse: Controllable Material Generation with Diffusion Models
por: Vecchio, Giuseppe, et al.
Publicado: (2023)
por: Vecchio, Giuseppe, et al.
Publicado: (2023)
AIM 2024 Challenge on Video Saliency Prediction: Methods and Results
por: Moskalenko, Andrey, et al.
Publicado: (2024)
por: Moskalenko, Andrey, et al.
Publicado: (2024)
Diffexplainer: Towards Cross-modal Global Explanations with Diffusion Models
por: Pennisi, Matteo, et al.
Publicado: (2024)
por: Pennisi, Matteo, et al.
Publicado: (2024)
Brain-Grasp: Graph-based Saliency Priors for Improved fMRI-based Visual Brain Decoding
por: Moradi, Mohammad, et al.
Publicado: (2026)
por: Moradi, Mohammad, et al.
Publicado: (2026)
A Compact Deep Architecture for Real-time Saliency Prediction
por: Zabihi, Saman, et al.
Publicado: (2020)
por: Zabihi, Saman, et al.
Publicado: (2020)
SeeingSounds: Learning Audio-to-Visual Alignment via Text
por: Carnemolla, Simone, et al.
Publicado: (2025)
por: Carnemolla, Simone, et al.
Publicado: (2025)
Evidential Federated Learning for Skin Lesion Image Classification
por: Hendrix, Rutger, et al.
Publicado: (2024)
por: Hendrix, Rutger, et al.
Publicado: (2024)
Selective Attention-based Modulation for Continual Learning
por: Bellitto, Giovanni, et al.
Publicado: (2024)
por: Bellitto, Giovanni, et al.
Publicado: (2024)
DiffSal: Joint Audio and Video Learning for Diffusion Saliency Prediction
por: Xiong, Junwen, et al.
Publicado: (2024)
por: Xiong, Junwen, et al.
Publicado: (2024)
PERL: Parameter Efficient Reasoning in CLIP Latent Space
por: Carnemolla, Simone, et al.
Publicado: (2026)
por: Carnemolla, Simone, et al.
Publicado: (2026)
Wake-Sleep Consolidated Learning
por: Sorrenti, Amelia, et al.
Publicado: (2023)
por: Sorrenti, Amelia, et al.
Publicado: (2023)
DEXTER: Diffusion-Guided EXplanations with TExtual Reasoning for Vision Models
por: Carnemolla, Simone, et al.
Publicado: (2025)
por: Carnemolla, Simone, et al.
Publicado: (2025)
Self-supervised learning for radio-astronomy source classification: a benchmark
por: Cecconello, Thomas, et al.
Publicado: (2024)
por: Cecconello, Thomas, et al.
Publicado: (2024)
UNBOX: Unveiling Black-box visual models with Natural-language
por: Carnemolla, Simone, et al.
Publicado: (2026)
por: Carnemolla, Simone, et al.
Publicado: (2026)
Qualitative Failures of Image Generation Models and Their Application in Detecting Deepfakes
por: Borji, Ali
Publicado: (2023)
por: Borji, Ali
Publicado: (2023)
Addressing a fundamental limitation in deep vision models: lack of spatial attention
por: Borji, Ali
Publicado: (2024)
por: Borji, Ali
Publicado: (2024)
GC-KBVQA: A New Four-Stage Framework for Enhancing Knowledge Based Visual Question Answering Performance
por: Moradi, Mohammad Mahdi, et al.
Publicado: (2025)
por: Moradi, Mohammad Mahdi, et al.
Publicado: (2025)
ViASNet: A Video Ad Saliency Network for Predicting Dynamic Saliency and Viewer Engagement
por: Ye, Jianping, et al.
Publicado: (2026)
por: Ye, Jianping, et al.
Publicado: (2026)
SalFAU-Net: Saliency Fusion Attention U-Net for Salient Object Detection
por: Mulat, Kassaw Abraham, et al.
Publicado: (2024)
por: Mulat, Kassaw Abraham, et al.
Publicado: (2024)
DTFSal: Audio-Visual Dynamic Token Fusion for Video Saliency Prediction
por: Hooshanfar, Kiana, et al.
Publicado: (2025)
por: Hooshanfar, Kiana, et al.
Publicado: (2025)
SalM$^{2}$: An Extremely Lightweight Saliency Mamba Model for Real-Time Cognitive Awareness of Driver Attention
por: Zhao, Chunyu, et al.
Publicado: (2025)
por: Zhao, Chunyu, et al.
Publicado: (2025)
Text-Audio-Visual-conditioned Diffusion Model for Video Saliency Prediction
por: Yu, Li, et al.
Publicado: (2025)
por: Yu, Li, et al.
Publicado: (2025)
Zero-Shot Decentralized Federated Learning
por: Masano, Alessio, et al.
Publicado: (2025)
por: Masano, Alessio, et al.
Publicado: (2025)
ViSAGE @ NTIRE 2026 Challenge on Video Saliency Prediction
por: Wang, Kun, et al.
Publicado: (2026)
por: Wang, Kun, et al.
Publicado: (2026)
Relevance-guided Audio Visual Fusion for Video Saliency Prediction
por: Yu, Li, et al.
Publicado: (2024)
por: Yu, Li, et al.
Publicado: (2024)
Forecasting Future Anatomies: Longitudinal Brain Mri-to-Mri Prediction
por: Farki, Ali, et al.
Publicado: (2025)
por: Farki, Ali, et al.
Publicado: (2025)
Follow the Saliency: Supervised Saliency for Retrieval-augmented Dense Video Captioning
por: Choi, Seung hee, et al.
Publicado: (2026)
por: Choi, Seung hee, et al.
Publicado: (2026)
Flow Mismatching: Unsupervised Anomaly Detection via Velocity Discrepancies in Flow Matching Models
por: Chen, Shengzhe, et al.
Publicado: (2026)
por: Chen, Shengzhe, et al.
Publicado: (2026)
Viewport Prediction for Volumetric Video Streaming by Exploring Video Saliency and Trajectory Information
por: Li, Jie, et al.
Publicado: (2023)
por: Li, Jie, et al.
Publicado: (2023)
Spherical Vision Transformers for Audio-Visual Saliency Prediction in 360-Degree Videos
por: Cokelek, Mert, et al.
Publicado: (2025)
por: Cokelek, Mert, et al.
Publicado: (2025)
A Psychophysically Oriented Saliency Map Prediction Model
por: Li, Qiang
Publicado: (2020)
por: Li, Qiang
Publicado: (2020)
QuantFormer: Learning to Quantize for Neural Activity Forecasting in Mouse Visual Cortex
por: Calcagno, Salvatore, et al.
Publicado: (2024)
por: Calcagno, Salvatore, et al.
Publicado: (2024)
Minimalistic Video Saliency Prediction via Efficient Decoder & Spatio Temporal Action Cues
por: Girmaji, Rohit, et al.
Publicado: (2025)
por: Girmaji, Rohit, et al.
Publicado: (2025)
SalNAS: Efficient Saliency-prediction Neural Architecture Search with self-knowledge distillation
por: Termritthikun, Chakkrit, et al.
Publicado: (2024)
por: Termritthikun, Chakkrit, et al.
Publicado: (2024)
FodFoM: Fake Outlier Data by Foundation Models Creates Stronger Visual Out-of-Distribution Detector
por: Chen, Jiankang, et al.
Publicado: (2024)
por: Chen, Jiankang, et al.
Publicado: (2024)
FoMo: Multi-Modal, Multi-Scale and Multi-Task Remote Sensing Foundation Models for Forest Monitoring
por: Bountos, Nikolaos Ioannis, et al.
Publicado: (2023)
por: Bountos, Nikolaos Ioannis, et al.
Publicado: (2023)
CaRDiff: Video Salient Object Ranking Chain of Thought Reasoning for Saliency Prediction with Diffusion
por: Tang, Yolo Yunlong, et al.
Publicado: (2024)
por: Tang, Yolo Yunlong, et al.
Publicado: (2024)
VMDT: Decoding the Trustworthiness of Video Foundation Models
por: Potter, Yujin, et al.
Publicado: (2025)
por: Potter, Yujin, et al.
Publicado: (2025)
Ejemplares similares
-
Transformer-based Video Saliency Prediction with High Temporal Dimension Decoding
por: Moradi, Morteza, et al.
Publicado: (2024) -
Global-Local Feature Decoding with Adapter-Guided SAMv2 for Salient Object Detection
por: Moradi, Morteza, et al.
Publicado: (2026) -
MatFuse: Controllable Material Generation with Diffusion Models
por: Vecchio, Giuseppe, et al.
Publicado: (2023) -
AIM 2024 Challenge on Video Saliency Prediction: Methods and Results
por: Moskalenko, Andrey, et al.
Publicado: (2024) -
Diffexplainer: Towards Cross-modal Global Explanations with Diffusion Models
por: Pennisi, Matteo, et al.
Publicado: (2024)