Using Saliency and Cropping to Improve Video Memorability
Fuente:
arXiv
Salvato in:
| Autori principali: | Mudgal, Vaibhav, Wang, Qingyang, Sweeney, Lorin, Smeaton, Alan F. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Generative Outpainting To Enhance the Memorability of Short-Form Videos
di: Byju, Alan, et al.
Pubblicazione: (2024)
di: Byju, Alan, et al.
Pubblicazione: (2024)
Efficient Object-centric Representation Learning with Pre-trained Geometric Prior
di: Khac, Phúc H. Le, et al.
Pubblicazione: (2024)
di: Khac, Phúc H. Le, et al.
Pubblicazione: (2024)
Viewport Prediction for Volumetric Video Streaming by Exploring Video Saliency and Trajectory Information
di: Li, Jie, et al.
Pubblicazione: (2023)
di: Li, Jie, et al.
Pubblicazione: (2023)
VideoMem: Constructing, Analyzing, Predicting Short-term and Long-term Video Memorability
di: Cohendet, Romain, et al.
Pubblicazione: (2018)
di: Cohendet, Romain, et al.
Pubblicazione: (2018)
Transformer-based Video Saliency Prediction with High Temporal Dimension Decoding
di: Moradi, Morteza, et al.
Pubblicazione: (2024)
di: Moradi, Morteza, et al.
Pubblicazione: (2024)
SpikeMba: Multi-Modal Spiking Saliency Mamba for Temporal Video Grounding
di: Li, Wenrui, et al.
Pubblicazione: (2024)
di: Li, Wenrui, et al.
Pubblicazione: (2024)
Variable Rate Image Compression via N-Gram Context based Swin-transformer
di: Mudgal, Priyanka
Pubblicazione: (2025)
di: Mudgal, Priyanka
Pubblicazione: (2025)
Enhancing Learned Image Compression via Cross Window-based Attention
di: Mudgal, Priyanka, et al.
Pubblicazione: (2024)
di: Mudgal, Priyanka, et al.
Pubblicazione: (2024)
GMFVAD: Using Grained Multi-modal Feature to Improve Video Anomaly Detection
di: Dai, Guangyu, et al.
Pubblicazione: (2025)
di: Dai, Guangyu, et al.
Pubblicazione: (2025)
2D or 3D: Who Governs Salience in VLA Models? -- Tri-Stage Token Pruning Framework with Modality Salience Awareness
di: Zheng, Zihao, et al.
Pubblicazione: (2026)
di: Zheng, Zihao, et al.
Pubblicazione: (2026)
SOSControl: Enhancing Human Motion Generation through Saliency-Aware Symbolic Orientation and Timing Control
di: Au, Ho Yin, et al.
Pubblicazione: (2025)
di: Au, Ho Yin, et al.
Pubblicazione: (2025)
Robust Mesh Saliency Ground Truth Acquisition in VR via View Cone Sampling and Manifold Diffusion
di: Zheng, Guoquan, et al.
Pubblicazione: (2026)
di: Zheng, Guoquan, et al.
Pubblicazione: (2026)
Sphere-GAN: a GAN-based Approach for Saliency Estimation in 360° Videos
di: Wahba, Mahmoud Z. A., et al.
Pubblicazione: (2025)
di: Wahba, Mahmoud Z. A., et al.
Pubblicazione: (2025)
Study of Subjective and Objective Quality Assessment of Mobile Cloud Gaming Videos
di: Saha, Avinab, et al.
Pubblicazione: (2023)
di: Saha, Avinab, et al.
Pubblicazione: (2023)
Joint Flow And Feature Refinement Using Attention For Video Restoration
di: Merugu, Ranjith, et al.
Pubblicazione: (2025)
di: Merugu, Ranjith, et al.
Pubblicazione: (2025)
Consistency-aware Fake Videos Detection on Short Video Platforms
di: Wang, Junxi, et al.
Pubblicazione: (2025)
di: Wang, Junxi, et al.
Pubblicazione: (2025)
TTOM: Test-Time Optimization and Memorization for Compositional Video Generation
di: Qu, Leigang, et al.
Pubblicazione: (2025)
di: Qu, Leigang, et al.
Pubblicazione: (2025)
A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation
di: Zhou, S. Z., et al.
Pubblicazione: (2025)
di: Zhou, S. Z., et al.
Pubblicazione: (2025)
Brain-Grasp: Graph-based Saliency Priors for Improved fMRI-based Visual Brain Decoding
di: Moradi, Mohammad, et al.
Pubblicazione: (2026)
di: Moradi, Mohammad, et al.
Pubblicazione: (2026)
VideoZeroBench: Probing the Limits of Video MLLMs with Spatio-Temporal Evidence Verification
di: Meng, Jiahao, et al.
Pubblicazione: (2026)
di: Meng, Jiahao, et al.
Pubblicazione: (2026)
PRVR: Partially Relevant Video Retrieval
di: Chen, Xianke, et al.
Pubblicazione: (2022)
di: Chen, Xianke, et al.
Pubblicazione: (2022)
VideoForest: Person-Anchored Hierarchical Reasoning for Cross-Video Question Answering
di: Meng, Yiran, et al.
Pubblicazione: (2025)
di: Meng, Yiran, et al.
Pubblicazione: (2025)
When Video Coding Meets Multimodal Large Language Models: A Unified Paradigm for Video Coding
di: Zhang, Pingping, et al.
Pubblicazione: (2024)
di: Zhang, Pingping, et al.
Pubblicazione: (2024)
Visual Autoregressive Modeling for Instruction-Guided Image Editing
di: Mao, Qingyang, et al.
Pubblicazione: (2025)
di: Mao, Qingyang, et al.
Pubblicazione: (2025)
FlowVid: Taming Imperfect Optical Flows for Consistent Video-to-Video Synthesis
di: Liang, Feng, et al.
Pubblicazione: (2023)
di: Liang, Feng, et al.
Pubblicazione: (2023)
Face Consistency Benchmark for GenAI Video
di: Podstawski, Michal, et al.
Pubblicazione: (2025)
di: Podstawski, Michal, et al.
Pubblicazione: (2025)
Error Analyses of Auto-Regressive Video Diffusion Models: A Unified Framework
di: Wang, Jing, et al.
Pubblicazione: (2025)
di: Wang, Jing, et al.
Pubblicazione: (2025)
LLM-based Fusion of Multi-modal Features for Commercial Memorability Prediction
di: Pramov, Aleksandar
Pubblicazione: (2025)
di: Pramov, Aleksandar
Pubblicazione: (2025)
ASAP: Advancing Semantic Alignment Promotes Multi-Modal Manipulation Detecting and Grounding
di: Zhang, Zhenxing, et al.
Pubblicazione: (2024)
di: Zhang, Zhenxing, et al.
Pubblicazione: (2024)
SSNVC: Single Stream Neural Video Compression with Implicit Temporal Information
di: Wang, Feng, et al.
Pubblicazione: (2024)
di: Wang, Feng, et al.
Pubblicazione: (2024)
Looking Backward: Streaming Video-to-Video Translation with Feature Banks
di: Liang, Feng, et al.
Pubblicazione: (2024)
di: Liang, Feng, et al.
Pubblicazione: (2024)
T-GVC: Trajectory-Guided Generative Video Coding at Ultra-Low Bitrates
di: Wang, Zhitao, et al.
Pubblicazione: (2025)
di: Wang, Zhitao, et al.
Pubblicazione: (2025)
StreamingEval: A Unified Evaluation Protocol towards Realistic Streaming Video Understanding
di: Tang, Guowei, et al.
Pubblicazione: (2026)
di: Tang, Guowei, et al.
Pubblicazione: (2026)
Adaptive 3D Gaussian Splatting Video Streaming: Visual Saliency-Aware Tiling and Meta-Learning-Based Bitrate Adaptation
di: Gong, Han, et al.
Pubblicazione: (2025)
di: Gong, Han, et al.
Pubblicazione: (2025)
Modality-Aware Shot Relating and Comparing for Video Scene Detection
di: Tan, Jiawei, et al.
Pubblicazione: (2024)
di: Tan, Jiawei, et al.
Pubblicazione: (2024)
Advanced Learning-Based Inter Prediction for Future Video Coding
di: Zhao, Yanchen, et al.
Pubblicazione: (2024)
di: Zhao, Yanchen, et al.
Pubblicazione: (2024)
FMNV: A Dataset of Media-Published News Videos for Fake News Detection
di: Wang, Yihao, et al.
Pubblicazione: (2025)
di: Wang, Yihao, et al.
Pubblicazione: (2025)
Failures to Surface Harmful Contents in Video Large Language Models
di: Cao, Yuxin, et al.
Pubblicazione: (2025)
di: Cao, Yuxin, et al.
Pubblicazione: (2025)
Hybrid Local-Global Context Learning for Neural Video Compression
di: Zhai, Yongqi, et al.
Pubblicazione: (2024)
di: Zhai, Yongqi, et al.
Pubblicazione: (2024)
GSVC: Efficient Video Representation and Compression Through 2D Gaussian Splatting
di: Wang, Longan, et al.
Pubblicazione: (2025)
di: Wang, Longan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Generative Outpainting To Enhance the Memorability of Short-Form Videos
di: Byju, Alan, et al.
Pubblicazione: (2024) -
Efficient Object-centric Representation Learning with Pre-trained Geometric Prior
di: Khac, Phúc H. Le, et al.
Pubblicazione: (2024) -
Viewport Prediction for Volumetric Video Streaming by Exploring Video Saliency and Trajectory Information
di: Li, Jie, et al.
Pubblicazione: (2023) -
VideoMem: Constructing, Analyzing, Predicting Short-term and Long-term Video Memorability
di: Cohendet, Romain, et al.
Pubblicazione: (2018) -
Transformer-based Video Saliency Prediction with High Temporal Dimension Decoding
di: Moradi, Morteza, et al.
Pubblicazione: (2024)