TriPSS: A Tri-Modal Keyframe Extraction Framework Using Perceptual, Structural, and Semantic Representations
Fuente:
arXiv
Saved in:
| Main Authors: | Cakmak, Mert Can, Agarwal, Nitin, Poudel, Diwash |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
PRISM: Perceptual Recognition for Identifying Standout Moments in Human-Centric Keyframe Extraction
by: Cakmak, Mert Can, et al.
Published: (2025)
by: Cakmak, Mert Can, et al.
Published: (2025)
YouTube Video Analytics for Patient Engagement: Evidence from Colonoscopy Preparation Videos
by: Guo, Yawen, et al.
Published: (2024)
by: Guo, Yawen, et al.
Published: (2024)
Multi-hop Parallel Image Semantic Communication for Distortion Accumulation Mitigation
by: Xie, Bingyan, et al.
Published: (2025)
by: Xie, Bingyan, et al.
Published: (2025)
Tube-Structured Incremental Semantic HARQ for Generative Video Receivers
by: Wang, Xuesong, et al.
Published: (2026)
by: Wang, Xuesong, et al.
Published: (2026)
CATRF: Codec-Adaptive TriPlane Radiance Fields for Volumetric Content Delivery
by: Chen, Tung-I, et al.
Published: (2026)
by: Chen, Tung-I, et al.
Published: (2026)
Bjøntegaard Delta (BD): A Tutorial Overview of the Metric, Evolution, Challenges, and Recommendations
by: Barman, Nabajeet, et al.
Published: (2024)
by: Barman, Nabajeet, et al.
Published: (2024)
Perception-Aware Video Semantic Communication
by: Huang, Yinhuan, et al.
Published: (2026)
by: Huang, Yinhuan, et al.
Published: (2026)
Audio-Visual Cross-Modal Compression for Generative Face Video Coding
by: Xu, Youmin, et al.
Published: (2025)
by: Xu, Youmin, et al.
Published: (2025)
Adaptive Wireless Image Semantic Transmission and Over-The-Air Testing
by: Ding, Jiarun, et al.
Published: (2024)
by: Ding, Jiarun, et al.
Published: (2024)
Prompt-based Multimodal Semantic Communication for Multi-spectral Image Segmentation
by: Zhang, Haoshuo, et al.
Published: (2025)
by: Zhang, Haoshuo, et al.
Published: (2025)
QoE Optimization for Semantic Self-Correcting Video Transmission in Multi-UAV Networks
by: Chen, Xuyang, et al.
Published: (2025)
by: Chen, Xuyang, et al.
Published: (2025)
Compact Visual Data Representation for Green Multimedia -- A Human Visual System Perspective
by: Chen, Peilin, et al.
Published: (2024)
by: Chen, Peilin, et al.
Published: (2024)
Image Restoration: A Comparative Analysis of Image De noising Using Different Spatial Filtering Techniques
by: Onyedinma, E. G., et al.
Published: (2024)
by: Onyedinma, E. G., et al.
Published: (2024)
Semantic Communication Enabled Holographic Video Processing and Transmission
by: Ying, Jingkai, et al.
Published: (2025)
by: Ying, Jingkai, et al.
Published: (2025)
Learning Perceptual Representations for Gaming NR-VQA with Multi-Task FR Signals
by: Chen, Yu-Chih, et al.
Published: (2026)
by: Chen, Yu-Chih, et al.
Published: (2026)
Avoiding Quality Saturation in UGC Compression Using Denoised References
by: Xiong, Xin, et al.
Published: (2025)
by: Xiong, Xin, et al.
Published: (2025)
NiMark: A Non-intrusive Watermarking Framework against Screen-shooting Attacks
by: Wu, Yufeng, et al.
Published: (2026)
by: Wu, Yufeng, et al.
Published: (2026)
Generative AI for Multimedia Communication: Recent Advances, An Information-Theoretic Framework, and Future Opportunities
by: Jin, Yili, et al.
Published: (2025)
by: Jin, Yili, et al.
Published: (2025)
Improved Screen Content Coding in VVC Using Soft Context Formation
by: Och, Hannah, et al.
Published: (2023)
by: Och, Hannah, et al.
Published: (2023)
H.265/HEVC Video Steganalysis Based on CU Block Structure Gradients and IPM Mapping
by: Zhang, Xiang, et al.
Published: (2026)
by: Zhang, Xiang, et al.
Published: (2026)
ABC: Adaptive BayesNet Structure Learning for Computational Scalable Multi-task Image Compression
by: Zhang, Yufeng, et al.
Published: (2025)
by: Zhang, Yufeng, et al.
Published: (2025)
Interactive $360^{\circ}$ Video Streaming Using FoV-Adaptive Coding with Temporal Prediction
by: Mao, Yixiang, et al.
Published: (2024)
by: Mao, Yixiang, et al.
Published: (2024)
Cross-Layer Encrypted Semantic Communication Framework for Panoramic Video Transmission
by: Gao, Haixiao, et al.
Published: (2024)
by: Gao, Haixiao, et al.
Published: (2024)
MarsSQE: Stereo Quality Enhancement for Martian Images Using Bi-level Cross-view Attention
by: Xu, Mai, et al.
Published: (2024)
by: Xu, Mai, et al.
Published: (2024)
PAL: Prompting Analytic Learning with Missing Modality for Multi-Modal Class-Incremental Learning
by: Yue, Xianghu, et al.
Published: (2025)
by: Yue, Xianghu, et al.
Published: (2025)
Robust Multi-modal Task-oriented Communications with Redundancy-aware Representations
by: Fu, Jingwen, et al.
Published: (2025)
by: Fu, Jingwen, et al.
Published: (2025)
Investigating Algorithmic Bias in YouTube Shorts
by: Cakmak, Mert Can, et al.
Published: (2025)
by: Cakmak, Mert Can, et al.
Published: (2025)
Integrating Notch Filtering and Statistical Methods for Improved Cardiac Diagnostics Using MATLAB
by: Bibar, Lohit, et al.
Published: (2025)
by: Bibar, Lohit, et al.
Published: (2025)
DICODerma: A practical approach for metadata management of images in dermatology
by: Eapen, Bell Raj, et al.
Published: (2021)
by: Eapen, Bell Raj, et al.
Published: (2021)
RBFIM: Perceptual Quality Assessment for Compressed Point Clouds Using Radial Basis Function Interpolation
by: Chen, Zhang, et al.
Published: (2025)
by: Chen, Zhang, et al.
Published: (2025)
High Perceptual Quality Wireless Image Delivery with Denoising Diffusion Models
by: Yilmaz, Selim F., et al.
Published: (2023)
by: Yilmaz, Selim F., et al.
Published: (2023)
Perceptual Video Quality Assessment: A Survey
by: Min, Xiongkuo, et al.
Published: (2024)
by: Min, Xiongkuo, et al.
Published: (2024)
Perceptual Quality Optimization of Image Super-Resolution
by: Zhou, Wei, et al.
Published: (2026)
by: Zhou, Wei, et al.
Published: (2026)
A Parametric Rate-Distortion Model for Video Transcoding
by: Jamali, Maedeh, et al.
Published: (2024)
by: Jamali, Maedeh, et al.
Published: (2024)
Video TokenCom: Textual Intent-Guided Multi-Rate Video Token Communications with UEP-Based Adaptive Source-Channel Coding
by: Men, Jingxuan, et al.
Published: (2026)
by: Men, Jingxuan, et al.
Published: (2026)
Perceptual Depth Quality Assessment of Stereoscopic Omnidirectional Images
by: Zhou, Wei, et al.
Published: (2024)
by: Zhou, Wei, et al.
Published: (2024)
Robust Live Streaming over LEO Satellite Constellations: Measurement, Analysis, and Handover-Aware Adaptation
by: Fang, Hao, et al.
Published: (2025)
by: Fang, Hao, et al.
Published: (2025)
Enhanced Template-based Intra Mode Derivation with Adaptive Block Vector Replacement
by: Zhang, Jiaqi, et al.
Published: (2025)
by: Zhang, Jiaqi, et al.
Published: (2025)
Transform and Entropy Coding in AV2
by: Nalci, Alican, et al.
Published: (2026)
by: Nalci, Alican, et al.
Published: (2026)
Rate-Quality or Energy-Quality Pareto Fronts for Adaptive Video Streaming?
by: Katsenou, Angeliki, et al.
Published: (2024)
by: Katsenou, Angeliki, et al.
Published: (2024)
Similar Items
-
PRISM: Perceptual Recognition for Identifying Standout Moments in Human-Centric Keyframe Extraction
by: Cakmak, Mert Can, et al.
Published: (2025) -
YouTube Video Analytics for Patient Engagement: Evidence from Colonoscopy Preparation Videos
by: Guo, Yawen, et al.
Published: (2024) -
Multi-hop Parallel Image Semantic Communication for Distortion Accumulation Mitigation
by: Xie, Bingyan, et al.
Published: (2025) -
Tube-Structured Incremental Semantic HARQ for Generative Video Receivers
by: Wang, Xuesong, et al.
Published: (2026) -
CATRF: Codec-Adaptive TriPlane Radiance Fields for Volumetric Content Delivery
by: Chen, Tung-I, et al.
Published: (2026)