Salvato in:
| Autori principali: | Van Duong, Vinh, Huu, Thuc Nguyen, Yim, Jonghoon, Jeon, Byeungwoo |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2310.08006 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Proposing Smart System for Detecting and Monitoring Vehicle Using Multiobject Multicamera Tracking
di: Phat Nguyen Huu, et al.
Pubblicazione: (2024)
di: Phat Nguyen Huu, et al.
Pubblicazione: (2024)
Multimodal LLM-based Query Paraphrasing for Video Search
di: Wu, Jiaxin, et al.
Pubblicazione: (2024)
di: Wu, Jiaxin, et al.
Pubblicazione: (2024)
Cross-Platform Neural Video Coding: A Case Study
di: Conceição, Ruhan, et al.
Pubblicazione: (2024)
di: Conceição, Ruhan, et al.
Pubblicazione: (2024)
KAN-Based Fusion of Dual-Domain for Audio-Driven Facial Landmarks Generation
di: Vo-Thanh, Hoang-Son, et al.
Pubblicazione: (2024)
di: Vo-Thanh, Hoang-Son, et al.
Pubblicazione: (2024)
CLIPRerank: An Extremely Simple Method for Improving Ad-hoc Video Search
di: Chen, Aozhu, et al.
Pubblicazione: (2024)
di: Chen, Aozhu, et al.
Pubblicazione: (2024)
Modeling the Impacts of Swipe Delay on User Quality of Experience in Short Video Streaming
di: Nguyen, Duc V., et al.
Pubblicazione: (2026)
di: Nguyen, Duc V., et al.
Pubblicazione: (2026)
Loss-resilient Coding of Texture and Depth for Free-viewpoint Video Conferencing
di: Macchiavello, Bruno, et al.
Pubblicazione: (2013)
di: Macchiavello, Bruno, et al.
Pubblicazione: (2013)
Fact-Checking at Scale: Multimodal AI for Authenticity and Context Verification in Online Media
di: Phan, Van-Hoang, et al.
Pubblicazione: (2025)
di: Phan, Van-Hoang, et al.
Pubblicazione: (2025)
MTAVG-Bench 2.0: Diagnosing Failure Modes of Cinematic Expressiveness in Multi-Talker Audio-Video Generation
di: Li, Haitian, et al.
Pubblicazione: (2026)
di: Li, Haitian, et al.
Pubblicazione: (2026)
MFQE 2.0: A New Approach for Multi-frame Quality Enhancement on Compressed Video
di: Xing, Qunliang, et al.
Pubblicazione: (2019)
di: Xing, Qunliang, et al.
Pubblicazione: (2019)
Integrated Semantic and Temporal Alignment for Interactive Video Retrieval
di: Luu, Thanh-Danh, et al.
Pubblicazione: (2025)
di: Luu, Thanh-Danh, et al.
Pubblicazione: (2025)
FedMAC: Tackling Partial-Modality Missing in Federated Learning with Cross-Modal Aggregation and Contrastive Regularization
di: Nguyen, Manh Duong, et al.
Pubblicazione: (2024)
di: Nguyen, Manh Duong, et al.
Pubblicazione: (2024)
Ada2I: Enhancing Modality Balance for Multimodal Conversational Emotion Recognition
di: Nguyen, Cam-Van Thi, et al.
Pubblicazione: (2024)
di: Nguyen, Cam-Van Thi, et al.
Pubblicazione: (2024)
VideoMem: Constructing, Analyzing, Predicting Short-term and Long-term Video Memorability
di: Cohendet, Romain, et al.
Pubblicazione: (2018)
di: Cohendet, Romain, et al.
Pubblicazione: (2018)
A Dual-Module Denoising Approach with Curriculum Learning for Enhancing Multimodal Aspect-Based Sentiment Analysis
di: Van Doan, Nguyen, et al.
Pubblicazione: (2024)
di: Van Doan, Nguyen, et al.
Pubblicazione: (2024)
diveXplore 6.0: ITEC's Interactive Video Exploration System at VBS 2022
di: Leibetseder, Andreas, et al.
Pubblicazione: (2025)
di: Leibetseder, Andreas, et al.
Pubblicazione: (2025)
Robust Relevance Feedback for Interactive Known-Item Video Search
di: Ma, Zhixin, et al.
Pubblicazione: (2025)
di: Ma, Zhixin, et al.
Pubblicazione: (2025)
Transform and Entropy Coding in AV2
di: Nalci, Alican, et al.
Pubblicazione: (2026)
di: Nalci, Alican, et al.
Pubblicazione: (2026)
BC-GAN: A Generative Adversarial Network for Synthesizing a Batch of Collocated Clothing
di: Zhou, Dongliang, et al.
Pubblicazione: (2025)
di: Zhou, Dongliang, et al.
Pubblicazione: (2025)
Symmetric Entropy-Constrained Video Coding for Machines
di: Sun, Yuxiao, et al.
Pubblicazione: (2025)
di: Sun, Yuxiao, et al.
Pubblicazione: (2025)
Short-Form Video Viewing Behavior Analysis and Multi-Step Viewing Time Prediction
di: Yen, Vu Thi Hai, et al.
Pubblicazione: (2026)
di: Yen, Vu Thi Hai, et al.
Pubblicazione: (2026)
Bi-modal Prediction and Transformation Coding for Compressing Complex Human Dynamics
di: Hoang, Huong, et al.
Pubblicazione: (2025)
di: Hoang, Huong, et al.
Pubblicazione: (2025)
When Video Coding Meets Multimodal Large Language Models: A Unified Paradigm for Video Coding
di: Zhang, Pingping, et al.
Pubblicazione: (2024)
di: Zhang, Pingping, et al.
Pubblicazione: (2024)
Contrast then Memorize: Semantic Neighbor Retrieval-Enhanced Inductive Multimodal Knowledge Graph Completion
di: Zhao, Yu, et al.
Pubblicazione: (2024)
di: Zhao, Yu, et al.
Pubblicazione: (2024)
Interpretable Embedding for Ad-hoc Video Search
di: Wu, Jiaxin, et al.
Pubblicazione: (2024)
di: Wu, Jiaxin, et al.
Pubblicazione: (2024)
How2Compress: Scalable and Efficient Edge Video Analytics via Adaptive Granular Video Compression
di: Wu, Yuheng, et al.
Pubblicazione: (2025)
di: Wu, Yuheng, et al.
Pubblicazione: (2025)
FCBoost-Net: A Generative Network for Synthesizing Multiple Collocated Outfits via Fashion Compatibility Boosting
di: Zhou, Dongliang, et al.
Pubblicazione: (2025)
di: Zhou, Dongliang, et al.
Pubblicazione: (2025)
Adaptive Resolution and Chroma Subsampling for Energy-Efficient Video Coding
di: Premkumar, Amritha, et al.
Pubblicazione: (2026)
di: Premkumar, Amritha, et al.
Pubblicazione: (2026)
Convex-hull Estimation using XPSNR for Versatile Video Coding
di: Menon, Vignesh V, et al.
Pubblicazione: (2024)
di: Menon, Vignesh V, et al.
Pubblicazione: (2024)
Reversible Video Steganography Using Quick Response Codes and Modified ElGamal Cryptosystem
di: Mstafa, Ramadhan J.
Pubblicazione: (2025)
di: Mstafa, Ramadhan J.
Pubblicazione: (2025)
Neural B-Frame Coding: Tackling Domain Shift Issues with Lightweight Online Motion Resolution Adaptation
di: NguyenQuang, Sang, et al.
Pubblicazione: (2025)
di: NguyenQuang, Sang, et al.
Pubblicazione: (2025)
Cap2Sum: Learning to Summarize Videos by Generating Captions
di: Zhao, Cairong, et al.
Pubblicazione: (2024)
di: Zhao, Cairong, et al.
Pubblicazione: (2024)
Audio-Visual Cross-Modal Compression for Generative Face Video Coding
di: Xu, Youmin, et al.
Pubblicazione: (2025)
di: Xu, Youmin, et al.
Pubblicazione: (2025)
MIntRec2.0: A Large-scale Benchmark Dataset for Multimodal Intent Recognition and Out-of-scope Detection in Conversations
di: Zhang, Hanlei, et al.
Pubblicazione: (2024)
di: Zhang, Hanlei, et al.
Pubblicazione: (2024)
Synchronized Video Storytelling: Generating Video Narrations with Structured Storyline
di: Yang, Dingyi, et al.
Pubblicazione: (2024)
di: Yang, Dingyi, et al.
Pubblicazione: (2024)
lifeXplore at the Lifelog Search Challenge 2020
di: Leibetseder, Andreas, et al.
Pubblicazione: (2025)
di: Leibetseder, Andreas, et al.
Pubblicazione: (2025)
DiFlowDubber: Discrete Flow Matching for Automated Video Dubbing via Cross-Modal Alignment and Synchronization
di: Nguyen, Ngoc-Son, et al.
Pubblicazione: (2026)
di: Nguyen, Ngoc-Son, et al.
Pubblicazione: (2026)
Sec2Sec Co-attention for Video-Based Apparent Affective Prediction
di: Sun, Mingwei, et al.
Pubblicazione: (2024)
di: Sun, Mingwei, et al.
Pubblicazione: (2024)
Towards Signboard-Oriented Visual Question Answering: ViSignVQA Dataset, Method and Benchmark
di: Nguyen, Hieu Minh, et al.
Pubblicazione: (2025)
di: Nguyen, Hieu Minh, et al.
Pubblicazione: (2025)
Subjective Quality Assessment of Dynamic 3D Meshes in Virtual Reality Environment
di: Nguyen, Duc V., et al.
Pubblicazione: (2026)
di: Nguyen, Duc V., et al.
Pubblicazione: (2026)
Documenti analoghi
-
Proposing Smart System for Detecting and Monitoring Vehicle Using Multiobject Multicamera Tracking
di: Phat Nguyen Huu, et al.
Pubblicazione: (2024) -
Multimodal LLM-based Query Paraphrasing for Video Search
di: Wu, Jiaxin, et al.
Pubblicazione: (2024) -
Cross-Platform Neural Video Coding: A Case Study
di: Conceição, Ruhan, et al.
Pubblicazione: (2024) -
KAN-Based Fusion of Dual-Domain for Audio-Driven Facial Landmarks Generation
di: Vo-Thanh, Hoang-Son, et al.
Pubblicazione: (2024) -
CLIPRerank: An Extremely Simple Method for Improving Ad-hoc Video Search
di: Chen, Aozhu, et al.
Pubblicazione: (2024)