Merge Mode for Template-based Intra Mode Derivation (TIMD) in ECM
Fuente:
arXiv
Saved in:
| Main Authors: | Abdoli, Mohsen, Youvalari, Ramin G., Plowman, Frank, Tissier, Alexandre |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Video Compression Beyond VVC: Quantitative Analysis of Intra Coding Tools in Enhanced Compression Model (ECM)
by: Abdoli, Mohsen, et al.
Published: (2024)
by: Abdoli, Mohsen, et al.
Published: (2024)
Enhanced Template-based Intra Mode Derivation with Adaptive Block Vector Replacement
by: Zhang, Jiaqi, et al.
Published: (2025)
by: Zhang, Jiaqi, et al.
Published: (2025)
Retracted: The Development Strategy of the Multimedia Fusion Mode of Big Data Technology in Japanese Translation Teaching
by: Advances in Multimedia
Published: (2024)
by: Advances in Multimedia
Published: (2024)
Augmenting Intra-Modal Understanding in MLLMs for Robust Multimodal Keyphrase Generation
by: Cao, Jiajun, et al.
Published: (2025)
by: Cao, Jiajun, et al.
Published: (2025)
Let the Model Learn to Feel: Mode-Guided Tonality Injection for Symbolic Music Emotion Recognition
by: Xia, Haiying, et al.
Published: (2025)
by: Xia, Haiying, et al.
Published: (2025)
MTAVG-Bench 2.0: Diagnosing Failure Modes of Cinematic Expressiveness in Multi-Talker Audio-Video Generation
by: Li, Haitian, et al.
Published: (2026)
by: Li, Haitian, et al.
Published: (2026)
Audio-visual Event Localization on Portrait Mode Short Videos
by: Liu, Wuyang, et al.
Published: (2025)
by: Liu, Wuyang, et al.
Published: (2025)
Evaluation of Objective Image Quality Metrics for High-Fidelity Image Compression
by: Mohammadi, Shima, et al.
Published: (2025)
by: Mohammadi, Shima, et al.
Published: (2025)
Editing Away the Evidence: Diffusion-Based Image Manipulation and the Failure Modes of Robust Watermarking
by: Qi, Qian, et al.
Published: (2026)
by: Qi, Qian, et al.
Published: (2026)
In-place Double Stimulus Methodology for Subjective Assessment of High Quality Images
by: Mohammadi, Shima, et al.
Published: (2025)
by: Mohammadi, Shima, et al.
Published: (2025)
Multi Agents Semantic Emotion Aligned Music to Image Generation with Music Derived Captions
by: Shi, Junchang, et al.
Published: (2025)
by: Shi, Junchang, et al.
Published: (2025)
Low Complexity Learning-based Lossless Event-based Compression
by: Sezavar, Ahmadreza, et al.
Published: (2024)
by: Sezavar, Ahmadreza, et al.
Published: (2024)
Learning-based Lossless Event Data Compression
by: Sezavar, Ahmadreza, et al.
Published: (2024)
by: Sezavar, Ahmadreza, et al.
Published: (2024)
PIRA: Pan-CDN Intra-video Resource Adaptation for Short Video Streaming
by: Qiao, Chunyu, et al.
Published: (2025)
by: Qiao, Chunyu, et al.
Published: (2025)
Multimodal LLM-based Query Paraphrasing for Video Search
by: Wu, Jiaxin, et al.
Published: (2024)
by: Wu, Jiaxin, et al.
Published: (2024)
A CLIP-based siamese approach for meme classification
by: Huertas-Tato, Javier, et al.
Published: (2024)
by: Huertas-Tato, Javier, et al.
Published: (2024)
QuMATL: Query-based Multi-annotator Tendency Learning
by: Zhang, Liyun, et al.
Published: (2025)
by: Zhang, Liyun, et al.
Published: (2025)
Structured Image-based Coding for Efficient Gaussian Splatting Compression
by: Martin, Pedro, et al.
Published: (2026)
by: Martin, Pedro, et al.
Published: (2026)
Graph-based Interaction Augmentation Network for Robust Multimodal Sentiment Analysis
by: Zhangfeng, Hu, et al.
Published: (2025)
by: Zhangfeng, Hu, et al.
Published: (2025)
MMC: Iterative Refinement of VLM Reasoning via MCTS-based Multimodal Critique
by: Liu, Shuhang, et al.
Published: (2025)
by: Liu, Shuhang, et al.
Published: (2025)
Movement- and Traffic-based User Identification in Commercial Virtual Reality Applications: Threats and Opportunities
by: Baldoni, Sara, et al.
Published: (2025)
by: Baldoni, Sara, et al.
Published: (2025)
Gain of Grain: A Film Grain Handling Toolchain for VVC-based Open Implementations
by: Menon, Vignesh V, et al.
Published: (2024)
by: Menon, Vignesh V, et al.
Published: (2024)
Clustering Internet Memes Through Template Matching and Multi-Dimensional Similarity
by: Bloem, Tygo, et al.
Published: (2025)
by: Bloem, Tygo, et al.
Published: (2025)
VRAgent-R1: Boosting Video Recommendation with MLLM-based Agents via Reinforcement Learning
by: Chen, Siran, et al.
Published: (2025)
by: Chen, Siran, et al.
Published: (2025)
ProMSC-MIS: Prompt-based Multimodal Semantic Communication for Multi-Spectral Image Segmentation
by: Zhang, Haoshuo, et al.
Published: (2025)
by: Zhang, Haoshuo, et al.
Published: (2025)
Nagare Media Engine: A System for Cloud- and Edge-Native Network-based Multimedia Workflows
by: Neugebauer, Matthias
Published: (2025)
by: Neugebauer, Matthias
Published: (2025)
Multi-view Hypergraph-based Contrastive Learning Model for Cold-Start Micro-video Recommendation
by: Lyu, Sisuo, et al.
Published: (2024)
by: Lyu, Sisuo, et al.
Published: (2024)
G4G:A Generic Framework for High Fidelity Talking Face Generation with Fine-grained Intra-modal Alignment
by: Zhang, Juan, et al.
Published: (2024)
by: Zhang, Juan, et al.
Published: (2024)
Towards Multimodal Empathetic Response Generation: A Rich Text-Speech-Vision Avatar-based Benchmark
by: Zhang, Han, et al.
Published: (2025)
by: Zhang, Han, et al.
Published: (2025)
Startup Delay Aware Short Video Ordering: Problem, Model, and A Reinforcement Learning based Algorithm
by: Gao, Zhipeng, et al.
Published: (2024)
by: Gao, Zhipeng, et al.
Published: (2024)
M3ST-DTI: A multi-task learning model for drug-target interactions based on multi-modal features and multi-stage alignment
by: Li, Xiangyu, et al.
Published: (2025)
by: Li, Xiangyu, et al.
Published: (2025)
UVG-VPC: Voxelized Point Cloud Dataset for Visual Volumetric Video-based Coding
by: Gautier, Guillaume, et al.
Published: (2025)
by: Gautier, Guillaume, et al.
Published: (2025)
Layer-wise Model Merging for Unsupervised Domain Adaptation in Segmentation Tasks
by: Alcover-Couso, Roberto, et al.
Published: (2024)
by: Alcover-Couso, Roberto, et al.
Published: (2024)
Start from Video-Music Retrieval: An Inter-Intra Modal Loss for Cross Modal Retrieval
by: Chen, Zeyu, et al.
Published: (2024)
by: Chen, Zeyu, et al.
Published: (2024)
MMED: A Multimodal Micro-Expression Dataset based on Audio-Visual Fusion
by: Wang, Junbo, et al.
Published: (2025)
by: Wang, Junbo, et al.
Published: (2025)
ASAP: Advancing Semantic Alignment Promotes Multi-Modal Manipulation Detecting and Grounding
by: Zhang, Zhenxing, et al.
Published: (2024)
by: Zhang, Zhenxing, et al.
Published: (2024)
Ensembling Synchronisation-based and Face-Voice Association Paradigms for Robust Active Speaker Detection in Egocentric Recordings
by: Clarke, Jason, et al.
Published: (2025)
by: Clarke, Jason, et al.
Published: (2025)
YTLive: A Dataset of Real-World YouTube Live Streaming Sessions
by: Mozhganfar, Mojtaba, et al.
Published: (2025)
by: Mozhganfar, Mojtaba, et al.
Published: (2025)
IIANet: An Intra- and Inter-Modality Attention Network for Audio-Visual Speech Separation
by: Li, Kai, et al.
Published: (2023)
by: Li, Kai, et al.
Published: (2023)
Inferencias causales durante la comprensión de textos expositivos en formato multimedia
by: Gastón Saux
Published: (2012)
by: Gastón Saux
Published: (2012)
Similar Items
-
Video Compression Beyond VVC: Quantitative Analysis of Intra Coding Tools in Enhanced Compression Model (ECM)
by: Abdoli, Mohsen, et al.
Published: (2024) -
Enhanced Template-based Intra Mode Derivation with Adaptive Block Vector Replacement
by: Zhang, Jiaqi, et al.
Published: (2025) -
Retracted: The Development Strategy of the Multimedia Fusion Mode of Big Data Technology in Japanese Translation Teaching
by: Advances in Multimedia
Published: (2024) -
Augmenting Intra-Modal Understanding in MLLMs for Robust Multimodal Keyphrase Generation
by: Cao, Jiajun, et al.
Published: (2025) -
Let the Model Learn to Feel: Mode-Guided Tonality Injection for Symbolic Music Emotion Recognition
by: Xia, Haiying, et al.
Published: (2025)