Hierarchical B-frame Video Coding for Long Group of Pictures
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Kirillov, Ivan, Parkhomenko, Denis, Chernyshev, Kirill, Pletnev, Alexander, Shi, Yibo, Lin, Kai, Babin, Dmitry |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
UCVC: A Unified Contextual Video Compression Framework with Joint P-frame and B-frame Coding
von: Yang, Jiayu, et al.
Veröffentlicht: (2024)
von: Yang, Jiayu, et al.
Veröffentlicht: (2024)
Alchemist: Turning Public Text-to-Image Data into Generative Gold
von: Startsev, Valerii, et al.
Veröffentlicht: (2025)
von: Startsev, Valerii, et al.
Veröffentlicht: (2025)
Motion Free B-frame Coding for Neural Video Compression
von: Nguyen, Van Thang
Veröffentlicht: (2024)
von: Nguyen, Van Thang
Veröffentlicht: (2024)
Hierarchical Memory for Long Video QA
von: Wang, Yiqin, et al.
Veröffentlicht: (2024)
von: Wang, Yiqin, et al.
Veröffentlicht: (2024)
HiAR: Efficient Autoregressive Long Video Generation via Hierarchical Denoising
von: Zou, Kai, et al.
Veröffentlicht: (2026)
von: Zou, Kai, et al.
Veröffentlicht: (2026)
Differentiable Rendering with Reparameterized Volume Sampling
von: Morozov, Nikita, et al.
Veröffentlicht: (2023)
von: Morozov, Nikita, et al.
Veröffentlicht: (2023)
IBVC: Interpolation-driven B-frame Video Compression
von: Xu, Chenming, et al.
Veröffentlicht: (2023)
von: Xu, Chenming, et al.
Veröffentlicht: (2023)
Deepfake detection in videos with multiple faces using geometric-fakeness features
von: Vyshegorodtsev, Kirill, et al.
Veröffentlicht: (2024)
von: Vyshegorodtsev, Kirill, et al.
Veröffentlicht: (2024)
Neural B-frame Video Compression with Bi-directional Reference Harmonization
von: Liu, Yuxi, et al.
Veröffentlicht: (2025)
von: Liu, Yuxi, et al.
Veröffentlicht: (2025)
MovieBench: A Hierarchical Movie Level Dataset for Long Video Generation
von: Wu, Weijia, et al.
Veröffentlicht: (2024)
von: Wu, Weijia, et al.
Veröffentlicht: (2024)
PRISM-Loc: a Lightweight Long-range LiDAR Localization in Urban Environments with Topological Maps
von: Muravyev, Kirill, et al.
Veröffentlicht: (2025)
von: Muravyev, Kirill, et al.
Veröffentlicht: (2025)
CasTex: Cascaded Text-to-Texture Synthesis via Explicit Texture Maps and Physically-Based Shading
von: Aliev, Mishan, et al.
Veröffentlicht: (2025)
von: Aliev, Mishan, et al.
Veröffentlicht: (2025)
Global Motion Understanding in Large-Scale Video Object Segmentation
von: Fedynyak, Volodymyr, et al.
Veröffentlicht: (2024)
von: Fedynyak, Volodymyr, et al.
Veröffentlicht: (2024)
Extending Video Masked Autoencoders to 128 frames
von: Gundavarapu, Nitesh Bharadwaj, et al.
Veröffentlicht: (2024)
von: Gundavarapu, Nitesh Bharadwaj, et al.
Veröffentlicht: (2024)
WVSC: Wireless Video Semantic Communication with Multi-frame Compensation
von: Xie, Bingyan, et al.
Veröffentlicht: (2025)
von: Xie, Bingyan, et al.
Veröffentlicht: (2025)
Regularized Distribution Matching Distillation for One-step Unpaired Image-to-Image Translation
von: Rakitin, Denis, et al.
Veröffentlicht: (2024)
von: Rakitin, Denis, et al.
Veröffentlicht: (2024)
Kandinsky 5.0: A Family of Foundation Models for Image and Video Generation
von: Arkhipkin, Vladimir, et al.
Veröffentlicht: (2025)
von: Arkhipkin, Vladimir, et al.
Veröffentlicht: (2025)
HAVEN: Hierarchically Aligned Multimodal Benchmark for Unified Video Understanding
von: Shi, Mengqi, et al.
Veröffentlicht: (2026)
von: Shi, Mengqi, et al.
Veröffentlicht: (2026)
Hierarchical Patch Diffusion Models for High-Resolution Video Generation
von: Skorokhodov, Ivan, et al.
Veröffentlicht: (2024)
von: Skorokhodov, Ivan, et al.
Veröffentlicht: (2024)
ARC-Chapter: Structuring Hour-Long Videos into Navigable Chapters and Hierarchical Summaries
von: Pu, Junfu, et al.
Veröffentlicht: (2025)
von: Pu, Junfu, et al.
Veröffentlicht: (2025)
Generative inpainting of incomplete Euclidean distance matrices of trajectories generated by a fractional Brownian motion
von: Lobashev, Alexander, et al.
Veröffentlicht: (2024)
von: Lobashev, Alexander, et al.
Veröffentlicht: (2024)
VideoChat-Flash: Hierarchical Compression for Long-Context Video Modeling
von: Li, Xinhao, et al.
Veröffentlicht: (2024)
von: Li, Xinhao, et al.
Veröffentlicht: (2024)
Post-Training Quantization for Diffusion Transformer via Hierarchical Timestep Grouping
von: Ding, Ning, et al.
Veröffentlicht: (2025)
von: Ding, Ning, et al.
Veröffentlicht: (2025)
Enhancing Long Video Question Answering with Scene-Localized Frame Grouping
von: Yang, Xuyi, et al.
Veröffentlicht: (2025)
von: Yang, Xuyi, et al.
Veröffentlicht: (2025)
End-to-End Facial Expression Detection in Long Videos
von: Fang, Yini, et al.
Veröffentlicht: (2025)
von: Fang, Yini, et al.
Veröffentlicht: (2025)
HAtt-Flow: Hierarchical Attention-Flow Mechanism for Group Activity Scene Graph Generation in Videos
von: Chappa, Naga VS Raviteja, et al.
Veröffentlicht: (2023)
von: Chappa, Naga VS Raviteja, et al.
Veröffentlicht: (2023)
LOGO: A Long-Form Video Dataset for Group Action Quality Assessment
von: Zhang, Shiyi, et al.
Veröffentlicht: (2024)
von: Zhang, Shiyi, et al.
Veröffentlicht: (2024)
MoGA: Mixture-of-Groups Attention for End-to-End Long Video Generation
von: Jia, Weinan, et al.
Veröffentlicht: (2025)
von: Jia, Weinan, et al.
Veröffentlicht: (2025)
OmniRoam: World Wandering via Long-Horizon Panoramic Video Generation
von: Liu, Yuheng, et al.
Veröffentlicht: (2026)
von: Liu, Yuheng, et al.
Veröffentlicht: (2026)
MMBench-Video: A Long-Form Multi-Shot Benchmark for Holistic Video Understanding
von: Fang, Xinyu, et al.
Veröffentlicht: (2024)
von: Fang, Xinyu, et al.
Veröffentlicht: (2024)
Long Context Tuning for Video Generation
von: Guo, Yuwei, et al.
Veröffentlicht: (2025)
von: Guo, Yuwei, et al.
Veröffentlicht: (2025)
FancyVideo: Towards Dynamic and Consistent Video Generation via Cross-frame Textual Guidance
von: Feng, Jiasong, et al.
Veröffentlicht: (2024)
von: Feng, Jiasong, et al.
Veröffentlicht: (2024)
DeVOS: Flow-Guided Deformable Transformer for Video Object Segmentation
von: Fedynyak, Volodymyr, et al.
Veröffentlicht: (2024)
von: Fedynyak, Volodymyr, et al.
Veröffentlicht: (2024)
SAVEn-Vid: Synergistic Audio-Visual Integration for Enhanced Understanding in Long Video Context
von: Li, Jungang, et al.
Veröffentlicht: (2024)
von: Li, Jungang, et al.
Veröffentlicht: (2024)
Variable-frame CNNLSTM for Breast Nodule Classification using Ultrasound Videos
von: Cui, Xiangxiang, et al.
Veröffentlicht: (2025)
von: Cui, Xiangxiang, et al.
Veröffentlicht: (2025)
DrVideo: Document Retrieval Based Long Video Understanding
von: Ma, Ziyu, et al.
Veröffentlicht: (2024)
von: Ma, Ziyu, et al.
Veröffentlicht: (2024)
A Neural-network Enhanced Video Coding Framework beyond ECM
von: Zhao, Yanchen, et al.
Veröffentlicht: (2024)
von: Zhao, Yanchen, et al.
Veröffentlicht: (2024)
VideoARM: Agentic Reasoning over Hierarchical Memory for Long-Form Video Understanding
von: Yin, Yufei, et al.
Veröffentlicht: (2025)
von: Yin, Yufei, et al.
Veröffentlicht: (2025)
FocusGraph: Graph-Structured Frame Selection for Embodied Long Video Question Answering
von: Zemskova, Tatiana, et al.
Veröffentlicht: (2026)
von: Zemskova, Tatiana, et al.
Veröffentlicht: (2026)
RTV-Bench: Benchmarking MLLM Continuous Perception, Understanding and Reasoning through Real-Time Video
von: Xun, Shuhang, et al.
Veröffentlicht: (2025)
von: Xun, Shuhang, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
UCVC: A Unified Contextual Video Compression Framework with Joint P-frame and B-frame Coding
von: Yang, Jiayu, et al.
Veröffentlicht: (2024) -
Alchemist: Turning Public Text-to-Image Data into Generative Gold
von: Startsev, Valerii, et al.
Veröffentlicht: (2025) -
Motion Free B-frame Coding for Neural Video Compression
von: Nguyen, Van Thang
Veröffentlicht: (2024) -
Hierarchical Memory for Long Video QA
von: Wang, Yiqin, et al.
Veröffentlicht: (2024) -
HiAR: Efficient Autoregressive Long Video Generation via Hierarchical Denoising
von: Zou, Kai, et al.
Veröffentlicht: (2026)