Looking Backward: Streaming Video-to-Video Translation with Feature Banks
Fuente:
arXiv
Salvato in:
| Autori principali: | Liang, Feng, Kodaira, Akio, Xu, Chenfeng, Tomizuka, Masayoshi, Keutzer, Kurt, Marculescu, Diana |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Immiscible Diffusion: Accelerating Diffusion Training with Noise Assignment
di: Li, Yiheng, et al.
Pubblicazione: (2024)
di: Li, Yiheng, et al.
Pubblicazione: (2024)
FlowVid: Taming Imperfect Optical Flows for Consistent Video-to-Video Synthesis
di: Liang, Feng, et al.
Pubblicazione: (2023)
di: Liang, Feng, et al.
Pubblicazione: (2023)
Improved Immiscible Diffusion: Accelerate Diffusion Training by Reducing Its Miscibility
di: Li, Yiheng, et al.
Pubblicazione: (2025)
di: Li, Yiheng, et al.
Pubblicazione: (2025)
Vision-Language Models Learn Super Images for Efficient Partially Relevant Video Retrieval
di: Nishimura, Taichi, et al.
Pubblicazione: (2023)
di: Nishimura, Taichi, et al.
Pubblicazione: (2023)
StreamDiffusion: A Pipeline-level Solution for Real-time Interactive Generation
di: Kodaira, Akio, et al.
Pubblicazione: (2023)
di: Kodaira, Akio, et al.
Pubblicazione: (2023)
SSNVC: Single Stream Neural Video Compression with Implicit Temporal Information
di: Wang, Feng, et al.
Pubblicazione: (2024)
di: Wang, Feng, et al.
Pubblicazione: (2024)
A Lesson in Splats: Teacher-Guided Diffusion for 3D Gaussian Splats Generation with 2D Supervision
di: Peng, Chensheng, et al.
Pubblicazione: (2024)
di: Peng, Chensheng, et al.
Pubblicazione: (2024)
Viewport Prediction for Volumetric Video Streaming by Exploring Video Saliency and Trajectory Information
di: Li, Jie, et al.
Pubblicazione: (2023)
di: Li, Jie, et al.
Pubblicazione: (2023)
Adaptive 3D Gaussian Splatting Video Streaming
di: Gong, Han, et al.
Pubblicazione: (2025)
di: Gong, Han, et al.
Pubblicazione: (2025)
StreamingEval: A Unified Evaluation Protocol towards Realistic Streaming Video Understanding
di: Tang, Guowei, et al.
Pubblicazione: (2026)
di: Tang, Guowei, et al.
Pubblicazione: (2026)
StreamDiT: Real-Time Streaming Text-to-Video Generation
di: Kodaira, Akio, et al.
Pubblicazione: (2025)
di: Kodaira, Akio, et al.
Pubblicazione: (2025)
SwinGS: Sliding Window Gaussian Splatting for Volumetric Video Streaming with Arbitrary Length
di: Liu, Bangya, et al.
Pubblicazione: (2024)
di: Liu, Bangya, et al.
Pubblicazione: (2024)
High-Quality Live Video Streaming via Transcoding Time Prediction and Preset Selection
di: Shahre-Babak, Zahra Nabizadeh, et al.
Pubblicazione: (2023)
di: Shahre-Babak, Zahra Nabizadeh, et al.
Pubblicazione: (2023)
StreamDiffusionV2: A Streaming System for Dynamic and Interactive Video Generation
di: Feng, Tianrui, et al.
Pubblicazione: (2025)
di: Feng, Tianrui, et al.
Pubblicazione: (2025)
Joint Flow And Feature Refinement Using Attention For Video Restoration
di: Merugu, Ranjith, et al.
Pubblicazione: (2025)
di: Merugu, Ranjith, et al.
Pubblicazione: (2025)
Accelerated Event-Based Feature Detection and Compression for Surveillance Video Systems
di: Freeman, Andrew C., et al.
Pubblicazione: (2023)
di: Freeman, Andrew C., et al.
Pubblicazione: (2023)
GMFVAD: Using Grained Multi-modal Feature to Improve Video Anomaly Detection
di: Dai, Guangyu, et al.
Pubblicazione: (2025)
di: Dai, Guangyu, et al.
Pubblicazione: (2025)
Compression of 3D Gaussian Splatting with Optimized Feature Planes and Standard Video Codecs
di: Lee, Soonbin, et al.
Pubblicazione: (2025)
di: Lee, Soonbin, et al.
Pubblicazione: (2025)
In-Loop Filtering Using Learned Look-Up Tables for Video Coding
di: Li, Zhuoyuan, et al.
Pubblicazione: (2025)
di: Li, Zhuoyuan, et al.
Pubblicazione: (2025)
VideoZeroBench: Probing the Limits of Video MLLMs with Spatio-Temporal Evidence Verification
di: Meng, Jiahao, et al.
Pubblicazione: (2026)
di: Meng, Jiahao, et al.
Pubblicazione: (2026)
NeR-SC: Adapting Neural Video Representation to Screen Content
di: Shi, Ruohan, et al.
Pubblicazione: (2026)
di: Shi, Ruohan, et al.
Pubblicazione: (2026)
Consistency-aware Fake Videos Detection on Short Video Platforms
di: Wang, Junxi, et al.
Pubblicazione: (2025)
di: Wang, Junxi, et al.
Pubblicazione: (2025)
When Video Coding Meets Multimodal Large Language Models: A Unified Paradigm for Video Coding
di: Zhang, Pingping, et al.
Pubblicazione: (2024)
di: Zhang, Pingping, et al.
Pubblicazione: (2024)
Hallo-Live: Real-Time Streaming Joint Audio-Video Avatar Generation with Asynchronous Dual-Stream and Human-Centric Preference Distillation
di: Li, Chunyu, et al.
Pubblicazione: (2026)
di: Li, Chunyu, et al.
Pubblicazione: (2026)
Zero-shot Video Moment Retrieval via Off-the-shelf Multimodal Large Language Models
di: Xu, Yifang, et al.
Pubblicazione: (2025)
di: Xu, Yifang, et al.
Pubblicazione: (2025)
Video Compression Meets Video Generation: Latent Inter-Frame Pruning with Attention Recovery
di: Menn, Dennis, et al.
Pubblicazione: (2026)
di: Menn, Dennis, et al.
Pubblicazione: (2026)
Rate-aware Compression for NeRF-based Volumetric Video
di: Zhang, Zhiyu, et al.
Pubblicazione: (2024)
di: Zhang, Zhiyu, et al.
Pubblicazione: (2024)
Generative Frame Sampler for Long Video Understanding
di: Yao, Linli, et al.
Pubblicazione: (2025)
di: Yao, Linli, et al.
Pubblicazione: (2025)
VideoForest: Person-Anchored Hierarchical Reasoning for Cross-Video Question Answering
di: Meng, Yiran, et al.
Pubblicazione: (2025)
di: Meng, Yiran, et al.
Pubblicazione: (2025)
WVSC: Wireless Video Semantic Communication with Multi-frame Compensation
di: Xie, Bingyan, et al.
Pubblicazione: (2025)
di: Xie, Bingyan, et al.
Pubblicazione: (2025)
A Survey on Generative AI and LLM for Video Generation, Understanding, and Streaming
di: Zhou, Pengyuan, et al.
Pubblicazione: (2024)
di: Zhou, Pengyuan, et al.
Pubblicazione: (2024)
MMBench-Video: A Long-Form Multi-Shot Benchmark for Holistic Video Understanding
di: Fang, Xinyu, et al.
Pubblicazione: (2024)
di: Fang, Xinyu, et al.
Pubblicazione: (2024)
VideoMem: Constructing, Analyzing, Predicting Short-term and Long-term Video Memorability
di: Cohendet, Romain, et al.
Pubblicazione: (2018)
di: Cohendet, Romain, et al.
Pubblicazione: (2018)
VCEval: Rethinking What is a Good Educational Video and How to Automatically Evaluate It
di: Zhu, Xiaoxuan, et al.
Pubblicazione: (2024)
di: Zhu, Xiaoxuan, et al.
Pubblicazione: (2024)
A Human-Annotated Video Dataset for Training and Evaluation of 360-Degree Video Summarization Methods
di: Kontostathis, Ioannis, et al.
Pubblicazione: (2024)
di: Kontostathis, Ioannis, et al.
Pubblicazione: (2024)
ChatVTG: Video Temporal Grounding via Chat with Video Dialogue Large Language Models
di: Qu, Mengxue, et al.
Pubblicazione: (2024)
di: Qu, Mengxue, et al.
Pubblicazione: (2024)
KeyVideoLLM: Towards Large-scale Video Keyframe Selection
di: Liang, Hao, et al.
Pubblicazione: (2024)
di: Liang, Hao, et al.
Pubblicazione: (2024)
Hierarchical Action Recognition: A Contrastive Video-Language Approach with Hierarchical Interactions
di: Zhang, Rui, et al.
Pubblicazione: (2024)
di: Zhang, Rui, et al.
Pubblicazione: (2024)
Unbiased Video Scene Graph Generation via Visual and Semantic Dual Debiasing
di: Li, Yanjun, et al.
Pubblicazione: (2025)
di: Li, Yanjun, et al.
Pubblicazione: (2025)
Generalized Video Anomaly Event Detection: Systematic Taxonomy and Comparison of Deep Models
di: Liu, Yang, et al.
Pubblicazione: (2023)
di: Liu, Yang, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Immiscible Diffusion: Accelerating Diffusion Training with Noise Assignment
di: Li, Yiheng, et al.
Pubblicazione: (2024) -
FlowVid: Taming Imperfect Optical Flows for Consistent Video-to-Video Synthesis
di: Liang, Feng, et al.
Pubblicazione: (2023) -
Improved Immiscible Diffusion: Accelerate Diffusion Training by Reducing Its Miscibility
di: Li, Yiheng, et al.
Pubblicazione: (2025) -
Vision-Language Models Learn Super Images for Efficient Partially Relevant Video Retrieval
di: Nishimura, Taichi, et al.
Pubblicazione: (2023) -
StreamDiffusion: A Pipeline-level Solution for Real-time Interactive Generation
di: Kodaira, Akio, et al.
Pubblicazione: (2023)