A Unified Solution to Video Fusion: From Multi-Frame Learning to Benchmarking
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhao, Zixiang, Bai, Haowen, Ke, Bingxin, Cui, Yukun, Deng, Lilun, Zhang, Yulun, Zhang, Kai, Schindler, Konrad |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
MambaVF: State Space Model for Efficient Video Fusion
por: Zhao, Zixiang, et al.
Publicado: (2026)
por: Zhao, Zixiang, et al.
Publicado: (2026)
Retinex-MEF: Retinex-based Glare Effects Aware Unsupervised Multi-Exposure Image Fusion
por: Bai, Haowen, et al.
Publicado: (2025)
por: Bai, Haowen, et al.
Publicado: (2025)
ReFusion: Learning Image Fusion from Reconstruction with Learnable Loss via Meta-Learning
por: Bai, Haowen, et al.
Publicado: (2023)
por: Bai, Haowen, et al.
Publicado: (2023)
Deep Unfolding Multi-modal Image Fusion Network via Attribution Analysis
por: Bai, Haowen, et al.
Publicado: (2025)
por: Bai, Haowen, et al.
Publicado: (2025)
Task-driven Image Fusion with Learnable Fusion Loss
por: Bai, Haowen, et al.
Publicado: (2024)
por: Bai, Haowen, et al.
Publicado: (2024)
Image Fusion via Vision-Language Model
por: Zhao, Zixiang, et al.
Publicado: (2024)
por: Zhao, Zixiang, et al.
Publicado: (2024)
Equivariant Multi-Modality Image Fusion
por: Zhao, Zixiang, et al.
Publicado: (2023)
por: Zhao, Zixiang, et al.
Publicado: (2023)
Simultaneous Automatic Picking and Manual Picking Refinement for First-Break
por: Bai, Haowen, et al.
Publicado: (2025)
por: Bai, Haowen, et al.
Publicado: (2025)
Video Depth without Video Models
por: Ke, Bingxin, et al.
Publicado: (2024)
por: Ke, Bingxin, et al.
Publicado: (2024)
StereoSpace: Depth-Free Synthesis of Stereo Geometry via End-to-End Diffusion in a Canonical Space
por: Behrens, Tjark, et al.
Publicado: (2025)
por: Behrens, Tjark, et al.
Publicado: (2025)
SatFusion: A Unified Framework for Enhancing Remote Sensing Images via Multi-Frame and Multi-Source Images Fusion
por: Tong, Yufei, et al.
Publicado: (2025)
por: Tong, Yufei, et al.
Publicado: (2025)
Repurposing Diffusion-Based Image Generators for Monocular Depth Estimation
por: Ke, Bingxin, et al.
Publicado: (2023)
por: Ke, Bingxin, et al.
Publicado: (2023)
Hipandas: Hyperspectral Image Joint Denoising and Super-Resolution by Image Fusion with the Panchromatic Image
por: Xu, Shuang, et al.
Publicado: (2024)
por: Xu, Shuang, et al.
Publicado: (2024)
BetterDepth: Plug-and-Play Diffusion Refiner for Zero-Shot Monocular Depth Estimation
por: Zhang, Xiang, et al.
Publicado: (2024)
por: Zhang, Xiang, et al.
Publicado: (2024)
PMQ-VE: Progressive Multi-Frame Quantization for Video Enhancement
por: Feng, ZhanFeng, et al.
Publicado: (2025)
por: Feng, ZhanFeng, et al.
Publicado: (2025)
VFIMamba: Video Frame Interpolation with State Space Models
por: Zhang, Guozhen, et al.
Publicado: (2024)
por: Zhang, Guozhen, et al.
Publicado: (2024)
Marigold-DC: Zero-Shot Monocular Depth Completion with Guided Diffusion
por: Viola, Massimiliano, et al.
Publicado: (2024)
por: Viola, Massimiliano, et al.
Publicado: (2024)
Benchmarking Video Frame Interpolation
por: Kiefhaber, Simon, et al.
Publicado: (2024)
por: Kiefhaber, Simon, et al.
Publicado: (2024)
FastVMT: Eliminating Redundancy in Video Motion Transfer
por: Ma, Yue, et al.
Publicado: (2026)
por: Ma, Yue, et al.
Publicado: (2026)
SViQA: A Unified Speech-Vision Multimodal Model for Textless Visual Question Answering
por: Li, Bingxin
Publicado: (2025)
por: Li, Bingxin
Publicado: (2025)
Marigold: Affordable Adaptation of Diffusion-Based Image Generators for Image Analysis
por: Ke, Bingxin, et al.
Publicado: (2025)
por: Ke, Bingxin, et al.
Publicado: (2025)
Depth Completion as Parameter-Efficient Test-Time Adaptation
por: Ke, Bingxin, et al.
Publicado: (2026)
por: Ke, Bingxin, et al.
Publicado: (2026)
Fose: Fusion of One-Step Diffusion and End-to-End Network for Pansharpening
por: Liu, Kai, et al.
Publicado: (2025)
por: Liu, Kai, et al.
Publicado: (2025)
Efficient Video Diffusion with Sparse Information Transmission for Video Compression
por: Zhou, Mingde, et al.
Publicado: (2026)
por: Zhou, Mingde, et al.
Publicado: (2026)
Continual Text-to-Video Retrieval with Frame Fusion and Task-Aware Routing
por: Zhao, Zecheng, et al.
Publicado: (2025)
por: Zhao, Zecheng, et al.
Publicado: (2025)
VideoFusion: A Spatio-Temporal Collaborative Network for Multi-modal Video Fusion
por: Tang, Linfeng, et al.
Publicado: (2025)
por: Tang, Linfeng, et al.
Publicado: (2025)
Motion-Aware Generative Frame Interpolation
por: Zhang, Guozhen, et al.
Publicado: (2025)
por: Zhang, Guozhen, et al.
Publicado: (2025)
Motion-Aware Video Frame Interpolation
por: Han, Pengfei, et al.
Publicado: (2024)
por: Han, Pengfei, et al.
Publicado: (2024)
FrameMind: Frame-Interleaved Video Reasoning via Reinforcement Learning
por: Ge, Haonan, et al.
Publicado: (2025)
por: Ge, Haonan, et al.
Publicado: (2025)
DySink: Dynamic Frame Sinks for Autoregressive Long Video Generation
por: Ye, Bo, et al.
Publicado: (2026)
por: Ye, Bo, et al.
Publicado: (2026)
Q-Frame: Query-aware Frame Selection and Multi-Resolution Adaptation for Video-LLMs
por: Zhang, Shaojie, et al.
Publicado: (2025)
por: Zhang, Shaojie, et al.
Publicado: (2025)
WIFE-Fusion:Wavelet-aware Intra-inter Frequency Enhancement for Multi-model Image Fusion
por: Zhang, Tianpei, et al.
Publicado: (2025)
por: Zhang, Tianpei, et al.
Publicado: (2025)
EventDiff: A Unified and Efficient Diffusion Model Framework for Event-based Video Frame Interpolation
por: Zheng, Hanle, et al.
Publicado: (2025)
por: Zheng, Hanle, et al.
Publicado: (2025)
UPP: Unified Point-Level Prompting for Robust Point Cloud Analysis
por: Ai, Zixiang, et al.
Publicado: (2025)
por: Ai, Zixiang, et al.
Publicado: (2025)
Continuous Space-Time Video Super-Resolution with 3D Fourier Fields
por: Becker, Alexander, et al.
Publicado: (2025)
por: Becker, Alexander, et al.
Publicado: (2025)
Unified Panoramic Geometry Estimation via Multi-View Foundation Models
por: Bozic, Vukasin, et al.
Publicado: (2026)
por: Bozic, Vukasin, et al.
Publicado: (2026)
Unified Arbitrary-Time Video Frame Interpolation and Prediction
por: Jin, Xin, et al.
Publicado: (2025)
por: Jin, Xin, et al.
Publicado: (2025)
Benchmarking Multi-dimensional AIGC Video Quality Assessment: A Dataset and Unified Model
por: Zhang, Zhichao, et al.
Publicado: (2024)
por: Zhang, Zhichao, et al.
Publicado: (2024)
Text-to-3D by Stitching a Multi-view Reconstruction Network to a Video Generator
por: Go, Hyojun, et al.
Publicado: (2025)
por: Go, Hyojun, et al.
Publicado: (2025)
FrameThinker: Learning to Think with Long Videos via Multi-Turn Frame Spotlighting
por: He, Zefeng, et al.
Publicado: (2025)
por: He, Zefeng, et al.
Publicado: (2025)
Ejemplares similares
-
MambaVF: State Space Model for Efficient Video Fusion
por: Zhao, Zixiang, et al.
Publicado: (2026) -
Retinex-MEF: Retinex-based Glare Effects Aware Unsupervised Multi-Exposure Image Fusion
por: Bai, Haowen, et al.
Publicado: (2025) -
ReFusion: Learning Image Fusion from Reconstruction with Learnable Loss via Meta-Learning
por: Bai, Haowen, et al.
Publicado: (2023) -
Deep Unfolding Multi-modal Image Fusion Network via Attribution Analysis
por: Bai, Haowen, et al.
Publicado: (2025) -
Task-driven Image Fusion with Learnable Fusion Loss
por: Bai, Haowen, et al.
Publicado: (2024)