VideoPanda: Video Panoramic Diffusion with Multi-view Attention
Fuente:
arXiv
Guardado en:
| Autores principales: | Xie, Kevin, Sabour, Amirmojtaba, Huang, Jiahui, Paschalidou, Despoina, Klar, Greg, Iqbal, Umar, Fidler, Sanja, Zeng, Xiaohui |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Align Your Steps: Optimizing Sampling Schedules in Diffusion Models
por: Sabour, Amirmojtaba, et al.
Publicado: (2024)
por: Sabour, Amirmojtaba, et al.
Publicado: (2024)
Align Your Flow: Scaling Continuous-Time Flow Map Distillation
por: Sabour, Amirmojtaba, et al.
Publicado: (2025)
por: Sabour, Amirmojtaba, et al.
Publicado: (2025)
XCube: Large-Scale 3D Generative Modeling using Sparse Voxel Hierarchies
por: Ren, Xuanchi, et al.
Publicado: (2023)
por: Ren, Xuanchi, et al.
Publicado: (2023)
PASTA: Controllable Part-Aware Shape Generation with Autoregressive Transformers
por: Li, Songlin, et al.
Publicado: (2024)
por: Li, Songlin, et al.
Publicado: (2024)
Controllable Weather Synthesis and Removal with Video Diffusion Models
por: Lin, Chih-Hao, et al.
Publicado: (2025)
por: Lin, Chih-Hao, et al.
Publicado: (2025)
LuxDiT: Lighting Estimation with Video Diffusion Transformer
por: Liang, Ruofan, et al.
Publicado: (2025)
por: Liang, Ruofan, et al.
Publicado: (2025)
EmerDiff: Emerging Pixel-level Semantic Knowledge in Diffusion Models
por: Namekata, Koichi, et al.
Publicado: (2024)
por: Namekata, Koichi, et al.
Publicado: (2024)
Lyra: Generative 3D Scene Reconstruction via Video Diffusion Model Self-Distillation
por: Bahmani, Sherwin, et al.
Publicado: (2025)
por: Bahmani, Sherwin, et al.
Publicado: (2025)
DiffusionRenderer: Neural Inverse and Forward Rendering with Video Diffusion Models
por: Liang, Ruofan, et al.
Publicado: (2025)
por: Liang, Ruofan, et al.
Publicado: (2025)
GEN3C: 3D-Informed World-Consistent Video Generation with Precise Camera Control
por: Ren, Xuanchi, et al.
Publicado: (2025)
por: Ren, Xuanchi, et al.
Publicado: (2025)
Feed-Forward Bullet-Time Reconstruction of Dynamic Scenes from Monocular Videos
por: Liang, Hanxue, et al.
Publicado: (2024)
por: Liang, Hanxue, et al.
Publicado: (2024)
ReMatching Dynamic Reconstruction Flow
por: Oblak, Sara, et al.
Publicado: (2024)
por: Oblak, Sara, et al.
Publicado: (2024)
InfiniCube: Unbounded and Controllable Dynamic 3D Driving Scene Generation with World-Guided Video Models
por: Lu, Yifan, et al.
Publicado: (2024)
por: Lu, Yifan, et al.
Publicado: (2024)
ViPE: Video Pose Engine for 3D Geometric Perception
por: Huang, Jiahui, et al.
Publicado: (2025)
por: Huang, Jiahui, et al.
Publicado: (2025)
Synchronized Multi‐Frame Diffusion for Temporally Consistent Video Stylization
por: Minshan Xie, et al.
Publicado: (2025)
por: Minshan Xie, et al.
Publicado: (2025)
fVDB: A Deep-Learning Framework for Sparse, Large-Scale, and High-Performance Spatial Intelligence
por: Williams, Francis, et al.
Publicado: (2024)
por: Williams, Francis, et al.
Publicado: (2024)
Bolt: Clothing Virtual Characters at Scale
por: Leaf, Jonathan, et al.
Publicado: (2025)
por: Leaf, Jonathan, et al.
Publicado: (2025)
D-Rex : Diffusion Rendering for Relightable Expressive Avatars
por: Teufel, Timo, et al.
Publicado: (2026)
por: Teufel, Timo, et al.
Publicado: (2026)
Sketch-based Fluid Video Generation Using Motion-Guided Diffusion Models in Still Landscape Images
por: Jin, Hao, et al.
Publicado: (2025)
por: Jin, Hao, et al.
Publicado: (2025)
TransVDM: Motion-Constrained Video Diffusion Model for Transparent Video Synthesis
por: Li, Menghao, et al.
Publicado: (2025)
por: Li, Menghao, et al.
Publicado: (2025)
VideoFrom3D: 3D Scene Video Generation via Complementary Image and Video Diffusion Models
por: Kim, Geonung, et al.
Publicado: (2025)
por: Kim, Geonung, et al.
Publicado: (2025)
EVA: Expressive Virtual Avatars from Multi-view Videos
por: Junkawitsch, Hendrik, et al.
Publicado: (2025)
por: Junkawitsch, Hendrik, et al.
Publicado: (2025)
GAF: Gaussian Avatar Reconstruction from Monocular Videos via Multi-view Diffusion
por: Tang, Jiapeng, et al.
Publicado: (2024)
por: Tang, Jiapeng, et al.
Publicado: (2024)
VidPanos: Generative Panoramic Videos from Casual Panning Videos
por: Ma, Jingwei, et al.
Publicado: (2024)
por: Ma, Jingwei, et al.
Publicado: (2024)
SuperPADL: Scaling Language-Directed Physics-Based Control with Progressive Supervised Distillation
por: Juravsky, Jordan, et al.
Publicado: (2024)
por: Juravsky, Jordan, et al.
Publicado: (2024)
Photorealistic Object Insertion with Diffusion-Guided Inverse Rendering
por: Liang, Ruofan, et al.
Publicado: (2024)
por: Liang, Ruofan, et al.
Publicado: (2024)
SCube: Instant Large-Scale Scene Reconstruction using VoxSplats
por: Ren, Xuanchi, et al.
Publicado: (2024)
por: Ren, Xuanchi, et al.
Publicado: (2024)
NeRF-XL: Scaling NeRFs with Multiple GPUs
por: Li, Ruilong, et al.
Publicado: (2024)
por: Li, Ruilong, et al.
Publicado: (2024)
VideoMat: Extracting PBR Materials from Video Diffusion Models
por: J. Munkberg, et al.
Publicado: (2025)
por: J. Munkberg, et al.
Publicado: (2025)
Motion Attribution for Video Generation
por: Wu, Xindi, et al.
Publicado: (2026)
por: Wu, Xindi, et al.
Publicado: (2026)
MeshAvatar: Learning High-quality Triangular Human Avatars from Multi-view Videos
por: Chen, Yushuo, et al.
Publicado: (2024)
por: Chen, Yushuo, et al.
Publicado: (2024)
LATTE3D: Large-scale Amortized Text-To-Enhanced3D Synthesis
por: Xie, Kevin, et al.
Publicado: (2024)
por: Xie, Kevin, et al.
Publicado: (2024)
CtrlVDiff: Controllable Video Generation via Unified Multimodal Video Diffusion
por: Xi, Dianbing, et al.
Publicado: (2025)
por: Xi, Dianbing, et al.
Publicado: (2025)
Empowering NPC Dialogue with Environmental Context Using LLMs and Panoramic Images
por: Radež, Grega, et al.
Publicado: (2026)
por: Radež, Grega, et al.
Publicado: (2026)
Dream, Lift, Animate: From Single Images to Animatable Gaussian Avatars
por: Bühler, Marcel C., et al.
Publicado: (2025)
por: Bühler, Marcel C., et al.
Publicado: (2025)
Collaborative Video Diffusion: Consistent Multi-video Generation with Camera Control
por: Kuang, Zhengfei, et al.
Publicado: (2024)
por: Kuang, Zhengfei, et al.
Publicado: (2024)
VideoMat: Extracting PBR Materials from Video Diffusion Models
por: Munkberg, Jacob, et al.
Publicado: (2025)
por: Munkberg, Jacob, et al.
Publicado: (2025)
AnimaMimic: Imitating 3D Animation from Video Priors
por: Xie, Tianyi, et al.
Publicado: (2025)
por: Xie, Tianyi, et al.
Publicado: (2025)
Row–Column Separated Attention Based Low‐Light Image/Video Enhancement
por: Chengqi Dong, et al.
Publicado: (2024)
por: Chengqi Dong, et al.
Publicado: (2024)
Consolidating Attention Features for Multi-view Image Editing
por: Patashnik, Or, et al.
Publicado: (2024)
por: Patashnik, Or, et al.
Publicado: (2024)
Ejemplares similares
-
Align Your Steps: Optimizing Sampling Schedules in Diffusion Models
por: Sabour, Amirmojtaba, et al.
Publicado: (2024) -
Align Your Flow: Scaling Continuous-Time Flow Map Distillation
por: Sabour, Amirmojtaba, et al.
Publicado: (2025) -
XCube: Large-Scale 3D Generative Modeling using Sparse Voxel Hierarchies
por: Ren, Xuanchi, et al.
Publicado: (2023) -
PASTA: Controllable Part-Aware Shape Generation with Autoregressive Transformers
por: Li, Songlin, et al.
Publicado: (2024) -
Controllable Weather Synthesis and Removal with Video Diffusion Models
por: Lin, Chih-Hao, et al.
Publicado: (2025)