MVTokenFlow: High-quality 4D Content Generation using Multiview Token Flow
Fuente:
arXiv
Guardado en:
| Autores principales: | Huang, Hanzhuo, Liu, Yuan, Zheng, Ge, Wang, Jiepeng, Dou, Zhiyang, Yang, Sibei |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Adaptive Part Learning for Fine-Grained Generalized Category Discovery: A Plug-and-Play Enhancement
por: Dai, Qiyuan, et al.
Publicado: (2025)
por: Dai, Qiyuan, et al.
Publicado: (2025)
Dynamic Realms: 4D Content Analysis, Recovery and Generation with Geometric, Topological and Physical Priors
por: Dou, Zhiyang
Publicado: (2024)
por: Dou, Zhiyang
Publicado: (2024)
RefAny3D: 3D Asset-Referenced Diffusion Models for Image Generation
por: Huang, Hanzhuo, et al.
Publicado: (2026)
por: Huang, Hanzhuo, et al.
Publicado: (2026)
MV2UV: Generating High-quality UV Texture Maps with Multiview Prompts
por: Zhang, Zheng, et al.
Publicado: (2026)
por: Zhang, Zheng, et al.
Publicado: (2026)
MVD$^2$: Efficient Multiview 3D Reconstruction for Multiview Diffusion
por: Zheng, Xin-Yang, et al.
Publicado: (2024)
por: Zheng, Xin-Yang, et al.
Publicado: (2024)
Closed-Loop Transfer for Weakly-supervised Affordance Grounding
por: Tang, Jiajin, et al.
Publicado: (2025)
por: Tang, Jiajin, et al.
Publicado: (2025)
SuperFlow: Training Flow Matching Models with RL on the Fly
por: Chen, Kaijie, et al.
Publicado: (2025)
por: Chen, Kaijie, et al.
Publicado: (2025)
TokenHSI: Unified Synthesis of Physical Human-Scene Interactions through Task Tokenization
por: Pan, Liang, et al.
Publicado: (2025)
por: Pan, Liang, et al.
Publicado: (2025)
Syn4D: A Multiview Synthetic 4D Dataset
por: Jiang, Zeren, et al.
Publicado: (2026)
por: Jiang, Zeren, et al.
Publicado: (2026)
AdaHuman: Animatable Detailed 3D Human Generation with Compositional Multiview Diffusion
por: Huang, Yangyi, et al.
Publicado: (2025)
por: Huang, Yangyi, et al.
Publicado: (2025)
The devil is in the object boundary: towards annotation-free instance segmentation using Foundation Models
por: Shi, Cheng, et al.
Publicado: (2024)
por: Shi, Cheng, et al.
Publicado: (2024)
Illusion3D: 3D Multiview Illusion with 2D Diffusion Priors
por: Feng, Yue, et al.
Publicado: (2024)
por: Feng, Yue, et al.
Publicado: (2024)
TokenFlow: Unified Image Tokenizer for Multimodal Understanding and Generation
por: Qu, Liao, et al.
Publicado: (2024)
por: Qu, Liao, et al.
Publicado: (2024)
UniFlow: A Unified Pixel Flow Tokenizer for Visual Understanding and Generation
por: Yue, Zhengrong, et al.
Publicado: (2025)
por: Yue, Zhengrong, et al.
Publicado: (2025)
GaussianFlow: Splatting Gaussian Dynamics for 4D Content Creation
por: Gao, Quankai, et al.
Publicado: (2024)
por: Gao, Quankai, et al.
Publicado: (2024)
Self-Guidance: Boosting Flow and Diffusion Generation on Their Own
por: Li, Tiancheng, et al.
Publicado: (2024)
por: Li, Tiancheng, et al.
Publicado: (2024)
Era3D: High-Resolution Multiview Diffusion using Efficient Row-wise Attention
por: Li, Peng, et al.
Publicado: (2024)
por: Li, Peng, et al.
Publicado: (2024)
PixelFlow: Pixel-Space Generative Models with Flow
por: Chen, Shoufa, et al.
Publicado: (2025)
por: Chen, Shoufa, et al.
Publicado: (2025)
Intervene-All-Paths: Unified Mitigation of LVLM Hallucinations across Alignment Formats
por: Qian, Jiaye, et al.
Publicado: (2025)
por: Qian, Jiaye, et al.
Publicado: (2025)
4DVD: Cascaded Dense-view Video Diffusion Model for High-quality 4D Content Generation
por: Yang, Shuzhou, et al.
Publicado: (2025)
por: Yang, Shuzhou, et al.
Publicado: (2025)
FlowCoMotion: Text-to-Motion Generation via Token-Latent Flow Modeling
por: Guan, Dawei, et al.
Publicado: (2026)
por: Guan, Dawei, et al.
Publicado: (2026)
CMD: Controllable Multiview Diffusion for 3D Editing and Progressive Generation
por: Li, Peng, et al.
Publicado: (2025)
por: Li, Peng, et al.
Publicado: (2025)
DreamFlow: High-Quality Text-to-3D Generation by Approximating Probability Flow
por: Lee, Kyungmin, et al.
Publicado: (2024)
por: Lee, Kyungmin, et al.
Publicado: (2024)
SyncHuman: Synchronizing 2D and 3D Generative Models for Single-view Human Reconstruction
por: Chen, Wenyue, et al.
Publicado: (2025)
por: Chen, Wenyue, et al.
Publicado: (2025)
FlowTok: Flowing Seamlessly Across Text and Image Tokens
por: He, Ju, et al.
Publicado: (2025)
por: He, Ju, et al.
Publicado: (2025)
GO-Renderer: Generative Object Rendering with 3D-aware Controllable Video Diffusion Models
por: Gu, Zekai, et al.
Publicado: (2026)
por: Gu, Zekai, et al.
Publicado: (2026)
LaTtE-Flow: Layerwise Timestep-Expert Flow-based Transformer
por: Shen, Ying, et al.
Publicado: (2025)
por: Shen, Ying, et al.
Publicado: (2025)
PhysCtrl: Generative Physics for Controllable and Physics-Grounded Video Generation
por: Wang, Chen, et al.
Publicado: (2025)
por: Wang, Chen, et al.
Publicado: (2025)
Generative Multiview Relighting for 3D Reconstruction under Extreme Illumination Variation
por: Alzayer, Hadi, et al.
Publicado: (2024)
por: Alzayer, Hadi, et al.
Publicado: (2024)
Probability-Flow Distillation: Exact Wasserstein Gradient Flow for High-Fidelity 3D Generation
por: Ramanan, Rohith, et al.
Publicado: (2026)
por: Ramanan, Rohith, et al.
Publicado: (2026)
FlowDreamer: Exploring High Fidelity Text-to-3D Generation via Rectified Flow
por: Li, Hangyu, et al.
Publicado: (2024)
por: Li, Hangyu, et al.
Publicado: (2024)
4KDehazeFlow: Ultra-High-Definition Image Dehazing via Flow Matching
por: Chen, Xingchi, et al.
Publicado: (2025)
por: Chen, Xingchi, et al.
Publicado: (2025)
Curriculum Point Prompting for Weakly-Supervised Referring Image Segmentation
por: Dai, Qiyuan, et al.
Publicado: (2024)
por: Dai, Qiyuan, et al.
Publicado: (2024)
Free on the Fly: Enhancing Flexibility in Test-Time Adaptation with Online EM
por: Dai, Qiyuan, et al.
Publicado: (2025)
por: Dai, Qiyuan, et al.
Publicado: (2025)
Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow
por: Qian, Shenhan, et al.
Publicado: (2026)
por: Qian, Shenhan, et al.
Publicado: (2026)
Why LVLMs Are More Prone to Hallucinations in Longer Responses: The Role of Context
por: Zheng, Ge, et al.
Publicado: (2025)
por: Zheng, Ge, et al.
Publicado: (2025)
3D Shape Tokenization via Latent Flow Matching
por: Chang, Jen-Hao Rick, et al.
Publicado: (2024)
por: Chang, Jen-Hao Rick, et al.
Publicado: (2024)
Information Flow in Self-Supervised Learning
por: Tan, Zhiquan, et al.
Publicado: (2023)
por: Tan, Zhiquan, et al.
Publicado: (2023)
SSRFlow: Semantic-aware Fusion with Spatial Temporal Re-embedding for Real-world Scene Flow
por: Lu, Zhiyang, et al.
Publicado: (2024)
por: Lu, Zhiyang, et al.
Publicado: (2024)
Flow4D: Leveraging 4D Voxel Network for LiDAR Scene Flow Estimation
por: Kim, Jaeyeul, et al.
Publicado: (2024)
por: Kim, Jaeyeul, et al.
Publicado: (2024)
Ejemplares similares
-
Adaptive Part Learning for Fine-Grained Generalized Category Discovery: A Plug-and-Play Enhancement
por: Dai, Qiyuan, et al.
Publicado: (2025) -
Dynamic Realms: 4D Content Analysis, Recovery and Generation with Geometric, Topological and Physical Priors
por: Dou, Zhiyang
Publicado: (2024) -
RefAny3D: 3D Asset-Referenced Diffusion Models for Image Generation
por: Huang, Hanzhuo, et al.
Publicado: (2026) -
MV2UV: Generating High-quality UV Texture Maps with Multiview Prompts
por: Zhang, Zheng, et al.
Publicado: (2026) -
MVD$^2$: Efficient Multiview 3D Reconstruction for Multiview Diffusion
por: Zheng, Xin-Yang, et al.
Publicado: (2024)