OrthoPhys: Physically Plausible Video Generation with Orthogonal-View Geometry Guidance
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Cong, Zhu, Hanxin, Tang, Xiao, Luo, Jiayi, Jin, Xin, Chen, Long, Chen, Zhibo |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
GTA: Advancing Image-to-3D World Generation via Geometry Then Appearance Video Diffusion
por: Zhu, Hanxin, et al.
Publicado: (2026)
por: Zhu, Hanxin, et al.
Publicado: (2026)
CMC: Few-shot Novel View Synthesis via Cross-view Multiplane Consistency
por: Zhu, Hanxin, et al.
Publicado: (2024)
por: Zhu, Hanxin, et al.
Publicado: (2024)
Attention Sparsity is Input-Stable: Training-Free Sparse Attention for Video Generation via Offline Sparsity Profiling and Online QK Co-Clustering
por: Luo, Jiayi, et al.
Publicado: (2026)
por: Luo, Jiayi, et al.
Publicado: (2026)
Is Vanilla MLP in Neural Radiance Field Enough for Few-shot View Synthesis?
por: Zhu, Hanxin, et al.
Publicado: (2024)
por: Zhu, Hanxin, et al.
Publicado: (2024)
Compositional 3D-aware Video Generation with LLM Director
por: Zhu, Hanxin, et al.
Publicado: (2024)
por: Zhu, Hanxin, et al.
Publicado: (2024)
Future Forcing: Future-aware Training-free KV Cache Policy for Autoregressive Video Generation
por: Luo, Jiayi, et al.
Publicado: (2026)
por: Luo, Jiayi, et al.
Publicado: (2026)
TIV-Diffusion: Towards Object-Centric Movement for Text-driven Image to Video Generation
por: Wang, Xingrui, et al.
Publicado: (2024)
por: Wang, Xingrui, et al.
Publicado: (2024)
Embody4D: A Generalist 4D World Model for Embodied AI
por: Tu, Peiyan, et al.
Publicado: (2026)
por: Tu, Peiyan, et al.
Publicado: (2026)
AR4D: Autoregressive 4D Generation from Monocular Videos
por: Zhu, Hanxin, et al.
Publicado: (2025)
por: Zhu, Hanxin, et al.
Publicado: (2025)
Light Field Compression Based on Implicit Neural Representation
por: Wang, Henan, et al.
Publicado: (2024)
por: Wang, Henan, et al.
Publicado: (2024)
PhysPart: Physically Plausible Part Completion for Interactable Objects
por: Luo, Rundong, et al.
Publicado: (2024)
por: Luo, Rundong, et al.
Publicado: (2024)
GaussianSR: 3D Gaussian Super-Resolution with 2D Diffusion Priors
por: Yu, Xiqian, et al.
Publicado: (2024)
por: Yu, Xiqian, et al.
Publicado: (2024)
PhysVideoGenerator: Towards Physically Aware Video Generation via Latent Physics Guidance
por: Satish, Siddarth Nilol Kundur, et al.
Publicado: (2026)
por: Satish, Siddarth Nilol Kundur, et al.
Publicado: (2026)
Enhancing Physical Plausibility in Video Generation by Reasoning the Implausibility
por: Hao, Yutong, et al.
Publicado: (2025)
por: Hao, Yutong, et al.
Publicado: (2025)
Physically Plausible Human-Object Rendering from Sparse Views via 3D Gaussian Splatting
por: Wang, Weiquan, et al.
Publicado: (2025)
por: Wang, Weiquan, et al.
Publicado: (2025)
PhysCtrl: Generative Physics for Controllable and Physics-Grounded Video Generation
por: Wang, Chen, et al.
Publicado: (2025)
por: Wang, Chen, et al.
Publicado: (2025)
UCIP: A Universal Framework for Compressed Image Super-Resolution using Dynamic Prompt
por: Li, Xin, et al.
Publicado: (2024)
por: Li, Xin, et al.
Publicado: (2024)
Hierarchical Fine-grained Preference Optimization for Physically Plausible Video Generation
por: Chen, Harold Haodong, et al.
Publicado: (2025)
por: Chen, Harold Haodong, et al.
Publicado: (2025)
PhysMaster: Mastering Physical Representation for Video Generation via Reinforcement Learning
por: Ji, Sihui, et al.
Publicado: (2025)
por: Ji, Sihui, et al.
Publicado: (2025)
P-4DGS: Predictive 4D Gaussian Splatting with 90$\times$ Compression
por: Wang, Henan, et al.
Publicado: (2025)
por: Wang, Henan, et al.
Publicado: (2025)
GSemSplat: Generalizable Semantic 3D Gaussian Splatting from Uncalibrated Image Pairs
por: Wang, Xingrui, et al.
Publicado: (2024)
por: Wang, Xingrui, et al.
Publicado: (2024)
ACWM-Phys: Investigating Generalized Physical Interaction in Action-Conditioned Video World Models
por: Xue, Haotian, et al.
Publicado: (2026)
por: Xue, Haotian, et al.
Publicado: (2026)
Chain of Event-Centric Causal Thought for Physically Plausible Video Generation
por: Wang, Zixuan, et al.
Publicado: (2026)
por: Wang, Zixuan, et al.
Publicado: (2026)
MMPhysVideo: Scaling Physical Plausibility in Video Generation via Joint Multimodal Modeling
por: Lin, Shubo, et al.
Publicado: (2026)
por: Lin, Shubo, et al.
Publicado: (2026)
Training-free Camera Control for Video Generation
por: Hou, Chen, et al.
Publicado: (2024)
por: Hou, Chen, et al.
Publicado: (2024)
SeD: Semantic-Aware Discriminator for Image Super-Resolution
por: Li, Bingchen, et al.
Publicado: (2024)
por: Li, Bingchen, et al.
Publicado: (2024)
Cross-View Meets Diffusion: Aerial Image Synthesis with Geometry and Text Guidance
por: Arrabi, Ahmad, et al.
Publicado: (2024)
por: Arrabi, Ahmad, et al.
Publicado: (2024)
4DWorldBench: A Comprehensive Evaluation Framework for 3D/4D World Generation Models
por: Lu, Yiting, et al.
Publicado: (2025)
por: Lu, Yiting, et al.
Publicado: (2025)
Tempered Self-Similarity Alignment for Physically Plausible Video Generation
por: Kim, Manjin, et al.
Publicado: (2026)
por: Kim, Manjin, et al.
Publicado: (2026)
PhysReaction: Physically Plausible Real-Time Humanoid Reaction Synthesis via Forward Dynamics Guided 4D Imitation
por: Liu, Yunze, et al.
Publicado: (2024)
por: Liu, Yunze, et al.
Publicado: (2024)
OrthoEraser: Coupled-Neuron Orthogonal Projection for Concept Erasure
por: Shi, Chuancheng, et al.
Publicado: (2026)
por: Shi, Chuancheng, et al.
Publicado: (2026)
CaliTex: Geometry-Calibrated Attention for View-Coherent 3D Texture Generation
por: Liu, Chenyu, et al.
Publicado: (2025)
por: Liu, Chenyu, et al.
Publicado: (2025)
PhysMoDPO: Physically-Plausible Humanoid Motion with Preference Optimization
por: Zhang, Yangsong, et al.
Publicado: (2026)
por: Zhang, Yangsong, et al.
Publicado: (2026)
PhysChoreo: Physics-Controllable Video Generation with Part-Aware Semantic Grounding
por: Zhang, Haoze, et al.
Publicado: (2025)
por: Zhang, Haoze, et al.
Publicado: (2025)
From Generated Human Videos to Physically Plausible Robot Trajectories
por: Ni, James, et al.
Publicado: (2025)
por: Ni, James, et al.
Publicado: (2025)
PhysHMR: Learning Humanoid Control Policies from Vision for Physically Plausible Human Motion Reconstruction
por: Feng, Qiao, et al.
Publicado: (2025)
por: Feng, Qiao, et al.
Publicado: (2025)
FlowMotion: Training-Free Flow Guidance for Video Motion Transfer
por: Wang, Zhen, et al.
Publicado: (2026)
por: Wang, Zhen, et al.
Publicado: (2026)
VLA-JEPA: Enhancing Vision-Language-Action Model with Latent World Model
por: Sun, Jingwen, et al.
Publicado: (2026)
por: Sun, Jingwen, et al.
Publicado: (2026)
PhysRVG: Physics-Aware Unified Reinforcement Learning for Video Generative Models
por: Zhang, Qiyuan, et al.
Publicado: (2026)
por: Zhang, Qiyuan, et al.
Publicado: (2026)
Ortho-Hydra: Orthogonalized Experts for DiT LoRA
por: Ji, Seunghyun
Publicado: (2026)
por: Ji, Seunghyun
Publicado: (2026)
Ejemplares similares
-
GTA: Advancing Image-to-3D World Generation via Geometry Then Appearance Video Diffusion
por: Zhu, Hanxin, et al.
Publicado: (2026) -
CMC: Few-shot Novel View Synthesis via Cross-view Multiplane Consistency
por: Zhu, Hanxin, et al.
Publicado: (2024) -
Attention Sparsity is Input-Stable: Training-Free Sparse Attention for Video Generation via Offline Sparsity Profiling and Online QK Co-Clustering
por: Luo, Jiayi, et al.
Publicado: (2026) -
Is Vanilla MLP in Neural Radiance Field Enough for Few-shot View Synthesis?
por: Zhu, Hanxin, et al.
Publicado: (2024) -
Compositional 3D-aware Video Generation with LLM Director
por: Zhu, Hanxin, et al.
Publicado: (2024)