ImViD: Immersive Volumetric Videos for Enhanced VR Engagement
Fuente:
arXiv
Guardado en:
| Autores principales: | Yang, Zhengxian, Pan, Shi, Wang, Shengqi, Wang, Haoxiang, Lin, Li, Li, Guanjun, Wen, Zhengqi, Lin, Borong, Tao, Jianhua, Yu, Tao |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Realizing Immersive Volumetric Video: A Multimodal Framework for 6-DoF VR Engagement
por: Yang, Zhengxian, et al.
Publicado: (2026)
por: Yang, Zhengxian, et al.
Publicado: (2026)
Den-SOFT: Dense Space-Oriented Light Field DataseT for 6-DOF Immersive Experience
por: Yu, Xiaohang, et al.
Publicado: (2024)
por: Yu, Xiaohang, et al.
Publicado: (2024)
Text Prompt is Not Enough: Sound Event Enhanced Prompt Adapter for Target Style Audio Generation
por: Xiong, Chenxu, et al.
Publicado: (2024)
por: Xiong, Chenxu, et al.
Publicado: (2024)
Exploring the Role of Audio in Multimodal Misinformation Detection
por: Liu, Moyang, et al.
Publicado: (2024)
por: Liu, Moyang, et al.
Publicado: (2024)
ClipGS-VR: Immersive and Interactive Cinematic Visualization of Volumetric Medical Data in Mobile Virtual Reality
por: Tong, Yuqi, et al.
Publicado: (2026)
por: Tong, Yuqi, et al.
Publicado: (2026)
Edit Content, Preserve Acoustics: Imperceptible Text-Based Speech Editing via Self-Consistency Rewards
por: Ren, Yong, et al.
Publicado: (2026)
por: Ren, Yong, et al.
Publicado: (2026)
MTPareto: A MultiModal Targeted Pareto Framework for Fake News Detection
por: Yan, Kaiying, et al.
Publicado: (2025)
por: Yan, Kaiying, et al.
Publicado: (2025)
RPRA-ADD: Forgery Trace Enhancement-Driven Audio Deepfake Detection
por: Fu, Ruibo, et al.
Publicado: (2025)
por: Fu, Ruibo, et al.
Publicado: (2025)
Robust Dual Gaussian Splatting for Immersive Human-centric Volumetric Videos
por: Jiang, Yuheng, et al.
Publicado: (2024)
por: Jiang, Yuheng, et al.
Publicado: (2024)
Chapter View Synthesis Tool for VR Immersive Video
por: Fachada, Sarah, et al.
Publicado: (2024)
por: Fachada, Sarah, et al.
Publicado: (2024)
DPI-TTS: Directional Patch Interaction for Fast-Converging and Style Temporal Modeling in Text-to-Speech
por: Qi, Xin, et al.
Publicado: (2024)
por: Qi, Xin, et al.
Publicado: (2024)
EELE: Exploring Efficient and Extensible LoRA Integration in Emotional Text-to-Speech
por: Qi, Xin, et al.
Publicado: (2024)
por: Qi, Xin, et al.
Publicado: (2024)
Mixture of Experts Fusion for Fake Audio Detection Using Frozen wav2vec 2.0
por: Wang, Zhiyong, et al.
Publicado: (2024)
por: Wang, Zhiyong, et al.
Publicado: (2024)
Residual Speaker Representation for One-Shot Voice Conversion
por: Xu, Le, et al.
Publicado: (2023)
por: Xu, Le, et al.
Publicado: (2023)
A Noval Feature via Color Quantisation for Fake Audio Detection
por: Wang, Zhiyong, et al.
Publicado: (2024)
por: Wang, Zhiyong, et al.
Publicado: (2024)
DashFusion: Dual-stream Alignment with Hierarchical Bottleneck Fusion for Multimodal Sentiment Analysis
por: Wen, Yuhua, et al.
Publicado: (2025)
por: Wen, Yuhua, et al.
Publicado: (2025)
Immersive Volumetric Video Playback: Near-RT Resource Allocation and O-RAN-based Implementation
por: Wen, Yao, et al.
Publicado: (2026)
por: Wen, Yao, et al.
Publicado: (2026)
MINT: a Multi-modal Image and Narrative Text Dubbing Dataset for Foley Audio Content Planning and Generation
por: Fu, Ruibo, et al.
Publicado: (2024)
por: Fu, Ruibo, et al.
Publicado: (2024)
Focus360: Guiding User Attention in Immersive Videos for VR
por: Silva, Paulo Vitor S., et al.
Publicado: (2026)
por: Silva, Paulo Vitor S., et al.
Publicado: (2026)
Does Current Deepfake Audio Detection Model Effectively Detect ALM-based Deepfake Audio?
por: Xie, Yuankun, et al.
Publicado: (2024)
por: Xie, Yuankun, et al.
Publicado: (2024)
A fast and efficient numerical method for computing the stress concentration between closely located stiff inclusions of general shapes
por: Li, Xiaofei, et al.
Publicado: (2023)
por: Li, Xiaofei, et al.
Publicado: (2023)
ImVideoEdit: Image-learning Video Editing via 2D Spatial Difference Attention Blocks
por: Xu, Jiayang, et al.
Publicado: (2026)
por: Xu, Jiayang, et al.
Publicado: (2026)
RT-NeRF: Real-Time On-Device Neural Radiance Fields Towards Immersive AR/VR Rendering
por: Li, Chaojian, et al.
Publicado: (2022)
por: Li, Chaojian, et al.
Publicado: (2022)
RePerformer: Immersive Human-centric Volumetric Videos from Playback to Photoreal Reperformance
por: Jiang, Yuheng, et al.
Publicado: (2025)
por: Jiang, Yuheng, et al.
Publicado: (2025)
ViVo: A Dataset for Volumetric Video Reconstruction and Compression
por: Azzarelli, Adrian, et al.
Publicado: (2025)
por: Azzarelli, Adrian, et al.
Publicado: (2025)
VR Calm Plus: Coupling a Squeezable Tangible Interaction with Immersive VR for Stress Regulation
por: Zhang, He, et al.
Publicado: (2026)
por: Zhang, He, et al.
Publicado: (2026)
On the Performance and Memory Footprint of Distributed Training: An Empirical Study on Transformers
por: Lu, Zhengxian, et al.
Publicado: (2024)
por: Lu, Zhengxian, et al.
Publicado: (2024)
On the Performance and Memory Footprint of Distributed Training: An Empirical Study on Transformers
por: Zhengxian Lu, et al.
Publicado: (2025)
por: Zhengxian Lu, et al.
Publicado: (2025)
Multimodal Diffusion Transformer with Memory Bank for Scalable Long-Duration Talking Video Generation
por: Zhang, Haojie, et al.
Publicado: (2024)
por: Zhang, Haojie, et al.
Publicado: (2024)
PSA-MF: Personality-Sentiment Aligned Multi-Level Fusion for Multimodal Sentiment Analysis
por: Xie, Heng, et al.
Publicado: (2025)
por: Xie, Heng, et al.
Publicado: (2025)
The optical conductivity of the 2D $t-J$ model and the origin of electron incoherence in the high-T$_{c}$ cuprate superconductors: a variational study
por: Yang, Jianhua, et al.
Publicado: (2023)
por: Yang, Jianhua, et al.
Publicado: (2023)
TraceableSpeech: Towards Proactively Traceable Text-to-Speech with Watermarking
por: Zhou, Junzuo, et al.
Publicado: (2024)
por: Zhou, Junzuo, et al.
Publicado: (2024)
Wind Resource Evaluation With Atmospheric Stability Across Different Surface Types
por: Zejia Hua, et al.
Publicado: (2026)
por: Zejia Hua, et al.
Publicado: (2026)
Fake News Detection and Manipulation Reasoning via Large Vision-Language Models
por: Jin, Ruihan, et al.
Publicado: (2024)
por: Jin, Ruihan, et al.
Publicado: (2024)
ControlHair: Physically-based Video Diffusion for Controllable Dynamic Hair Rendering
por: Lin, Weikai, et al.
Publicado: (2025)
por: Lin, Weikai, et al.
Publicado: (2025)
Enhancing Sign Language Teaching: A Mixed Reality Approach for Immersive Learning and Multi-Dimensional Feedback
por: Wen, Hongli, et al.
Publicado: (2024)
por: Wen, Hongli, et al.
Publicado: (2024)
PackUV: Packed Gaussian UV Maps for 4D Volumetric Video
por: Rai, Aashish, et al.
Publicado: (2026)
por: Rai, Aashish, et al.
Publicado: (2026)
From Air to Wear: Personalized 3D Digital Fashion with AR/VR Immersive 3D Sketching
por: Zang, Ying, et al.
Publicado: (2025)
por: Zang, Ying, et al.
Publicado: (2025)
P2Mark: Plug-and-play Parameter-level Watermarking for Neural Speech Generation
por: Ren, Yong, et al.
Publicado: (2025)
por: Ren, Yong, et al.
Publicado: (2025)
ViLA: Efficient Video-Language Alignment for Video Question Answering
por: Wang, Xijun, et al.
Publicado: (2023)
por: Wang, Xijun, et al.
Publicado: (2023)
Ejemplares similares
-
Realizing Immersive Volumetric Video: A Multimodal Framework for 6-DoF VR Engagement
por: Yang, Zhengxian, et al.
Publicado: (2026) -
Den-SOFT: Dense Space-Oriented Light Field DataseT for 6-DOF Immersive Experience
por: Yu, Xiaohang, et al.
Publicado: (2024) -
Text Prompt is Not Enough: Sound Event Enhanced Prompt Adapter for Target Style Audio Generation
por: Xiong, Chenxu, et al.
Publicado: (2024) -
Exploring the Role of Audio in Multimodal Misinformation Detection
por: Liu, Moyang, et al.
Publicado: (2024) -
ClipGS-VR: Immersive and Interactive Cinematic Visualization of Volumetric Medical Data in Mobile Virtual Reality
por: Tong, Yuqi, et al.
Publicado: (2026)