ImViD: Immersive Volumetric Videos for Enhanced VR Engagement
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yang, Zhengxian, Pan, Shi, Wang, Shengqi, Wang, Haoxiang, Lin, Li, Li, Guanjun, Wen, Zhengqi, Lin, Borong, Tao, Jianhua, Yu, Tao |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Realizing Immersive Volumetric Video: A Multimodal Framework for 6-DoF VR Engagement
par: Yang, Zhengxian, et autres
Publié: (2026)
par: Yang, Zhengxian, et autres
Publié: (2026)
Den-SOFT: Dense Space-Oriented Light Field DataseT for 6-DOF Immersive Experience
par: Yu, Xiaohang, et autres
Publié: (2024)
par: Yu, Xiaohang, et autres
Publié: (2024)
Text Prompt is Not Enough: Sound Event Enhanced Prompt Adapter for Target Style Audio Generation
par: Xiong, Chenxu, et autres
Publié: (2024)
par: Xiong, Chenxu, et autres
Publié: (2024)
Exploring the Role of Audio in Multimodal Misinformation Detection
par: Liu, Moyang, et autres
Publié: (2024)
par: Liu, Moyang, et autres
Publié: (2024)
ClipGS-VR: Immersive and Interactive Cinematic Visualization of Volumetric Medical Data in Mobile Virtual Reality
par: Tong, Yuqi, et autres
Publié: (2026)
par: Tong, Yuqi, et autres
Publié: (2026)
Edit Content, Preserve Acoustics: Imperceptible Text-Based Speech Editing via Self-Consistency Rewards
par: Ren, Yong, et autres
Publié: (2026)
par: Ren, Yong, et autres
Publié: (2026)
MTPareto: A MultiModal Targeted Pareto Framework for Fake News Detection
par: Yan, Kaiying, et autres
Publié: (2025)
par: Yan, Kaiying, et autres
Publié: (2025)
RPRA-ADD: Forgery Trace Enhancement-Driven Audio Deepfake Detection
par: Fu, Ruibo, et autres
Publié: (2025)
par: Fu, Ruibo, et autres
Publié: (2025)
Robust Dual Gaussian Splatting for Immersive Human-centric Volumetric Videos
par: Jiang, Yuheng, et autres
Publié: (2024)
par: Jiang, Yuheng, et autres
Publié: (2024)
Chapter View Synthesis Tool for VR Immersive Video
par: Fachada, Sarah, et autres
Publié: (2024)
par: Fachada, Sarah, et autres
Publié: (2024)
DPI-TTS: Directional Patch Interaction for Fast-Converging and Style Temporal Modeling in Text-to-Speech
par: Qi, Xin, et autres
Publié: (2024)
par: Qi, Xin, et autres
Publié: (2024)
EELE: Exploring Efficient and Extensible LoRA Integration in Emotional Text-to-Speech
par: Qi, Xin, et autres
Publié: (2024)
par: Qi, Xin, et autres
Publié: (2024)
Mixture of Experts Fusion for Fake Audio Detection Using Frozen wav2vec 2.0
par: Wang, Zhiyong, et autres
Publié: (2024)
par: Wang, Zhiyong, et autres
Publié: (2024)
Residual Speaker Representation for One-Shot Voice Conversion
par: Xu, Le, et autres
Publié: (2023)
par: Xu, Le, et autres
Publié: (2023)
A Noval Feature via Color Quantisation for Fake Audio Detection
par: Wang, Zhiyong, et autres
Publié: (2024)
par: Wang, Zhiyong, et autres
Publié: (2024)
DashFusion: Dual-stream Alignment with Hierarchical Bottleneck Fusion for Multimodal Sentiment Analysis
par: Wen, Yuhua, et autres
Publié: (2025)
par: Wen, Yuhua, et autres
Publié: (2025)
Immersive Volumetric Video Playback: Near-RT Resource Allocation and O-RAN-based Implementation
par: Wen, Yao, et autres
Publié: (2026)
par: Wen, Yao, et autres
Publié: (2026)
MINT: a Multi-modal Image and Narrative Text Dubbing Dataset for Foley Audio Content Planning and Generation
par: Fu, Ruibo, et autres
Publié: (2024)
par: Fu, Ruibo, et autres
Publié: (2024)
Focus360: Guiding User Attention in Immersive Videos for VR
par: Silva, Paulo Vitor S., et autres
Publié: (2026)
par: Silva, Paulo Vitor S., et autres
Publié: (2026)
Does Current Deepfake Audio Detection Model Effectively Detect ALM-based Deepfake Audio?
par: Xie, Yuankun, et autres
Publié: (2024)
par: Xie, Yuankun, et autres
Publié: (2024)
A fast and efficient numerical method for computing the stress concentration between closely located stiff inclusions of general shapes
par: Li, Xiaofei, et autres
Publié: (2023)
par: Li, Xiaofei, et autres
Publié: (2023)
ImVideoEdit: Image-learning Video Editing via 2D Spatial Difference Attention Blocks
par: Xu, Jiayang, et autres
Publié: (2026)
par: Xu, Jiayang, et autres
Publié: (2026)
RT-NeRF: Real-Time On-Device Neural Radiance Fields Towards Immersive AR/VR Rendering
par: Li, Chaojian, et autres
Publié: (2022)
par: Li, Chaojian, et autres
Publié: (2022)
RePerformer: Immersive Human-centric Volumetric Videos from Playback to Photoreal Reperformance
par: Jiang, Yuheng, et autres
Publié: (2025)
par: Jiang, Yuheng, et autres
Publié: (2025)
ViVo: A Dataset for Volumetric Video Reconstruction and Compression
par: Azzarelli, Adrian, et autres
Publié: (2025)
par: Azzarelli, Adrian, et autres
Publié: (2025)
VR Calm Plus: Coupling a Squeezable Tangible Interaction with Immersive VR for Stress Regulation
par: Zhang, He, et autres
Publié: (2026)
par: Zhang, He, et autres
Publié: (2026)
On the Performance and Memory Footprint of Distributed Training: An Empirical Study on Transformers
par: Lu, Zhengxian, et autres
Publié: (2024)
par: Lu, Zhengxian, et autres
Publié: (2024)
On the Performance and Memory Footprint of Distributed Training: An Empirical Study on Transformers
par: Zhengxian Lu, et autres
Publié: (2025)
par: Zhengxian Lu, et autres
Publié: (2025)
Multimodal Diffusion Transformer with Memory Bank for Scalable Long-Duration Talking Video Generation
par: Zhang, Haojie, et autres
Publié: (2024)
par: Zhang, Haojie, et autres
Publié: (2024)
PSA-MF: Personality-Sentiment Aligned Multi-Level Fusion for Multimodal Sentiment Analysis
par: Xie, Heng, et autres
Publié: (2025)
par: Xie, Heng, et autres
Publié: (2025)
The optical conductivity of the 2D $t-J$ model and the origin of electron incoherence in the high-T$_{c}$ cuprate superconductors: a variational study
par: Yang, Jianhua, et autres
Publié: (2023)
par: Yang, Jianhua, et autres
Publié: (2023)
TraceableSpeech: Towards Proactively Traceable Text-to-Speech with Watermarking
par: Zhou, Junzuo, et autres
Publié: (2024)
par: Zhou, Junzuo, et autres
Publié: (2024)
Wind Resource Evaluation With Atmospheric Stability Across Different Surface Types
par: Zejia Hua, et autres
Publié: (2026)
par: Zejia Hua, et autres
Publié: (2026)
Fake News Detection and Manipulation Reasoning via Large Vision-Language Models
par: Jin, Ruihan, et autres
Publié: (2024)
par: Jin, Ruihan, et autres
Publié: (2024)
ControlHair: Physically-based Video Diffusion for Controllable Dynamic Hair Rendering
par: Lin, Weikai, et autres
Publié: (2025)
par: Lin, Weikai, et autres
Publié: (2025)
Enhancing Sign Language Teaching: A Mixed Reality Approach for Immersive Learning and Multi-Dimensional Feedback
par: Wen, Hongli, et autres
Publié: (2024)
par: Wen, Hongli, et autres
Publié: (2024)
PackUV: Packed Gaussian UV Maps for 4D Volumetric Video
par: Rai, Aashish, et autres
Publié: (2026)
par: Rai, Aashish, et autres
Publié: (2026)
From Air to Wear: Personalized 3D Digital Fashion with AR/VR Immersive 3D Sketching
par: Zang, Ying, et autres
Publié: (2025)
par: Zang, Ying, et autres
Publié: (2025)
P2Mark: Plug-and-play Parameter-level Watermarking for Neural Speech Generation
par: Ren, Yong, et autres
Publié: (2025)
par: Ren, Yong, et autres
Publié: (2025)
ViLA: Efficient Video-Language Alignment for Video Question Answering
par: Wang, Xijun, et autres
Publié: (2023)
par: Wang, Xijun, et autres
Publié: (2023)
Documents similaires
-
Realizing Immersive Volumetric Video: A Multimodal Framework for 6-DoF VR Engagement
par: Yang, Zhengxian, et autres
Publié: (2026) -
Den-SOFT: Dense Space-Oriented Light Field DataseT for 6-DOF Immersive Experience
par: Yu, Xiaohang, et autres
Publié: (2024) -
Text Prompt is Not Enough: Sound Event Enhanced Prompt Adapter for Target Style Audio Generation
par: Xiong, Chenxu, et autres
Publié: (2024) -
Exploring the Role of Audio in Multimodal Misinformation Detection
par: Liu, Moyang, et autres
Publié: (2024) -
ClipGS-VR: Immersive and Interactive Cinematic Visualization of Volumetric Medical Data in Mobile Virtual Reality
par: Tong, Yuqi, et autres
Publié: (2026)