RiverEcho: Real-Time Interactive Digital System for Ancient Yellow River Culture
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Haofeng, Guo, Yilin, Li, Zehao, Yue, Tong, Wang, Yizong, Zhang, Enci, Lin, Rongqun, Gao, Feng, Wang, Shiqi, Ma, Siwei |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
End-to-End RGB-IR Joint Image Compression With Channel-wise Cross-modality Entropy Model
por: Wang, Haofeng, et al.
Publicado: (2025)
por: Wang, Haofeng, et al.
Publicado: (2025)
Compact Visual Data Representation for Green Multimedia -- A Human Visual System Perspective
por: Chen, Peilin, et al.
Publicado: (2024)
por: Chen, Peilin, et al.
Publicado: (2024)
VARFVV: View-Adaptive Real-Time Interactive Free-View Video Streaming with Edge Computing
por: Hu, Qiang, et al.
Publicado: (2025)
por: Hu, Qiang, et al.
Publicado: (2025)
SPC-NeRF: Spatial Predictive Compression for Voxel Based Radiance Field
por: Song, Zetian, et al.
Publicado: (2024)
por: Song, Zetian, et al.
Publicado: (2024)
Video Echoed in Music: Semantic, Temporal, and Rhythmic Alignment for Video-to-Music Generation
por: Tong, Xinyi, et al.
Publicado: (2025)
por: Tong, Xinyi, et al.
Publicado: (2025)
EidetiCom: A Cross-modal Brain-Computer Semantic Communication Paradigm for Decoding Visual Perception
por: Zheng, Linfeng, et al.
Publicado: (2024)
por: Zheng, Linfeng, et al.
Publicado: (2024)
Latent Feature-Guided Conditional Diffusion for Generative Image Semantic Communication
por: Chen, Zehao, et al.
Publicado: (2025)
por: Chen, Zehao, et al.
Publicado: (2025)
Voxel-GS: Quantized Scaffold Gaussian Splatting Compression with Run-Length Coding
por: Fu, Chunyang, et al.
Publicado: (2025)
por: Fu, Chunyang, et al.
Publicado: (2025)
Period-conscious Time-series Reconstruction under Local Differential Privacy
por: Wang, Yaxuan, et al.
Publicado: (2026)
por: Wang, Yaxuan, et al.
Publicado: (2026)
The Rhythm of Tai Chi: Revitalizing Cultural Heritage in Virtual Reality through Interactive Visuals
por: Wang, Xianghan
Publicado: (2025)
por: Wang, Xianghan
Publicado: (2025)
An Emotion Recognition Framework via Cross-modal Alignment of EEG and Eye Movement Data
por: Wang, Jianlu, et al.
Publicado: (2025)
por: Wang, Jianlu, et al.
Publicado: (2025)
Rethinking Bjøntegaard Delta for Compression Efficiency Evaluation: Are We Calculating It Precisely and Reliably?
por: Hang, Xinyu, et al.
Publicado: (2024)
por: Hang, Xinyu, et al.
Publicado: (2024)
EmotionTalk: An Interactive Chinese Multimodal Emotion Dataset With Rich Annotations
por: Sun, Haoqin, et al.
Publicado: (2025)
por: Sun, Haoqin, et al.
Publicado: (2025)
Towards Real-World Stickers Use: A New Dataset for Multi-Tag Sticker Recognition
por: Wang, Bingbing, et al.
Publicado: (2024)
por: Wang, Bingbing, et al.
Publicado: (2024)
ASAP: Advancing Semantic Alignment Promotes Multi-Modal Manipulation Detecting and Grounding
por: Zhang, Zhenxing, et al.
Publicado: (2024)
por: Zhang, Zhenxing, et al.
Publicado: (2024)
Enkidu: Universal Frequential Perturbation for Real-Time Audio Privacy Protection against Voice Deepfakes
por: Feng, Zhou, et al.
Publicado: (2025)
por: Feng, Zhou, et al.
Publicado: (2025)
Virbo: Multimodal Multilingual Avatar Video Generation in Digital Marketing
por: Zhang, Juan, et al.
Publicado: (2024)
por: Zhang, Juan, et al.
Publicado: (2024)
Transforming Video Subjective Testing with Training, Engagement, and Real-Time Feedback
por: Rahul, Kumar, et al.
Publicado: (2026)
por: Rahul, Kumar, et al.
Publicado: (2026)
Predicting Satisfied User and Machine Ratio for Compressed Images: A Unified Approach
por: Zhang, Qi, et al.
Publicado: (2024)
por: Zhang, Qi, et al.
Publicado: (2024)
Perceive-Sample-Compress: Towards Real-Time 3D Gaussian Splatting
por: Wang, Zijian, et al.
Publicado: (2025)
por: Wang, Zijian, et al.
Publicado: (2025)
Mitigating Multimodal Inconsistency via Cognitive Dual-Pathway Reasoning for Intent Recognition
por: Wang, Yifan, et al.
Publicado: (2026)
por: Wang, Yifan, et al.
Publicado: (2026)
LiveK12Bench: Have Large Multimodal Models Truly Conquered High School-level Examinations?
por: Wang, Xiaohan, et al.
Publicado: (2026)
por: Wang, Xiaohan, et al.
Publicado: (2026)
Real-Time Interactive Hybrid Ocean: Spectrum-Consistent Wave Particle-FFT Coupling
por: Xue, Shengze, et al.
Publicado: (2025)
por: Xue, Shengze, et al.
Publicado: (2025)
EchoSR: Efficient Context Harnessing for Lightweight Image Super-Resolution
por: Zhao, Hanli, et al.
Publicado: (2026)
por: Zhao, Hanli, et al.
Publicado: (2026)
DeepStream: Prototyping Deep Joint Source-Channel Coding for Real-Time Multimedia Transmissions
por: Chi, Kaiyi, et al.
Publicado: (2025)
por: Chi, Kaiyi, et al.
Publicado: (2025)
Volume Tracking Based Reference Mesh Extraction for Time-Varying Mesh Compression
por: Chen, Guodong, et al.
Publicado: (2024)
por: Chen, Guodong, et al.
Publicado: (2024)
Muse: A Multimodal Conversational Recommendation Dataset with Scenario-Grounded User Profiles
por: Wang, Zihan, et al.
Publicado: (2024)
por: Wang, Zihan, et al.
Publicado: (2024)
CueNet: Robust Audio-Visual Speaker Extraction through Cross-Modal Cue Mining and Interaction
por: Wang, Jiadong, et al.
Publicado: (2026)
por: Wang, Jiadong, et al.
Publicado: (2026)
Beyond Isolated Utterances: Cue-Guided Interaction for Context-Dependent Conversational Multimodal Understanding
por: Pan, Zhaoyan, et al.
Publicado: (2026)
por: Pan, Zhaoyan, et al.
Publicado: (2026)
Opinion-Unaware Blind Image Quality Assessment using Multi-Scale Deep Feature Statistics
por: Ni, Zhangkai, et al.
Publicado: (2024)
por: Ni, Zhangkai, et al.
Publicado: (2024)
RealBench: A Chinese Multi-image Understanding Benchmark Close to Real-world Scenarios
por: Zhao, Fei, et al.
Publicado: (2025)
por: Zhao, Fei, et al.
Publicado: (2025)
LungCURE: Benchmarking Multimodal Real-World Clinical Reasoning for Precision Lung Cancer Diagnosis and Treatment
por: Hao, Fangyu, et al.
Publicado: (2026)
por: Hao, Fangyu, et al.
Publicado: (2026)
Hue4U: Real-Time Personalized Color Correction in Augmented Reality
por: Qin, Jingwen, et al.
Publicado: (2025)
por: Qin, Jingwen, et al.
Publicado: (2025)
Detached and Interactive Multimodal Learning
por: Fan, Yunfeng, et al.
Publicado: (2024)
por: Fan, Yunfeng, et al.
Publicado: (2024)
Towards Practical Real-Time Low-Latency Music Source Separation
por: Wu, Junyu, et al.
Publicado: (2025)
por: Wu, Junyu, et al.
Publicado: (2025)
Physics-Aware Novel-View Acoustic Synthesis with Vision-Language Priors and 3D Acoustic Environment Modeling
por: Fan, Congyi, et al.
Publicado: (2026)
por: Fan, Congyi, et al.
Publicado: (2026)
Advanced Learning-Based Inter Prediction for Future Video Coding
por: Zhao, Yanchen, et al.
Publicado: (2024)
por: Zhao, Yanchen, et al.
Publicado: (2024)
SSNVC: Single Stream Neural Video Compression with Implicit Temporal Information
por: Wang, Feng, et al.
Publicado: (2024)
por: Wang, Feng, et al.
Publicado: (2024)
Stepwise Schema-Guided Prompting Framework with Parameter Efficient Instruction Tuning for Multimedia Event Extraction
por: Yuan, Xiang, et al.
Publicado: (2025)
por: Yuan, Xiang, et al.
Publicado: (2025)
TCAN: Text-oriented Cross Attention Network for Multimodal Sentiment Analysis
por: Quan, Weize, et al.
Publicado: (2024)
por: Quan, Weize, et al.
Publicado: (2024)
Ejemplares similares
-
End-to-End RGB-IR Joint Image Compression With Channel-wise Cross-modality Entropy Model
por: Wang, Haofeng, et al.
Publicado: (2025) -
Compact Visual Data Representation for Green Multimedia -- A Human Visual System Perspective
por: Chen, Peilin, et al.
Publicado: (2024) -
VARFVV: View-Adaptive Real-Time Interactive Free-View Video Streaming with Edge Computing
por: Hu, Qiang, et al.
Publicado: (2025) -
SPC-NeRF: Spatial Predictive Compression for Voxel Based Radiance Field
por: Song, Zetian, et al.
Publicado: (2024) -
Video Echoed in Music: Semantic, Temporal, and Rhythmic Alignment for Video-to-Music Generation
por: Tong, Xinyi, et al.
Publicado: (2025)