Salvato in:
| Autori principali: | Wu, Xinyi, Wang, Haohong, Katsaggelos, Aggelos K. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2506.07076 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Automatic Camera Trajectory Control with Enhanced Immersion for Virtual Cinematography
di: Wu, Xinyi, et al.
Pubblicazione: (2023)
di: Wu, Xinyi, et al.
Pubblicazione: (2023)
DIVA-VQA: Detecting Inter-frame Variations in UGC Video Quality
di: Wang, Xinyi, et al.
Pubblicazione: (2025)
di: Wang, Xinyi, et al.
Pubblicazione: (2025)
Multimodal Dataset Normalization and Perceptual Validation for Music-Taste Correspondences
di: Spanio, Matteo, et al.
Pubblicazione: (2026)
di: Spanio, Matteo, et al.
Pubblicazione: (2026)
SFQA: A Comprehensive Perceptual Quality Assessment Dataset for Singing Face Generation
di: Gao, Zhilin, et al.
Pubblicazione: (2026)
di: Gao, Zhilin, et al.
Pubblicazione: (2026)
MotionBeat: Motion-Aligned Music Representation via Embodied Contrastive Learning and Bar-Equivariant Contact-Aware Encoding
di: Wang, Xuanchen, et al.
Pubblicazione: (2025)
di: Wang, Xuanchen, et al.
Pubblicazione: (2025)
PP-Motion: Physical-Perceptual Fidelity Evaluation for Human Motion Generation
di: Zhao, Sihan, et al.
Pubblicazione: (2025)
di: Zhao, Sihan, et al.
Pubblicazione: (2025)
Face Consistency Benchmark for GenAI Video
di: Podstawski, Michal, et al.
Pubblicazione: (2025)
di: Podstawski, Michal, et al.
Pubblicazione: (2025)
Avoiding Quality Saturation in UGC Compression Using Denoised References
di: Xiong, Xin, et al.
Pubblicazione: (2025)
di: Xiong, Xin, et al.
Pubblicazione: (2025)
A Tri-Dynamic Preprocessing Framework for UGC Video Compression
di: Zhao, Fei, et al.
Pubblicazione: (2025)
di: Zhao, Fei, et al.
Pubblicazione: (2025)
TPIFM: A Task-Aware Model for Evaluating Perceptual Interaction Fluency in Remote AR Collaboration
di: Song, Jiarun, et al.
Pubblicazione: (2026)
di: Song, Jiarun, et al.
Pubblicazione: (2026)
Video Echoed in Music: Semantic, Temporal, and Rhythmic Alignment for Video-to-Music Generation
di: Tong, Xinyi, et al.
Pubblicazione: (2025)
di: Tong, Xinyi, et al.
Pubblicazione: (2025)
Perceptual-oriented Learned Image Compression with Dynamic Kernel
di: Fu, Nianxiang, et al.
Pubblicazione: (2024)
di: Fu, Nianxiang, et al.
Pubblicazione: (2024)
Intelligent Text-Conditioned Music Generation
di: Xie, Zhouyao, et al.
Pubblicazione: (2024)
di: Xie, Zhouyao, et al.
Pubblicazione: (2024)
HarmonyIQA: Pioneering Benchmark and Model for Image Harmonization Quality Assessment
di: Xu, Zitong, et al.
Pubblicazione: (2025)
di: Xu, Zitong, et al.
Pubblicazione: (2025)
Harmony: A Unified Framework for Modality Incremental Learning
di: Song, Yaguang, et al.
Pubblicazione: (2025)
di: Song, Yaguang, et al.
Pubblicazione: (2025)
Perceptual Quality Assessment of Octree-RAHT Encoded 3D Point Clouds
di: Duan, Dongshuai, et al.
Pubblicazione: (2024)
di: Duan, Dongshuai, et al.
Pubblicazione: (2024)
MetaSR: Content-Adaptive Metadata Orchestration for Generative Super-Resolution
di: Guo, Jiaqi, et al.
Pubblicazione: (2026)
di: Guo, Jiaqi, et al.
Pubblicazione: (2026)
Music4All A+A: A Multimodal Dataset for Music Information Retrieval Tasks
di: Geiger, Jonas, et al.
Pubblicazione: (2025)
di: Geiger, Jonas, et al.
Pubblicazione: (2025)
MusicScore: A Dataset for Music Score Modeling and Generation
di: Lin, Yuheng, et al.
Pubblicazione: (2024)
di: Lin, Yuheng, et al.
Pubblicazione: (2024)
MusicAOG: an Energy-Based Model for Learning and Sampling a Hierarchical Representation of Symbolic Music
di: Qian, Yikai, et al.
Pubblicazione: (2024)
di: Qian, Yikai, et al.
Pubblicazione: (2024)
MusicWeaver: Composer-Style Structural Editing and Minute-Scale Coherent Music Generation
di: Wang, Xuanchen, et al.
Pubblicazione: (2025)
di: Wang, Xuanchen, et al.
Pubblicazione: (2025)
Music Grounding by Short Video
di: Xin, Zijie, et al.
Pubblicazione: (2024)
di: Xin, Zijie, et al.
Pubblicazione: (2024)
MusicSem: A Semantically Rich Language--Audio Dataset of Natural Music Descriptions
di: Salganik, Rebecca, et al.
Pubblicazione: (2026)
di: Salganik, Rebecca, et al.
Pubblicazione: (2026)
MoMu-Diffusion: On Learning Long-Term Motion-Music Synchronization and Correspondence
di: You, Fuming, et al.
Pubblicazione: (2024)
di: You, Fuming, et al.
Pubblicazione: (2024)
Multi Agents Semantic Emotion Aligned Music to Image Generation with Music Derived Captions
di: Shi, Junchang, et al.
Pubblicazione: (2025)
di: Shi, Junchang, et al.
Pubblicazione: (2025)
Music-Aligned Holistic 3D Dance Generation via Hierarchical Motion Modeling
di: Li, Xiaojie, et al.
Pubblicazione: (2025)
di: Li, Xiaojie, et al.
Pubblicazione: (2025)
Towards Practical Real-Time Low-Latency Music Source Separation
di: Wu, Junyu, et al.
Pubblicazione: (2025)
di: Wu, Junyu, et al.
Pubblicazione: (2025)
DanceCamera3D: 3D Camera Movement Synthesis with Music and Dance
di: Wang, Zixuan, et al.
Pubblicazione: (2024)
di: Wang, Zixuan, et al.
Pubblicazione: (2024)
SIDQL: An Efficient Keyframe Extraction and Motion Reconstruction Framework in Motion Capture
di: Zhang, Xuling, et al.
Pubblicazione: (2024)
di: Zhang, Xuling, et al.
Pubblicazione: (2024)
Embedded Blockchains: A Synthesis of Blockchains, Spread Spectrum Watermarking, Perceptual Hashing & Digital Signatures
di: Blake, Sam
Pubblicazione: (2020)
di: Blake, Sam
Pubblicazione: (2020)
An Inverse Partial Optimal Transport Framework for Music-guided Movie Trailer Generation
di: Wang, Yutong, et al.
Pubblicazione: (2024)
di: Wang, Yutong, et al.
Pubblicazione: (2024)
SonicGauss: Position-Aware Physical Sound Synthesis for 3D Gaussian Representations
di: Wang, Chunshi, et al.
Pubblicazione: (2025)
di: Wang, Chunshi, et al.
Pubblicazione: (2025)
Detecting Notational Errors in Digital Music Scores
di: Léo, Géré, et al.
Pubblicazione: (2025)
di: Léo, Géré, et al.
Pubblicazione: (2025)
Jamendo-QA: A Large-Scale Music Question Answering Dataset
di: Koh, Junyoung, et al.
Pubblicazione: (2025)
di: Koh, Junyoung, et al.
Pubblicazione: (2025)
REArtGS: Reconstructing and Generating Articulated Objects via 3D Gaussian Splatting with Geometric and Motion Constraints
di: Wu, Di, et al.
Pubblicazione: (2025)
di: Wu, Di, et al.
Pubblicazione: (2025)
Orthogonal Disentanglement with Projected Feature Alignment for Multimodal Emotion Recognition in Conversation
di: Che, Xinyi, et al.
Pubblicazione: (2025)
di: Che, Xinyi, et al.
Pubblicazione: (2025)
Memo2496: Expert-Annotated Dataset and Dual-View Adaptive Framework for Music Emotion Recognition
di: Li, Qilin, et al.
Pubblicazione: (2025)
di: Li, Qilin, et al.
Pubblicazione: (2025)
Generating Attribute-Aware Human Motions from Textual Prompt
di: Wang, Xinghan, et al.
Pubblicazione: (2025)
di: Wang, Xinghan, et al.
Pubblicazione: (2025)
Socially Aware Music Recommendation: A Multi-Modal Graph Neural Networks for Collaborative Music Consumption and Community-Based Engagement
di: Ziaoddini, Kajwan
Pubblicazione: (2025)
di: Ziaoddini, Kajwan
Pubblicazione: (2025)
Music Arena: Live Evaluation for Text-to-Music
di: Kim, Yonghyun, et al.
Pubblicazione: (2025)
di: Kim, Yonghyun, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Automatic Camera Trajectory Control with Enhanced Immersion for Virtual Cinematography
di: Wu, Xinyi, et al.
Pubblicazione: (2023) -
DIVA-VQA: Detecting Inter-frame Variations in UGC Video Quality
di: Wang, Xinyi, et al.
Pubblicazione: (2025) -
Multimodal Dataset Normalization and Perceptual Validation for Music-Taste Correspondences
di: Spanio, Matteo, et al.
Pubblicazione: (2026) -
SFQA: A Comprehensive Perceptual Quality Assessment Dataset for Singing Face Generation
di: Gao, Zhilin, et al.
Pubblicazione: (2026) -
MotionBeat: Motion-Aligned Music Representation via Embodied Contrastive Learning and Bar-Equivariant Contact-Aware Encoding
di: Wang, Xuanchen, et al.
Pubblicazione: (2025)