Visual and Auditory Aesthetic Preferences Across Cultures
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lee, Harin, Van Geert, Eline, Celen, Elif, Marjieh, Raja, van Rijn, Pol, Park, Minsu, Jacoby, Nori |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Are Expressions for Music Emotions the Same Across Cultures?
par: Celen, Elif, et autres
Publié: (2025)
par: Celen, Elif, et autres
Publié: (2025)
GlobalMood: A cross-cultural benchmark for music emotion recognition
par: Lee, Harin, et autres
Publié: (2025)
par: Lee, Harin, et autres
Publié: (2025)
Characterizing the Large‐Scale Structure of Multimodal Semantic Networks
par: Raja Marjieh, et autres
Publié: (2025)
par: Raja Marjieh, et autres
Publié: (2025)
A Rational Analysis of the Speech-to-Song Illusion
par: Marjieh, Raja, et autres
Publié: (2024)
par: Marjieh, Raja, et autres
Publié: (2024)
Characterizing Similarities and Divergences in Conversational Tones in Humans and LLMs by Sampling with People
par: Huang, Dun-Ming, et autres
Publié: (2024)
par: Huang, Dun-Ming, et autres
Publié: (2024)
An Experimental Method to Study Opinion Diffusion in Human-AI Hybrid Societies
par: Gaubert, Léna, et autres
Publié: (2026)
par: Gaubert, Léna, et autres
Publié: (2026)
Solving Copyright Infringement on Short Video Platforms: Novel Datasets and an Audio Restoration Deep Learning Pipeline
par: Oh, Minwoo, et autres
Publié: (2025)
par: Oh, Minwoo, et autres
Publié: (2025)
BioNet-XR: Biological Network Visualization Framework for Virtual Reality and Mixed Reality Environments
par: Senderin, Busra, et autres
Publié: (2024)
par: Senderin, Busra, et autres
Publié: (2024)
EmoVLM-KD: Fusing Distilled Expertise with Vision-Language Models for Visual Emotion Analysis
par: Lee, SangEun, et autres
Publié: (2025)
par: Lee, SangEun, et autres
Publié: (2025)
Characterizing the Interaction of Cultural Evolution Mechanisms in Experimental Social Networks
par: Marjieh, Raja, et autres
Publié: (2025)
par: Marjieh, Raja, et autres
Publié: (2025)
CLIP Brings Better Features to Visual Aesthetics Learners
par: Xu, Liwu, et autres
Publié: (2023)
par: Xu, Liwu, et autres
Publié: (2023)
AV2AV: Direct Audio-Visual Speech to Audio-Visual Speech Translation with Unified Audio-Visual Speech Representation
par: Choi, Jeongsoo, et autres
Publié: (2023)
par: Choi, Jeongsoo, et autres
Publié: (2023)
Human Aesthetic Preference-Based Large Text-to-Image Model Personalization: Kandinsky Generation as an Example
par: Zhou, Aven-Le, et autres
Publié: (2024)
par: Zhou, Aven-Le, et autres
Publié: (2024)
The Dynamics of Collective Creativity in Human-AI Hybrid Societies
par: Shiiku, Shota, et autres
Publié: (2025)
par: Shiiku, Shota, et autres
Publié: (2025)
Do Melody and Rhythm Coevolve?
par: Lee, Harin, et autres
Publié: (2026)
par: Lee, Harin, et autres
Publié: (2026)
TAGF: Time-aware Gated Fusion for Multimodal Valence-Arousal Estimation
par: Lee, Yubeen, et autres
Publié: (2025)
par: Lee, Yubeen, et autres
Publié: (2025)
Adaptive Audio-Visual Speech Recognition via Matryoshka-Based Multimodal LLMs
par: Cappellazzo, Umberto, et autres
Publié: (2025)
par: Cappellazzo, Umberto, et autres
Publié: (2025)
Design-MLLM: A Reinforcement Alignment Framework for Verifiable and Aesthetic Interior Design
par: Yang, Yuxuan, et autres
Publié: (2026)
par: Yang, Yuxuan, et autres
Publié: (2026)
ScaleTrotter: Illustrative Visual Travels Across Negative Scales
par: Halladjian, Sarkis, et autres
Publié: (2019)
par: Halladjian, Sarkis, et autres
Publié: (2019)
CDIO: Cross-Domain Inference Optimization with Resource Preference Prediction for Edge-Cloud Collaboration
par: Yang, Zheming, et autres
Publié: (2025)
par: Yang, Zheming, et autres
Publié: (2025)
VSpeechLM: A Visual Speech Language Model for Visual Text-to-Speech Task
par: Wang, Yuyue, et autres
Publié: (2025)
par: Wang, Yuyue, et autres
Publié: (2025)
Inter-Frame Compression for Dynamic Point Cloud Geometry Coding
par: Akhtar, Anique, et autres
Publié: (2022)
par: Akhtar, Anique, et autres
Publié: (2022)
Song Aesthetics Evaluation with Multi-Stem Attention and Hierarchical Uncertainty Modeling
par: Lv, Yishan, et autres
Publié: (2026)
par: Lv, Yishan, et autres
Publié: (2026)
The Rhythm of Tai Chi: Revitalizing Cultural Heritage in Virtual Reality through Interactive Visuals
par: Wang, Xianghan
Publié: (2025)
par: Wang, Xianghan
Publié: (2025)
Delayed Commitment for Representation Readiness in Stage-wise Audio-Visual Learning
par: Xu, Xinmeng, et autres
Publié: (2026)
par: Xu, Xinmeng, et autres
Publié: (2026)
EMID: An Emotional Aligned Dataset in Audio-Visual Modality
par: Zou, Jialing, et autres
Publié: (2023)
par: Zou, Jialing, et autres
Publié: (2023)
A Progressive Evaluation Framework for Multicultural Analysis of Story Visualization
par: Kapuriya, Janak, et autres
Publié: (2025)
par: Kapuriya, Janak, et autres
Publié: (2025)
Enhancing Video Music Recommendation with Transformer-Driven Audio-Visual Embeddings
par: Liu, Shimiao, et autres
Publié: (2025)
par: Liu, Shimiao, et autres
Publié: (2025)
MarkIt: Training-Free Visual Markers for Precise Video Temporal Grounding
par: Fang, Pengcheng, et autres
Publié: (2026)
par: Fang, Pengcheng, et autres
Publié: (2026)
MeMo: Attentional Momentum for Real-time Audio-visual Speaker Extraction under Impaired Visual Conditions
par: Li, Junjie, et autres
Publié: (2025)
par: Li, Junjie, et autres
Publié: (2025)
Creating Aesthetic Sonifications on the Web with SIREN
par: Peng, Tristan, et autres
Publié: (2024)
par: Peng, Tristan, et autres
Publié: (2024)
PixelatedScatter: Arbitrary-level Visual Abstraction for Large-scale Multiclass Scatterplots
par: Guo, Ziheng, et autres
Publié: (2025)
par: Guo, Ziheng, et autres
Publié: (2025)
MViR: Multi-View Visual-Semantic Representation for Fake News Detection
par: Liang, Haochen, et autres
Publié: (2026)
par: Liang, Haochen, et autres
Publié: (2026)
Cross-Modality and Within-Modality Regularization for Audio-Visual DeepFake Detection
par: Zou, Heqing, et autres
Publié: (2024)
par: Zou, Heqing, et autres
Publié: (2024)
Generalizing Video DeepFake Detection by Self-generated Audio-Visual Pseudo-Fakes
par: Wei, Zihe, et autres
Publié: (2026)
par: Wei, Zihe, et autres
Publié: (2026)
MAR3: Multi-Agent Recognition, Reasoning, and Reflection for Reference Audio-Visual Segmentation
par: Zhao, Yuan, et autres
Publié: (2026)
par: Zhao, Yuan, et autres
Publié: (2026)
Stage-Adaptive Reliability Modeling for Continuous Valence-Arousal Estimation
par: Lee, Yubeen, et autres
Publié: (2026)
par: Lee, Yubeen, et autres
Publié: (2026)
Designing a Multimodal Viewer for Piano Performance Analysis -- a Pedagogy-First Approach
par: Bae, Joonhyung, et autres
Publié: (2025)
par: Bae, Joonhyung, et autres
Publié: (2025)
Learning Trimodal Relation for Audio-Visual Question Answering with Missing Modality
par: Park, Kyu Ri, et autres
Publié: (2024)
par: Park, Kyu Ri, et autres
Publié: (2024)
TeMTG: Text-Enhanced Multi-Hop Temporal Graph Modeling for Audio-Visual Video Parsing
par: Chen, Yaru, et autres
Publié: (2025)
par: Chen, Yaru, et autres
Publié: (2025)
Documents similaires
-
Are Expressions for Music Emotions the Same Across Cultures?
par: Celen, Elif, et autres
Publié: (2025) -
GlobalMood: A cross-cultural benchmark for music emotion recognition
par: Lee, Harin, et autres
Publié: (2025) -
Characterizing the Large‐Scale Structure of Multimodal Semantic Networks
par: Raja Marjieh, et autres
Publié: (2025) -
A Rational Analysis of the Speech-to-Song Illusion
par: Marjieh, Raja, et autres
Publié: (2024) -
Characterizing Similarities and Divergences in Conversational Tones in Humans and LLMs by Sampling with People
par: Huang, Dun-Ming, et autres
Publié: (2024)