Creating a Lens of Chinese Culture: A Multimodal Dataset for Chinese Pun Rebus Art Understanding
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Tuo, Feng, Tiantian, Ni, Yibin, Cao, Mengqin, Liu, Ruying, Butler, Katharine, Weng, Yanjun, Zhang, Mi, Narayanan, Shrikanth S., Avestimehr, Salman |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ModalityMirror: Improving Audio Classification in Modality Heterogeneity Federated Learning with Multimodal Distillation
di: Feng, Tiantian, et al.
Pubblicazione: (2024)
di: Feng, Tiantian, et al.
Pubblicazione: (2024)
GPT-FL: Generative Pre-trained Model-Assisted Federated Learning
di: Zhang, Tuo, et al.
Pubblicazione: (2023)
di: Zhang, Tuo, et al.
Pubblicazione: (2023)
Understanding Stress, Burnout, and Behavioral Patterns in Medical Residents Using Large-scale Longitudinal Wearable Recordings
di: Feng, Tiantian, et al.
Pubblicazione: (2024)
di: Feng, Tiantian, et al.
Pubblicazione: (2024)
FedAIoT: A Federated Learning Benchmark for Artificial Intelligence of Things
di: Alam, Samiul, et al.
Pubblicazione: (2023)
di: Alam, Samiul, et al.
Pubblicazione: (2023)
Revisiting OPRO: The Limitations of Small-Scale LLMs as Optimizers
di: Zhang, Tuo, et al.
Pubblicazione: (2024)
di: Zhang, Tuo, et al.
Pubblicazione: (2024)
CHATTER: A Character Attribution Dataset for Narrative Understanding
di: Baruah, Sabyasachee, et al.
Pubblicazione: (2024)
di: Baruah, Sabyasachee, et al.
Pubblicazione: (2024)
PEFT-SER: On the Use of Parameter Efficient Transfer Learning Approaches For Speech Emotion Recognition Using Pre-trained Speech Models
di: Feng, Tiantian, et al.
Pubblicazione: (2023)
di: Feng, Tiantian, et al.
Pubblicazione: (2023)
Leveraging Uncertainty Estimation for Efficient LLM Routing
di: Zhang, Tuo, et al.
Pubblicazione: (2025)
di: Zhang, Tuo, et al.
Pubblicazione: (2025)
TI-ASU: Toward Robust Automatic Speech Understanding through Text-to-speech Imputation Against Missing Speech Modality
di: Feng, Tiantian, et al.
Pubblicazione: (2024)
di: Feng, Tiantian, et al.
Pubblicazione: (2024)
How to Retrieve Examples in In-context Learning to Improve Conversational Emotion Recognition using Large Language Models?
di: Wang, Mengqi, et al.
Pubblicazione: (2025)
di: Wang, Mengqi, et al.
Pubblicazione: (2025)
Can Synthetic Audio From Generative Foundation Models Assist Audio Recognition and Speech Modeling?
di: Feng, Tiantian, et al.
Pubblicazione: (2024)
di: Feng, Tiantian, et al.
Pubblicazione: (2024)
Exploring Speech Foundation Models for Speaker Diarization Across Lifespan
di: Xu, Anfeng, et al.
Pubblicazione: (2026)
di: Xu, Anfeng, et al.
Pubblicazione: (2026)
Joint ASR and Speaker Role Tagging with Serialized Output Training
di: Xu, Anfeng, et al.
Pubblicazione: (2025)
di: Xu, Anfeng, et al.
Pubblicazione: (2025)
Rebus Immigrazione
di: Roberto Marinucci
Pubblicazione: (2017)
di: Roberto Marinucci
Pubblicazione: (2017)
Embracing Federated Learning: Enabling Weak Client Participation via Partial Model Training
di: Lee, Sunwoo, et al.
Pubblicazione: (2024)
di: Lee, Sunwoo, et al.
Pubblicazione: (2024)
Understanding Communication Backends in Cross-Silo Federated Learning
di: Ziashahabi, Amir, et al.
Pubblicazione: (2026)
di: Ziashahabi, Amir, et al.
Pubblicazione: (2026)
Developing a High-performance Framework for Speech Emotion Recognition in Naturalistic Conditions Challenge for Emotional Attribute Prediction
di: Lertpetchpun, Thanathai, et al.
Pubblicazione: (2025)
di: Lertpetchpun, Thanathai, et al.
Pubblicazione: (2025)
Can Text-to-image Model Assist Multi-modal Learning for Visual Recognition with Visual Modality Missing?
di: Feng, Tiantian, et al.
Pubblicazione: (2024)
di: Feng, Tiantian, et al.
Pubblicazione: (2024)
Emotion-Aligned Contrastive Learning Between Images and Music
di: Stewart, Shanti, et al.
Pubblicazione: (2023)
di: Stewart, Shanti, et al.
Pubblicazione: (2023)
VoxCog: Towards End-to-End Multilingual Cognitive Impairment Classification through Dialectal Knowledge
di: Feng, Tiantian, et al.
Pubblicazione: (2026)
di: Feng, Tiantian, et al.
Pubblicazione: (2026)
Developing a Top-tier Framework in Naturalistic Conditions Challenge for Categorized Emotion Prediction: From Speech Foundation Models and Learning Objective to Data Augmentation and Engineering Choices
di: Feng, Tiantian, et al.
Pubblicazione: (2025)
di: Feng, Tiantian, et al.
Pubblicazione: (2025)
FoodieQA: A Multimodal Dataset for Fine-Grained Understanding of Chinese Food Culture
di: Li, Wenyan, et al.
Pubblicazione: (2024)
di: Li, Wenyan, et al.
Pubblicazione: (2024)
TILES-2018 Sleep Benchmark Dataset: A Longitudinal Wearable Sleep Data Set of Hospital Workers for Modeling and Understanding Sleep Behaviors
di: Feng, Tiantian, et al.
Pubblicazione: (2025)
di: Feng, Tiantian, et al.
Pubblicazione: (2025)
Non Verbis, Sed Rebus: Large Language Models are Weak Solvers of Italian Rebuses
di: Sarti, Gabriele, et al.
Pubblicazione: (2024)
di: Sarti, Gabriele, et al.
Pubblicazione: (2024)
Differentially Private Federated Learning without Noise Addition: When is it Possible?
di: Zhang, Jiang, et al.
Pubblicazione: (2024)
di: Zhang, Jiang, et al.
Pubblicazione: (2024)
Pun Unintended: LLMs and the Illusion of Humor Understanding
di: Zangari, Alessandro, et al.
Pubblicazione: (2025)
di: Zangari, Alessandro, et al.
Pubblicazione: (2025)
Understanding Authenticity in Chinese Cultural Heritage
Pubblicazione: (2023)
Pubblicazione: (2023)
Creating Chinese Urbanism
di: Wu, Fulong
Pubblicazione: (2022)
di: Wu, Fulong
Pubblicazione: (2022)
Andrew Pun
Pubblicazione: (2024)
Pubblicazione: (2024)
Andrew Pun
Pubblicazione: (2024)
Pubblicazione: (2024)
A Survey of Pun Generation: Datasets, Evaluations and Methodologies
di: Su, Yuchen, et al.
Pubblicazione: (2025)
di: Su, Yuchen, et al.
Pubblicazione: (2025)
Intelligence Requires Grounding But Not Embodiment
di: Ma, Marcus, et al.
Pubblicazione: (2026)
di: Ma, Marcus, et al.
Pubblicazione: (2026)
Egocentric Speaker Classification in Child-Adult Dyadic Interactions: From Sensing to Computational Modeling
di: Feng, Tiantian, et al.
Pubblicazione: (2024)
di: Feng, Tiantian, et al.
Pubblicazione: (2024)
End-to-End Joint ASR and Speaker Role Diarization with Child-Adult Interactions
di: Xu, Anfeng, et al.
Pubblicazione: (2026)
di: Xu, Anfeng, et al.
Pubblicazione: (2026)
Assessing Visual Privacy Risks in Multimodal AI: A Novel Taxonomy-Grounded Evaluation of Vision-Language Models
di: Tsaprazlis, Efthymios, et al.
Pubblicazione: (2025)
di: Tsaprazlis, Efthymios, et al.
Pubblicazione: (2025)
TCC-Bench: Benchmarking the Traditional Chinese Culture Understanding Capabilities of MLLMs
di: Xu, Pengju, et al.
Pubblicazione: (2025)
di: Xu, Pengju, et al.
Pubblicazione: (2025)
Navigating the Mediterranean Through the Chinese Lens
Pubblicazione: (2025)
Pubblicazione: (2025)
Towards Cross-modal Retrieval in Chinese Cultural Heritage Documents: Dataset and Solution
di: Yuan, Junyi, et al.
Pubblicazione: (2025)
di: Yuan, Junyi, et al.
Pubblicazione: (2025)
Audio-visual child-adult speaker classification in dyadic interactions
di: Xu, Anfeng, et al.
Pubblicazione: (2023)
di: Xu, Anfeng, et al.
Pubblicazione: (2023)
Data Efficient Child-Adult Speaker Diarization with Simulated Conversations
di: Xu, Anfeng, et al.
Pubblicazione: (2024)
di: Xu, Anfeng, et al.
Pubblicazione: (2024)
Documenti analoghi
-
ModalityMirror: Improving Audio Classification in Modality Heterogeneity Federated Learning with Multimodal Distillation
di: Feng, Tiantian, et al.
Pubblicazione: (2024) -
GPT-FL: Generative Pre-trained Model-Assisted Federated Learning
di: Zhang, Tuo, et al.
Pubblicazione: (2023) -
Understanding Stress, Burnout, and Behavioral Patterns in Medical Residents Using Large-scale Longitudinal Wearable Recordings
di: Feng, Tiantian, et al.
Pubblicazione: (2024) -
FedAIoT: A Federated Learning Benchmark for Artificial Intelligence of Things
di: Alam, Samiul, et al.
Pubblicazione: (2023) -
Revisiting OPRO: The Limitations of Small-Scale LLMs as Optimizers
di: Zhang, Tuo, et al.
Pubblicazione: (2024)