Multimodal Trustworthy Semantic Communication for Audio-Visual Event Localization

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Li, Yuandi, Xiang, Zhe, Yu, Fei, Guan, Zhangshuang, Ji, Hui, Wan, Zhiguo, Feng, Cheng
Formato: Preprint
Publicado: 2024
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
_version_ 1866917828009918464
author Li, Yuandi
Xiang, Zhe
Yu, Fei
Guan, Zhangshuang
Ji, Hui
Wan, Zhiguo
Feng, Cheng
author_facet Li, Yuandi
Xiang, Zhe
Yu, Fei
Guan, Zhangshuang
Ji, Hui
Wan, Zhiguo
Feng, Cheng
contents The exponential growth in wireless data traffic, driven by the proliferation of mobile devices and smart applications, poses significant challenges for modern communication systems. Ensuring the secure and reliable transmission of multimodal semantic information is increasingly critical, particularly for tasks like Audio-Visual Event (AVE) localization. This letter introduces MMTrustSC, a novel framework designed to address these challenges by enhancing the security and reliability of multimodal communication. MMTrustSC incorporates advanced semantic encoding techniques to safeguard data integrity and privacy. It features a two-level coding scheme that combines error-correcting codes with conventional encoders to improve the accuracy and reliability of multimodal data transmission. Additionally, MMTrustSC employs hybrid encryption, integrating both asymmetric and symmetric encryption methods, to secure semantic information and ensure its confidentiality and integrity across potentially hostile networks. Simulation results validate MMTrustSC's effectiveness, demonstrating substantial improvements in data transmission accuracy and reliability for AVE localization tasks. This framework represents a significant advancement in managing intermodal information complementarity and mitigating physical noise, thus enhancing overall system performance.
format Preprint
id arxiv_https___arxiv_org_abs_2411_01991
institution arXiv
publishDate 2024
record_format arxiv
spellingShingle Multimodal Trustworthy Semantic Communication for Audio-Visual Event Localization
Li, Yuandi
Xiang, Zhe
Yu, Fei
Guan, Zhangshuang
Ji, Hui
Wan, Zhiguo
Feng, Cheng
Signal Processing
The exponential growth in wireless data traffic, driven by the proliferation of mobile devices and smart applications, poses significant challenges for modern communication systems. Ensuring the secure and reliable transmission of multimodal semantic information is increasingly critical, particularly for tasks like Audio-Visual Event (AVE) localization. This letter introduces MMTrustSC, a novel framework designed to address these challenges by enhancing the security and reliability of multimodal communication. MMTrustSC incorporates advanced semantic encoding techniques to safeguard data integrity and privacy. It features a two-level coding scheme that combines error-correcting codes with conventional encoders to improve the accuracy and reliability of multimodal data transmission. Additionally, MMTrustSC employs hybrid encryption, integrating both asymmetric and symmetric encryption methods, to secure semantic information and ensure its confidentiality and integrity across potentially hostile networks. Simulation results validate MMTrustSC's effectiveness, demonstrating substantial improvements in data transmission accuracy and reliability for AVE localization tasks. This framework represents a significant advancement in managing intermodal information complementarity and mitigating physical noise, thus enhancing overall system performance.
title Multimodal Trustworthy Semantic Communication for Audio-Visual Event Localization
topic Signal Processing
url https://arxiv.org/abs/2411.01991