Interdisciplinary Translations: Sensory Perception as a Universal Language
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kang, Xindi, Huang, Xuanyang, Song, Mingdong, Guljajeva, Varvara, Kuchera-Morin, JoAnn |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Generative AI-enabled Mobile Tactical Multimedia Networks: Distribution, Generation, and Perception
par: Xu, Minrui, et autres
Publié: (2024)
par: Xu, Minrui, et autres
Publié: (2024)
Diverse Sign Language Translation
par: Shen, Xin, et autres
Publié: (2024)
par: Shen, Xin, et autres
Publié: (2024)
Task Presentation and Human Perception in Interactive Video Retrieval
par: Willis, Nina, et autres
Publié: (2024)
par: Willis, Nina, et autres
Publié: (2024)
Perception-Aware Video Semantic Communication
par: Huang, Yinhuan, et autres
Publié: (2026)
par: Huang, Yinhuan, et autres
Publié: (2026)
QoS-QoE Translation with Large Language Model
par: Yu, Yingjie, et autres
Publié: (2026)
par: Yu, Yingjie, et autres
Publié: (2026)
ALMol: Aligned Language-Molecule Translation LLMs through Offline Preference Contrastive Optimisation
par: Gkoumas, Dimitris
Publié: (2024)
par: Gkoumas, Dimitris
Publié: (2024)
Situational Agency: The Framework for Designing Behavior in Agent-based art
par: Huang, Ary-Yue, et autres
Publié: (2025)
par: Huang, Ary-Yue, et autres
Publié: (2025)
VSpeechLM: A Visual Speech Language Model for Visual Text-to-Speech Task
par: Wang, Yuyue, et autres
Publié: (2025)
par: Wang, Yuyue, et autres
Publié: (2025)
Hierarchical Refinement of Universal Multimodal Attacks on Vision-Language Models
par: Zhang, Peng-Fei, et autres
Publié: (2026)
par: Zhang, Peng-Fei, et autres
Publié: (2026)
EidetiCom: A Cross-modal Brain-Computer Semantic Communication Paradigm for Decoding Visual Perception
par: Zheng, Linfeng, et autres
Publié: (2024)
par: Zheng, Linfeng, et autres
Publié: (2024)
Universal Organizer of SAM for Unsupervised Semantic Segmentation
par: Li, Tingting, et autres
Publié: (2024)
par: Li, Tingting, et autres
Publié: (2024)
Rethinking Bjøntegaard Delta for Compression Efficiency Evaluation: Are We Calculating It Precisely and Reliably?
par: Hang, Xinyu, et autres
Publié: (2024)
par: Hang, Xinyu, et autres
Publié: (2024)
Spatial Orchestra: Locomotion Music Instruments through Spatial Exploration
par: Kim, You-Jin, et autres
Publié: (2025)
par: Kim, You-Jin, et autres
Publié: (2025)
From Perception to Cognition: How Latency Affects Interaction Fluency and Social Presence in VR Conferencing
par: Song, Jiarun, et autres
Publié: (2026)
par: Song, Jiarun, et autres
Publié: (2026)
Virtual Social Immersive Multi-Sensory E-Commerce
par: Dubey, Alpana, et autres
Publié: (2025)
par: Dubey, Alpana, et autres
Publié: (2025)
Listen, Pause, and Reason: Toward Perception-Grounded Hybrid Reasoning for Audio Understanding
par: Wang, Jieyi, et autres
Publié: (2026)
par: Wang, Jieyi, et autres
Publié: (2026)
COPA: Efficient Vision-Language Pre-training Through Collaborative Object- and Patch-Text Alignment
par: Jiang, Chaoya, et autres
Publié: (2023)
par: Jiang, Chaoya, et autres
Publié: (2023)
Retracted: The Development Strategy of the Multimedia Fusion Mode of Big Data Technology in Japanese Translation Teaching
par: Advances in Multimedia
Publié: (2024)
par: Advances in Multimedia
Publié: (2024)
RFNNS: Robust Fixed Neural Network Steganography with Universal Text-to-Image Models
par: Cheng, Yu, et autres
Publié: (2025)
par: Cheng, Yu, et autres
Publié: (2025)
A Survey of Multi-sensor Fusion Perception for Embodied AI: Background, Methods, Challenges and Prospects
par: Ruan, Shulan, et autres
Publié: (2025)
par: Ruan, Shulan, et autres
Publié: (2025)
Recognizing Everything from All Modalities at Once: Grounded Multimodal Universal Information Extraction
par: Zhang, Meishan, et autres
Publié: (2024)
par: Zhang, Meishan, et autres
Publié: (2024)
Seeing Sarcasm Through Different Eyes: Analyzing Multimodal Sarcasm Perception in Large Vision-Language Models
par: Chen, Junjie, et autres
Publié: (2025)
par: Chen, Junjie, et autres
Publié: (2025)
The Dream Within Huang Long Cave: AI-Driven Interactive Narrative for Family Storytelling and Emotional Reflection
par: Huang, Jiayang, et autres
Publié: (2025)
par: Huang, Jiayang, et autres
Publié: (2025)
Visions of Destruction: Exploring a Potential of Generative AI in Interactive Art
par: Sola, Mar Canet, et autres
Publié: (2024)
par: Sola, Mar Canet, et autres
Publié: (2024)
Learning Shared Sentiment Prototypes for Adaptive Multimodal Sentiment Analysis
par: Su, Chen, et autres
Publié: (2026)
par: Su, Chen, et autres
Publié: (2026)
Latency Effects on Multi-Dimensional QoE in Networked VR Whiteboards
par: Song, Jiarun, et autres
Publié: (2026)
par: Song, Jiarun, et autres
Publié: (2026)
Multimodal Emotion Recognition with Large Language Models
par: Zhang, Hongrui, et autres
Publié: (2026)
par: Zhang, Hongrui, et autres
Publié: (2026)
Visions Of Destruction: Exploring Human Impact on Nature by Navigating the Latent Space of a Diffusion Model via Gaze
par: Sola, Mar Canet, et autres
Publié: (2023)
par: Sola, Mar Canet, et autres
Publié: (2023)
SCI-Reason: A Dataset with Chain-of-Thought Rationales for Complex Multimodal Reasoning in Academic Areas
par: Ma, Chenghao, et autres
Publié: (2025)
par: Ma, Chenghao, et autres
Publié: (2025)
Large Language Models (LLMs): Deployment, Tokenomics and Sustainability
par: Dong, Haiwei, et autres
Publié: (2024)
par: Dong, Haiwei, et autres
Publié: (2024)
TPIFM: A Task-Aware Model for Evaluating Perceptual Interaction Fluency in Remote AR Collaboration
par: Song, Jiarun, et autres
Publié: (2026)
par: Song, Jiarun, et autres
Publié: (2026)
LapisGS: Layered Progressive 3D Gaussian Splatting for Adaptive Streaming
par: Shi, Yuang, et autres
Publié: (2024)
par: Shi, Yuang, et autres
Publié: (2024)
Automatically Generating High-Precision Simulated Road Networking in Traffic Scenario
par: Xie, Liang, et autres
Publié: (2025)
par: Xie, Liang, et autres
Publié: (2025)
Enabling American Sign Language Communication Under Low Data Rates
par: Santhalingam, Panneer Selvam, et autres
Publié: (2025)
par: Santhalingam, Panneer Selvam, et autres
Publié: (2025)
Identity-Aware Vision-Language Model for Explainable Face Forgery Detection
par: Xu, Junhao, et autres
Publié: (2025)
par: Xu, Junhao, et autres
Publié: (2025)
ITEACH-Net: Inverted Teacher-studEnt seArCH Network for Emotion Recognition in Conversation
par: Sun, Haiyang, et autres
Publié: (2023)
par: Sun, Haiyang, et autres
Publié: (2023)
A Multi-modal Fusion Network for Terrain Perception Based on Illumination Aware
par: Wang, Rui, et autres
Publié: (2025)
par: Wang, Rui, et autres
Publié: (2025)
Revisiting Vision-Language Features Adaptation and Inconsistency for Social Media Popularity Prediction
par: Hsu, Chih-Chung, et autres
Publié: (2024)
par: Hsu, Chih-Chung, et autres
Publié: (2024)
Fine-grained Knowledge Graph-driven Video-Language Learning for Action Recognition
par: Zhang, Rui, et autres
Publié: (2024)
par: Zhang, Rui, et autres
Publié: (2024)
Language-oriented Semantic Communication for Image Transmission with Fine-Tuned Diffusion Model
par: Wei, Xinfeng, et autres
Publié: (2024)
par: Wei, Xinfeng, et autres
Publié: (2024)
Documents similaires
-
Generative AI-enabled Mobile Tactical Multimedia Networks: Distribution, Generation, and Perception
par: Xu, Minrui, et autres
Publié: (2024) -
Diverse Sign Language Translation
par: Shen, Xin, et autres
Publié: (2024) -
Task Presentation and Human Perception in Interactive Video Retrieval
par: Willis, Nina, et autres
Publié: (2024) -
Perception-Aware Video Semantic Communication
par: Huang, Yinhuan, et autres
Publié: (2026) -
QoS-QoE Translation with Large Language Model
par: Yu, Yingjie, et autres
Publié: (2026)