An Attentive Dual-Encoder Framework Leveraging Multimodal Visual and Semantic Information for Automatic OSAHS Diagnosis
Fuente:
arXiv
Saved in:
| Main Authors: | Wei, Yingchen, Qiu, Xihe, Tan, Xiaoyu, Huang, Jingjing, Chu, Wei, Xu, Yinghui, Qi, Yuan |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Structured Visual Evidence Decomposition for Evidence-Grounded Multimodal Screening of Obstructive Sleep Apnea-Hypopnea Syndrome
by: Zhan, Chen, et al.
Published: (2026)
by: Zhan, Chen, et al.
Published: (2026)
Robust Deep Hawkes Process under Label Noise of Both Event and Occurrence
by: Tan, Xiaoyu, et al.
Published: (2024)
by: Tan, Xiaoyu, et al.
Published: (2024)
CogniDual Framework: Self-Training Large Language Models within a Dual-System Theoretical Framework for Improving Cognitive Tasks
by: Deng, Yongxin, et al.
Published: (2024)
by: Deng, Yongxin, et al.
Published: (2024)
Struct-X: Enhancing Large Language Models Reasoning with Structured Data
by: Tan, Xiaoyu, et al.
Published: (2024)
by: Tan, Xiaoyu, et al.
Published: (2024)
Thought-Like-Pro: Enhancing Reasoning of Large Language Models through Self-Driven Prolog-based Chain-of-Thought
by: Tan, Xiaoyu, et al.
Published: (2024)
by: Tan, Xiaoyu, et al.
Published: (2024)
Towards Collaborative Intelligence: Propagating Intentions and Reasoning for Multi-Agent Coordination with Large Language Models
by: Qiu, Xihe, et al.
Published: (2024)
by: Qiu, Xihe, et al.
Published: (2024)
Promoting Equality in Large Language Models: Identifying and Mitigating the Implicit Bias based on Bayesian Theory
by: Deng, Yongxin, et al.
Published: (2024)
by: Deng, Yongxin, et al.
Published: (2024)
AURORA:Automated Training Framework of Universal Process Reward Models via Ensemble Prompting and Reverse Verification
by: Tan, Xiaoyu, et al.
Published: (2025)
by: Tan, Xiaoyu, et al.
Published: (2025)
Reflective Personalization Optimization: A Post-hoc Rewriting Framework for Black-Box Large Language Models
by: Hao, Teqi, et al.
Published: (2025)
by: Hao, Teqi, et al.
Published: (2025)
Subequivariant Reinforcement Learning Framework for Coordinated Motion Control
by: Wang, Haoyu, et al.
Published: (2024)
by: Wang, Haoyu, et al.
Published: (2024)
OR-VSKC: Resolving Visual-Semantic Knowledge Conflicts in Operating Rooms with Synthetic Data-Guided Alignment
by: Zhao, Weiyi, et al.
Published: (2025)
by: Zhao, Weiyi, et al.
Published: (2025)
Reward Guidance for Reinforcement Learning Tasks Based on Large Language Models: The LMGT Framework
by: Deng, Yongxin, et al.
Published: (2024)
by: Deng, Yongxin, et al.
Published: (2024)
FedSlate:A Federated Deep Reinforcement Learning Recommender System
by: Deng, Yongxin, et al.
Published: (2024)
by: Deng, Yongxin, et al.
Published: (2024)
DRASP: A Dual-Resolution Attentive Statistics Pooling Framework for Automatic MOS Prediction
by: Yang, Cheng-Yeh, et al.
Published: (2025)
by: Yang, Cheng-Yeh, et al.
Published: (2025)
SCP-116K: A High-Quality Problem-Solution Dataset and a Generalized Pipeline for Automated Extraction in the Higher Education Science Domain
by: Lu, Dakuan, et al.
Published: (2025)
by: Lu, Dakuan, et al.
Published: (2025)
EEG-VLM: A Hierarchical Vision-Language Model with Multi-Level Feature Alignment and Visually Enhanced Language-Guided Reasoning for EEG Image-Based Sleep Stage Prediction
by: Qiu, Xihe, et al.
Published: (2025)
by: Qiu, Xihe, et al.
Published: (2025)
PRISM: Festina Lente Proactivity -- Risk-Sensitive, Uncertainty-Aware Deliberation for Proactive Agents
by: Fu, Yuxuan, et al.
Published: (2026)
by: Fu, Yuxuan, et al.
Published: (2026)
MINDECHO: Role-Playing Language Agents for Key Opinion Leaders
by: Xu, Rui, et al.
Published: (2024)
by: Xu, Rui, et al.
Published: (2024)
PILLOW: Enhancing Efficient Instruction Fine-tuning via Prompt Matching
by: Qi, Zhenting, et al.
Published: (2023)
by: Qi, Zhenting, et al.
Published: (2023)
Investigating the Role of Scd1 in OSAHS‐Induced Vascular Changes
by: Jing Yang, et al.
Published: (2025)
by: Jing Yang, et al.
Published: (2025)
Dual-Prompt CLIP with Hybrid Visual Encoders for Occluded Person Re-Identification
by: Ji, Zhangjian, et al.
Published: (2026)
by: Ji, Zhangjian, et al.
Published: (2026)
VIVID-Med: LLM-Supervised Structured Pretraining for Deployable Medical ViTs
by: Wang, Xiyao, et al.
Published: (2026)
by: Wang, Xiyao, et al.
Published: (2026)
Curiosity Driven Knowledge Retrieval for Mobile Agents
by: Li, Sijia, et al.
Published: (2026)
by: Li, Sijia, et al.
Published: (2026)
Guess What I am Thinking: A Benchmark for Inner Thought Reasoning of Role-Playing Language Agents
by: Xu, Rui, et al.
Published: (2025)
by: Xu, Rui, et al.
Published: (2025)
Attentive-based Multi-level Feature Fusion for Voice Disorder Diagnosis
by: Shen, Lipeng, et al.
Published: (2024)
by: Shen, Lipeng, et al.
Published: (2024)
ORIGAMISPACE: Benchmarking Multimodal LLMs in Multi-Step Spatial Reasoning with Mathematical Constraints
by: Xu, Rui, et al.
Published: (2025)
by: Xu, Rui, et al.
Published: (2025)
DuMo: Dual Encoder Modulation Network for Precise Concept Erasure
by: Han, Feng, et al.
Published: (2025)
by: Han, Feng, et al.
Published: (2025)
Leveraging CLIP Encoder for Multimodal Emotion Recognition
by: Song, Yehun, et al.
Published: (2025)
by: Song, Yehun, et al.
Published: (2025)
Obstructive Sleep Apnea‐Hypopnea Syndrome (OSAHS) Combined With Obesity Leads to Elevated Thyroid Hormone Levels
by: Shenjie Xu, et al.
Published: (2025)
by: Shenjie Xu, et al.
Published: (2025)
ConvLLaVA: Hierarchical Backbones as Visual Encoder for Large Multimodal Models
by: Ge, Chunjiang, et al.
Published: (2024)
by: Ge, Chunjiang, et al.
Published: (2024)
From Answers to Arguments: Toward Trustworthy Clinical Diagnostic Reasoning with Toulmin-Guided Curriculum Goal-Conditioned Learning
by: Zhan, Chen, et al.
Published: (2026)
by: Zhan, Chen, et al.
Published: (2026)
An Interpretable Cross-Attentive Multi-modal MRI Fusion Framework for Schizophrenia Diagnosis
by: Zhou, Ziyu, et al.
Published: (2024)
by: Zhou, Ziyu, et al.
Published: (2024)
Tonsils Sparing Antero‐Lateral Barbed Pharyngoplasty: A Minimally Invasive Approach for OSAHS
by: Andrea Marzetti, et al.
Published: (2025)
by: Andrea Marzetti, et al.
Published: (2025)
MedMIX: Modality-Internal Expert Fusion for Multimodal Medical Diagnosis
by: Cho, Seungik, et al.
Published: (2026)
by: Cho, Seungik, et al.
Published: (2026)
SRU-Pix2Pix: A Fusion-Driven Generator Network for Medical Image Translation with Few-Shot Learning
by: Qiu, Xihe, et al.
Published: (2026)
by: Qiu, Xihe, et al.
Published: (2026)
Adaptive Learning on User Segmentation: Universal to Specific Representation via Bipartite Neural Interaction
by: Tan, Xiaoyu, et al.
Published: (2024)
by: Tan, Xiaoyu, et al.
Published: (2024)
Dual Encoder: Exploiting the Potential of Syntactic and Semantic for Aspect Sentiment Triplet Extraction
by: Zhao, Xiaowei, et al.
Published: (2024)
by: Zhao, Xiaowei, et al.
Published: (2024)
Customized Visual Storytelling with Unified Multimodal LLMs
by: Li, Wei-Hua, et al.
Published: (2026)
by: Li, Wei-Hua, et al.
Published: (2026)
Leveraging 3D Molecular Spatial Visual Information and Multi‐Perspective Representations for Drug Discovery
by: Zimai Zhang, et al.
Published: (2025)
by: Zimai Zhang, et al.
Published: (2025)
Dynamic Encoder Size Based on Data-Driven Layer-wise Pruning for Speech Recognition
by: Xu, Jingjing, et al.
Published: (2024)
by: Xu, Jingjing, et al.
Published: (2024)
Similar Items
-
Structured Visual Evidence Decomposition for Evidence-Grounded Multimodal Screening of Obstructive Sleep Apnea-Hypopnea Syndrome
by: Zhan, Chen, et al.
Published: (2026) -
Robust Deep Hawkes Process under Label Noise of Both Event and Occurrence
by: Tan, Xiaoyu, et al.
Published: (2024) -
CogniDual Framework: Self-Training Large Language Models within a Dual-System Theoretical Framework for Improving Cognitive Tasks
by: Deng, Yongxin, et al.
Published: (2024) -
Struct-X: Enhancing Large Language Models Reasoning with Structured Data
by: Tan, Xiaoyu, et al.
Published: (2024) -
Thought-Like-Pro: Enhancing Reasoning of Large Language Models through Self-Driven Prolog-based Chain-of-Thought
by: Tan, Xiaoyu, et al.
Published: (2024)