Survey: Transformer-based Models in Data Modality Conversion
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Rashno, Elyas, Eskandari, Amir, Anand, Aman, Zulkernine, Farhana |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Depth-Guided Self-Supervised Human Keypoint Detection via Cross-Modal Distillation
par: Anand, Aman, et autres
Publié: (2024)
par: Anand, Aman, et autres
Publié: (2024)
Exploring Wavelet Transformations for Deep Learning-based Machine Condition Diagnosis
par: Piedad, Eduardo Jr, et autres
Publié: (2024)
par: Piedad, Eduardo Jr, et autres
Publié: (2024)
Time-Domain Linear Model-based Framework for Passive Acoustic Mapping of Cavitation Activity
par: Gelvez-Barrera, Tatiana, et autres
Publié: (2025)
par: Gelvez-Barrera, Tatiana, et autres
Publié: (2025)
RAVEN: Radar Adaptive Vision Encoders for Efficient Chirp-wise Object Detection and Segmentation
par: Sen, Anuvab, et autres
Publié: (2026)
par: Sen, Anuvab, et autres
Publié: (2026)
WiserVR: Semantic Communication Enabled Wireless Virtual Reality Delivery
par: Xia, Le, et autres
Publié: (2022)
par: Xia, Le, et autres
Publié: (2022)
AGI-Driven Generative Semantic Communications: Principles and Practices
par: Yuan, Xiaojun, et autres
Publié: (2025)
par: Yuan, Xiaojun, et autres
Publié: (2025)
An AI Teaching Assistant for Motion Picture Engineering
par: O'Regan, Deirdre, et autres
Publié: (2026)
par: O'Regan, Deirdre, et autres
Publié: (2026)
A Survey of IMU Based Cross-Modal Transfer Learning in Human Activity Recognition
par: Kamboj, Abhi, et autres
Publié: (2024)
par: Kamboj, Abhi, et autres
Publié: (2024)
MRI Super-Resolution with Deep Learning: A Comprehensive Survey
par: Khateri, Mohammad, et autres
Publié: (2025)
par: Khateri, Mohammad, et autres
Publié: (2025)
Mathematical Computation on High-dimensional Data via Array Programming and Parallel Acceleration
par: Zhang, Chen
Publié: (2025)
par: Zhang, Chen
Publié: (2025)
Research on Feature Extraction Data Processing System For MRI of Brain Diseases Based on Computer Deep Learning
par: Xiao, Lingxi, et autres
Publié: (2024)
par: Xiao, Lingxi, et autres
Publié: (2024)
HyPer-EP: Meta-Learning Hybrid Personalized Models for Cardiac Electrophysiology
par: Jiang, Xiajun, et autres
Publié: (2024)
par: Jiang, Xiajun, et autres
Publié: (2024)
Large-Scale Model Enabled Semantic Communication Based on Robust Knowledge Distillation
par: Ding, Kuiyuan, et autres
Publié: (2025)
par: Ding, Kuiyuan, et autres
Publié: (2025)
Tackle CSM in JPEG Steganalysis with Data Adaptation
par: Abecidan, Rony, et autres
Publié: (2026)
par: Abecidan, Rony, et autres
Publié: (2026)
Quality-Controlled Multimodal Emotion Recognition in Conversations with Identity-Based Transfer Learning and MAMBA Fusion
par: Wang, Zanxu, et autres
Publié: (2025)
par: Wang, Zanxu, et autres
Publié: (2025)
COS2A: Conversion from Sentinel-2 to AVIRIS Hyperspectral Data Using Interpretable Algorithm With Spectral-Spatial Duality
par: Lin, Chia-Hsiang, et autres
Publié: (2025)
par: Lin, Chia-Hsiang, et autres
Publié: (2025)
Adaptive-avg-pooling based Attention Vision Transformer for Face Anti-spoofing
par: Yang, Jichen, et autres
Publié: (2024)
par: Yang, Jichen, et autres
Publié: (2024)
Predictive Modeling of Rat Brain Local Field Potentials using Single-Variable and Multivariable Approaches
par: Kalbasi, AmirAli, et autres
Publié: (2025)
par: Kalbasi, AmirAli, et autres
Publié: (2025)
Leveraging Reverberation and Visual Depth Cues for Sound Event Localization and Detection with Distance Estimation
par: Berghi, Davide, et autres
Publié: (2024)
par: Berghi, Davide, et autres
Publié: (2024)
AI WALKUP: A Computer-Vision Approach to Quantifying MDS-UPDRS in Parkinson's Disease
par: Xiang, Xiang, et autres
Publié: (2024)
par: Xiang, Xiang, et autres
Publié: (2024)
Posterior-Mean Rectified Flow: Towards Minimum MSE Photo-Realistic Image Restoration
par: Ohayon, Guy, et autres
Publié: (2024)
par: Ohayon, Guy, et autres
Publié: (2024)
Biometric Authentication Based on Enhanced Remote Photoplethysmography Signal Morphology
par: Sun, Zhaodong, et autres
Publié: (2024)
par: Sun, Zhaodong, et autres
Publié: (2024)
Resource-Efficient Multiview Perception: Integrating Semantic Masking with Masked Autoencoders
par: Dakic, Kosta, et autres
Publié: (2024)
par: Dakic, Kosta, et autres
Publié: (2024)
NeRF Solves Undersampled MRI Reconstruction
par: Jang, Tae Jun, et autres
Publié: (2024)
par: Jang, Tae Jun, et autres
Publié: (2024)
Lightweight Video Denoising Using a Classic Bayesian Backbone
par: Bled, Clément, et autres
Publié: (2024)
par: Bled, Clément, et autres
Publié: (2024)
MemWarp: Discontinuity-Preserving Cardiac Registration with Memorized Anatomical Filters
par: Zhang, Hang, et autres
Publié: (2024)
par: Zhang, Hang, et autres
Publié: (2024)
VoxelOpt: Voxel-Adaptive Message Passing for Discrete Optimization in Deformable Abdominal CT Registration
par: Zhang, Hang, et autres
Publié: (2025)
par: Zhang, Hang, et autres
Publié: (2025)
NEF-NET+: Adapting Electrocardio panorama in the wild
par: Zhan, Zehui, et autres
Publié: (2025)
par: Zhan, Zehui, et autres
Publié: (2025)
OpenEarthMap-SAR: A Benchmark Synthetic Aperture Radar Dataset for Global High-Resolution Land Cover Mapping
par: Xia, Junshi, et autres
Publié: (2025)
par: Xia, Junshi, et autres
Publié: (2025)
Global and Local Contrastive Learning for Joint Representations from Cardiac MRI and ECG
par: Selivanov, Alexander, et autres
Publié: (2025)
par: Selivanov, Alexander, et autres
Publié: (2025)
Deep Learning-Enabled Dissolved Oxygen Sensing in Biofouling Environments for Ocean Monitoring
par: Salaris, Nikolaos, et autres
Publié: (2026)
par: Salaris, Nikolaos, et autres
Publié: (2026)
GMR-Conv: An Efficient Rotation and Reflection Equivariant Convolution Kernel Using Gaussian Mixture Rings
par: Du, Yuexi, et autres
Publié: (2025)
par: Du, Yuexi, et autres
Publié: (2025)
Synthesizing and Identifying Noise Levels in Autonomous Vehicle Camera Radar Datasets
par: Morales, Mathis, et autres
Publié: (2025)
par: Morales, Mathis, et autres
Publié: (2025)
BRIGHT: A globally distributed multimodal building damage assessment dataset with very-high-resolution for all-weather disaster response
par: Chen, Hongruixuan, et autres
Publié: (2025)
par: Chen, Hongruixuan, et autres
Publié: (2025)
Next-Generation Teleophthalmology: AI-enabled Quality Assessment Aiding Remote Smartphone-based Consultation
par: Srikanth, Dhruv, et autres
Publié: (2024)
par: Srikanth, Dhruv, et autres
Publié: (2024)
S$^3$F-Net: A Multi-Modal Approach to Medical Image Classification via Spatial-Spectral Summarizer Fusion Network
par: Siddiqui, Md. Saiful Bari, et autres
Publié: (2025)
par: Siddiqui, Md. Saiful Bari, et autres
Publié: (2025)
ECG-Image-Database: A Dataset of ECG Images with Real-World Imaging and Scanning Artifacts; A Foundation for Computerized ECG Image Digitization and Analysis
par: Reyna, Matthew A., et autres
Publié: (2024)
par: Reyna, Matthew A., et autres
Publié: (2024)
TACO: Rethinking Semantic Communications with Task Adaptation and Context Embedding
par: Wijesinghe, Achintha, et autres
Publié: (2025)
par: Wijesinghe, Achintha, et autres
Publié: (2025)
A Real-Time Privacy-Preserving Behavior Recognition System via Edge-Cloud Collaboration
par: Song, Huan, et autres
Publié: (2026)
par: Song, Huan, et autres
Publié: (2026)
Physics-Guided Conditional Diffusion Networks for Microwave Image Reconstruction
par: Chehelgami, Shirin, et autres
Publié: (2025)
par: Chehelgami, Shirin, et autres
Publié: (2025)
Documents similaires
-
Depth-Guided Self-Supervised Human Keypoint Detection via Cross-Modal Distillation
par: Anand, Aman, et autres
Publié: (2024) -
Exploring Wavelet Transformations for Deep Learning-based Machine Condition Diagnosis
par: Piedad, Eduardo Jr, et autres
Publié: (2024) -
Time-Domain Linear Model-based Framework for Passive Acoustic Mapping of Cavitation Activity
par: Gelvez-Barrera, Tatiana, et autres
Publié: (2025) -
RAVEN: Radar Adaptive Vision Encoders for Efficient Chirp-wise Object Detection and Segmentation
par: Sen, Anuvab, et autres
Publié: (2026) -
WiserVR: Semantic Communication Enabled Wireless Virtual Reality Delivery
par: Xia, Le, et autres
Publié: (2022)