Salvato in:
| Autori principali: | Zheng, Tong, Sone, Shusaku, Ushiku, Yoshitaka, Oba, Yuki, Ma, Jiaxin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2403.01802 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
TriFusion-SR: Joint Tri-Modal Medical Image Fusion and SR
di: Dharejo, Fayaz Ali, et al.
Pubblicazione: (2026)
di: Dharejo, Fayaz Ali, et al.
Pubblicazione: (2026)
SciPostLayout: A Dataset for Layout Analysis and Layout Generation of Scientific Posters
di: Tanaka, Shohei, et al.
Pubblicazione: (2024)
di: Tanaka, Shohei, et al.
Pubblicazione: (2024)
SciPostLayoutTree: A Dataset for Structural Analysis of Scientific Posters
di: Tanaka, Shohei, et al.
Pubblicazione: (2025)
di: Tanaka, Shohei, et al.
Pubblicazione: (2025)
Learning Contrastive Multimodal Fusion with Improved Modality Dropout for Disease Detection and Prediction
di: Gu, Yi, et al.
Pubblicazione: (2025)
di: Gu, Yi, et al.
Pubblicazione: (2025)
SBS Figures: Pre-training Figure QA from Stage-by-Stage Synthesized Images
di: Shinoda, Risa, et al.
Pubblicazione: (2024)
di: Shinoda, Risa, et al.
Pubblicazione: (2024)
AgroBench: Vision-Language Model Benchmark in Agriculture
di: Shinoda, Risa, et al.
Pubblicazione: (2025)
di: Shinoda, Risa, et al.
Pubblicazione: (2025)
CaptionSmiths: Flexibly Controlling Language Pattern in Image Captioning
di: Saito, Kuniaki, et al.
Pubblicazione: (2025)
di: Saito, Kuniaki, et al.
Pubblicazione: (2025)
Spatial-Spectral Binarized Neural Network for Panchromatic and Multi-spectral Images Fusion
di: Jiang, Yizhen, et al.
Pubblicazione: (2025)
di: Jiang, Yizhen, et al.
Pubblicazione: (2025)
XFMamba: Cross-Fusion Mamba for Multi-View Medical Image Classification
di: Zheng, Xiaoyu, et al.
Pubblicazione: (2025)
di: Zheng, Xiaoyu, et al.
Pubblicazione: (2025)
HalDec-Bench: Benchmarking Hallucination Detector in Image Captioning
di: Saito, Kuniaki, et al.
Pubblicazione: (2026)
di: Saito, Kuniaki, et al.
Pubblicazione: (2026)
HalDec-Bench: Benchmarking Hallucination Detector in Image Captioning
di: Saito, Kuniaki, et al.
Pubblicazione: (2025)
di: Saito, Kuniaki, et al.
Pubblicazione: (2025)
Recipe Generation from Unsegmented Cooking Videos
di: Nishimura, Taichi, et al.
Pubblicazione: (2022)
di: Nishimura, Taichi, et al.
Pubblicazione: (2022)
Balanced Diffusion-Guided Fusion for Multimodal Remote Sensing Classification
di: Liu, Hao, et al.
Pubblicazione: (2025)
di: Liu, Hao, et al.
Pubblicazione: (2025)
AdaCoder: Adaptive Prompt Compression for Programmatic Visual Question Answering
di: Ukai, Mahiro, et al.
Pubblicazione: (2024)
di: Ukai, Mahiro, et al.
Pubblicazione: (2024)
BiSegMamba: Efficient Bidirectional Tri-Oriented Mamba for 3D Medical Image Segmentation
di: Zada, Bakht, et al.
Pubblicazione: (2026)
di: Zada, Bakht, et al.
Pubblicazione: (2026)
Multimodal Fusion Learning with Dual Attention for Medical Imaging
di: Dhar, Joy, et al.
Pubblicazione: (2024)
di: Dhar, Joy, et al.
Pubblicazione: (2024)
SciPostGen: Bridging the Gap between Scientific Papers and Poster Layouts
di: Inadumi, Shun, et al.
Pubblicazione: (2025)
di: Inadumi, Shun, et al.
Pubblicazione: (2025)
Exo2EgoDVC: Dense Video Captioning of Egocentric Procedural Activities Using Web Instructional Videos
di: Ohkawa, Takehiko, et al.
Pubblicazione: (2023)
di: Ohkawa, Takehiko, et al.
Pubblicazione: (2023)
GraphMMP: A Graph Neural Network Model with Mutual Information and Global Fusion for Multimodal Medical Prognosis
di: Shan, Xuhao, et al.
Pubblicazione: (2025)
di: Shan, Xuhao, et al.
Pubblicazione: (2025)
DepMamba: Progressive Fusion Mamba for Multimodal Depression Detection
di: Ye, Jiaxin, et al.
Pubblicazione: (2024)
di: Ye, Jiaxin, et al.
Pubblicazione: (2024)
MedTri: A Platform for Structured Medical Report Normalization to Enhance Vision-Language Pretraining
di: Chu, Yuetan, et al.
Pubblicazione: (2026)
di: Chu, Yuetan, et al.
Pubblicazione: (2026)
Tri-Modal Fusion Transformers for UAV-based Object Detection
di: Iaboni, Craig, et al.
Pubblicazione: (2026)
di: Iaboni, Craig, et al.
Pubblicazione: (2026)
HyPCA-Net: Advancing Multimodal Fusion in Medical Image Analysis
di: Dhar, J., et al.
Pubblicazione: (2026)
di: Dhar, J., et al.
Pubblicazione: (2026)
Neural Processing of Tri-Plane Hybrid Neural Fields
di: Cardace, Adriano, et al.
Pubblicazione: (2023)
di: Cardace, Adriano, et al.
Pubblicazione: (2023)
Reference-Free Image Quality Assessment for Virtual Try-On via Human Feedback
di: Hirakawa, Yuki, et al.
Pubblicazione: (2026)
di: Hirakawa, Yuki, et al.
Pubblicazione: (2026)
COM Kitchens: An Unedited Overhead-view Video Dataset as a Vision-Language Benchmark
di: Maeda, Koki, et al.
Pubblicazione: (2024)
di: Maeda, Koki, et al.
Pubblicazione: (2024)
Dynamic Try-On: Taming Video Virtual Try-on with Dynamic Attention Mechanism
di: Zheng, Jun, et al.
Pubblicazione: (2024)
di: Zheng, Jun, et al.
Pubblicazione: (2024)
iTryOn: Mastering Interactive Video Virtual Try-On with Spatial-Semantic Guidance
di: Zheng, Jun, et al.
Pubblicazione: (2026)
di: Zheng, Jun, et al.
Pubblicazione: (2026)
USCNet: Transformer-Based Multimodal Fusion with Segmentation Guidance for Urolithiasis Classification
di: Wang, Changmiao, et al.
Pubblicazione: (2026)
di: Wang, Changmiao, et al.
Pubblicazione: (2026)
Mobile-VTON: High-Fidelity On-Device Virtual Try-On
di: Wan, Zhenchen, et al.
Pubblicazione: (2026)
di: Wan, Zhenchen, et al.
Pubblicazione: (2026)
Simultaneous Tri-Modal Medical Image Fusion and Super-Resolution using Conditional Diffusion Model
di: Xu, Yushen, et al.
Pubblicazione: (2024)
di: Xu, Yushen, et al.
Pubblicazione: (2024)
Interactive Multimodal Fusion with Temporal Modeling
di: Yu, Jun, et al.
Pubblicazione: (2025)
di: Yu, Jun, et al.
Pubblicazione: (2025)
FusionMamba: Dynamic Feature Enhancement for Multimodal Image Fusion with Mamba
di: Xie, Xinyu, et al.
Pubblicazione: (2024)
di: Xie, Xinyu, et al.
Pubblicazione: (2024)
Evaluating the Fairness of Neural Collapse in Medical Image Classification
di: Mouheb, Kaouther, et al.
Pubblicazione: (2024)
di: Mouheb, Kaouther, et al.
Pubblicazione: (2024)
OOTDiffusion: Outfitting Fusion based Latent Diffusion for Controllable Virtual Try-on
di: Xu, Yuhao, et al.
Pubblicazione: (2024)
di: Xu, Yuhao, et al.
Pubblicazione: (2024)
SMFusion: Semantic-Preserving Fusion of Multimodal Medical Images for Enhanced Clinical Diagnosis
di: Xiang, Haozhe, et al.
Pubblicazione: (2025)
di: Xiang, Haozhe, et al.
Pubblicazione: (2025)
SNN-Driven Multimodal Human Action Recognition via Sparse Spatial-Temporal Data Fusion
di: Zheng, Naichuan, et al.
Pubblicazione: (2025)
di: Zheng, Naichuan, et al.
Pubblicazione: (2025)
TriFusion-AE: Language-Guided Depth and LiDAR Fusion for Robust Point Cloud Processing
di: Neogi, Susmit
Pubblicazione: (2025)
di: Neogi, Susmit
Pubblicazione: (2025)
TIP: Tabular-Image Pre-training for Multimodal Classification with Incomplete Data
di: Du, Siyi, et al.
Pubblicazione: (2024)
di: Du, Siyi, et al.
Pubblicazione: (2024)
Multi-Contrast Fusion Module: An attention mechanism integrating multi-contrast features for fetal torso plane classification
di: Zhu, Shengjun, et al.
Pubblicazione: (2025)
di: Zhu, Shengjun, et al.
Pubblicazione: (2025)
Documenti analoghi
-
TriFusion-SR: Joint Tri-Modal Medical Image Fusion and SR
di: Dharejo, Fayaz Ali, et al.
Pubblicazione: (2026) -
SciPostLayout: A Dataset for Layout Analysis and Layout Generation of Scientific Posters
di: Tanaka, Shohei, et al.
Pubblicazione: (2024) -
SciPostLayoutTree: A Dataset for Structural Analysis of Scientific Posters
di: Tanaka, Shohei, et al.
Pubblicazione: (2025) -
Learning Contrastive Multimodal Fusion with Improved Modality Dropout for Disease Detection and Prediction
di: Gu, Yi, et al.
Pubblicazione: (2025) -
SBS Figures: Pre-training Figure QA from Stage-by-Stage Synthesized Images
di: Shinoda, Risa, et al.
Pubblicazione: (2024)