Anatomical Attention Alignment representation for Radiology Report Generation
Fuente:
arXiv
Guardado en:
| Autores principales: | Nguyen, Quang Vinh, Nguyen, Minh Duc, Vo, Thanh Hoang Son, Yang, Hyung-Jeong, Kim, Soo-Hyung |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
KAN-Based Fusion of Dual-Domain for Audio-Driven Facial Landmarks Generation
por: Vo-Thanh, Hoang-Son, et al.
Publicado: (2024)
por: Vo-Thanh, Hoang-Son, et al.
Publicado: (2024)
ATL-Diff: Audio-Driven Talking Head Generation with Early Landmarks-Guide Noise Diffusion
por: Vo, Hoang-Son, et al.
Publicado: (2025)
por: Vo, Hoang-Son, et al.
Publicado: (2025)
Rethinking Top Probability from Multi-view for Distracted Driver Behaviour Localization
por: Nguyen, Quang Vinh, et al.
Publicado: (2024)
por: Nguyen, Quang Vinh, et al.
Publicado: (2024)
Polyp-SES: Automatic Polyp Segmentation with Self-Enriched Semantic Model
por: Nguyen, Quang Vinh, et al.
Publicado: (2024)
por: Nguyen, Quang Vinh, et al.
Publicado: (2024)
Leveraging WaveNet for Dynamic Listening Head Modeling from Speech
por: Nguyen, Minh-Duc, et al.
Publicado: (2024)
por: Nguyen, Minh-Duc, et al.
Publicado: (2024)
Transformer with Leveraged Masked Autoencoder for video-based Pain Assessment
por: Nguyen, Minh-Duc, et al.
Publicado: (2024)
por: Nguyen, Minh-Duc, et al.
Publicado: (2024)
Adaptation of Distinct Semantics for Uncertain Areas in Polyp Segmentation
por: Nguyen, Quang Vinh, et al.
Publicado: (2024)
por: Nguyen, Quang Vinh, et al.
Publicado: (2024)
Self-supervised Video Object Segmentation with Distillation Learning of Deformable Attention
por: Truong, Quang-Trung, et al.
Publicado: (2024)
por: Truong, Quang-Trung, et al.
Publicado: (2024)
Act Like a Radiologist: Radiology Report Generation across Anatomical Regions
por: Chen, Qi, et al.
Publicado: (2023)
por: Chen, Qi, et al.
Publicado: (2023)
Radiology Report Generation with Layer-Wise Anatomical Attention
por: Muñiz-De-León, Emmanuel D., et al.
Publicado: (2025)
por: Muñiz-De-León, Emmanuel D., et al.
Publicado: (2025)
FrameDiT: Diffusion Transformer with Matrix Attention for Efficient Video Generation
por: Le, Minh Khoa, et al.
Publicado: (2026)
por: Le, Minh Khoa, et al.
Publicado: (2026)
Semi-Supervised Semantic Segmentation using Redesigned Self-Training for White Blood Cells
por: Luu, Vinh Quoc, et al.
Publicado: (2024)
por: Luu, Vinh Quoc, et al.
Publicado: (2024)
SDPA++: A General Framework for Self-Supervised Denoising with Patch Aggregation
por: Nguyen, Huy Minh Nhat, et al.
Publicado: (2025)
por: Nguyen, Huy Minh Nhat, et al.
Publicado: (2025)
TwinLiteNet+: An Enhanced Multi-Task Segmentation Model for Autonomous Driving
por: Che, Quang-Huy, et al.
Publicado: (2024)
por: Che, Quang-Huy, et al.
Publicado: (2024)
Toward a Vision-Language Foundation Model for Medical Data: Multimodal Dataset and Benchmarks for Vietnamese PET/CT Report Generation
por: Nguyen, Huu Tien, et al.
Publicado: (2025)
por: Nguyen, Huu Tien, et al.
Publicado: (2025)
Color Alignment in Diffusion
por: Shum, Ka Chun, et al.
Publicado: (2025)
por: Shum, Ka Chun, et al.
Publicado: (2025)
The Art of Camouflage: Few-Shot Learning for Animal Detection and Segmentation
por: Nguyen, Thanh-Danh, et al.
Publicado: (2023)
por: Nguyen, Thanh-Danh, et al.
Publicado: (2023)
Enhancing person re-identification via Uncertainty Feature Fusion Method and Auto-weighted Measure Combination
por: Che, Quang-Huy, et al.
Publicado: (2024)
por: Che, Quang-Huy, et al.
Publicado: (2024)
SATURN: Autoregressive Image Generation Guided by Scene Graphs
por: Vo, Thanh-Nhan, et al.
Publicado: (2025)
por: Vo, Thanh-Nhan, et al.
Publicado: (2025)
U-CESE: Unified Clip-based Event Search Engine for AI Challenge HCMC 2025
por: Le, Duc-Nhuan, et al.
Publicado: (2026)
por: Le, Duc-Nhuan, et al.
Publicado: (2026)
PADM: A Physics-aware Diffusion Model for Attenuation Correction
por: Pham, Trung Kien, et al.
Publicado: (2025)
por: Pham, Trung Kien, et al.
Publicado: (2025)
Enhanced Generative Data Augmentation for Semantic Segmentation via Stronger Guidance
por: Che, Quang-Huy, et al.
Publicado: (2024)
por: Che, Quang-Huy, et al.
Publicado: (2024)
Persistent Test-time Adaptation in Recurring Testing Scenarios
por: Hoang, Trung-Hieu, et al.
Publicado: (2023)
por: Hoang, Trung-Hieu, et al.
Publicado: (2023)
KGAlign: Joint Semantic-Structural Knowledge Encoding for Multimodal Fake News Detection
por: La, Tuan-Vinh, et al.
Publicado: (2025)
por: La, Tuan-Vinh, et al.
Publicado: (2025)
ShowFlow: From Robust Single Concept to Condition-Free Multi-Concept Generation
por: Hoang, Trong-Vu, et al.
Publicado: (2025)
por: Hoang, Trong-Vu, et al.
Publicado: (2025)
Emotic Masked Autoencoder with Attention Fusion for Facial Expression Recognition
por: Nguyen-Xuan, Bach, et al.
Publicado: (2024)
por: Nguyen-Xuan, Bach, et al.
Publicado: (2024)
Detection Fire in Camera RGB-NIR
por: Khai, Nguyen Truong, et al.
Publicado: (2025)
por: Khai, Nguyen Truong, et al.
Publicado: (2025)
DART: Disease-aware Image-Text Alignment and Self-correcting Re-alignment for Trustworthy Radiology Report Generation
por: Park, Sang-Jun, et al.
Publicado: (2025)
por: Park, Sang-Jun, et al.
Publicado: (2025)
Bridging the Training-Deployment Gap: Gated Encoding and Multi-Scale Refinement for Efficient Quantization-Aware Image Enhancement
por: To-Thanh, Dat, et al.
Publicado: (2026)
por: To-Thanh, Dat, et al.
Publicado: (2026)
MoBind: Motion Binding for Fine-Grained IMU-Video Pose Alignment
por: Nguyen, Duc Duy, et al.
Publicado: (2026)
por: Nguyen, Duc Duy, et al.
Publicado: (2026)
VENUS: Visual Editing with Noise Inversion Using Scene Graphs
por: Vo, Thanh-Nhan, et al.
Publicado: (2026)
por: Vo, Thanh-Nhan, et al.
Publicado: (2026)
SimGraph: A Unified Framework for Scene Graph-Based Image Generation and Editing
por: Vo, Thanh-Nhan, et al.
Publicado: (2026)
por: Vo, Thanh-Nhan, et al.
Publicado: (2026)
SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)
por: Nguyen, Trong-Thuan, et al.
Publicado: (2025)
por: Nguyen, Trong-Thuan, et al.
Publicado: (2025)
ITSELF: Attention Guided Fine-Grained Alignment for Vision-Language Retrieval
por: Nguyen, Tien-Huy, et al.
Publicado: (2026)
por: Nguyen, Tien-Huy, et al.
Publicado: (2026)
Multi-Perspective Data Augmentation for Few-shot Object Detection
por: Vu, Anh-Khoa Nguyen, et al.
Publicado: (2025)
por: Vu, Anh-Khoa Nguyen, et al.
Publicado: (2025)
Towards Efficient and Robust Moment Retrieval System: A Unified Framework for Multi-Granularity Models and Temporal Reranking
por: Tran, Huu-Loc, et al.
Publicado: (2025)
por: Tran, Huu-Loc, et al.
Publicado: (2025)
SwiftTry: Fast and Consistent Video Virtual Try-On with Diffusion Models
por: Nguyen, Hung, et al.
Publicado: (2024)
por: Nguyen, Hung, et al.
Publicado: (2024)
GeoSearch: Augmenting Worldwide Geolocalization with Web-Scale Reverse Image Search and Image Matching
por: Le-Duc, Tung-Duong, et al.
Publicado: (2026)
por: Le-Duc, Tung-Duong, et al.
Publicado: (2026)
UIT-DarkCow team at ImageCLEFmedical Caption 2024: Diagnostic Captioning for Radiology Images Efficiency with Transformer Models
por: Van Nguyen, Quan, et al.
Publicado: (2024)
por: Van Nguyen, Quan, et al.
Publicado: (2024)
A model-agnostic active learning approach for animal detection from camera traps
por: Nguyen, Thi Thu Thuy, et al.
Publicado: (2025)
por: Nguyen, Thi Thu Thuy, et al.
Publicado: (2025)
Ejemplares similares
-
KAN-Based Fusion of Dual-Domain for Audio-Driven Facial Landmarks Generation
por: Vo-Thanh, Hoang-Son, et al.
Publicado: (2024) -
ATL-Diff: Audio-Driven Talking Head Generation with Early Landmarks-Guide Noise Diffusion
por: Vo, Hoang-Son, et al.
Publicado: (2025) -
Rethinking Top Probability from Multi-view for Distracted Driver Behaviour Localization
por: Nguyen, Quang Vinh, et al.
Publicado: (2024) -
Polyp-SES: Automatic Polyp Segmentation with Self-Enriched Semantic Model
por: Nguyen, Quang Vinh, et al.
Publicado: (2024) -
Leveraging WaveNet for Dynamic Listening Head Modeling from Speech
por: Nguyen, Minh-Duc, et al.
Publicado: (2024)