FITA: Fine-grained Image-Text Aligner for Radiology Report Generation
Fuente:
arXiv
Salvato in:
| Autori principali: | Yang, Honglong, Tang, Hui, Li, Xiaomeng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
DDaTR: Dynamic Difference-aware Temporal Residual Network for Longitudinal Radiology Report Generation
di: Song, Shanshan, et al.
Pubblicazione: (2025)
di: Song, Shanshan, et al.
Pubblicazione: (2025)
Which Tool Response Should I Trust? Tool-Expertise-Aware Chest X-ray Agent with Multimodal Agentic Learning
di: Huai, Zheang, et al.
Pubblicazione: (2026)
di: Huai, Zheang, et al.
Pubblicazione: (2026)
Proactive Reasoning-with-Retrieval Framework for Medical Multimodal Large Language Models
di: Wang, Lehan, et al.
Pubblicazione: (2025)
di: Wang, Lehan, et al.
Pubblicazione: (2025)
Fine-grained Text to Image Synthesis
di: Ouyang, Xu, et al.
Pubblicazione: (2024)
di: Ouyang, Xu, et al.
Pubblicazione: (2024)
S-RRG-Bench: Structured Radiology Report Generation with Fine-Grained Evaluation Framework
di: Li, Yingshu, et al.
Pubblicazione: (2025)
di: Li, Yingshu, et al.
Pubblicazione: (2025)
RIHA: Report-Image Hierarchical Alignment for Radiology Report Generation
di: Chen, Yucheng, et al.
Pubblicazione: (2026)
di: Chen, Yucheng, et al.
Pubblicazione: (2026)
GarmentAligner: Text-to-Garment Generation via Retrieval-augmented Multi-level Corrections
di: Zhang, Shiyue, et al.
Pubblicazione: (2024)
di: Zhang, Shiyue, et al.
Pubblicazione: (2024)
EVALALIGN: Supervised Fine-Tuning Multimodal LLMs with Human-Aligned Data for Evaluating Text-to-Image Models
di: Tan, Zhiyu, et al.
Pubblicazione: (2024)
di: Tan, Zhiyu, et al.
Pubblicazione: (2024)
Hybrid-Tower: Fine-grained Pseudo-query Interaction and Generation for Text-to-Video Retrieval
di: Lan, Bangxiang, et al.
Pubblicazione: (2025)
di: Lan, Bangxiang, et al.
Pubblicazione: (2025)
Radiology Report Generation for Low-Quality X-Ray Images
di: Zhu, Hongze, et al.
Pubblicazione: (2026)
di: Zhu, Hongze, et al.
Pubblicazione: (2026)
ID-Aligner: Enhancing Identity-Preserving Text-to-Image Generation with Reward Feedback Learning
di: Chen, Weifeng, et al.
Pubblicazione: (2024)
di: Chen, Weifeng, et al.
Pubblicazione: (2024)
DART: Disease-aware Image-Text Alignment and Self-correcting Re-alignment for Trustworthy Radiology Report Generation
di: Park, Sang-Jun, et al.
Pubblicazione: (2025)
di: Park, Sang-Jun, et al.
Pubblicazione: (2025)
Multi-modal Reference Learning for Fine-grained Text-to-Image Retrieval
di: Ma, Zehong, et al.
Pubblicazione: (2025)
di: Ma, Zehong, et al.
Pubblicazione: (2025)
TextToucher: Fine-Grained Text-to-Touch Generation
di: Tu, Jiahang, et al.
Pubblicazione: (2024)
di: Tu, Jiahang, et al.
Pubblicazione: (2024)
Unleashing Video Language Models for Fine-grained HRCT Report Generation
di: Fang, Yingying, et al.
Pubblicazione: (2026)
di: Fang, Yingying, et al.
Pubblicazione: (2026)
FiVA: Fine-grained Visual Attribute Dataset for Text-to-Image Diffusion Models
di: Wu, Tong, et al.
Pubblicazione: (2024)
di: Wu, Tong, et al.
Pubblicazione: (2024)
SignAligner: Harmonizing Complementary Pose Modalities for Coherent Sign Language Generation
di: Wang, Xu, et al.
Pubblicazione: (2025)
di: Wang, Xu, et al.
Pubblicazione: (2025)
KETA: Kinematic-Phrases-Enhanced Text-to-Motion Generation via Fine-grained Alignment
di: Jiang, Yu, et al.
Pubblicazione: (2025)
di: Jiang, Yu, et al.
Pubblicazione: (2025)
Interpretable Bilingual Multimodal Large Language Model for Diverse Biomedical Tasks
di: Wang, Lehan, et al.
Pubblicazione: (2024)
di: Wang, Lehan, et al.
Pubblicazione: (2024)
Forgetting-Resistant and Lesion-Aware Source-Free Domain Adaptive Fundus Image Analysis with Vision-Language Model
di: Huai, Zheang, et al.
Pubblicazione: (2026)
di: Huai, Zheang, et al.
Pubblicazione: (2026)
Anatomical Attention Alignment representation for Radiology Report Generation
di: Nguyen, Quang Vinh, et al.
Pubblicazione: (2025)
di: Nguyen, Quang Vinh, et al.
Pubblicazione: (2025)
Block-wise LoRA: Revisiting Fine-grained LoRA for Effective Personalization and Stylization in Text-to-Image Generation
di: Li, Likun, et al.
Pubblicazione: (2024)
di: Li, Likun, et al.
Pubblicazione: (2024)
Fine-grained Image Retrieval via Dual-Vision Adaptation
di: Jiang, Xin, et al.
Pubblicazione: (2025)
di: Jiang, Xin, et al.
Pubblicazione: (2025)
Contrastive Learning with Counterfactual Explanations for Radiology Report Generation
di: Li, Mingjie, et al.
Pubblicazione: (2024)
di: Li, Mingjie, et al.
Pubblicazione: (2024)
Fine-grained Defocus Blur Control for Generative Image Models
di: Shrivastava, Ayush, et al.
Pubblicazione: (2025)
di: Shrivastava, Ayush, et al.
Pubblicazione: (2025)
FineDiffusion: Scaling up Diffusion Models for Fine-grained Image Generation with 10,000 Classes
di: Pan, Ziying, et al.
Pubblicazione: (2024)
di: Pan, Ziying, et al.
Pubblicazione: (2024)
Intensive Vision-guided Network for Radiology Report Generation
di: Zheng, Fudan, et al.
Pubblicazione: (2024)
di: Zheng, Fudan, et al.
Pubblicazione: (2024)
F4-ITS: Fine-grained Feature Fusion for Food Image-Text Search
di: Asokan, Raghul
Pubblicazione: (2025)
di: Asokan, Raghul
Pubblicazione: (2025)
Cross-modal Full-mode Fine-grained Alignment for Text-to-Image Person Retrieval
di: Yin, Hao, et al.
Pubblicazione: (2025)
di: Yin, Hao, et al.
Pubblicazione: (2025)
T2I-VeRW: Part-level Fine-grained Perception for Text-to-Image Vehicle Retrieval
di: Wang, Xiao, et al.
Pubblicazione: (2026)
di: Wang, Xiao, et al.
Pubblicazione: (2026)
EMRRG: Efficient Fine-Tuning Pre-trained X-ray Mamba Networks for Radiology Report Generation
di: Zhang, Mingzheng, et al.
Pubblicazione: (2025)
di: Zhang, Mingzheng, et al.
Pubblicazione: (2025)
Scene Graph Aided Radiology Report Generation
di: Wang, Jun, et al.
Pubblicazione: (2024)
di: Wang, Jun, et al.
Pubblicazione: (2024)
VidGen-1M: A Large-Scale Dataset for Text-to-video Generation
di: Tan, Zhiyu, et al.
Pubblicazione: (2024)
di: Tan, Zhiyu, et al.
Pubblicazione: (2024)
Fine-grained Dynamic Network for Generic Event Boundary Detection
di: Zheng, Ziwei, et al.
Pubblicazione: (2024)
di: Zheng, Ziwei, et al.
Pubblicazione: (2024)
FocusDiff: Advancing Fine-Grained Text-Image Alignment for Autoregressive Visual Generation through RL
di: Pan, Kaihang, et al.
Pubblicazione: (2025)
di: Pan, Kaihang, et al.
Pubblicazione: (2025)
FINEMATCH: Aspect-based Fine-grained Image and Text Mismatch Detection and Correction
di: Hua, Hang, et al.
Pubblicazione: (2024)
di: Hua, Hang, et al.
Pubblicazione: (2024)
MVAM: Multi-View Attention Method for Fine-grained Image-Text Matching
di: Cui, Wanqing, et al.
Pubblicazione: (2024)
di: Cui, Wanqing, et al.
Pubblicazione: (2024)
Vision Mamba Distillation for Low-resolution Fine-grained Image Classification
di: Chen, Yao, et al.
Pubblicazione: (2024)
di: Chen, Yao, et al.
Pubblicazione: (2024)
ETVA: Evaluation of Text-to-Video Alignment via Fine-grained Question Generation and Answering
di: Guan, Kaisi, et al.
Pubblicazione: (2025)
di: Guan, Kaisi, et al.
Pubblicazione: (2025)
Learning to Align Generative Appearance Priors for Fine-grained Image Retrieval
di: Wang, Shijie, et al.
Pubblicazione: (2026)
di: Wang, Shijie, et al.
Pubblicazione: (2026)
Documenti analoghi
-
DDaTR: Dynamic Difference-aware Temporal Residual Network for Longitudinal Radiology Report Generation
di: Song, Shanshan, et al.
Pubblicazione: (2025) -
Which Tool Response Should I Trust? Tool-Expertise-Aware Chest X-ray Agent with Multimodal Agentic Learning
di: Huai, Zheang, et al.
Pubblicazione: (2026) -
Proactive Reasoning-with-Retrieval Framework for Medical Multimodal Large Language Models
di: Wang, Lehan, et al.
Pubblicazione: (2025) -
Fine-grained Text to Image Synthesis
di: Ouyang, Xu, et al.
Pubblicazione: (2024) -
S-RRG-Bench: Structured Radiology Report Generation with Fine-Grained Evaluation Framework
di: Li, Yingshu, et al.
Pubblicazione: (2025)