FITA: Fine-grained Image-Text Aligner for Radiology Report Generation
Fuente:
arXiv
Guardado en:
| Autores principales: | Yang, Honglong, Tang, Hui, Li, Xiaomeng |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
DDaTR: Dynamic Difference-aware Temporal Residual Network for Longitudinal Radiology Report Generation
por: Song, Shanshan, et al.
Publicado: (2025)
por: Song, Shanshan, et al.
Publicado: (2025)
Which Tool Response Should I Trust? Tool-Expertise-Aware Chest X-ray Agent with Multimodal Agentic Learning
por: Huai, Zheang, et al.
Publicado: (2026)
por: Huai, Zheang, et al.
Publicado: (2026)
Proactive Reasoning-with-Retrieval Framework for Medical Multimodal Large Language Models
por: Wang, Lehan, et al.
Publicado: (2025)
por: Wang, Lehan, et al.
Publicado: (2025)
Fine-grained Text to Image Synthesis
por: Ouyang, Xu, et al.
Publicado: (2024)
por: Ouyang, Xu, et al.
Publicado: (2024)
S-RRG-Bench: Structured Radiology Report Generation with Fine-Grained Evaluation Framework
por: Li, Yingshu, et al.
Publicado: (2025)
por: Li, Yingshu, et al.
Publicado: (2025)
RIHA: Report-Image Hierarchical Alignment for Radiology Report Generation
por: Chen, Yucheng, et al.
Publicado: (2026)
por: Chen, Yucheng, et al.
Publicado: (2026)
GarmentAligner: Text-to-Garment Generation via Retrieval-augmented Multi-level Corrections
por: Zhang, Shiyue, et al.
Publicado: (2024)
por: Zhang, Shiyue, et al.
Publicado: (2024)
EVALALIGN: Supervised Fine-Tuning Multimodal LLMs with Human-Aligned Data for Evaluating Text-to-Image Models
por: Tan, Zhiyu, et al.
Publicado: (2024)
por: Tan, Zhiyu, et al.
Publicado: (2024)
Hybrid-Tower: Fine-grained Pseudo-query Interaction and Generation for Text-to-Video Retrieval
por: Lan, Bangxiang, et al.
Publicado: (2025)
por: Lan, Bangxiang, et al.
Publicado: (2025)
Radiology Report Generation for Low-Quality X-Ray Images
por: Zhu, Hongze, et al.
Publicado: (2026)
por: Zhu, Hongze, et al.
Publicado: (2026)
ID-Aligner: Enhancing Identity-Preserving Text-to-Image Generation with Reward Feedback Learning
por: Chen, Weifeng, et al.
Publicado: (2024)
por: Chen, Weifeng, et al.
Publicado: (2024)
DART: Disease-aware Image-Text Alignment and Self-correcting Re-alignment for Trustworthy Radiology Report Generation
por: Park, Sang-Jun, et al.
Publicado: (2025)
por: Park, Sang-Jun, et al.
Publicado: (2025)
Multi-modal Reference Learning for Fine-grained Text-to-Image Retrieval
por: Ma, Zehong, et al.
Publicado: (2025)
por: Ma, Zehong, et al.
Publicado: (2025)
TextToucher: Fine-Grained Text-to-Touch Generation
por: Tu, Jiahang, et al.
Publicado: (2024)
por: Tu, Jiahang, et al.
Publicado: (2024)
Unleashing Video Language Models for Fine-grained HRCT Report Generation
por: Fang, Yingying, et al.
Publicado: (2026)
por: Fang, Yingying, et al.
Publicado: (2026)
FiVA: Fine-grained Visual Attribute Dataset for Text-to-Image Diffusion Models
por: Wu, Tong, et al.
Publicado: (2024)
por: Wu, Tong, et al.
Publicado: (2024)
SignAligner: Harmonizing Complementary Pose Modalities for Coherent Sign Language Generation
por: Wang, Xu, et al.
Publicado: (2025)
por: Wang, Xu, et al.
Publicado: (2025)
KETA: Kinematic-Phrases-Enhanced Text-to-Motion Generation via Fine-grained Alignment
por: Jiang, Yu, et al.
Publicado: (2025)
por: Jiang, Yu, et al.
Publicado: (2025)
Interpretable Bilingual Multimodal Large Language Model for Diverse Biomedical Tasks
por: Wang, Lehan, et al.
Publicado: (2024)
por: Wang, Lehan, et al.
Publicado: (2024)
Forgetting-Resistant and Lesion-Aware Source-Free Domain Adaptive Fundus Image Analysis with Vision-Language Model
por: Huai, Zheang, et al.
Publicado: (2026)
por: Huai, Zheang, et al.
Publicado: (2026)
Anatomical Attention Alignment representation for Radiology Report Generation
por: Nguyen, Quang Vinh, et al.
Publicado: (2025)
por: Nguyen, Quang Vinh, et al.
Publicado: (2025)
Block-wise LoRA: Revisiting Fine-grained LoRA for Effective Personalization and Stylization in Text-to-Image Generation
por: Li, Likun, et al.
Publicado: (2024)
por: Li, Likun, et al.
Publicado: (2024)
Fine-grained Image Retrieval via Dual-Vision Adaptation
por: Jiang, Xin, et al.
Publicado: (2025)
por: Jiang, Xin, et al.
Publicado: (2025)
Contrastive Learning with Counterfactual Explanations for Radiology Report Generation
por: Li, Mingjie, et al.
Publicado: (2024)
por: Li, Mingjie, et al.
Publicado: (2024)
Fine-grained Defocus Blur Control for Generative Image Models
por: Shrivastava, Ayush, et al.
Publicado: (2025)
por: Shrivastava, Ayush, et al.
Publicado: (2025)
FineDiffusion: Scaling up Diffusion Models for Fine-grained Image Generation with 10,000 Classes
por: Pan, Ziying, et al.
Publicado: (2024)
por: Pan, Ziying, et al.
Publicado: (2024)
Intensive Vision-guided Network for Radiology Report Generation
por: Zheng, Fudan, et al.
Publicado: (2024)
por: Zheng, Fudan, et al.
Publicado: (2024)
F4-ITS: Fine-grained Feature Fusion for Food Image-Text Search
por: Asokan, Raghul
Publicado: (2025)
por: Asokan, Raghul
Publicado: (2025)
Cross-modal Full-mode Fine-grained Alignment for Text-to-Image Person Retrieval
por: Yin, Hao, et al.
Publicado: (2025)
por: Yin, Hao, et al.
Publicado: (2025)
T2I-VeRW: Part-level Fine-grained Perception for Text-to-Image Vehicle Retrieval
por: Wang, Xiao, et al.
Publicado: (2026)
por: Wang, Xiao, et al.
Publicado: (2026)
EMRRG: Efficient Fine-Tuning Pre-trained X-ray Mamba Networks for Radiology Report Generation
por: Zhang, Mingzheng, et al.
Publicado: (2025)
por: Zhang, Mingzheng, et al.
Publicado: (2025)
Scene Graph Aided Radiology Report Generation
por: Wang, Jun, et al.
Publicado: (2024)
por: Wang, Jun, et al.
Publicado: (2024)
VidGen-1M: A Large-Scale Dataset for Text-to-video Generation
por: Tan, Zhiyu, et al.
Publicado: (2024)
por: Tan, Zhiyu, et al.
Publicado: (2024)
Fine-grained Dynamic Network for Generic Event Boundary Detection
por: Zheng, Ziwei, et al.
Publicado: (2024)
por: Zheng, Ziwei, et al.
Publicado: (2024)
FocusDiff: Advancing Fine-Grained Text-Image Alignment for Autoregressive Visual Generation through RL
por: Pan, Kaihang, et al.
Publicado: (2025)
por: Pan, Kaihang, et al.
Publicado: (2025)
FINEMATCH: Aspect-based Fine-grained Image and Text Mismatch Detection and Correction
por: Hua, Hang, et al.
Publicado: (2024)
por: Hua, Hang, et al.
Publicado: (2024)
MVAM: Multi-View Attention Method for Fine-grained Image-Text Matching
por: Cui, Wanqing, et al.
Publicado: (2024)
por: Cui, Wanqing, et al.
Publicado: (2024)
Vision Mamba Distillation for Low-resolution Fine-grained Image Classification
por: Chen, Yao, et al.
Publicado: (2024)
por: Chen, Yao, et al.
Publicado: (2024)
ETVA: Evaluation of Text-to-Video Alignment via Fine-grained Question Generation and Answering
por: Guan, Kaisi, et al.
Publicado: (2025)
por: Guan, Kaisi, et al.
Publicado: (2025)
Learning to Align Generative Appearance Priors for Fine-grained Image Retrieval
por: Wang, Shijie, et al.
Publicado: (2026)
por: Wang, Shijie, et al.
Publicado: (2026)
Ejemplares similares
-
DDaTR: Dynamic Difference-aware Temporal Residual Network for Longitudinal Radiology Report Generation
por: Song, Shanshan, et al.
Publicado: (2025) -
Which Tool Response Should I Trust? Tool-Expertise-Aware Chest X-ray Agent with Multimodal Agentic Learning
por: Huai, Zheang, et al.
Publicado: (2026) -
Proactive Reasoning-with-Retrieval Framework for Medical Multimodal Large Language Models
por: Wang, Lehan, et al.
Publicado: (2025) -
Fine-grained Text to Image Synthesis
por: Ouyang, Xu, et al.
Publicado: (2024) -
S-RRG-Bench: Structured Radiology Report Generation with Fine-Grained Evaluation Framework
por: Li, Yingshu, et al.
Publicado: (2025)