Anatomical grounding pre-training for medical phrase grounding
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Wenjun, Chandra, Shakes, Nicolson, Aaron |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Generalised Medical Phrase Grounding
di: Zhang, Wenjun, et al.
Pubblicazione: (2025)
di: Zhang, Wenjun, et al.
Pubblicazione: (2025)
Anatomically-guided masked autoencoder pre-training for aneurysm detection
di: Ceballos-Arroyo, Alberto Mario, et al.
Pubblicazione: (2025)
di: Ceballos-Arroyo, Alberto Mario, et al.
Pubblicazione: (2025)
Contrastive ground-level image and remote sensing pre-training improves representation learning for natural world imagery
di: Huynh, Andy V., et al.
Pubblicazione: (2024)
di: Huynh, Andy V., et al.
Pubblicazione: (2024)
Longitudinal Data and a Semantic Similarity Reward for Chest X-Ray Report Generation
di: Nicolson, Aaron, et al.
Pubblicazione: (2023)
di: Nicolson, Aaron, et al.
Pubblicazione: (2023)
DeViDe: Faceted medical knowledge for improved medical vision-language pre-training
di: Luo, Haozhe, et al.
Pubblicazione: (2024)
di: Luo, Haozhe, et al.
Pubblicazione: (2024)
Audio-visual training for improved grounding in video-text LLMs
di: Sagare, Shivprasad, et al.
Pubblicazione: (2024)
di: Sagare, Shivprasad, et al.
Pubblicazione: (2024)
The Impact of Auxiliary Patient Data on Automated Chest X-Ray Report Generation and How to Incorporate It
di: Nicolson, Aaron, et al.
Pubblicazione: (2024)
di: Nicolson, Aaron, et al.
Pubblicazione: (2024)
MIMO: A medical vision language model with visual referring multimodal input and pixel grounding multimodal output
di: Chen, Yanyuan, et al.
Pubblicazione: (2025)
di: Chen, Yanyuan, et al.
Pubblicazione: (2025)
Visually-grounded Humanoid Agents
di: Ye, Hang, et al.
Pubblicazione: (2026)
di: Ye, Hang, et al.
Pubblicazione: (2026)
e-Health CSIRO at RRG24: Entropy-Augmented Self-Critical Sequence Training for Radiology Report Generation
di: Nicolson, Aaron, et al.
Pubblicazione: (2024)
di: Nicolson, Aaron, et al.
Pubblicazione: (2024)
Anatomical Structure-Guided Medical Vision-Language Pre-training
di: Li, Qingqiu, et al.
Pubblicazione: (2024)
di: Li, Qingqiu, et al.
Pubblicazione: (2024)
Fake It Right: Injecting Anatomical Logic into Synthetic Supervised Pre-training for Medical Segmentation
di: Tang, Jiaqi, et al.
Pubblicazione: (2026)
di: Tang, Jiaqi, et al.
Pubblicazione: (2026)
Comprehensive language-image pre-training for 3D medical image understanding
di: Wald, Tassilo, et al.
Pubblicazione: (2025)
di: Wald, Tassilo, et al.
Pubblicazione: (2025)
Video sentence grounding with temporally global textual knowledge
di: Chen, Cai, et al.
Pubblicazione: (2024)
di: Chen, Cai, et al.
Pubblicazione: (2024)
VLDrive: Vision-Augmented Lightweight MLLMs for Efficient Language-grounded Autonomous Driving
di: Zhang, Ruifei, et al.
Pubblicazione: (2025)
di: Zhang, Ruifei, et al.
Pubblicazione: (2025)
Lighting-grounded Video Generation with Renderer-based Agent Reasoning
di: Cai, Ziqi, et al.
Pubblicazione: (2026)
di: Cai, Ziqi, et al.
Pubblicazione: (2026)
Detecting and refurbishing ground truth errors during training of deep learning-based echocardiography segmentation models
di: Islam, Iman, et al.
Pubblicazione: (2026)
di: Islam, Iman, et al.
Pubblicazione: (2026)
One-shot lip-based biometric authentication: extending behavioral features with authentication phrase information
di: Koch, Brando, et al.
Pubblicazione: (2023)
di: Koch, Brando, et al.
Pubblicazione: (2023)
View-decoupled Transformer for Person Re-identification under Aerial-ground Camera Network
di: Zhang, Quan, et al.
Pubblicazione: (2024)
di: Zhang, Quan, et al.
Pubblicazione: (2024)
Bridging the gap to real-world language-grounded visual concept learning
di: Jung, Whie, et al.
Pubblicazione: (2025)
di: Jung, Whie, et al.
Pubblicazione: (2025)
WHAM: Reconstructing World-grounded Humans with Accurate 3D Motion
di: Shin, Soyong, et al.
Pubblicazione: (2023)
di: Shin, Soyong, et al.
Pubblicazione: (2023)
Revisiting MAE pre-training for 3D medical image segmentation
di: Wald, Tassilo, et al.
Pubblicazione: (2024)
di: Wald, Tassilo, et al.
Pubblicazione: (2024)
LLM-grounded Video Diffusion Models
di: Lian, Long, et al.
Pubblicazione: (2023)
di: Lian, Long, et al.
Pubblicazione: (2023)
EagleVision: A Dual-Stage Framework with BEV-grounding-based Chain-of-Thought for Spatial Intelligence
di: Wan, Jiaxu, et al.
Pubblicazione: (2025)
di: Wan, Jiaxu, et al.
Pubblicazione: (2025)
High-frequency near-eye ground truth for event-based eye tracking
di: Simpsi, Andrea, et al.
Pubblicazione: (2025)
di: Simpsi, Andrea, et al.
Pubblicazione: (2025)
Human-like compositional learning of visually-grounded concepts using synthetic environments
di: Lin, Zijun, et al.
Pubblicazione: (2025)
di: Lin, Zijun, et al.
Pubblicazione: (2025)
CG-Bench: Clue-grounded Question Answering Benchmark for Long Video Understanding
di: Chen, Guo, et al.
Pubblicazione: (2024)
di: Chen, Guo, et al.
Pubblicazione: (2024)
Online pre-training with long-form videos
di: Kato, Itsuki, et al.
Pubblicazione: (2024)
di: Kato, Itsuki, et al.
Pubblicazione: (2024)
ASHiTA: Automatic Scene-grounded HIerarchical Task Analysis
di: Chang, Yun, et al.
Pubblicazione: (2025)
di: Chang, Yun, et al.
Pubblicazione: (2025)
Anatomically-aware conformal prediction for medical image segmentation with random walks
di: Gaillochet, Mélanie, et al.
Pubblicazione: (2026)
di: Gaillochet, Mélanie, et al.
Pubblicazione: (2026)
Multi-turn Physics-informed Vision-language Model for Physics-grounded Anomaly Detection
di: Gu, Yao, et al.
Pubblicazione: (2026)
di: Gu, Yao, et al.
Pubblicazione: (2026)
Robust soybean seed yield estimation using high-throughput ground robot videos
di: Feng, Jiale, et al.
Pubblicazione: (2024)
di: Feng, Jiale, et al.
Pubblicazione: (2024)
A Video-grounded Dialogue Dataset and Metric for Event-driven Activities
di: Imrattanatrai, Wiradee, et al.
Pubblicazione: (2025)
di: Imrattanatrai, Wiradee, et al.
Pubblicazione: (2025)
Uncovering Hidden Connections: Iterative Search and Reasoning for Video-grounded Dialog
di: Zhang, Haoyu, et al.
Pubblicazione: (2023)
di: Zhang, Haoyu, et al.
Pubblicazione: (2023)
When are radiology reports useful for training medical image classifiers?
di: Bergström, Herman, et al.
Pubblicazione: (2025)
di: Bergström, Herman, et al.
Pubblicazione: (2025)
PitVQA: Image-grounded Text Embedding LLM for Visual Question Answering in Pituitary Surgery
di: He, Runlong, et al.
Pubblicazione: (2024)
di: He, Runlong, et al.
Pubblicazione: (2024)
A ground-based dataset and a diffusion model for on-orbit low-light image enhancement
di: Zhu, Yiman, et al.
Pubblicazione: (2023)
di: Zhu, Yiman, et al.
Pubblicazione: (2023)
VitalVideos-Europe: A dataset of face videos with PPG and blood pressure ground truths
di: Toye, Pieter-Jan
Pubblicazione: (2023)
di: Toye, Pieter-Jan
Pubblicazione: (2023)
MGI: Multimodal Contrastive pre-training of Genomic and Medical Imaging
di: Zhou, Jiaying, et al.
Pubblicazione: (2024)
di: Zhou, Jiaying, et al.
Pubblicazione: (2024)
DOC-Depth: A novel approach for dense depth ground truth generation
di: de Moreau, Simon, et al.
Pubblicazione: (2025)
di: de Moreau, Simon, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Generalised Medical Phrase Grounding
di: Zhang, Wenjun, et al.
Pubblicazione: (2025) -
Anatomically-guided masked autoencoder pre-training for aneurysm detection
di: Ceballos-Arroyo, Alberto Mario, et al.
Pubblicazione: (2025) -
Contrastive ground-level image and remote sensing pre-training improves representation learning for natural world imagery
di: Huynh, Andy V., et al.
Pubblicazione: (2024) -
Longitudinal Data and a Semantic Similarity Reward for Chest X-Ray Report Generation
di: Nicolson, Aaron, et al.
Pubblicazione: (2023) -
DeViDe: Faceted medical knowledge for improved medical vision-language pre-training
di: Luo, Haozhe, et al.
Pubblicazione: (2024)