Visual Question Answering in Ophthalmology: A Progressive and Practical Perspective
Fuente:
arXiv
Saved in:
| Main Authors: | Chen, Xiaolan, Chen, Ruoyu, Xu, Pusheng, Zhang, Weiyi, Shang, Xianwen, He, Mingguang, Shi, Danli |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
EyeDiff: text-to-image diffusion model improves rare eye disease diagnosis
by: Chen, Ruoyu, et al.
Published: (2024)
by: Chen, Ruoyu, et al.
Published: (2024)
Choroidal Vessel Segmentation on Indocyanine Green Angiography Images via Human-in-the-Loop Labeling
by: Chen, Ruoyu, et al.
Published: (2024)
by: Chen, Ruoyu, et al.
Published: (2024)
UWF-RI2FA: Generating Multi-frame Ultrawide-field Fluorescein Angiography from Ultrawide-field Retinal Imaging Improves Diabetic Retinopathy Stratification
by: Chen, Ruoyu, et al.
Published: (2024)
by: Chen, Ruoyu, et al.
Published: (2024)
Fundus2Video: Cross-Modal Angiography Video Generation from Static Fundus Photography with Clinical Knowledge Guidance
by: Zhang, Weiyi, et al.
Published: (2024)
by: Zhang, Weiyi, et al.
Published: (2024)
Fundus2Globe: Generative AI-Driven 3D Digital Twins for Personalized Myopia Management
by: Shi, Danli, et al.
Published: (2025)
by: Shi, Danli, et al.
Published: (2025)
Unifying Image Processing as Visual Prompting Question Answering
by: Liu, Yihao, et al.
Published: (2023)
by: Liu, Yihao, et al.
Published: (2023)
Predicting Diabetic Macular Edema Treatment Responses Using OCT: Dataset and Methods of APTOS Competition
by: Zhang, Weiyi, et al.
Published: (2025)
by: Zhang, Weiyi, et al.
Published: (2025)
Goal-Oriented Semantic Communication for Wireless Visual Question Answering
by: Liu, Sige, et al.
Published: (2024)
by: Liu, Sige, et al.
Published: (2024)
Benchmarking Large Multimodal Models for Ophthalmic Visual Question Answering with OphthalWeChat
by: Xu, Pusheng, et al.
Published: (2025)
by: Xu, Pusheng, et al.
Published: (2025)
DiffNR: Diffusion-Enhanced Neural Representation Optimization for Sparse-View 3D Tomographic Reconstruction
by: Su, Shiyan, et al.
Published: (2026)
by: Su, Shiyan, et al.
Published: (2026)
Deep Learning for Ophthalmology: The State-of-the-Art and Future Trends
by: Nguyen, Duy M. H., et al.
Published: (2025)
by: Nguyen, Duy M. H., et al.
Published: (2025)
VideoQA-SC: Adaptive Semantic Communication for Video Question Answering
by: Guo, Jiangyuan, et al.
Published: (2024)
by: Guo, Jiangyuan, et al.
Published: (2024)
HERBench: A Benchmark for Multi-Evidence Integration in Video Question Answering
by: Ben-Ami, Dan, et al.
Published: (2025)
by: Ben-Ami, Dan, et al.
Published: (2025)
Efficient Bilinear Attention-based Fusion for Medical Visual Question Answering
by: Zhang, Zhilin, et al.
Published: (2024)
by: Zhang, Zhilin, et al.
Published: (2024)
Beyond GFVC: A Progressive Face Video Compression Framework with Adaptive Visual Tokens
by: Chen, Bolin, et al.
Published: (2024)
by: Chen, Bolin, et al.
Published: (2024)
Uncertainty-guided Perturbation for Image Super-Resolution Diffusion Model
by: Zhang, Leheng, et al.
Published: (2025)
by: Zhang, Leheng, et al.
Published: (2025)
SAR-RAG: ATR Visual Question Answering by Semantic Search, Retrieval, and MLLM Generation
by: Ramirez, David F., et al.
Published: (2026)
by: Ramirez, David F., et al.
Published: (2026)
Neighboring Autoregressive Modeling for Efficient Visual Generation
by: He, Yefei, et al.
Published: (2025)
by: He, Yefei, et al.
Published: (2025)
Semantically Structured Image Compression via Irregular Group-Based Decoupling
by: Feng, Ruoyu, et al.
Published: (2023)
by: Feng, Ruoyu, et al.
Published: (2023)
Rate-Distortion-Cognition Controllable Versatile Neural Image Compression
by: Liu, Jinming, et al.
Published: (2024)
by: Liu, Jinming, et al.
Published: (2024)
Surgical-LVLM: Learning to Adapt Large Vision-Language Model for Grounded Visual Question Answering in Robotic Surgery
by: Wang, Guankun, et al.
Published: (2024)
by: Wang, Guankun, et al.
Published: (2024)
Practical Compact Deep Compressed Sensing
by: Chen, Bin, et al.
Published: (2024)
by: Chen, Bin, et al.
Published: (2024)
A Comprehensive Review of Agricultural Parcel and Boundary Delineation from Remote Sensing Images: Recent Progress and Future Perspectives
by: Zheng, Juepeng, et al.
Published: (2025)
by: Zheng, Juepeng, et al.
Published: (2025)
Rethinking Medical Anomaly Detection in Brain MRI: An Image Quality Assessment Perspective
by: Pan, Zixuan, et al.
Published: (2024)
by: Pan, Zixuan, et al.
Published: (2024)
Uni-LVC: A Unified Method for Intra- and Inter-Mode Learned Video Compression
by: Zhang, Yichi, et al.
Published: (2026)
by: Zhang, Yichi, et al.
Published: (2026)
Generative Visual Compression: A Review
by: Chen, Bolin, et al.
Published: (2024)
by: Chen, Bolin, et al.
Published: (2024)
Progressive Uncertainty-Guided Evidential U-KAN for Trustworthy Medical Image Segmentation
by: Yang, Zhen, et al.
Published: (2025)
by: Yang, Zhen, et al.
Published: (2025)
Towards Clinical Practice in CT-Based Pulmonary Disease Screening: An Efficient and Reliable Framework
by: Shao, Qian, et al.
Published: (2024)
by: Shao, Qian, et al.
Published: (2024)
SeD: Semantic-Aware Discriminator for Image Super-Resolution
by: Li, Bingchen, et al.
Published: (2024)
by: Li, Bingchen, et al.
Published: (2024)
Downstream Analysis of Foundational Medical Vision Models for Disease Progression
by: Demir, Basar, et al.
Published: (2025)
by: Demir, Basar, et al.
Published: (2025)
MFGDiffusion: Mask-Guided Smoke Synthesis for Enhanced Forest Fire Detection
by: Wu, Guanghao, et al.
Published: (2025)
by: Wu, Guanghao, et al.
Published: (2025)
PL-Net: Progressive Learning Network for Medical Image Segmentation
by: Mao, Kunpeng, et al.
Published: (2021)
by: Mao, Kunpeng, et al.
Published: (2021)
Spatial-Frequency Dual Progressive Attention Network For Medical Image Segmentation
by: Zhou, Zhenhuan, et al.
Published: (2024)
by: Zhou, Zhenhuan, et al.
Published: (2024)
2.75D: Boosting learning by representing 3D Medical imaging to 2D features for small data
by: Wang, Xin, et al.
Published: (2020)
by: Wang, Xin, et al.
Published: (2020)
Generative Image Compression by Estimating Gradients of the Rate-variable Feature Distribution
by: Han, Minghao, et al.
Published: (2025)
by: Han, Minghao, et al.
Published: (2025)
Interpretable Few-Shot Retinal Disease Diagnosis with Concept-Guided Prompting of Vision-Language Models
by: Mehta, Deval, et al.
Published: (2025)
by: Mehta, Deval, et al.
Published: (2025)
Large Language Model for Lossless Image Compression with Visual Prompts
by: Du, Junhao, et al.
Published: (2025)
by: Du, Junhao, et al.
Published: (2025)
Measuring and Predicting Where and When Pathologists Focus their Visual Attention while Grading Whole Slide Images of Cancer
by: Chakraborty, Souradeep, et al.
Published: (2025)
by: Chakraborty, Souradeep, et al.
Published: (2025)
Superpixel perception graph neural network for intelligent defect detection of aero-engine blade
by: Shang, Hongbing, et al.
Published: (2022)
by: Shang, Hongbing, et al.
Published: (2022)
Towards a Large Language-Vision Question Answering Model for MSTAR Automatic Target Recognition
by: Ramirez, David F., et al.
Published: (2026)
by: Ramirez, David F., et al.
Published: (2026)
Similar Items
-
EyeDiff: text-to-image diffusion model improves rare eye disease diagnosis
by: Chen, Ruoyu, et al.
Published: (2024) -
Choroidal Vessel Segmentation on Indocyanine Green Angiography Images via Human-in-the-Loop Labeling
by: Chen, Ruoyu, et al.
Published: (2024) -
UWF-RI2FA: Generating Multi-frame Ultrawide-field Fluorescein Angiography from Ultrawide-field Retinal Imaging Improves Diabetic Retinopathy Stratification
by: Chen, Ruoyu, et al.
Published: (2024) -
Fundus2Video: Cross-Modal Angiography Video Generation from Static Fundus Photography with Clinical Knowledge Guidance
by: Zhang, Weiyi, et al.
Published: (2024) -
Fundus2Globe: Generative AI-Driven 3D Digital Twins for Personalized Myopia Management
by: Shi, Danli, et al.
Published: (2025)