EyecareGPT: Boosting Comprehensive Ophthalmology Understanding with Tailored Dataset, Benchmark and Model
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Sijing, Lin, Tianwei, Lin, Lingshuai, Zhang, Wenqiao, Liu, Jiang, Yang, Xiaoda, Li, Juncheng, He, Yucheng, Song, Xiaohui, Xiao, Jun, Zhuang, Yueting, Ooi, Beng Chin |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
HeartcareGPT: A Unified Multimodal ECG Suite for Dual Signal-Image Modeling and Understanding
par: Xie, Yihan, et autres
Publié: (2025)
par: Xie, Yihan, et autres
Publié: (2025)
HealthGPT: A Medical Large Vision-Language Model for Unifying Comprehension and Generation via Heterogeneous Knowledge Adaptation
par: Lin, Tianwei, et autres
Publié: (2025)
par: Lin, Tianwei, et autres
Publié: (2025)
OmniCT: Towards a Unified Slice-Volume LVLM for Comprehensive CT Analysis
par: Lin, Tianwei, et autres
Publié: (2026)
par: Lin, Tianwei, et autres
Publié: (2026)
LMMs Meet Object-Centric Vision: Understanding, Segmentation, Editing and Generation
par: Yuan, Yuqian, et autres
Publié: (2026)
par: Yuan, Yuqian, et autres
Publié: (2026)
CrossView Suite: Harnessing Cross-view Spatial Intelligence of MLLMs with Dataset, Model and Benchmark
par: Wang, Wei, et autres
Publié: (2026)
par: Wang, Wei, et autres
Publié: (2026)
TeamLoRA: Boosting Low-Rank Adaptation with Expert Collaboration and Competition
par: Lin, Tianwei, et autres
Publié: (2024)
par: Lin, Tianwei, et autres
Publié: (2024)
METER: A Dynamic Concept Adaptation Framework for Online Anomaly Detection
par: Zhu, Jiaqi, et autres
Publié: (2023)
par: Zhu, Jiaqi, et autres
Publié: (2023)
Boosting Private Domain Understanding of Efficient MLLMs: A Tuning-free, Adaptive, Universal Prompt Optimization Framework
par: Liu, Jiang, et autres
Publié: (2024)
par: Liu, Jiang, et autres
Publié: (2024)
Fast Thinking for Large Language Models
par: Zheng, Haoyu, et autres
Publié: (2025)
par: Zheng, Haoyu, et autres
Publié: (2025)
MoA: Heterogeneous Mixture of Adapters for Parameter-Efficient Fine-Tuning of Large Language Models
par: Cao, Jie, et autres
Publié: (2025)
par: Cao, Jie, et autres
Publié: (2025)
Catching Every Ripple: Enhanced Anomaly Awareness via Dynamic Concept Adaptation
par: Zhu, Jiaqi, et autres
Publié: (2026)
par: Zhu, Jiaqi, et autres
Publié: (2026)
CLEAR-Mamba:Towards Accurate, Adaptive and Trustworthy Multi-Sequence Ophthalmic Angiography Classification
par: Wang, Zhuonan, et autres
Publié: (2026)
par: Wang, Zhuonan, et autres
Publié: (2026)
Robust Modality-incomplete Anomaly Detection: A Modality-instructive Framework with Benchmark
par: Miao, Bingchen, et autres
Publié: (2024)
par: Miao, Bingchen, et autres
Publié: (2024)
InstructSAM: Segment Any Instance with Any Instructions
par: Yuan, Yuqian, et autres
Publié: (2026)
par: Yuan, Yuqian, et autres
Publié: (2026)
EgoCoT-Bench: Benchmarking Grounded and Verifiable Operation-Centric Chain of Thought Reasoning for MLLMs
par: Dai, Yang, et autres
Publié: (2026)
par: Dai, Yang, et autres
Publié: (2026)
Unified Personalized Understanding, Generating and Editing
par: Zhong, Yu, et autres
Publié: (2026)
par: Zhong, Yu, et autres
Publié: (2026)
Scientific Graphics Program Synthesis via Dual Self-Consistency Reinforcement Learning
par: Lin, Juekai, et autres
Publié: (2026)
par: Lin, Juekai, et autres
Publié: (2026)
Toward Robust Signed Graph Learning through Joint Input-Target Denoising
par: Wu, Junran, et autres
Publié: (2025)
par: Wu, Junran, et autres
Publié: (2025)
Graft: Integrating the Domain Knowledge via Efficient Parameter Synergy for MLLMs
par: Dai, Yang, et autres
Publié: (2025)
par: Dai, Yang, et autres
Publié: (2025)
OLED Eyecare Technology Concealed Within Sight
par: Haijun Qiu, et autres
Publié: (2025)
par: Haijun Qiu, et autres
Publié: (2025)
PixelRefer: A Unified Framework for Spatio-Temporal Object Referring with Arbitrary Granularity
par: Yuan, Yuqian, et autres
Publié: (2025)
par: Yuan, Yuqian, et autres
Publié: (2025)
WorldGPT: Empowering LLM as Multimodal World Model
par: Ge, Zhiqi, et autres
Publié: (2024)
par: Ge, Zhiqi, et autres
Publié: (2024)
HyperLLaVA: Dynamic Visual and Language Expert Tuning for Multimodal Large Language Models
par: Zhang, Wenqiao, et autres
Publié: (2024)
par: Zhang, Wenqiao, et autres
Publié: (2024)
Do LLMs Understand Visual Anomalies? Uncovering LLM's Capabilities in Zero-shot Anomaly Detection
par: Zhu, Jiaqi, et autres
Publié: (2024)
par: Zhu, Jiaqi, et autres
Publié: (2024)
SOYO: A Tuning-Free Approach for Video Style Morphing via Style-Adaptive Interpolation in Diffusion Models
par: Zheng, Haoyu, et autres
Publié: (2025)
par: Zheng, Haoyu, et autres
Publié: (2025)
Chart-HQA: A Benchmark for Hypothetical Question Answering in Charts
par: Chen, Xiangnan, et autres
Publié: (2025)
par: Chen, Xiangnan, et autres
Publié: (2025)
SFQA: A Comprehensive Perceptual Quality Assessment Dataset for Singing Face Generation
par: Gao, Zhilin, et autres
Publié: (2026)
par: Gao, Zhilin, et autres
Publié: (2026)
Iris: Breaking GUI Complexity with Adaptive Focus and Self-Refining
par: Ge, Zhiqi, et autres
Publié: (2024)
par: Ge, Zhiqi, et autres
Publié: (2024)
CtrlCoT: Dual-Granularity Chain-of-Thought Compression for Controllable Reasoning
par: Fan, Zhenxuan, et autres
Publié: (2026)
par: Fan, Zhenxuan, et autres
Publié: (2026)
AnyMS: Bottom-up Attention Decoupling for Layout-guided and Training-free Multi-subject Customization
par: Yu, Binhe, et autres
Publié: (2025)
par: Yu, Binhe, et autres
Publié: (2025)
Bridging Local Details and Global Context in Text-Attributed Graphs
par: Wang, Yaoke, et autres
Publié: (2024)
par: Wang, Yaoke, et autres
Publié: (2024)
DuetRAG: Collaborative Retrieval-Augmented Generation
par: Jiao, Dian, et autres
Publié: (2024)
par: Jiao, Dian, et autres
Publié: (2024)
LMOD+: A Comprehensive Multimodal Dataset and Benchmark for Developing and Evaluating Multimodal Large Language Models in Ophthalmology
par: Qin, Zhenyue, et autres
Publié: (2025)
par: Qin, Zhenyue, et autres
Publié: (2025)
Enhancing Post-Training Quantization via Future Activation Awareness
par: Lv, Zheqi, et autres
Publié: (2026)
par: Lv, Zheqi, et autres
Publié: (2026)
Mastering Collaborative Multi-modal Data Selection: A Focus on Informativeness, Uniqueness, and Representativeness
par: Yu, Qifan, et autres
Publié: (2024)
par: Yu, Qifan, et autres
Publié: (2024)
LASER: Tuning-Free LLM-Driven Attention Control for Efficient Text-conditioned Image-to-Animation
par: Zheng, Haoyu, et autres
Publié: (2024)
par: Zheng, Haoyu, et autres
Publié: (2024)
Distribution-aware Online Continual Learning for Urban Spatio-Temporal Forecasting
par: Wang, Chengxin, et autres
Publié: (2024)
par: Wang, Chengxin, et autres
Publié: (2024)
NL2SQLBench: A Modular Benchmarking Framework for LLM-Enabled NL2SQL Solutions
par: Hou, Shizheng, et autres
Publié: (2026)
par: Hou, Shizheng, et autres
Publié: (2026)
Generative AI for Healthcare: Fundamentals, Challenges, and Perspectives
par: Chen, Gang, et autres
Publié: (2025)
par: Chen, Gang, et autres
Publié: (2025)
Align$^2$LLaVA: Cascaded Human and Large Language Model Preference Alignment for Multi-modal Instruction Curation
par: Huang, Hongzhe, et autres
Publié: (2024)
par: Huang, Hongzhe, et autres
Publié: (2024)
Documents similaires
-
HeartcareGPT: A Unified Multimodal ECG Suite for Dual Signal-Image Modeling and Understanding
par: Xie, Yihan, et autres
Publié: (2025) -
HealthGPT: A Medical Large Vision-Language Model for Unifying Comprehension and Generation via Heterogeneous Knowledge Adaptation
par: Lin, Tianwei, et autres
Publié: (2025) -
OmniCT: Towards a Unified Slice-Volume LVLM for Comprehensive CT Analysis
par: Lin, Tianwei, et autres
Publié: (2026) -
LMMs Meet Object-Centric Vision: Understanding, Segmentation, Editing and Generation
par: Yuan, Yuqian, et autres
Publié: (2026) -
CrossView Suite: Harnessing Cross-view Spatial Intelligence of MLLMs with Dataset, Model and Benchmark
par: Wang, Wei, et autres
Publié: (2026)