IOSVLM: A 3D Vision-Language Model for Unified Dental Diagnosis from Intraoral Scans
Fuente:
arXiv
Salvato in:
| Autori principali: | Xiong, Huimin, Meng, Zijie, Hu, Tianxiang, Zhou, Chenyi, Feng, Yang, Liu, Zuozhu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
DentVLM: A Multimodal Vision-Language Model for Comprehensive Dental Diagnosis and Enhanced Clinical Practice
di: Meng, Zijie, et al.
Pubblicazione: (2025)
di: Meng, Zijie, et al.
Pubblicazione: (2025)
Detecting Dental Landmarks from Intraoral 3D Scans: the 3DTeethLand challenge
di: Ben-Hamadou, Achraf, et al.
Pubblicazione: (2025)
di: Ben-Hamadou, Achraf, et al.
Pubblicazione: (2025)
KPL: Training-Free Medical Knowledge Mining of Vision-Language Models
di: Liu, Jiaxiang, et al.
Pubblicazione: (2025)
di: Liu, Jiaxiang, et al.
Pubblicazione: (2025)
Teeth3DS+: An Extended Benchmark for Intraoral 3D Scans Analysis
di: Ben-Hamadou, Achraf, et al.
Pubblicazione: (2022)
di: Ben-Hamadou, Achraf, et al.
Pubblicazione: (2022)
3D-RAD: A Comprehensive 3D Radiology Med-VQA Dataset with Multi-Temporal Analysis and Diverse Diagnostic Tasks
di: Gai, Xiaotang, et al.
Pubblicazione: (2025)
di: Gai, Xiaotang, et al.
Pubblicazione: (2025)
Silhouette-to-Contour Registration: Aligning Intraoral Scan Models with Cephalometric Radiographs
di: Miao, Yiyi, et al.
Pubblicazione: (2025)
di: Miao, Yiyi, et al.
Pubblicazione: (2025)
DinoDental: Benchmarking DINOv3 as a Unified Vision Encoder for Dental Image Analysis
di: Tang, Kun, et al.
Pubblicazione: (2026)
di: Tang, Kun, et al.
Pubblicazione: (2026)
MedThink: Explaining Medical Visual Question Answering via Multimodal Decision-Making Rationale
di: Gai, Xiaotang, et al.
Pubblicazione: (2024)
di: Gai, Xiaotang, et al.
Pubblicazione: (2024)
Dental3R: Geometry-Aware Pairing for Intraoral 3D Reconstruction from Sparse-View Photographs
di: Miao, Yiyi, et al.
Pubblicazione: (2025)
di: Miao, Yiyi, et al.
Pubblicazione: (2025)
Hulu-Med: A Transparent Generalist Model towards Holistic Medical Vision-Language Understanding
di: Jiang, Songtao, et al.
Pubblicazione: (2025)
di: Jiang, Songtao, et al.
Pubblicazione: (2025)
Magnet: We Never Know How Text-to-Image Diffusion Models Work, Until We Learn How Vision-Language Models Function
di: Zhuang, Chenyi, et al.
Pubblicazione: (2024)
di: Zhuang, Chenyi, et al.
Pubblicazione: (2024)
Quantized Prompt for Efficient Generalization of Vision-Language Models
di: Hao, Tianxiang, et al.
Pubblicazione: (2024)
di: Hao, Tianxiang, et al.
Pubblicazione: (2024)
Modest-Align: Data-Efficient Alignment for Vision-Language Models
di: Liu, Jiaxiang, et al.
Pubblicazione: (2025)
di: Liu, Jiaxiang, et al.
Pubblicazione: (2025)
Fair-MoE: Fairness-Oriented Mixture of Experts in Vision-Language Models
di: Wang, Peiran, et al.
Pubblicazione: (2025)
di: Wang, Peiran, et al.
Pubblicazione: (2025)
Evaluating the Suitability of Different Intraoral Scan Resolutions for Deep Learning-Based Tooth Segmentation
di: Weekley, Daron, et al.
Pubblicazione: (2025)
di: Weekley, Daron, et al.
Pubblicazione: (2025)
SkyEyeGPT: Unifying Remote Sensing Vision-Language Tasks via Instruction Tuning with Large Language Model
di: Zhan, Yang, et al.
Pubblicazione: (2024)
di: Zhan, Yang, et al.
Pubblicazione: (2024)
Understanding Degradation with Vision Language Model
di: Lan, Guanzhou, et al.
Pubblicazione: (2026)
di: Lan, Guanzhou, et al.
Pubblicazione: (2026)
Med3D-R1: Incentivizing Clinical Reasoning in 3D Medical Vision-Language Models for Abnormality Diagnosis
di: Lai, Haoran, et al.
Pubblicazione: (2026)
di: Lai, Haoran, et al.
Pubblicazione: (2026)
Med-2E3: A 2D-Enhanced 3D Medical Multimodal Large Language Model
di: Shi, Yiming, et al.
Pubblicazione: (2024)
di: Shi, Yiming, et al.
Pubblicazione: (2024)
Advancing Lung Disease Diagnosis in 3D CT Scans
di: Li, Qingqiu, et al.
Pubblicazione: (2025)
di: Li, Qingqiu, et al.
Pubblicazione: (2025)
HSCR: Hierarchical Self-Contrastive Rewarding for Aligning Medical Vision Language Models
di: Jiang, Songtao, et al.
Pubblicazione: (2025)
di: Jiang, Songtao, et al.
Pubblicazione: (2025)
Modality-Fair Preference Optimization for Trustworthy MLLM Alignment
di: Jiang, Songtao, et al.
Pubblicazione: (2024)
di: Jiang, Songtao, et al.
Pubblicazione: (2024)
Are Vision Language Models Ready for Clinical Diagnosis? A 3D Medical Benchmark for Tumor-centric Visual Question Answering
di: Chen, Yixiong, et al.
Pubblicazione: (2025)
di: Chen, Yixiong, et al.
Pubblicazione: (2025)
High-Fidelity 3D Tooth Reconstruction by Fusing Intraoral Scans and CBCT Data via a Deep Implicit Representation
di: Zhu, Yi, et al.
Pubblicazione: (2026)
di: Zhu, Yi, et al.
Pubblicazione: (2026)
HICT: High-precision 3D CBCT reconstruction from a single X-ray
di: Ma, Wen, et al.
Pubblicazione: (2026)
di: Ma, Wen, et al.
Pubblicazione: (2026)
Delving into Out-of-Distribution Detection with Medical Vision-Language Models
di: Ju, Lie, et al.
Pubblicazione: (2025)
di: Ju, Lie, et al.
Pubblicazione: (2025)
Unified Language-Vision Pretraining in LLM with Dynamic Discrete Visual Tokenization
di: Jin, Yang, et al.
Pubblicazione: (2023)
di: Jin, Yang, et al.
Pubblicazione: (2023)
LT-Gaussian: Long-Term Map Update Using 3D Gaussian Splatting for Autonomous Driving
di: Cheng, Luqi, et al.
Pubblicazione: (2025)
di: Cheng, Luqi, et al.
Pubblicazione: (2025)
Uni4D: A Unified Self-Supervised Learning Framework for Point Cloud Videos
di: Zuo, Zhi, et al.
Pubblicazione: (2025)
di: Zuo, Zhi, et al.
Pubblicazione: (2025)
GeoGround: A Unified Large Vision-Language Model for Remote Sensing Visual Grounding
di: Zhou, Yue, et al.
Pubblicazione: (2024)
di: Zhou, Yue, et al.
Pubblicazione: (2024)
PX2Tooth: Reconstructing the 3D Point Cloud Teeth from a Single Panoramic X-ray
di: Ma, Wen, et al.
Pubblicazione: (2024)
di: Ma, Wen, et al.
Pubblicazione: (2024)
Unifying 3D Vision-Language Understanding via Promptable Queries
di: Zhu, Ziyu, et al.
Pubblicazione: (2024)
di: Zhu, Ziyu, et al.
Pubblicazione: (2024)
A Unified Perspective on Adversarial Membership Manipulation in Vision Models
di: Gao, Ruize, et al.
Pubblicazione: (2026)
di: Gao, Ruize, et al.
Pubblicazione: (2026)
From 2D CAD Drawings to 3D Parametric Models: A Vision-Language Approach
di: Wang, Xilin, et al.
Pubblicazione: (2024)
di: Wang, Xilin, et al.
Pubblicazione: (2024)
Med-GLIP: Advancing Medical Language-Image Pre-training with Large-scale Grounded Dataset
di: Deng, Ziye, et al.
Pubblicazione: (2025)
di: Deng, Ziye, et al.
Pubblicazione: (2025)
Unified Personalized Reward Model for Vision Generation
di: Wang, Yibin, et al.
Pubblicazione: (2026)
di: Wang, Yibin, et al.
Pubblicazione: (2026)
Unified Generation and Self-Verification for Vision-Language Models via Advantage Decoupled Preference Optimization
di: Qiu, Xinyu, et al.
Pubblicazione: (2026)
di: Qiu, Xinyu, et al.
Pubblicazione: (2026)
Data-Efficient Fine-Tuning of Vision-Language Models for Diagnosis of Alzheimer's Disease
di: Cheng, Fangqi, et al.
Pubblicazione: (2025)
di: Cheng, Fangqi, et al.
Pubblicazione: (2025)
CLIP-GS: Unifying Vision-Language Representation with 3D Gaussian Splatting
di: Jiao, Siyu, et al.
Pubblicazione: (2024)
di: Jiao, Siyu, et al.
Pubblicazione: (2024)
GSPR: Multimodal Place Recognition Using 3D Gaussian Splatting for Autonomous Driving
di: Qi, Zhangshuo, et al.
Pubblicazione: (2024)
di: Qi, Zhangshuo, et al.
Pubblicazione: (2024)
Documenti analoghi
-
DentVLM: A Multimodal Vision-Language Model for Comprehensive Dental Diagnosis and Enhanced Clinical Practice
di: Meng, Zijie, et al.
Pubblicazione: (2025) -
Detecting Dental Landmarks from Intraoral 3D Scans: the 3DTeethLand challenge
di: Ben-Hamadou, Achraf, et al.
Pubblicazione: (2025) -
KPL: Training-Free Medical Knowledge Mining of Vision-Language Models
di: Liu, Jiaxiang, et al.
Pubblicazione: (2025) -
Teeth3DS+: An Extended Benchmark for Intraoral 3D Scans Analysis
di: Ben-Hamadou, Achraf, et al.
Pubblicazione: (2022) -
3D-RAD: A Comprehensive 3D Radiology Med-VQA Dataset with Multi-Temporal Analysis and Diverse Diagnostic Tasks
di: Gai, Xiaotang, et al.
Pubblicazione: (2025)