Towards Generalist Intelligence in Dentistry: Vision Foundation Models for Oral and Maxillofacial Radiology
Fuente:
arXiv
Guardado en:
| Autores principales: | Huang, Xinrui, Xiao, Fan, He, Dongming, Gao, Anqi, Li, Dandan, Zhang, Xiaofan, Zhang, Shaoting, Wang, Xudong |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
PathoTune: Adapting Visual Foundation Model to Pathological Specialists
por: Lu, Jiaxuan, et al.
Publicado: (2024)
por: Lu, Jiaxuan, et al.
Publicado: (2024)
MedDiff-FM: A Diffusion-based Foundation Model for Versatile Medical Image Applications
por: Yu, Yongrui, et al.
Publicado: (2024)
por: Yu, Yongrui, et al.
Publicado: (2024)
A Synthetic Data-Driven Radiology Foundation Model for Pan-tumor Clinical Diagnosis
por: Lei, Wenhui, et al.
Publicado: (2025)
por: Lei, Wenhui, et al.
Publicado: (2025)
Unifying Multiple Foundation Models for Advanced Computational Pathology
por: Lei, Wenhui, et al.
Publicado: (2025)
por: Lei, Wenhui, et al.
Publicado: (2025)
Vision Foundation Models as Generalist Tokenizers for Image Generation
por: Zheng, Anlin, et al.
Publicado: (2026)
por: Zheng, Anlin, et al.
Publicado: (2026)
Unleashing the Potential of Vision-Language Pre-Training for 3D Zero-Shot Lesion Segmentation via Mask-Attribute Alignment
por: Jiang, Yankai, et al.
Publicado: (2024)
por: Jiang, Yankai, et al.
Publicado: (2024)
VisionFM: a Multi-Modal Multi-Task Vision Foundation Model for Generalist Ophthalmic Artificial Intelligence
por: Qiu, Jianing, et al.
Publicado: (2023)
por: Qiu, Jianing, et al.
Publicado: (2023)
Modality-Aware and Shift Mixer for Multi-modal Brain Tumor Segmentation
por: Huang, Zhongzhen, et al.
Publicado: (2024)
por: Huang, Zhongzhen, et al.
Publicado: (2024)
ZePT: Zero-Shot Pan-Tumor Segmentation via Query-Disentangling and Self-Prompting
por: Jiang, Yankai, et al.
Publicado: (2023)
por: Jiang, Yankai, et al.
Publicado: (2023)
CAT: Coordinating Anatomical-Textual Prompts for Multi-Organ and Tumor Segmentation
por: Huang, Zhongzhen, et al.
Publicado: (2024)
por: Huang, Zhongzhen, et al.
Publicado: (2024)
Towards Generalist Game Players: An Investigation of Foundation Models in the Game Multiverse
por: Zhang, Kuan, et al.
Publicado: (2026)
por: Zhang, Kuan, et al.
Publicado: (2026)
MedLSAM: Localize and Segment Anything Model for 3D CT Images
por: Lei, Wenhui, et al.
Publicado: (2023)
por: Lei, Wenhui, et al.
Publicado: (2023)
DRScaffold: Boosting Dense-Scene Reasoning in Lightweight Vision Language Models
por: Shi, Xinrui, et al.
Publicado: (2026)
por: Shi, Xinrui, et al.
Publicado: (2026)
Masked AutoDecoder is Effective Multi-Task Vision Generalist
por: Qiu, Han, et al.
Publicado: (2024)
por: Qiu, Han, et al.
Publicado: (2024)
Towards Unbiased Source-Free Object Detection via Vision Foundation Models
por: Cai, Zhi, et al.
Publicado: (2026)
por: Cai, Zhi, et al.
Publicado: (2026)
Toward a Diffusion-Based Generalist for Dense Vision Tasks
por: Fan, Yue, et al.
Publicado: (2024)
por: Fan, Yue, et al.
Publicado: (2024)
One for All: Toward Unified Foundation Models for Earth Vision
por: Xiong, Zhitong, et al.
Publicado: (2024)
por: Xiong, Zhitong, et al.
Publicado: (2024)
EyeFound: A Multimodal Generalist Foundation Model for Ophthalmic Imaging
por: Shi, Danli, et al.
Publicado: (2024)
por: Shi, Danli, et al.
Publicado: (2024)
DeReStainer: H&E to IHC Pathological Image Translation via Decoupled Staining Channels
por: Wei, Linda, et al.
Publicado: (2024)
por: Wei, Linda, et al.
Publicado: (2024)
OmniMRI: A Unified Vision--Language Foundation Model for Generalist MRI Interpretation
por: He, Xingxin, et al.
Publicado: (2025)
por: He, Xingxin, et al.
Publicado: (2025)
OmniFashion: Towards Generalist Fashion Intelligence via Multi-Task Vision-Language Learning
por: Yang, Zhengwei, et al.
Publicado: (2026)
por: Yang, Zhengwei, et al.
Publicado: (2026)
CT-Flow: Orchestrating CT Interpretation Workflow with Model Context Protocol Servers
por: Gu, Yannian, et al.
Publicado: (2026)
por: Gu, Yannian, et al.
Publicado: (2026)
Towards Training-free Anomaly Detection with Vision and Language Foundation Models
por: Zhang, Jinjin, et al.
Publicado: (2025)
por: Zhang, Jinjin, et al.
Publicado: (2025)
Forging a Dynamic Memory: Retrieval-Guided Continual Learning for Generalist Medical Foundation Models
por: Chen, Zizhi, et al.
Publicado: (2025)
por: Chen, Zizhi, et al.
Publicado: (2025)
Foundation Model for Endoscopy Video Analysis via Large-scale Self-supervised Pre-train
por: Wang, Zhao, et al.
Publicado: (2023)
por: Wang, Zhao, et al.
Publicado: (2023)
OctoNav: Towards Generalist Embodied Navigation
por: Gao, Chen, et al.
Publicado: (2025)
por: Gao, Chen, et al.
Publicado: (2025)
MMXU: A Multi-Modal and Multi-X-ray Understanding Dataset for Disease Progression
por: Mu, Linjie, et al.
Publicado: (2025)
por: Mu, Linjie, et al.
Publicado: (2025)
Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation
por: Wang, Shansong, et al.
Publicado: (2025)
por: Wang, Shansong, et al.
Publicado: (2025)
TALO: Pushing 3D Vision Foundation Models Towards Globally Consistent Online Reconstruction
por: Zhang, Fengyi, et al.
Publicado: (2025)
por: Zhang, Fengyi, et al.
Publicado: (2025)
MedCAL-Bench: A Comprehensive Benchmark on Cold-Start Active Learning with Foundation Models for Medical Image Analysis
por: Zhu, Ning, et al.
Publicado: (2025)
por: Zhu, Ning, et al.
Publicado: (2025)
BRIGHT: A Collaborative Generalist-Specialist Foundation Model for Breast Pathology
por: Guo, Xiaojing, et al.
Publicado: (2026)
por: Guo, Xiaojing, et al.
Publicado: (2026)
Background Adaptation with Residual Modeling for Exemplar-Free Class-Incremental Semantic Segmentation
por: Zhang, Anqi, et al.
Publicado: (2024)
por: Zhang, Anqi, et al.
Publicado: (2024)
Medical Vision Generalist: Unifying Medical Imaging Tasks in Context
por: Ren, Sucheng, et al.
Publicado: (2024)
por: Ren, Sucheng, et al.
Publicado: (2024)
Interactive Segmentation and Report Generation for CT Images
por: Gu, Yannian, et al.
Publicado: (2025)
por: Gu, Yannian, et al.
Publicado: (2025)
What Matters in Building Vision-Language-Action Models for Generalist Robots
por: Li, Xinghang, et al.
Publicado: (2024)
por: Li, Xinghang, et al.
Publicado: (2024)
GiT: Towards Generalist Vision Transformer through Universal Language Interface
por: Wang, Haiyang, et al.
Publicado: (2024)
por: Wang, Haiyang, et al.
Publicado: (2024)
MetaDent: Labeling Clinical Images for Vision-Language Models in Dentistry
por: Li, Meng-Xun, et al.
Publicado: (2026)
por: Li, Meng-Xun, et al.
Publicado: (2026)
Vision Generalist Model: A Survey
por: Wang, Ziyi, et al.
Publicado: (2025)
por: Wang, Ziyi, et al.
Publicado: (2025)
DocRes: A Generalist Model Toward Unifying Document Image Restoration Tasks
por: Zhang, Jiaxin, et al.
Publicado: (2024)
por: Zhang, Jiaxin, et al.
Publicado: (2024)
OpenPath: Open-Set Active Learning for Pathology Image Classification via Pre-trained Vision-Language Models
por: Zhong, Lanfeng, et al.
Publicado: (2025)
por: Zhong, Lanfeng, et al.
Publicado: (2025)
Ejemplares similares
-
PathoTune: Adapting Visual Foundation Model to Pathological Specialists
por: Lu, Jiaxuan, et al.
Publicado: (2024) -
MedDiff-FM: A Diffusion-based Foundation Model for Versatile Medical Image Applications
por: Yu, Yongrui, et al.
Publicado: (2024) -
A Synthetic Data-Driven Radiology Foundation Model for Pan-tumor Clinical Diagnosis
por: Lei, Wenhui, et al.
Publicado: (2025) -
Unifying Multiple Foundation Models for Advanced Computational Pathology
por: Lei, Wenhui, et al.
Publicado: (2025) -
Vision Foundation Models as Generalist Tokenizers for Image Generation
por: Zheng, Anlin, et al.
Publicado: (2026)