Enregistré dans:
| Auteurs principaux: | Jiang, Songtao, Wang, Yuan, Song, Sibo, Hu, Tianxiang, Zhou, Chenyi, Pu, Bin, Zhang, Yan, Yang, Zhibo, Feng, Yang, Zhou, Joey Tianyi, Hao, Jin, Chen, Zijian, Wu, Ruijia, Tang, Tao, Lv, Junhui, Xu, Hongxia, Wang, Hongwei, Xiao, Jun, Feng, Bin, Zhu, Fudong, Li, Kenli, Xie, Weidi, Sun, Jimeng, Wu, Jian, Liu, Zuozhu |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2510.08668 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MedThink: Explaining Medical Visual Question Answering via Multimodal Decision-Making Rationale
par: Gai, Xiaotang, et autres
Publié: (2024)
par: Gai, Xiaotang, et autres
Publié: (2024)
OmniV-Med: Scaling Medical Vision-Language Model for Universal Visual Understanding
par: Jiang, Songtao, et autres
Publié: (2025)
par: Jiang, Songtao, et autres
Publié: (2025)
Joint Visual and Text Prompting for Improved Object-Centric Perception with Multimodal Large Language Models
par: Jiang, Songtao, et autres
Publié: (2024)
par: Jiang, Songtao, et autres
Publié: (2024)
IOSVLM: A 3D Vision-Language Model for Unified Dental Diagnosis from Intraoral Scans
par: Xiong, Huimin, et autres
Publié: (2026)
par: Xiong, Huimin, et autres
Publié: (2026)
MedEthicsQA: A Comprehensive Question Answering Benchmark for Medical Ethics Evaluation of LLMs
par: Wei, Jianhui, et autres
Publié: (2025)
par: Wei, Jianhui, et autres
Publié: (2025)
DentVLM: A Multimodal Vision-Language Model for Comprehensive Dental Diagnosis and Enhanced Clinical Practice
par: Meng, Zijie, et autres
Publié: (2025)
par: Meng, Zijie, et autres
Publié: (2025)
CAPO: Reinforcing Consistent Reasoning in Medical Decision-Making
par: Jiang, Songtao, et autres
Publié: (2025)
par: Jiang, Songtao, et autres
Publié: (2025)
Fast or Slow? Integrating Fast Intuition and Deliberate Thinking for Enhancing Visual Question Answering
par: Jiang, Songtao, et autres
Publié: (2025)
par: Jiang, Songtao, et autres
Publié: (2025)
Knowing or Guessing? Robust Medical Visual Question Answering via Joint Consistency and Contrastive Learning
par: Jiang, Songtao, et autres
Publié: (2025)
par: Jiang, Songtao, et autres
Publié: (2025)
MedCoT: Medical Chain of Thought via Hierarchical Expert
par: Liu, Jiaxiang, et autres
Publié: (2024)
par: Liu, Jiaxiang, et autres
Publié: (2024)
Med-U1: Incentivizing Unified Medical Reasoning in LLMs via Large-scale Reinforcement Learning
par: Zhang, Xiaotian, et autres
Publié: (2025)
par: Zhang, Xiaotian, et autres
Publié: (2025)
Learnable Privacy Neurons Localization in Language Models
par: Chen, Ruizhe, et autres
Publié: (2024)
par: Chen, Ruizhe, et autres
Publié: (2024)
Modality-Fair Preference Optimization for Trustworthy MLLM Alignment
par: Jiang, Songtao, et autres
Publié: (2024)
par: Jiang, Songtao, et autres
Publié: (2024)
Learning Transferable Temporal Primitives for Video Reasoning via Synthetic Videos
par: Jiang, Songtao, et autres
Publié: (2026)
par: Jiang, Songtao, et autres
Publié: (2026)
KPL: Training-Free Medical Knowledge Mining of Vision-Language Models
par: Liu, Jiaxiang, et autres
Publié: (2025)
par: Liu, Jiaxiang, et autres
Publié: (2025)
HSCR: Hierarchical Self-Contrastive Rewarding for Aligning Medical Vision Language Models
par: Jiang, Songtao, et autres
Publié: (2025)
par: Jiang, Songtao, et autres
Publié: (2025)
Identifying and Mitigating Social Bias Knowledge in Language Models
par: Chen, Ruizhe, et autres
Publié: (2024)
par: Chen, Ruizhe, et autres
Publié: (2024)
GRIT: Graph-Regularized Logit Refinement for Zero-shot Cell Type Annotation
par: Hu, Tianxiang, et autres
Publié: (2025)
par: Hu, Tianxiang, et autres
Publié: (2025)
Med-MoE: Mixture of Domain-Specific Experts for Lightweight Medical Vision-Language Models
par: Jiang, Songtao, et autres
Publié: (2024)
par: Jiang, Songtao, et autres
Publié: (2024)
FedLoGe: Joint Local and Generic Federated Learning under Long-tailed Data
par: Xiao, Zikai, et autres
Publié: (2024)
par: Xiao, Zikai, et autres
Publié: (2024)
Beyond Label Attention: Transparency in Language Models for Automated Medical Coding via Dictionary Learning
par: Wu, John, et autres
Publié: (2024)
par: Wu, John, et autres
Publié: (2024)
Bridging the Skill Gap in Clinical CBCT Interpretation with CBCTRepD
par: Wu, Qinxin, et autres
Publié: (2026)
par: Wu, Qinxin, et autres
Publié: (2026)
GradCraft: Elevating Multi-task Recommendations through Holistic Gradient Crafting
par: Bai, Yimeng, et autres
Publié: (2024)
par: Bai, Yimeng, et autres
Publié: (2024)
A population study comparing tracheal and lung adenoid cystic carcinoma
par: Yu Gu, et autres
Publié: (2024)
par: Yu Gu, et autres
Publié: (2024)
Librarian Generalists: Holistic Librarianship.
par: Bechtel, Joan M.
Publié: (1994)
par: Bechtel, Joan M.
Publié: (1994)
Towards Distribution-Agnostic Generalized Category Discovery
par: Bai, Jianhong, et autres
Publié: (2023)
par: Bai, Jianhong, et autres
Publié: (2023)
AnyECG: Foundational Models for Multitask Cardiac Analysis in Real-World Settings
par: Wang, Yue, et autres
Publié: (2024)
par: Wang, Yue, et autres
Publié: (2024)
Med-GLIP: Advancing Medical Language-Image Pre-training with Large-scale Grounded Dataset
par: Deng, Ziye, et autres
Publié: (2025)
par: Deng, Ziye, et autres
Publié: (2025)
Online Video Business Models: YouTube vs. Hulu
par: Juan P. Artero
Publié: (2010)
par: Juan P. Artero
Publié: (2010)
PX2Tooth: Reconstructing the 3D Point Cloud Teeth from a Single Panoramic X-ray
par: Ma, Wen, et autres
Publié: (2024)
par: Ma, Wen, et autres
Publié: (2024)
Beyond Modality Collapse: Representations Blending for Multimodal Dataset Distillation
par: Zhang, Xin, et autres
Publié: (2025)
par: Zhang, Xin, et autres
Publié: (2025)
Merging Photocatalysis with Chiral Lewis Acid Catalysis for Enantioselective Hydrosilylation/Hydrogermylation of Electron‐Deficient Alkenes
par: Xiaofan Chen, et autres
Publié: (2025)
par: Xiaofan Chen, et autres
Publié: (2025)
Merging Photocatalysis with Chiral Lewis Acid Catalysis for Enantioselective Hydrosilylation/Hydrogermylation of Electron‐Deficient Alkenes
par: Xiaofan Chen, et autres
Publié: (2025)
par: Xiaofan Chen, et autres
Publié: (2025)
OS-Symphony: A Holistic Framework for Robust and Generalist Computer-Using Agent
par: Yang, Bowen, et autres
Publié: (2026)
par: Yang, Bowen, et autres
Publié: (2026)
MedVersa: A Generalist Foundation Model for Medical Image Interpretation
par: Zhou, Hong-Yu, et autres
Publié: (2024)
par: Zhou, Hong-Yu, et autres
Publié: (2024)
CLAW: A Vision-Language-Action Framework for Weight-Aware Robotic Grasping
par: An, Zijian, et autres
Publié: (2025)
par: An, Zijian, et autres
Publié: (2025)
Gauss Relations in Feynman Integrals
par: Feng, Tai-Fu, et autres
Publié: (2024)
par: Feng, Tai-Fu, et autres
Publié: (2024)
FairMT-Bench: Benchmarking Fairness for Multi-turn Dialogue in Conversational LLMs
par: Fan, Zhiting, et autres
Publié: (2024)
par: Fan, Zhiting, et autres
Publié: (2024)
Persona-judge: Personalized Alignment of Large Language Models via Token-level Self-judgment
par: Zhang, Xiaotian, et autres
Publié: (2025)
par: Zhang, Xiaotian, et autres
Publié: (2025)
3D-U-SAM Network For Few-shot Tooth Segmentation in CBCT Images
par: Zhang, Yifu, et autres
Publié: (2023)
par: Zhang, Yifu, et autres
Publié: (2023)
Documents similaires
-
MedThink: Explaining Medical Visual Question Answering via Multimodal Decision-Making Rationale
par: Gai, Xiaotang, et autres
Publié: (2024) -
OmniV-Med: Scaling Medical Vision-Language Model for Universal Visual Understanding
par: Jiang, Songtao, et autres
Publié: (2025) -
Joint Visual and Text Prompting for Improved Object-Centric Perception with Multimodal Large Language Models
par: Jiang, Songtao, et autres
Publié: (2024) -
IOSVLM: A 3D Vision-Language Model for Unified Dental Diagnosis from Intraoral Scans
par: Xiong, Huimin, et autres
Publié: (2026) -
MedEthicsQA: A Comprehensive Question Answering Benchmark for Medical Ethics Evaluation of LLMs
par: Wei, Jianhui, et autres
Publié: (2025)