GTP-4o: Modality-prompted Heterogeneous Graph Learning for Omni-modal Biomedical Representation
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Chenxin, Liu, Xinyu, Wang, Cheng, Liu, Yifan, Yu, Weihao, Shao, Jing, Yuan, Yixuan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
GeoT: Geometry-guided Instance-dependent Transition Matrix for Semi-supervised Tooth Point Cloud Segmentation
di: Yu, Weihao, et al.
Pubblicazione: (2025)
di: Yu, Weihao, et al.
Pubblicazione: (2025)
MonoSplat: Generalizable 3D Gaussian Splatting from Monocular Depth Foundation Models
di: Liu, Yifan, et al.
Pubblicazione: (2025)
di: Liu, Yifan, et al.
Pubblicazione: (2025)
EndoSparse: Real-Time Sparse View Synthesis of Endoscopic Scenes using Gaussian Splatting
di: Li, Chenxin, et al.
Pubblicazione: (2024)
di: Li, Chenxin, et al.
Pubblicazione: (2024)
LGS: A Light-weight 4D Gaussian Splatting for Efficient Surgical Scene Reconstruction
di: Liu, Hengyu, et al.
Pubblicazione: (2024)
di: Liu, Hengyu, et al.
Pubblicazione: (2024)
EndoGaussian: Real-time Gaussian Splatting for Dynamic Endoscopic Scene Reconstruction
di: Liu, Yifan, et al.
Pubblicazione: (2024)
di: Liu, Yifan, et al.
Pubblicazione: (2024)
OmniFM: Toward Modality-Robust and Task-Agnostic Federated Learning for Heterogeneous Medical Imaging
di: Liu, Meilin, et al.
Pubblicazione: (2026)
di: Liu, Meilin, et al.
Pubblicazione: (2026)
Endora: Video Generation Models as Endoscopy Simulators
di: Li, Chenxin, et al.
Pubblicazione: (2024)
di: Li, Chenxin, et al.
Pubblicazione: (2024)
X$^{2}$-Gaussian: 4D Radiative Gaussian Splatting for Continuous-time Tomographic Reconstruction
di: Yu, Weihao, et al.
Pubblicazione: (2025)
di: Yu, Weihao, et al.
Pubblicazione: (2025)
X-GRM: Large Gaussian Reconstruction Model for Sparse-view X-rays to Computed Tomography
di: Liu, Yifan, et al.
Pubblicazione: (2025)
di: Liu, Yifan, et al.
Pubblicazione: (2025)
U-KAN Makes Strong Backbone for Medical Image Segmentation and Generation
di: Li, Chenxin, et al.
Pubblicazione: (2024)
di: Li, Chenxin, et al.
Pubblicazione: (2024)
Harnessing Lightweight Transformer with Contextual Synergic Enhancement for Efficient 3D Medical Image Segmentation
di: Liu, Xinyu, et al.
Pubblicazione: (2026)
di: Liu, Xinyu, et al.
Pubblicazione: (2026)
ViT-Lens: Towards Omni-modal Representations
di: Lei, Weixian, et al.
Pubblicazione: (2023)
di: Lei, Weixian, et al.
Pubblicazione: (2023)
OmniSelect: Dynamic Modality-Aware Token Compression for Efficient Omni-modal Large Language Models
di: Yang, Morunliu, et al.
Pubblicazione: (2026)
di: Yang, Morunliu, et al.
Pubblicazione: (2026)
GaussianStego: A Generalizable Stenography Pipeline for Generative 3D Gaussians Splatting
di: Li, Chenxin, et al.
Pubblicazione: (2024)
di: Li, Chenxin, et al.
Pubblicazione: (2024)
OmniEvent: Unified Event Representation Learning
di: Yan, Weiqi, et al.
Pubblicazione: (2025)
di: Yan, Weiqi, et al.
Pubblicazione: (2025)
OmniBooth: Learning Latent Control for Image Synthesis with Multi-modal Instruction
di: Li, Leheng, et al.
Pubblicazione: (2024)
di: Li, Leheng, et al.
Pubblicazione: (2024)
GTP-ViT: Efficient Vision Transformers via Graph-based Token Propagation
di: Xu, Xuwei, et al.
Pubblicazione: (2023)
di: Xu, Xuwei, et al.
Pubblicazione: (2023)
Explore the Limits of Omni-modal Pretraining at Scale
di: Zhang, Yiyuan, et al.
Pubblicazione: (2024)
di: Zhang, Yiyuan, et al.
Pubblicazione: (2024)
OmniJigsaw: Enhancing Omni-Modal Reasoning via Modality-Orchestrated Reordering
di: Jia, Yiduo, et al.
Pubblicazione: (2026)
di: Jia, Yiduo, et al.
Pubblicazione: (2026)
Modality Unified Attack for Omni-Modality Person Re-Identification
di: Bian, Yuan, et al.
Pubblicazione: (2025)
di: Bian, Yuan, et al.
Pubblicazione: (2025)
Enhancing Representations through Heterogeneous Self-Supervised Learning
di: Li, Zhong-Yu, et al.
Pubblicazione: (2023)
di: Li, Zhong-Yu, et al.
Pubblicazione: (2023)
Omni-DuplexEval: Evaluating Real-time Duplex Omni-modal Interaction
di: He, Chaoqun, et al.
Pubblicazione: (2026)
di: He, Chaoqun, et al.
Pubblicazione: (2026)
Mogao: An Omni Foundation Model for Interleaved Multi-Modal Generation
di: Liao, Chao, et al.
Pubblicazione: (2025)
di: Liao, Chao, et al.
Pubblicazione: (2025)
OmniBind: Large-scale Omni Multimodal Representation via Binding Spaces
di: Wang, Zehan, et al.
Pubblicazione: (2024)
di: Wang, Zehan, et al.
Pubblicazione: (2024)
RoboOmni: Proactive Robot Manipulation in Omni-modal Context
di: Wang, Siyin, et al.
Pubblicazione: (2025)
di: Wang, Siyin, et al.
Pubblicazione: (2025)
ThinkOmni: Lifting Textual Reasoning to Omni-modal Scenarios via Guidance Decoding
di: Guan, Yiran, et al.
Pubblicazione: (2026)
di: Guan, Yiran, et al.
Pubblicazione: (2026)
OmniVGGT: Omni-Modality Driven Visual Geometry Grounded Transformer
di: Peng, Haosong, et al.
Pubblicazione: (2025)
di: Peng, Haosong, et al.
Pubblicazione: (2025)
OmniWorld: A Multi-Domain and Multi-Modal Dataset for 4D World Modeling
di: Zhou, Yang, et al.
Pubblicazione: (2025)
di: Zhou, Yang, et al.
Pubblicazione: (2025)
Temporal Adaptive RGBT Tracking with Modality Prompt
di: Wang, Hongyu, et al.
Pubblicazione: (2024)
di: Wang, Hongyu, et al.
Pubblicazione: (2024)
EndoBench: A Comprehensive Evaluation of Multi-Modal Large Language Models for Endoscopy Analysis
di: Liu, Shengyuan, et al.
Pubblicazione: (2025)
di: Liu, Shengyuan, et al.
Pubblicazione: (2025)
OmniCLIP: Adapting CLIP for Video Recognition with Spatial-Temporal Omni-Scale Feature Learning
di: Liu, Mushui, et al.
Pubblicazione: (2024)
di: Liu, Mushui, et al.
Pubblicazione: (2024)
OmniFysics: Towards Physical Intelligence Evolution via Omni-Modal Signal Processing and Network Optimization
di: Han, Minghao, et al.
Pubblicazione: (2026)
di: Han, Minghao, et al.
Pubblicazione: (2026)
DreamVideo-Omni: Omni-Motion Controlled Multi-Subject Video Customization with Latent Identity Reinforcement Learning
di: Wei, Yujie, et al.
Pubblicazione: (2026)
di: Wei, Yujie, et al.
Pubblicazione: (2026)
OmniMotion: Multimodal Motion Generation with Continuous Masked Autoregression
di: Li, Zhe, et al.
Pubblicazione: (2025)
di: Li, Zhe, et al.
Pubblicazione: (2025)
Is Extending Modality The Right Path Towards Omni-Modality?
di: Zhu, Tinghui, et al.
Pubblicazione: (2025)
di: Zhu, Tinghui, et al.
Pubblicazione: (2025)
Omni-Scene: Omni-Gaussian Representation for Ego-Centric Sparse-View Scene Reconstruction
di: Wei, Dongxu, et al.
Pubblicazione: (2024)
di: Wei, Dongxu, et al.
Pubblicazione: (2024)
Omni-Reward: Towards Generalist Omni-Modal Reward Modeling with Free-Form Preferences
di: Jin, Zhuoran, et al.
Pubblicazione: (2025)
di: Jin, Zhuoran, et al.
Pubblicazione: (2025)
OmniSegmentor: A Flexible Multi-Modal Learning Framework for Semantic Segmentation
di: Yin, Bo-Wen, et al.
Pubblicazione: (2025)
di: Yin, Bo-Wen, et al.
Pubblicazione: (2025)
EndoGen: Conditional Autoregressive Endoscopic Video Generation
di: Liu, Xinyu, et al.
Pubblicazione: (2025)
di: Liu, Xinyu, et al.
Pubblicazione: (2025)
Chain of Modality: From Static Fusion to Dynamic Orchestration in Omni-MLLMs
di: Luo, Ziyang, et al.
Pubblicazione: (2026)
di: Luo, Ziyang, et al.
Pubblicazione: (2026)
Documenti analoghi
-
GeoT: Geometry-guided Instance-dependent Transition Matrix for Semi-supervised Tooth Point Cloud Segmentation
di: Yu, Weihao, et al.
Pubblicazione: (2025) -
MonoSplat: Generalizable 3D Gaussian Splatting from Monocular Depth Foundation Models
di: Liu, Yifan, et al.
Pubblicazione: (2025) -
EndoSparse: Real-Time Sparse View Synthesis of Endoscopic Scenes using Gaussian Splatting
di: Li, Chenxin, et al.
Pubblicazione: (2024) -
LGS: A Light-weight 4D Gaussian Splatting for Efficient Surgical Scene Reconstruction
di: Liu, Hengyu, et al.
Pubblicazione: (2024) -
EndoGaussian: Real-time Gaussian Splatting for Dynamic Endoscopic Scene Reconstruction
di: Liu, Yifan, et al.
Pubblicazione: (2024)