Unlocking the Power of Spatial and Temporal Information in Medical Multimodal Pre-training
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yang, Jinxia, Su, Bing, Zhao, Wayne Xin, Wen, Ji-Rong |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ReasoningLM: Enabling Structural Subgraph Reasoning in Pre-trained Language Models for Question Answering over Knowledge Graph
par: Jiang, Jinhao, et autres
Publié: (2023)
par: Jiang, Jinhao, et autres
Publié: (2023)
Pre-training Generative Recommender with Multi-Identifier Item Tokenization
par: Zheng, Bowen, et autres
Publié: (2025)
par: Zheng, Bowen, et autres
Publié: (2025)
Adaptive Ability Decomposing for Unlocking Large Reasoning Model Effective Reinforcement Learning
par: Chen, Zhipeng, et autres
Publié: (2026)
par: Chen, Zhipeng, et autres
Publié: (2026)
Decomposing the Entropy-Performance Exchange: The Missing Keys to Unlocking Effective Reinforcement Learning
par: Deng, Jia, et autres
Publié: (2025)
par: Deng, Jia, et autres
Publié: (2025)
Multimodal Medical Image Classification via Synergistic Learning Pre-training
par: Lin, Qinghua, et autres
Publié: (2025)
par: Lin, Qinghua, et autres
Publié: (2025)
Low-rank Optimization Trajectories Modeling for LLM RLVR Acceleration
par: Chen, Zhipeng, et autres
Publié: (2026)
par: Chen, Zhipeng, et autres
Publié: (2026)
Spatial-Temporal Cross-View Contrastive Pre-training for Check-in Sequence Representation Learning
par: Gong, Letian, et autres
Publié: (2024)
par: Gong, Letian, et autres
Publié: (2024)
Experience-Guided Reflective Co-Evolution of Prompts and Heuristics for Automatic Algorithm Design
par: Liu, Yihong, et autres
Publié: (2025)
par: Liu, Yihong, et autres
Publié: (2025)
Universal Item Tokenization for Transferable Generative Recommendation
par: Zheng, Bowen, et autres
Publié: (2025)
par: Zheng, Bowen, et autres
Publié: (2025)
Towards Long-horizon Agentic Multimodal Search
par: Du, Yifan, et autres
Publié: (2026)
par: Du, Yifan, et autres
Publié: (2026)
Backdoor in Seconds: Unlocking Vulnerabilities in Large Pre-trained Models via Model Editing
par: Guo, Dongliang, et autres
Publié: (2024)
par: Guo, Dongliang, et autres
Publié: (2024)
Multimodal 3D Genome Pre-training
par: Yang, Minghao, et autres
Publié: (2025)
par: Yang, Minghao, et autres
Publié: (2025)
A Smart Multimodal Healthcare Copilot with Powerful LLM Reasoning
par: Zhao, Xuejiao, et autres
Publié: (2025)
par: Zhao, Xuejiao, et autres
Publié: (2025)
Data Darwinism Part I: Unlocking the Value of Scientific Data for Pre-training
par: Qin, Yiwei, et autres
Publié: (2026)
par: Qin, Yiwei, et autres
Publié: (2026)
MIPS: a Multimodal Infinite Polymer Sequence Pre-training Framework for Polymer Property Prediction
par: Wang, Jiaxi, et autres
Publié: (2025)
par: Wang, Jiaxi, et autres
Publié: (2025)
Memory Reviving, Continuing Learning and Beyond: Evaluation of Pre-trained Encoders and Decoders for Multimodal Machine Translation
par: Yu, Zhuang, et autres
Publié: (2025)
par: Yu, Zhuang, et autres
Publié: (2025)
PRECISE: Pre-training Sequential Recommenders with Collaborative and Semantic Information
par: Song, Chonggang, et autres
Publié: (2024)
par: Song, Chonggang, et autres
Publié: (2024)
Self Pre-training with Topology- and Spatiality-aware Masked Autoencoders for 3D Medical Image Segmentation
par: Gu, Pengfei, et autres
Publié: (2024)
par: Gu, Pengfei, et autres
Publié: (2024)
Utilizing Strategic Pre-training to Reduce Overfitting: Baguan -- A Pre-trained Weather Forecasting Model
par: Niu, Peisong, et autres
Publié: (2025)
par: Niu, Peisong, et autres
Publié: (2025)
Unlocking Pre-trained Image Backbones for Semantic Image Synthesis
par: Berrada, Tariq, et autres
Publié: (2023)
par: Berrada, Tariq, et autres
Publié: (2023)
The Geometry of Compromise: Unlocking Generative Capabilities via Controllable Modality Alignment
par: Liu, Hongyuan, et autres
Publié: (2026)
par: Liu, Hongyuan, et autres
Publié: (2026)
Wikiformer: Pre-training with Structured Information of Wikipedia for Ad-hoc Retrieval
par: Su, Weihang, et autres
Publié: (2023)
par: Su, Weihang, et autres
Publié: (2023)
SimpleDeepSearcher: Deep Information Seeking via Web-Powered Reasoning Trajectory Synthesis
par: Sun, Shuang, et autres
Publié: (2025)
par: Sun, Shuang, et autres
Publié: (2025)
RecNet: Self-Evolving Preference Propagation for Agentic Recommender Systems
par: Li, Bingqian, et autres
Publié: (2026)
par: Li, Bingqian, et autres
Publié: (2026)
RA-BLIP: Multimodal Adaptive Retrieval-Augmented Bootstrapping Language-Image Pre-training
par: Ding, Muhe, et autres
Publié: (2024)
par: Ding, Muhe, et autres
Publié: (2024)
Enhancing Sequential Recommender with Large Language Models for Joint Video and Comment Recommendation
par: Zheng, Bowen, et autres
Publié: (2024)
par: Zheng, Bowen, et autres
Publié: (2024)
Slow Thinking for Sequential Recommendation
par: Zhang, Junjie, et autres
Publié: (2025)
par: Zhang, Junjie, et autres
Publié: (2025)
Cross-domain Random Pre-training with Prototypes for Reinforcement Learning
par: Liu, Xin, et autres
Publié: (2023)
par: Liu, Xin, et autres
Publié: (2023)
Delayed Bottlenecking: Alleviating Forgetting in Pre-trained Graph Neural Networks
par: Zhao, Zhe, et autres
Publié: (2024)
par: Zhao, Zhe, et autres
Publié: (2024)
Understanding Data Temporality Impact on Large Language Models Pre-training
par: Pilchen, Hippolyte, et autres
Publié: (2026)
par: Pilchen, Hippolyte, et autres
Publié: (2026)
Probing Language Models for Pre-training Data Detection
par: Liu, Zhenhua, et autres
Publié: (2024)
par: Liu, Zhenhua, et autres
Publié: (2024)
A Pre-training Framework for Relational Data with Information-theoretic Principles
par: Truong, Quang, et autres
Publié: (2025)
par: Truong, Quang, et autres
Publié: (2025)
MedGen: Unlocking Medical Video Generation by Scaling Granularly-annotated Medical Videos
par: Wang, Rongsheng, et autres
Publié: (2025)
par: Wang, Rongsheng, et autres
Publié: (2025)
Dynamic Prompt Optimizing for Text-to-Image Generation
par: Mo, Wenyi, et autres
Publié: (2024)
par: Mo, Wenyi, et autres
Publié: (2024)
RegionMed-CLIP: A Region-Aware Multimodal Contrastive Learning Pre-trained Model for Medical Image Understanding
par: Fang, Tianchen, et autres
Publié: (2025)
par: Fang, Tianchen, et autres
Publié: (2025)
Towards Coarse-to-Fine Evaluation of Inference Efficiency for Large Language Models
par: Chen, Yushuo, et autres
Publié: (2024)
par: Chen, Yushuo, et autres
Publié: (2024)
Grounded Knowledge-Enhanced Medical Vision-Language Pre-training for Chest X-Ray
par: Deng, Qiao, et autres
Publié: (2024)
par: Deng, Qiao, et autres
Publié: (2024)
MedFILIP: Medical Fine-grained Language-Image Pre-training
par: Liang, Xinjie, et autres
Publié: (2025)
par: Liang, Xinjie, et autres
Publié: (2025)
TCGPN: Temporal-Correlation Graph Pre-trained Network for Stock Forecasting
par: Yan, Wenbo, et autres
Publié: (2024)
par: Yan, Wenbo, et autres
Publié: (2024)
KEPO: Knowledge-Enhanced Preference Optimization for Multimodal Reasoning with Applications to Medical VQA
par: Yang, Fan, et autres
Publié: (2026)
par: Yang, Fan, et autres
Publié: (2026)
Documents similaires
-
ReasoningLM: Enabling Structural Subgraph Reasoning in Pre-trained Language Models for Question Answering over Knowledge Graph
par: Jiang, Jinhao, et autres
Publié: (2023) -
Pre-training Generative Recommender with Multi-Identifier Item Tokenization
par: Zheng, Bowen, et autres
Publié: (2025) -
Adaptive Ability Decomposing for Unlocking Large Reasoning Model Effective Reinforcement Learning
par: Chen, Zhipeng, et autres
Publié: (2026) -
Decomposing the Entropy-Performance Exchange: The Missing Keys to Unlocking Effective Reinforcement Learning
par: Deng, Jia, et autres
Publié: (2025) -
Multimodal Medical Image Classification via Synergistic Learning Pre-training
par: Lin, Qinghua, et autres
Publié: (2025)