DeepMoLM: Leveraging Visual and Geometric Structural Information for Molecule-Text Modeling
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lan, Jing, Ding, Hexiao, Chen, Hongzhao, Jiang, Yufeng, Ng, Nga-Chun, Yip, Gwing Kei, Cheng, Gerald W. Y., Mao, Yunlin, Cai, Jing, Lin, Liang-ting, Yoo, Jung Sun |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Structure-Aware Contrastive Learning with Fine-Grained Binding Representations for Drug Discovery
par: Lan, Jing, et autres
Publié: (2025)
par: Lan, Jing, et autres
Publié: (2025)
REACT-KD: Region-Aware Cross-modal Topological Knowledge Distillation for Interpretable Medical Image Classification
par: Chen, Hongzhao, et autres
Publié: (2025)
par: Chen, Hongzhao, et autres
Publié: (2025)
Contrastive Multi-Task Learning with Solvent-Aware Augmentation for Drug Discovery
par: Lan, Jing, et autres
Publié: (2025)
par: Lan, Jing, et autres
Publié: (2025)
LaF-GRPO: In-Situ Navigation Instruction Generation for the Visually Impaired via GRPO with LLM-as-Follower Reward
par: Zhao, Yi, et autres
Publié: (2025)
par: Zhao, Yi, et autres
Publié: (2025)
ALMol: Aligned Language-Molecule Translation LLMs through Offline Preference Contrastive Optimisation
par: Gkoumas, Dimitris
Publié: (2024)
par: Gkoumas, Dimitris
Publié: (2024)
Robust Symbolic Reasoning for Visual Narratives via Hierarchical and Semantically Normalized Knowledge Graphs
par: Chen, Yi-Chun
Publié: (2025)
par: Chen, Yi-Chun
Publié: (2025)
A Unified Non-Parametric and Interpretable Point Cloud Analysis via t-FCW Graph Representation
par: Lai, Haijian, et autres
Publié: (2026)
par: Lai, Haijian, et autres
Publié: (2026)
Less for More: Enhanced Feedback-aligned Mixed LLMs for Molecule Caption Generation and Fine-Grained NLI Evaluation
par: Gkoumas, Dimitris, et autres
Publié: (2024)
par: Gkoumas, Dimitris, et autres
Publié: (2024)
Prompt-Guided Generation of Structured Chest X-Ray Report Using a Pre-trained LLM
par: Li, Hongzhao, et autres
Publié: (2024)
par: Li, Hongzhao, et autres
Publié: (2024)
Sentiment-enhanced Graph-based Sarcasm Explanation in Dialogue
par: Ouyang, Kun, et autres
Publié: (2024)
par: Ouyang, Kun, et autres
Publié: (2024)
Modularized Zero-shot VQA with Pre-trained Models
par: Cao, Rui, et autres
Publié: (2023)
par: Cao, Rui, et autres
Publié: (2023)
MIND Your Reasoning: A Meta-Cognitive Intuitive-Reflective Network for Dual-Reasoning in Multimodal Stance Detection
par: Wang, Bingbing, et autres
Publié: (2025)
par: Wang, Bingbing, et autres
Publié: (2025)
TAVGBench: Benchmarking Text to Audible-Video Generation
par: Mao, Yuxin, et autres
Publié: (2024)
par: Mao, Yuxin, et autres
Publié: (2024)
Connecting Giants: Synergistic Knowledge Transfer of Large Multimodal Models for Few-Shot Learning
par: Tang, Hao, et autres
Publié: (2025)
par: Tang, Hao, et autres
Publié: (2025)
Automatic Prompt Generation and Grounding Object Detection for Zero-Shot Image Anomaly Detection
par: Cheung, Tsun-Hin, et autres
Publié: (2024)
par: Cheung, Tsun-Hin, et autres
Publié: (2024)
Multimodal Dialog Systems with Dual Knowledge-enhanced Generative Pretrained Language Model
par: Chen, Xiaolin, et autres
Publié: (2022)
par: Chen, Xiaolin, et autres
Publié: (2022)
Calibration & Reconstruction: Deep Integrated Language for Referring Image Segmentation
par: Yan, Yichen, et autres
Publié: (2024)
par: Yan, Yichen, et autres
Publié: (2024)
Listening Deepfake Detection: A New Perspective Beyond Speaking-Centric Forgery Analysis
par: Liu, Miao, et autres
Publié: (2026)
par: Liu, Miao, et autres
Publié: (2026)
PoEmotion: Can AI Utilize Chinese Calligraphy to Express Emotion from Poems?
par: Liu, Tiancheng, et autres
Publié: (2025)
par: Liu, Tiancheng, et autres
Publié: (2025)
Unveiling the Visual Rhetoric of Persuasive Cartography: A Case Study of the Design of Octopus Maps
par: Lin, Daocheng, et autres
Publié: (2025)
par: Lin, Daocheng, et autres
Publié: (2025)
ReactXT: Understanding Molecular "Reaction-ship" via Reaction-Contextualized Molecule-Text Pretraining
par: Liu, Zhiyuan, et autres
Publié: (2024)
par: Liu, Zhiyuan, et autres
Publié: (2024)
MemeCLIP: Leveraging CLIP Representations for Multimodal Meme Classification
par: Shah, Siddhant Bikram, et autres
Publié: (2024)
par: Shah, Siddhant Bikram, et autres
Publié: (2024)
IoT-LM: Large Multisensory Language Models for the Internet of Things
par: Mo, Shentong, et autres
Publié: (2024)
par: Mo, Shentong, et autres
Publié: (2024)
Wavelet-Decoupling Contrastive Enhancement Network for Fine-Grained Skeleton-Based Action Recognition
par: Chang, Haochen, et autres
Publié: (2024)
par: Chang, Haochen, et autres
Publié: (2024)
Dual Mutual Learning Network with Global-local Awareness for RGB-D Salient Object Detection
par: Yi, Kang, et autres
Publié: (2025)
par: Yi, Kang, et autres
Publié: (2025)
Probabilistic Temporal Masked Attention for Cross-view Online Action Detection
par: Xie, Liping, et autres
Publié: (2025)
par: Xie, Liping, et autres
Publié: (2025)
OT-DETECTOR: Delving into Optimal Transport for Zero-shot Out-of-Distribution Detection
par: Liu, Yu, et autres
Publié: (2025)
par: Liu, Yu, et autres
Publié: (2025)
MoRAG -- Multi-Fusion Retrieval Augmented Generation for Human Motion
par: Kalakonda, Sai Shashank, et autres
Publié: (2024)
par: Kalakonda, Sai Shashank, et autres
Publié: (2024)
Leveraging multimodal explanatory annotations for video interpretation with Modality Specific Dataset
par: Ancarani, Elisa, et autres
Publié: (2025)
par: Ancarani, Elisa, et autres
Publié: (2025)
Efficient Object-centric Representation Learning with Pre-trained Geometric Prior
par: Khac, Phúc H. Le, et autres
Publié: (2024)
par: Khac, Phúc H. Le, et autres
Publié: (2024)
Arena: A Patch-of-Interest ViT Inference Acceleration System for Edge-Assisted Video Analytics
par: Peng, Haosong, et autres
Publié: (2024)
par: Peng, Haosong, et autres
Publié: (2024)
Unveiling Encoder-Free Vision-Language Models
par: Diao, Haiwen, et autres
Publié: (2024)
par: Diao, Haiwen, et autres
Publié: (2024)
MMedFD: A Real-world Healthcare Benchmark for Multi-turn Full-Duplex Automatic Speech Recognition
par: Chen, Hongzhao, et autres
Publié: (2025)
par: Chen, Hongzhao, et autres
Publié: (2025)
PlanMoGPT: Flow-Enhanced Progressive Planning for Text to Motion Synthesis
par: Jin, Chuhao, et autres
Publié: (2025)
par: Jin, Chuhao, et autres
Publié: (2025)
Securing Social Media Against Deepfakes using Identity, Behavioral, and Geometric Signatures
par: Farooq, Muhammad Umar, et autres
Publié: (2024)
par: Farooq, Muhammad Umar, et autres
Publié: (2024)
Cross-Attention Fusion of Visual and Geometric Features for Large Vocabulary Arabic Lipreading
par: Daou, Samar, et autres
Publié: (2024)
par: Daou, Samar, et autres
Publié: (2024)
StableMoFusion: Towards Robust and Efficient Diffusion-based Motion Generation Framework
par: Huang, Yiheng, et autres
Publié: (2024)
par: Huang, Yiheng, et autres
Publié: (2024)
HuMo: Human-Centric Video Generation via Collaborative Multi-Modal Conditioning
par: Chen, Liyang, et autres
Publié: (2025)
par: Chen, Liyang, et autres
Publié: (2025)
Reasoning Like Experts: Leveraging Multimodal Large Language Models for Drawing-based Psychoanalysis
par: Ma, Xueqi, et autres
Publié: (2025)
par: Ma, Xueqi, et autres
Publié: (2025)
FoodMLLM-JP: Leveraging Multimodal Large Language Models for Japanese Recipe Generation
par: Imajuku, Yuki, et autres
Publié: (2024)
par: Imajuku, Yuki, et autres
Publié: (2024)
Documents similaires
-
Structure-Aware Contrastive Learning with Fine-Grained Binding Representations for Drug Discovery
par: Lan, Jing, et autres
Publié: (2025) -
REACT-KD: Region-Aware Cross-modal Topological Knowledge Distillation for Interpretable Medical Image Classification
par: Chen, Hongzhao, et autres
Publié: (2025) -
Contrastive Multi-Task Learning with Solvent-Aware Augmentation for Drug Discovery
par: Lan, Jing, et autres
Publié: (2025) -
LaF-GRPO: In-Situ Navigation Instruction Generation for the Visually Impaired via GRPO with LLM-as-Follower Reward
par: Zhao, Yi, et autres
Publié: (2025) -
ALMol: Aligned Language-Molecule Translation LLMs through Offline Preference Contrastive Optimisation
par: Gkoumas, Dimitris
Publié: (2024)