Guardado en:
| Autores principales: | Wang, Wei, Ly, Quoc-Toan, Yu, Chong, Bai, Jun |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2601.13331 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
SIGMMA: Hierarchical Graph-Based Multi-Scale Multi-modal Contrastive Alignment of Histopathology Image and Spatial Transcriptome
por: Jeong, Dabin, et al.
Publicado: (2025)
por: Jeong, Dabin, et al.
Publicado: (2025)
MEATRD: Multimodal Anomalous Tissue Region Detection Enhanced with Spatial Transcriptomics
por: Xu, Kaichen, et al.
Publicado: (2024)
por: Xu, Kaichen, et al.
Publicado: (2024)
A Patch-based Cross-view Regularized Framework for Backdoor Defense in Multimodal Large Language Models
por: Fang, Tianmeng, et al.
Publicado: (2026)
por: Fang, Tianmeng, et al.
Publicado: (2026)
SENCA-st: Integrating Spatial Transcriptomics and Histopathology with Cross Attention Shared Encoder for Region Identification in Cancer Pathology
por: Liyanaarachchi, Shanaka, et al.
Publicado: (2025)
por: Liyanaarachchi, Shanaka, et al.
Publicado: (2025)
Cross-modal Diffusion Modelling for Super-resolved Spatial Transcriptomics
por: Wang, Xiaofei, et al.
Publicado: (2024)
por: Wang, Xiaofei, et al.
Publicado: (2024)
Leveraging Spatial Transcriptomics as Alternative to Manual Annotations for Deep Learning-Based Nuclei Analysis
por: Nishimura, Kazuya, et al.
Publicado: (2026)
por: Nishimura, Kazuya, et al.
Publicado: (2026)
ST-Align: A Multimodal Foundation Model for Image-Gene Alignment in Spatial Transcriptomics
por: Lin, Yuxiang, et al.
Publicado: (2024)
por: Lin, Yuxiang, et al.
Publicado: (2024)
M2H: Multi-Task Learning with Efficient Window-Based Cross-Task Attention for Monocular Spatial Perception
por: Udugama, U. V. B. L, et al.
Publicado: (2025)
por: Udugama, U. V. B. L, et al.
Publicado: (2025)
Global Context-aware Representation Learning for Spatially Resolved Transcriptomics
por: Oh, Yunhak, et al.
Publicado: (2025)
por: Oh, Yunhak, et al.
Publicado: (2025)
Coarse Correspondences Boost Spatial-Temporal Reasoning in Multimodal Language Model
por: Liu, Benlin, et al.
Publicado: (2024)
por: Liu, Benlin, et al.
Publicado: (2024)
ST-GDance++: A Scalable Spatial-Temporal Diffusion for Long-Duration Group Choreography
por: Xu, Jing, et al.
Publicado: (2026)
por: Xu, Jing, et al.
Publicado: (2026)
Enhancing Parameter-Efficient Fine-Tuning of Vision Transformers through Frequency-Based Adaptation
por: Ly, Son Thai, et al.
Publicado: (2024)
por: Ly, Son Thai, et al.
Publicado: (2024)
Multi-Slice Spatial Transcriptomics Data Integration Analysis with STG3Net
por: Fang, Donghai, et al.
Publicado: (2024)
por: Fang, Donghai, et al.
Publicado: (2024)
HEXST: Hexagonal Shifted-Window Transformer for Spatial Transcriptomics Gene Expression Prediction
por: Byeon, Keunho, et al.
Publicado: (2026)
por: Byeon, Keunho, et al.
Publicado: (2026)
HyperST: Hierarchical Hyperbolic Learning for Spatial Transcriptomics Prediction
por: Zhang, Chen, et al.
Publicado: (2025)
por: Zhang, Chen, et al.
Publicado: (2025)
Dual-Model Defense: Safeguarding Diffusion Models from Membership Inference Attacks through Disjoint Data Splitting
por: Tran, Bao Q., et al.
Publicado: (2024)
por: Tran, Bao Q., et al.
Publicado: (2024)
GC-GAT: Multimodal Vehicular Trajectory Prediction using Graph Goal Conditioning and Cross-context Attention
por: Gulzar, Mahir, et al.
Publicado: (2025)
por: Gulzar, Mahir, et al.
Publicado: (2025)
Feature Alignment Determines Fusion Strategy: A Comparative Study of Cross-Attention and Concatenation in Multimodal Learning
por: Zhou, Zhiqiang, et al.
Publicado: (2026)
por: Zhou, Zhiqiang, et al.
Publicado: (2026)
Concept Unlearning via Cross-Attention Activation Projection for Diffusion Models
por: Moon, Saemi, et al.
Publicado: (2026)
por: Moon, Saemi, et al.
Publicado: (2026)
$MV_{Hybrid}$: Improving Spatial Transcriptomics Prediction with Hybrid State Space-Vision Transformer Backbone in Pathology Vision Foundation Models
por: Cho, Won June, et al.
Publicado: (2025)
por: Cho, Won June, et al.
Publicado: (2025)
CSA-Net: Channel-wise Spatially Autocorrelated Attention Networks
por: Nikzad, Nick, et al.
Publicado: (2024)
por: Nikzad, Nick, et al.
Publicado: (2024)
UniVL: Unified Vision-Language Embedding for Spatially Grounded Contextual Image Generation
por: Wang, Jiayun, et al.
Publicado: (2026)
por: Wang, Jiayun, et al.
Publicado: (2026)
Multimodal Language Models Cannot Spot Spatial Inconsistencies
por: Khangaonkar, Om, et al.
Publicado: (2026)
por: Khangaonkar, Om, et al.
Publicado: (2026)
Imaging-anchored Multiomics in Cardiovascular Disease: Integrating Cardiac Imaging, Bulk, Single-cell, and Spatial Transcriptomics
por: Le, Minh H. N., et al.
Publicado: (2026)
por: Le, Minh H. N., et al.
Publicado: (2026)
Attention Frequency Modulation: Training-Free Spectral Modulation of Diffusion Cross-Attention
por: Oh, Seunghun, et al.
Publicado: (2026)
por: Oh, Seunghun, et al.
Publicado: (2026)
Attention Deep Model with Multi-Scale Deep Supervision for Person Re-Identification
por: Wu, Di, et al.
Publicado: (2019)
por: Wu, Di, et al.
Publicado: (2019)
Origins of Creativity in Attention-Based Diffusion Models
por: Finn, Emma, et al.
Publicado: (2025)
por: Finn, Emma, et al.
Publicado: (2025)
Boomda: Balanced Multi-objective Optimization for Multimodal Domain Adaptation
por: Sun, Jun, et al.
Publicado: (2025)
por: Sun, Jun, et al.
Publicado: (2025)
Rethinking Generative Image Pretraining: How Far Are We From Scaling Up Next-Pixel Prediction?
por: Yan, Xinchen, et al.
Publicado: (2025)
por: Yan, Xinchen, et al.
Publicado: (2025)
HaloQuest: A Visual Hallucination Dataset for Advancing Multimodal Reasoning
por: Wang, Zhecan, et al.
Publicado: (2024)
por: Wang, Zhecan, et al.
Publicado: (2024)
A Survey of Vision Transformers in Autonomous Driving: Current Trends and Future Directions
por: Lai-Dang, Quoc-Vinh
Publicado: (2024)
por: Lai-Dang, Quoc-Vinh
Publicado: (2024)
Concepts or Skills? Rethinking Instruction Selection for Multi-modal Models
por: Bai, Andrew, et al.
Publicado: (2025)
por: Bai, Andrew, et al.
Publicado: (2025)
Latent Danger Zone: Distilling Unified Attention for Cross-Architecture Black-box Attacks
por: Li, Yang, et al.
Publicado: (2025)
por: Li, Yang, et al.
Publicado: (2025)
Gradient-Aligned Calibration for Post-Training Quantization of Diffusion Models
por: Hoang, Dung Anh, et al.
Publicado: (2026)
por: Hoang, Dung Anh, et al.
Publicado: (2026)
Privacy Protection in Personalized Diffusion Models via Targeted Cross-Attention Adversarial Attack
por: Xu, Xide, et al.
Publicado: (2024)
por: Xu, Xide, et al.
Publicado: (2024)
Introducing Visual Perception Token into Multimodal Large Language Model
por: Yu, Runpeng, et al.
Publicado: (2025)
por: Yu, Runpeng, et al.
Publicado: (2025)
Towards Understanding Multimodal Fine-Tuning: Spatial Features
por: Naghashyar, Lachin, et al.
Publicado: (2026)
por: Naghashyar, Lachin, et al.
Publicado: (2026)
MolFM-Lite: Multi-Modal Molecular Property Prediction with Conformer Ensemble Attention and Cross-Modal Fusion
por: Shah, Syed Omer, et al.
Publicado: (2026)
por: Shah, Syed Omer, et al.
Publicado: (2026)
FSTA-SNN:Frequency-based Spatial-Temporal Attention Module for Spiking Neural Networks
por: Yu, Kairong, et al.
Publicado: (2024)
por: Yu, Kairong, et al.
Publicado: (2024)
Dual-Path Knowledge-Augmented Contrastive Alignment Network for Spatially Resolved Transcriptomics
por: Zhang, Wei, et al.
Publicado: (2025)
por: Zhang, Wei, et al.
Publicado: (2025)
Ejemplares similares
-
SIGMMA: Hierarchical Graph-Based Multi-Scale Multi-modal Contrastive Alignment of Histopathology Image and Spatial Transcriptome
por: Jeong, Dabin, et al.
Publicado: (2025) -
MEATRD: Multimodal Anomalous Tissue Region Detection Enhanced with Spatial Transcriptomics
por: Xu, Kaichen, et al.
Publicado: (2024) -
A Patch-based Cross-view Regularized Framework for Backdoor Defense in Multimodal Large Language Models
por: Fang, Tianmeng, et al.
Publicado: (2026) -
SENCA-st: Integrating Spatial Transcriptomics and Histopathology with Cross Attention Shared Encoder for Region Identification in Cancer Pathology
por: Liyanaarachchi, Shanaka, et al.
Publicado: (2025) -
Cross-modal Diffusion Modelling for Super-resolved Spatial Transcriptomics
por: Wang, Xiaofei, et al.
Publicado: (2024)