HiPath: Hierarchical Vision-Language Alignment for Structured Pathology Report Prediction
Fuente:
arXiv
Guardado en:
| Autores principales: | Yuan, Ruicheng, Zhang, Zhenxuan, Wang, Anbang, Hu, Liwei, Hua, Xiangqian, Peng, Yaya, Luo, Jiawei, Yang, Guang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Towards Trustworthy Selective Generation: Reliability-Guided Diffusion for Ultra-Low-Field to High-Field MRI Synthesis
por: Zhang, Zhenxuan, et al.
Publicado: (2026)
por: Zhang, Zhenxuan, et al.
Publicado: (2026)
HiLa: Hierarchical Vision-Language Collaboration for Cancer Survival Prediction
por: Cui, Jiaqi, et al.
Publicado: (2025)
por: Cui, Jiaqi, et al.
Publicado: (2025)
HiPP-Prune: Hierarchical Preference-Conditioned Structured Pruning for Vision-Language Models
por: Bai, Lincen, et al.
Publicado: (2026)
por: Bai, Lincen, et al.
Publicado: (2026)
Hi-Agent: Hierarchical Vision-Language Agents for Mobile Device Control
por: Wu, Zhe, et al.
Publicado: (2025)
por: Wu, Zhe, et al.
Publicado: (2025)
PathFL: Multi-Alignment Federated Learning for Pathology Image Segmentation
por: Zhang, Yuan, et al.
Publicado: (2025)
por: Zhang, Yuan, et al.
Publicado: (2025)
PathoHR: Hierarchical Reasoning for Vision-Language Models in Pathology
por: Huang, Yating, et al.
Publicado: (2025)
por: Huang, Yating, et al.
Publicado: (2025)
LoC-Path: Learning to Compress for Pathology Multimodal Large Language Models
por: Hu, Qingqiao, et al.
Publicado: (2025)
por: Hu, Qingqiao, et al.
Publicado: (2025)
HiCrowd: Hierarchical Crowd Flow Alignment for Dense Human Environments
por: Zhu, Yufei, et al.
Publicado: (2026)
por: Zhu, Yufei, et al.
Publicado: (2026)
HiSpatial: Taming Hierarchical 3D Spatial Understanding in Vision-Language Models
por: Liang, Huizhi, et al.
Publicado: (2026)
por: Liang, Huizhi, et al.
Publicado: (2026)
ScaleKD: Strong Vision Transformers Could Be Excellent Teachers
por: Fan, Jiawei, et al.
Publicado: (2024)
por: Fan, Jiawei, et al.
Publicado: (2024)
HiMo-CLIP: Modeling Semantic Hierarchy and Monotonicity in Vision-Language Alignment
por: Wu, Ruijia, et al.
Publicado: (2025)
por: Wu, Ruijia, et al.
Publicado: (2025)
HiPrune: Hierarchical Attention for Efficient Token Pruning in Vision-Language Models
por: Liu, Jizhihui, et al.
Publicado: (2025)
por: Liu, Jizhihui, et al.
Publicado: (2025)
HiTVideo: Hierarchical Tokenizers for Enhancing Text-to-Video Generation with Autoregressive Large Language Models
por: Zhou, Ziqin, et al.
Publicado: (2025)
por: Zhou, Ziqin, et al.
Publicado: (2025)
HiMemVLN: Enhancing Reliability of Open-Source Zero-Shot Vision-and-Language Navigation with Hierarchical Memory System
por: Lyu, Kailin, et al.
Publicado: (2026)
por: Lyu, Kailin, et al.
Publicado: (2026)
Unleashing Video Language Models for Fine-grained HRCT Report Generation
por: Fang, Yingying, et al.
Publicado: (2026)
por: Fang, Yingying, et al.
Publicado: (2026)
Accurate and Scalable Multimodal Pathology Retrieval via Attentive Vision-Language Alignment
por: Wang, Hongyi, et al.
Publicado: (2025)
por: Wang, Hongyi, et al.
Publicado: (2025)
HiMoE-VLA: Hierarchical Mixture-of-Experts for Generalist Vision-Language-Action Policies
por: Du, Zhiying, et al.
Publicado: (2025)
por: Du, Zhiying, et al.
Publicado: (2025)
HiBench: Benchmarking LLMs Capability on Hierarchical Structure Reasoning
por: Jiang, Zhuohang, et al.
Publicado: (2025)
por: Jiang, Zhuohang, et al.
Publicado: (2025)
Hi Robot: Open-Ended Instruction Following with Hierarchical Vision-Language-Action Models
por: Shi, Lucy Xiaoyang, et al.
Publicado: (2025)
por: Shi, Lucy Xiaoyang, et al.
Publicado: (2025)
UniHDSA: A Unified Relation Prediction Approach for Hierarchical Document Structure Analysis
por: Wang, Jiawei, et al.
Publicado: (2025)
por: Wang, Jiawei, et al.
Publicado: (2025)
HiF-DTA: Hierarchical Feature Learning Network for Drug-Target Affinity Prediction
por: Li, Minghui, et al.
Publicado: (2025)
por: Li, Minghui, et al.
Publicado: (2025)
PathAR: Structure-First Autoregressive Synthesis of Multimodal Pathology Images
por: Zhang, Yuan, et al.
Publicado: (2026)
por: Zhang, Yuan, et al.
Publicado: (2026)
HiScene: Creating Hierarchical 3D Scenes with Isometric View Generation
por: Dong, Wenqi, et al.
Publicado: (2025)
por: Dong, Wenqi, et al.
Publicado: (2025)
Seeing Through Experts Eyes A Foundational Vision Language Model Trained on Radiologists Gaze and Reasoning
por: Lee, Kinhei, et al.
Publicado: (2026)
por: Lee, Kinhei, et al.
Publicado: (2026)
Chain-of-Models Pre-Training: Rethinking Training Acceleration of Vision Foundation Models
por: Fan, Jiawei, et al.
Publicado: (2026)
por: Fan, Jiawei, et al.
Publicado: (2026)
HiAgent: Hierarchical Working Memory Management for Solving Long-Horizon Agent Tasks with Large Language Model
por: Hu, Mengkang, et al.
Publicado: (2024)
por: Hu, Mengkang, et al.
Publicado: (2024)
On Ihara's lemma for definite unitary groups
por: Yang, Xiangqian
Publicado: (2025)
por: Yang, Xiangqian
Publicado: (2025)
Hi-Dyna Graph: Hierarchical Dynamic Scene Graph for Robotic Autonomy in Human-Centric Environments
por: Hou, Jiawei, et al.
Publicado: (2025)
por: Hou, Jiawei, et al.
Publicado: (2025)
Modest-Align: Data-Efficient Alignment for Vision-Language Models
por: Liu, Jiaxiang, et al.
Publicado: (2025)
por: Liu, Jiaxiang, et al.
Publicado: (2025)
HiMix: Reducing Computational Complexity in Large Vision-Language Models
por: Zhang, Xuange, et al.
Publicado: (2025)
por: Zhang, Xuange, et al.
Publicado: (2025)
HiFusion: Hierarchical Intra-Spot Alignment and Regional Context Fusion for Spatial Gene Expression Prediction from Histopathology
por: Weng, Ziqiao, et al.
Publicado: (2025)
por: Weng, Ziqiao, et al.
Publicado: (2025)
HiVG: Hierarchical Multimodal Fine-grained Modulation for Visual Grounding
por: Xiao, Linhui, et al.
Publicado: (2024)
por: Xiao, Linhui, et al.
Publicado: (2024)
Morse: Dual-Sampling for Lossless Acceleration of Diffusion Models
por: Li, Chao, et al.
Publicado: (2025)
por: Li, Chao, et al.
Publicado: (2025)
HiGR: Efficient Generative Slate Recommendation via Hierarchical Planning and Multi-Objective Preference Alignment
por: Pang, Yunsheng, et al.
Publicado: (2025)
por: Pang, Yunsheng, et al.
Publicado: (2025)
SGHA-Attack: Semantic-Guided Hierarchical Alignment for Transferable Targeted Attacks on Vision-Language Models
por: Wang, Haobo, et al.
Publicado: (2026)
por: Wang, Haobo, et al.
Publicado: (2026)
Hi-GMAE: Hierarchical Graph Masked Autoencoders
por: Liu, Chuang, et al.
Publicado: (2024)
por: Liu, Chuang, et al.
Publicado: (2024)
HiMix: Hierarchical Artifact-aware Mixup for Generalized Synthetic Image Detection
por: Zhou, Shuchang, et al.
Publicado: (2026)
por: Zhou, Shuchang, et al.
Publicado: (2026)
Hi-SAM: A Hierarchical Structure-Aware Multi-modal Framework for Large-Scale Recommendation
por: Pan, Pingjun, et al.
Publicado: (2026)
por: Pan, Pingjun, et al.
Publicado: (2026)
HiRQA: Hierarchical Ranking and Quality Alignment for Opinion-Unaware Image Quality Assessment
por: Ramesh, Vaishnav, et al.
Publicado: (2025)
por: Ramesh, Vaishnav, et al.
Publicado: (2025)
PathFound: An Agentic Multimodal Model Activating Evidence-seeking Pathological Diagnosis
por: Hua, Shengyi, et al.
Publicado: (2025)
por: Hua, Shengyi, et al.
Publicado: (2025)
Ejemplares similares
-
Towards Trustworthy Selective Generation: Reliability-Guided Diffusion for Ultra-Low-Field to High-Field MRI Synthesis
por: Zhang, Zhenxuan, et al.
Publicado: (2026) -
HiLa: Hierarchical Vision-Language Collaboration for Cancer Survival Prediction
por: Cui, Jiaqi, et al.
Publicado: (2025) -
HiPP-Prune: Hierarchical Preference-Conditioned Structured Pruning for Vision-Language Models
por: Bai, Lincen, et al.
Publicado: (2026) -
Hi-Agent: Hierarchical Vision-Language Agents for Mobile Device Control
por: Wu, Zhe, et al.
Publicado: (2025) -
PathFL: Multi-Alignment Federated Learning for Pathology Image Segmentation
por: Zhang, Yuan, et al.
Publicado: (2025)