CTIS-QA: Clinical Template-Informed Slide-level Question Answering for Pathology
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lu, Hao, Qian, Ziniu, Li, Yifu, Zhou, Yang, Wei, Bingzheng, Xu, Yan |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
All-In-One Medical Image Restoration via Task-Adaptive Routing
par: Yang, Zhiwen, et autres
Publié: (2024)
par: Yang, Zhiwen, et autres
Publié: (2024)
VeriSciQA: An Auto-Verified Dataset for Scientific Visual Question Answering
par: Li, Yuyi, et autres
Publié: (2025)
par: Li, Yuyi, et autres
Publié: (2025)
Region Attention Transformer for Medical Image Restoration
par: Yang, Zhiwen, et autres
Publié: (2024)
par: Yang, Zhiwen, et autres
Publié: (2024)
NuScenes-QA: A Multi-modal Visual Question Answering Benchmark for Autonomous Driving Scenario
par: Qian, Tianwen, et autres
Publié: (2023)
par: Qian, Tianwen, et autres
Publié: (2023)
Revisiting End-to-End Learning with Slide-level Supervision in Computational Pathology
par: Tang, Wenhao, et autres
Publié: (2025)
par: Tang, Wenhao, et autres
Publié: (2025)
VoQA: Visual-only Question Answering
par: An, Jianing, et autres
Publié: (2025)
par: An, Jianing, et autres
Publié: (2025)
Path-RAG: Knowledge-Guided Key Region Retrieval for Open-ended Pathology Visual Question Answering
par: Naeem, Awais, et autres
Publié: (2024)
par: Naeem, Awais, et autres
Publié: (2024)
Visual Textualization for Image Prompted Object Detection
par: Wu, Yongjian, et autres
Publié: (2025)
par: Wu, Yongjian, et autres
Publié: (2025)
VideoQA-SC: Adaptive Semantic Communication for Video Question Answering
par: Guo, Jiangyuan, et autres
Publié: (2024)
par: Guo, Jiangyuan, et autres
Publié: (2024)
WSI-VQA: Interpreting Whole Slide Images by Generative Visual Question Answering
par: Chen, Pingyi, et autres
Publié: (2024)
par: Chen, Pingyi, et autres
Publié: (2024)
LingoQA: Visual Question Answering for Autonomous Driving
par: Marcu, Ana-Maria, et autres
Publié: (2023)
par: Marcu, Ana-Maria, et autres
Publié: (2023)
Can We Simplify Slide-level Fine-tuning of Pathology Foundation Models?
par: Li, Jiawen, et autres
Publié: (2025)
par: Li, Jiawen, et autres
Publié: (2025)
Sports-QA: A Large-Scale Video Question Answering Benchmark for Complex and Professional Sports
par: Li, Haopeng, et autres
Publié: (2024)
par: Li, Haopeng, et autres
Publié: (2024)
STRIDE-QA: Visual Question Answering Dataset for Spatiotemporal Reasoning in Urban Driving Scenes
par: Ishihara, Keishi, et autres
Publié: (2025)
par: Ishihara, Keishi, et autres
Publié: (2025)
RoadscapesQA: A Multitask, Multimodal Dataset for Visual Question Answering on Indian Roads
par: Iyer, Vijayasri, et autres
Publié: (2026)
par: Iyer, Vijayasri, et autres
Publié: (2026)
MovieRecapsQA: A Multimodal Open-Ended Video Question-Answering Benchmark
par: Shaar, Shaden, et autres
Publié: (2026)
par: Shaar, Shaden, et autres
Publié: (2026)
Overview of TREC 2024 Medical Video Question Answering (MedVidQA) Track
par: Gupta, Deepak, et autres
Publié: (2024)
par: Gupta, Deepak, et autres
Publié: (2024)
Answering Questions in Stages: Prompt Chaining for Contract QA
par: Roegiest, Adam, et autres
Publié: (2024)
par: Roegiest, Adam, et autres
Publié: (2024)
RSVLM-QA: A Benchmark Dataset for Remote Sensing Vision Language Model-based Question Answering
par: Zi, Xing, et autres
Publié: (2025)
par: Zi, Xing, et autres
Publié: (2025)
Fusion of Multi-scale Heterogeneous Pathology Foundation Models for Whole Slide Image Analysis
par: Yang, Zhidong, et autres
Publié: (2025)
par: Yang, Zhidong, et autres
Publié: (2025)
Agentic Keyframe Search for Video Question Answering
par: Fan, Sunqi, et autres
Publié: (2025)
par: Fan, Sunqi, et autres
Publié: (2025)
DocVideoQA: Towards Comprehensive Understanding of Document-Centric Videos through Question Answering
par: Wang, Haochen, et autres
Publié: (2025)
par: Wang, Haochen, et autres
Publié: (2025)
SViQA: A Unified Speech-Vision Multimodal Model for Textless Visual Question Answering
par: Li, Bingxin
Publié: (2025)
par: Li, Bingxin
Publié: (2025)
Foundation Models for Slide-level Cancer Subtyping in Digital Pathology
par: Meseguer, Pablo, et autres
Publié: (2024)
par: Meseguer, Pablo, et autres
Publié: (2024)
InfoChartQA: A Benchmark for Multimodal Question Answering on Infographic Charts
par: Xie, Tianchi, et autres
Publié: (2025)
par: Xie, Tianchi, et autres
Publié: (2025)
QA-Dragon: Query-Aware Dynamic RAG System for Knowledge-Intensive Visual Question Answering
par: Jiang, Zhuohang, et autres
Publié: (2025)
par: Jiang, Zhuohang, et autres
Publié: (2025)
MA-EgoQA: Question Answering over Egocentric Videos from Multiple Embodied Agents
par: Kim, Kangsan, et autres
Publié: (2026)
par: Kim, Kangsan, et autres
Publié: (2026)
TAT: Task-Adaptive Transformer for All-in-One Medical Image Restoration
par: Yang, Zhiwen, et autres
Publié: (2025)
par: Yang, Zhiwen, et autres
Publié: (2025)
UDVideoQA: A Traffic Video Question Answering Dataset for Multi-Object Spatio-Temporal Reasoning in Urban Dynamics
par: Vishal, Joseph Raj, et autres
Publié: (2026)
par: Vishal, Joseph Raj, et autres
Publié: (2026)
MTVQA: Benchmarking Multilingual Text-Centric Visual Question Answering
par: Tang, Jingqun, et autres
Publié: (2024)
par: Tang, Jingqun, et autres
Publié: (2024)
Patch-level Sounding Object Tracking for Audio-Visual Question Answering
par: Li, Zhangbin, et autres
Publié: (2024)
par: Li, Zhangbin, et autres
Publié: (2024)
SDPT: Synchronous Dual Prompt Tuning for Fusion-based Visual-Language Pre-trained Models
par: Zhou, Yang, et autres
Publié: (2024)
par: Zhou, Yang, et autres
Publié: (2024)
AttriPrompter: Auto-Prompting with Attribute Semantics for Zero-shot Nuclei Detection via Visual-Language Pre-trained Models
par: Wu, Yongjian, et autres
Publié: (2024)
par: Wu, Yongjian, et autres
Publié: (2024)
All-in-One Medical Image Restoration with Latent Diffusion-Enhanced Vector-Quantized Codebook Prior
par: Chen, Haowei, et autres
Publié: (2025)
par: Chen, Haowei, et autres
Publié: (2025)
Neural-Symbolic VideoQA: Learning Compositional Spatio-Temporal Reasoning for Real-world Video Question Answering
par: Liang, Lili, et autres
Publié: (2024)
par: Liang, Lili, et autres
Publié: (2024)
UpstreamQA: A Modular Framework for Explicit Reasoning on Video Question Answering Tasks
par: Nguyen, Jason, et autres
Publié: (2026)
par: Nguyen, Jason, et autres
Publié: (2026)
Diagnostic Text-guided Representation Learning in Hierarchical Classification for Pathological Whole Slide Image
par: Li, Jiawen, et autres
Publié: (2024)
par: Li, Jiawen, et autres
Publié: (2024)
VisualSimpleQA: A Benchmark for Decoupled Evaluation of Large Vision-Language Models in Fact-Seeking Question Answering
par: Wang, Yanling, et autres
Publié: (2025)
par: Wang, Yanling, et autres
Publié: (2025)
FEAT: Full-Dimensional Efficient Attention Transformer for Medical Video Generation
par: Wang, Huihan, et autres
Publié: (2025)
par: Wang, Huihan, et autres
Publié: (2025)
Multimodal Rationales for Explainable Visual Question Answering
par: Li, Kun, et autres
Publié: (2024)
par: Li, Kun, et autres
Publié: (2024)
Documents similaires
-
All-In-One Medical Image Restoration via Task-Adaptive Routing
par: Yang, Zhiwen, et autres
Publié: (2024) -
VeriSciQA: An Auto-Verified Dataset for Scientific Visual Question Answering
par: Li, Yuyi, et autres
Publié: (2025) -
Region Attention Transformer for Medical Image Restoration
par: Yang, Zhiwen, et autres
Publié: (2024) -
NuScenes-QA: A Multi-modal Visual Question Answering Benchmark for Autonomous Driving Scenario
par: Qian, Tianwen, et autres
Publié: (2023) -
Revisiting End-to-End Learning with Slide-level Supervision in Computational Pathology
par: Tang, Wenhao, et autres
Publié: (2025)