Answering Questions in Stages: Prompt Chaining for Contract QA
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Roegiest, Adam, Chitta, Radha |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MMToM-QA: Multimodal Theory of Mind Question Answering
par: Jin, Chuanyang, et autres
Publié: (2024)
par: Jin, Chuanyang, et autres
Publié: (2024)
ElectroVizQA: How well do Multi-modal LLMs perform in Electronics Visual Question Answering?
par: Meshram, Pragati Shuddhodhan, et autres
Publié: (2024)
par: Meshram, Pragati Shuddhodhan, et autres
Publié: (2024)
Prophet: Prompting Large Language Models with Complementary Answer Heuristics for Knowledge-based Visual Question Answering
par: Yu, Zhou, et autres
Publié: (2023)
par: Yu, Zhou, et autres
Publié: (2023)
Which Client is Reliable?: A Reliable and Personalized Prompt-based Federated Learning for Medical Image Question Answering
par: Zhu, He, et autres
Publié: (2024)
par: Zhu, He, et autres
Publié: (2024)
Meta-Adaptive Prompt Distillation for Few-Shot Visual Question Answering
par: Gupta, Akash, et autres
Publié: (2025)
par: Gupta, Akash, et autres
Publié: (2025)
Prompting Medical Large Vision-Language Models to Diagnose Pathologies by Visual Question Answering
par: Guo, Danfeng, et autres
Publié: (2024)
par: Guo, Danfeng, et autres
Publié: (2024)
Enhancing Visual Question Answering through Ranking-Based Hybrid Training and Multimodal Fusion
par: Chen, Peiyuan, et autres
Publié: (2024)
par: Chen, Peiyuan, et autres
Publié: (2024)
Generalizing Visual Question Answering from Synthetic to Human-Written Questions via a Chain of QA with a Large Language Model
par: Kim, Taehee, et autres
Publié: (2024)
par: Kim, Taehee, et autres
Publié: (2024)
ChainReaction: Causal Chain-Guided Reasoning for Modular and Explainable Causal-Why Video Question Answering
par: Parmar, Paritosh, et autres
Publié: (2025)
par: Parmar, Paritosh, et autres
Publié: (2025)
Exploring Diverse Methods in Visual Question Answering
par: Li, Panfeng, et autres
Publié: (2024)
par: Li, Panfeng, et autres
Publié: (2024)
ConceptBed: Evaluating Concept Learning Abilities of Text-to-Image Diffusion Models
par: Patel, Maitreya, et autres
Publié: (2023)
par: Patel, Maitreya, et autres
Publié: (2023)
CausalChaos! Dataset for Comprehensive Causal Action Question Answering Over Longer Causal Chains Grounded in Dynamic Visual Scenes
par: Parmar, Paritosh, et autres
Publié: (2024)
par: Parmar, Paritosh, et autres
Publié: (2024)
SViQA: A Unified Speech-Vision Multimodal Model for Textless Visual Question Answering
par: Li, Bingxin
Publié: (2025)
par: Li, Bingxin
Publié: (2025)
CVQA: Culturally-diverse Multilingual Visual Question Answering Benchmark
par: Romero, David, et autres
Publié: (2024)
par: Romero, David, et autres
Publié: (2024)
Find The Gap: Knowledge Base Reasoning For Visual Question Answering
par: Barezi, Elham J., et autres
Publié: (2024)
par: Barezi, Elham J., et autres
Publié: (2024)
Federated Document Visual Question Answering: A Pilot Study
par: Nguyen, Khanh, et autres
Publié: (2024)
par: Nguyen, Khanh, et autres
Publié: (2024)
FlowVQA: Mapping Multimodal Logic in Visual Question Answering with Flowcharts
par: Singh, Shubhankar, et autres
Publié: (2024)
par: Singh, Shubhankar, et autres
Publié: (2024)
GraphEQA: Using 3D Semantic Scene Graphs for Real-time Embodied Question Answering
par: Saxena, Saumya, et autres
Publié: (2024)
par: Saxena, Saumya, et autres
Publié: (2024)
Investigating VLM Hallucination from a Cognitive Psychology Perspective: A First Step Toward Interpretation with Intriguing Observations
par: Liu, Xiangrui, et autres
Publié: (2025)
par: Liu, Xiangrui, et autres
Publié: (2025)
RAVEN: Query-Guided Representation Alignment for Question Answering over Audio, Video, Embedded Sensors, and Natural Language
par: Biswas, Subrata, et autres
Publié: (2025)
par: Biswas, Subrata, et autres
Publié: (2025)
Spatially Grounded Explanations in Vision Language Models for Document Visual Question Answering
par: Lagos, Maximiliano Hormazábal, et autres
Publié: (2025)
par: Lagos, Maximiliano Hormazábal, et autres
Publié: (2025)
MapIQ: Evaluating Multimodal Large Language Models for Map Question Answering
par: Srivastava, Varun, et autres
Publié: (2025)
par: Srivastava, Varun, et autres
Publié: (2025)
Multilingual OCR-Aware Fine-Tuning and Prompt-Guided Chain-of-Thought Reasoning for Multimodal Large Language Models
par: Xu, Qinwu, et autres
Publié: (2026)
par: Xu, Qinwu, et autres
Publié: (2026)
Towards Self-Explainable Document Visual Question Answering with Chain-of-Explanation Predictions
par: Indrehus, Kjetil, et autres
Publié: (2026)
par: Indrehus, Kjetil, et autres
Publié: (2026)
TraveLER: A Modular Multi-LMM Agent Framework for Video Question-Answering
par: Shang, Chuyi, et autres
Publié: (2024)
par: Shang, Chuyi, et autres
Publié: (2024)
Multimedia-Aware Question Answering: A Review of Retrieval and Cross-Modal Reasoning Architectures
par: Raja, Rahul, et autres
Publié: (2025)
par: Raja, Rahul, et autres
Publié: (2025)
Questioning the Stability of Visual Question Answering
par: Rosenfeld, Amir, et autres
Publié: (2025)
par: Rosenfeld, Amir, et autres
Publié: (2025)
Compositional Chain-of-Thought Prompting for Large Multimodal Models
par: Mitra, Chancharik, et autres
Publié: (2023)
par: Mitra, Chancharik, et autres
Publié: (2023)
Perception Test 2024: Challenge Summary and a Novel Hour-Long VideoQA Benchmark
par: Heyward, Joseph, et autres
Publié: (2024)
par: Heyward, Joseph, et autres
Publié: (2024)
Guiding Vision-Language Model Selection for Visual Question-Answering Across Tasks, Domains, and Knowledge Types
par: Sinha, Neelabh, et autres
Publié: (2024)
par: Sinha, Neelabh, et autres
Publié: (2024)
MediFact at MEDIQA-M3G 2024: Medical Question Answering in Dermatology with Multimodal Learning
par: Saeed, Nadia
Publié: (2024)
par: Saeed, Nadia
Publié: (2024)
FRAMES-VQA: Benchmarking Fine-Tuning Robustness across Multi-Modal Shifts in Visual Question Answering
par: Huang, Chengyue, et autres
Publié: (2025)
par: Huang, Chengyue, et autres
Publié: (2025)
TempCore: Are Video QA Benchmarks Temporally Grounded? A Frame Selection Sensitivity Analysis and Benchmark
par: Ok, Hyunjong, et autres
Publié: (2025)
par: Ok, Hyunjong, et autres
Publié: (2025)
Don't Blame the Annotator: Bias Already Starts in the Annotation Instructions
par: Parmar, Mihir, et autres
Publié: (2022)
par: Parmar, Mihir, et autres
Publié: (2022)
An Image Grid Can Be Worth a Video: Zero-shot Video Question Answering Using a VLM
par: Kim, Wonkyun, et autres
Publié: (2024)
par: Kim, Wonkyun, et autres
Publié: (2024)
GeReA: Question-Aware Prompt Captions for Knowledge-based Visual Question Answering
par: Ma, Ziyu, et autres
Publié: (2024)
par: Ma, Ziyu, et autres
Publié: (2024)
Patch-Prompt Aligned Bayesian Prompt Tuning for Vision-Language Models
par: Liu, Xinyang, et autres
Publié: (2023)
par: Liu, Xinyang, et autres
Publié: (2023)
MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering
par: Li, Xu, et autres
Publié: (2025)
par: Li, Xu, et autres
Publié: (2025)
Investigating Prompting Techniques for Zero- and Few-Shot Visual Question Answering
par: Awal, Rabiul, et autres
Publié: (2023)
par: Awal, Rabiul, et autres
Publié: (2023)
PromptTA: Prompt-driven Text Adapter for Source-free Domain Generalization
par: Zhang, Haoran, et autres
Publié: (2024)
par: Zhang, Haoran, et autres
Publié: (2024)
Documents similaires
-
MMToM-QA: Multimodal Theory of Mind Question Answering
par: Jin, Chuanyang, et autres
Publié: (2024) -
ElectroVizQA: How well do Multi-modal LLMs perform in Electronics Visual Question Answering?
par: Meshram, Pragati Shuddhodhan, et autres
Publié: (2024) -
Prophet: Prompting Large Language Models with Complementary Answer Heuristics for Knowledge-based Visual Question Answering
par: Yu, Zhou, et autres
Publié: (2023) -
Which Client is Reliable?: A Reliable and Personalized Prompt-based Federated Learning for Medical Image Question Answering
par: Zhu, He, et autres
Publié: (2024) -
Meta-Adaptive Prompt Distillation for Few-Shot Visual Question Answering
par: Gupta, Akash, et autres
Publié: (2025)