Salvato in:
| Autori principali: | Jin, Chuanyang, Wu, Yutong, Cao, Jing, Xiang, Jiannan, Kuo, Yen-Ling, Hu, Zhiting, Ullman, Tomer, Torralba, Antonio, Tenenbaum, Joshua B., Shu, Tianmin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2401.08743 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MuMA-ToM: Multi-modal Multi-Agent Theory of Mind
di: Shi, Haojun, et al.
Pubblicazione: (2024)
di: Shi, Haojun, et al.
Pubblicazione: (2024)
GOMA: Proactive Embodied Cooperative Communication via Goal-Oriented Mental Alignment
di: Ying, Lance, et al.
Pubblicazione: (2024)
di: Ying, Lance, et al.
Pubblicazione: (2024)
Re-evaluating Theory of Mind evaluation in large language models
di: Hu, Jennifer, et al.
Pubblicazione: (2025)
di: Hu, Jennifer, et al.
Pubblicazione: (2025)
The Illusion-Illusion: Vision Language Models See Illusions Where There are None
di: Ullman, Tomer
Pubblicazione: (2024)
di: Ullman, Tomer
Pubblicazione: (2024)
Pragmatic Embodied Spoken Instruction Following in Human-Robot Collaboration with Theory of Mind
di: Ying, Lance, et al.
Pubblicazione: (2024)
di: Ying, Lance, et al.
Pubblicazione: (2024)
Memory-QA: Answering Recall Questions Based on Multimodal Memories
di: Jiang, Hongda, et al.
Pubblicazione: (2025)
di: Jiang, Hongda, et al.
Pubblicazione: (2025)
VeriSciQA: An Auto-Verified Dataset for Scientific Visual Question Answering
di: Li, Yuyi, et al.
Pubblicazione: (2025)
di: Li, Yuyi, et al.
Pubblicazione: (2025)
AutoToM: Scaling Model-based Mental Inference via Automated Agent Modeling
di: Zhang, Zhining, et al.
Pubblicazione: (2025)
di: Zhang, Zhining, et al.
Pubblicazione: (2025)
DashboardQA: Benchmarking Multimodal Agents for Question Answering on Interactive Dashboards
di: Kartha, Aaryaman, et al.
Pubblicazione: (2025)
di: Kartha, Aaryaman, et al.
Pubblicazione: (2025)
Grounding Language about Belief in a Bayesian Theory-of-Mind
di: Ying, Lance, et al.
Pubblicazione: (2024)
di: Ying, Lance, et al.
Pubblicazione: (2024)
NeoQA: Evidence-based Question Answering with Generated News Events
di: Glockner, Max, et al.
Pubblicazione: (2025)
di: Glockner, Max, et al.
Pubblicazione: (2025)
PolQA: Polish Question Answering Dataset
di: Rybak, Piotr, et al.
Pubblicazione: (2022)
di: Rybak, Piotr, et al.
Pubblicazione: (2022)
ASTRA-QA: A Benchmark for Abstract Question Answering over Documents
di: Wang, Shu, et al.
Pubblicazione: (2026)
di: Wang, Shu, et al.
Pubblicazione: (2026)
Relations, Negations, and Numbers: Looking for Logic in Generative Text-to-Image Models
di: Conwell, Colin, et al.
Pubblicazione: (2024)
di: Conwell, Colin, et al.
Pubblicazione: (2024)
Understanding Epistemic Language with a Language-augmented Bayesian Theory of Mind
di: Ying, Lance, et al.
Pubblicazione: (2024)
di: Ying, Lance, et al.
Pubblicazione: (2024)
Answering Questions in Stages: Prompt Chaining for Contract QA
di: Roegiest, Adam, et al.
Pubblicazione: (2024)
di: Roegiest, Adam, et al.
Pubblicazione: (2024)
Building Cooperative Embodied Agents Modularly with Large Language Models
di: Zhang, Hongxin, et al.
Pubblicazione: (2023)
di: Zhang, Hongxin, et al.
Pubblicazione: (2023)
Shades of Zero: Distinguishing Impossibility from Inconceivability
di: Hu, Jennifer, et al.
Pubblicazione: (2025)
di: Hu, Jennifer, et al.
Pubblicazione: (2025)
InfoChartQA: A Benchmark for Multimodal Question Answering on Infographic Charts
di: Xie, Tianchi, et al.
Pubblicazione: (2025)
di: Xie, Tianchi, et al.
Pubblicazione: (2025)
DebateQA: Evaluating Question Answering on Debatable Knowledge
di: Xu, Rongwu, et al.
Pubblicazione: (2024)
di: Xu, Rongwu, et al.
Pubblicazione: (2024)
RetrievalQA: Assessing Adaptive Retrieval-Augmented Generation for Short-form Open-Domain Question Answering
di: Zhang, Zihan, et al.
Pubblicazione: (2024)
di: Zhang, Zihan, et al.
Pubblicazione: (2024)
RoadscapesQA: A Multitask, Multimodal Dataset for Visual Question Answering on Indian Roads
di: Iyer, Vijayasri, et al.
Pubblicazione: (2026)
di: Iyer, Vijayasri, et al.
Pubblicazione: (2026)
MovieRecapsQA: A Multimodal Open-Ended Video Question-Answering Benchmark
di: Shaar, Shaden, et al.
Pubblicazione: (2026)
di: Shaar, Shaden, et al.
Pubblicazione: (2026)
MM-PhyQA: Multimodal Physics Question-Answering With Multi-Image CoT Prompting
di: Anand, Avinash, et al.
Pubblicazione: (2024)
di: Anand, Avinash, et al.
Pubblicazione: (2024)
VoQA: Visual-only Question Answering
di: An, Jianing, et al.
Pubblicazione: (2025)
di: An, Jianing, et al.
Pubblicazione: (2025)
SyllabusQA: A Course Logistics Question Answering Dataset
di: Fernandez, Nigel, et al.
Pubblicazione: (2024)
di: Fernandez, Nigel, et al.
Pubblicazione: (2024)
Minding the Politeness Gap in Cross-cultural Communication
di: Machino, Yuka, et al.
Pubblicazione: (2025)
di: Machino, Yuka, et al.
Pubblicazione: (2025)
FoQA: A Faroese Question-Answering Dataset
di: Simonsen, Annika, et al.
Pubblicazione: (2025)
di: Simonsen, Annika, et al.
Pubblicazione: (2025)
WikiMixQA: A Multimodal Benchmark for Question Answering over Tables and Charts
di: Foroutan, Negar, et al.
Pubblicazione: (2025)
di: Foroutan, Negar, et al.
Pubblicazione: (2025)
M2QA: Multi-domain Multilingual Question Answering
di: Engländer, Leon, et al.
Pubblicazione: (2024)
di: Engländer, Leon, et al.
Pubblicazione: (2024)
GRS-QA -- Graph Reasoning-Structured Question Answering Dataset
di: Pahilajani, Anish, et al.
Pubblicazione: (2024)
di: Pahilajani, Anish, et al.
Pubblicazione: (2024)
CT2C-QA: Multimodal Question Answering over Chinese Text, Table and Chart
di: Zhao, Bowen, et al.
Pubblicazione: (2024)
di: Zhao, Bowen, et al.
Pubblicazione: (2024)
One fish, two fish, but not the whole sea: Alignment reduces language models' conceptual diversity
di: Murthy, Sonia K., et al.
Pubblicazione: (2024)
di: Murthy, Sonia K., et al.
Pubblicazione: (2024)
Grounding Social Perception in Intuitive Physics
di: Ying, Lance, et al.
Pubblicazione: (2026)
di: Ying, Lance, et al.
Pubblicazione: (2026)
Question-Answering (QA) Model for a Personalized Learning Assistant for Arabic Language
di: Sammoudi, Mohammad, et al.
Pubblicazione: (2024)
di: Sammoudi, Mohammad, et al.
Pubblicazione: (2024)
UnSeenTimeQA: Time-Sensitive Question-Answering Beyond LLMs' Memorization
di: Uddin, Md Nayem, et al.
Pubblicazione: (2024)
di: Uddin, Md Nayem, et al.
Pubblicazione: (2024)
UTSA-NLP at ArchEHR-QA 2025: Improving EHR Question Answering via Self-Consistency Prompting
di: Shields-Menard, Sara, et al.
Pubblicazione: (2025)
di: Shields-Menard, Sara, et al.
Pubblicazione: (2025)
AIM: Asymmetric Information Masking for Visual Question Answering Continual Learning
di: Zhang, Peifeng, et al.
Pubblicazione: (2026)
di: Zhang, Peifeng, et al.
Pubblicazione: (2026)
Hypothesis-Driven Theory-of-Mind Reasoning for Large Language Models
di: Kim, Hyunwoo, et al.
Pubblicazione: (2025)
di: Kim, Hyunwoo, et al.
Pubblicazione: (2025)
LingoQA: Visual Question Answering for Autonomous Driving
di: Marcu, Ana-Maria, et al.
Pubblicazione: (2023)
di: Marcu, Ana-Maria, et al.
Pubblicazione: (2023)
Documenti analoghi
-
MuMA-ToM: Multi-modal Multi-Agent Theory of Mind
di: Shi, Haojun, et al.
Pubblicazione: (2024) -
GOMA: Proactive Embodied Cooperative Communication via Goal-Oriented Mental Alignment
di: Ying, Lance, et al.
Pubblicazione: (2024) -
Re-evaluating Theory of Mind evaluation in large language models
di: Hu, Jennifer, et al.
Pubblicazione: (2025) -
The Illusion-Illusion: Vision Language Models See Illusions Where There are None
di: Ullman, Tomer
Pubblicazione: (2024) -
Pragmatic Embodied Spoken Instruction Following in Human-Robot Collaboration with Theory of Mind
di: Ying, Lance, et al.
Pubblicazione: (2024)