What's in the Box? Reasoning about Unseen Objects from Multimodal Cues
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ying, Lance, Xu, Daniel, Zhang, Alicia, Collins, Katherine M., Siegel, Max H., Tenenbaum, Joshua B. |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Reasoning about the Unseen for Efficient Outdoor Object Navigation
par: Xie, Quanting, et autres
Publié: (2023)
par: Xie, Quanting, et autres
Publié: (2023)
Grounding Language about Belief in a Bayesian Theory-of-Mind
par: Ying, Lance, et autres
Publié: (2024)
par: Ying, Lance, et autres
Publié: (2024)
Language-Informed Synthesis of Rational Agent Models for Grounded Theory-of-Mind Reasoning On-The-Fly
par: Ying, Lance, et autres
Publié: (2025)
par: Ying, Lance, et autres
Publié: (2025)
People use fast, goal-directed simulation to reason about novel games
par: Zhang, Cedegao E., et autres
Publié: (2024)
par: Zhang, Cedegao E., et autres
Publié: (2024)
On Benchmarking Human-Like Intelligence in Machines
par: Ying, Lance, et autres
Publié: (2025)
par: Ying, Lance, et autres
Publié: (2025)
Pragmatic Instruction Following and Goal Assistance via Cooperative Language-Guided Inverse Planning
par: Zhi-Xuan, Tan, et autres
Publié: (2024)
par: Zhi-Xuan, Tan, et autres
Publié: (2024)
Understanding Epistemic Language with a Language-augmented Bayesian Theory of Mind
par: Ying, Lance, et autres
Publié: (2024)
par: Ying, Lance, et autres
Publié: (2024)
Hypothesis-Driven Theory-of-Mind Reasoning for Large Language Models
par: Kim, Hyunwoo, et autres
Publié: (2025)
par: Kim, Hyunwoo, et autres
Publié: (2025)
Learning Iterative Reasoning through Energy Diffusion
par: Du, Yilun, et autres
Publié: (2024)
par: Du, Yilun, et autres
Publié: (2024)
Empathy in Explanation
par: Collins, Katherine M., et autres
Publié: (2025)
par: Collins, Katherine M., et autres
Publié: (2025)
GOMA: Proactive Embodied Cooperative Communication via Goal-Oriented Mental Alignment
par: Ying, Lance, et autres
Publié: (2024)
par: Ying, Lance, et autres
Publié: (2024)
AI Gamestore: Scalable, Open-Ended Evaluation of Machine General Intelligence with Human Games
par: Ying, Lance, et autres
Publié: (2026)
par: Ying, Lance, et autres
Publié: (2026)
Evaluating Language Models' Evaluations of Games
par: Collins, Katherine M., et autres
Publié: (2025)
par: Collins, Katherine M., et autres
Publié: (2025)
People use fast, flat goal-directed simulation to reason about novel problems
par: Collins, Katherine M., et autres
Publié: (2025)
par: Collins, Katherine M., et autres
Publié: (2025)
Modeling Open-World Cognition as On-Demand Synthesis of Probabilistic Models
par: Wong, Lionel, et autres
Publié: (2025)
par: Wong, Lionel, et autres
Publié: (2025)
Grounding Social Perception in Intuitive Physics
par: Ying, Lance, et autres
Publié: (2026)
par: Ying, Lance, et autres
Publié: (2026)
"Just in Time" World Modeling Supports Human Planning and Reasoning
par: Chen, Tony, et autres
Publié: (2026)
par: Chen, Tony, et autres
Publié: (2026)
What Planning Problems Can A Relational Neural Network Solve?
par: Mao, Jiayuan, et autres
Publié: (2023)
par: Mao, Jiayuan, et autres
Publié: (2023)
Medical Model Synthesis Architectures: A Case Study
par: Collins, Katherine M., et autres
Publié: (2026)
par: Collins, Katherine M., et autres
Publié: (2026)
GThinker: Towards General Multimodal Reasoning via Cue-Guided Rethinking
par: Zhan, Yufei, et autres
Publié: (2025)
par: Zhan, Yufei, et autres
Publié: (2025)
Cue Point Estimation using Object Detection
par: Argüello, Giulia, et autres
Publié: (2024)
par: Argüello, Giulia, et autres
Publié: (2024)
BoxTuning: Directly Injecting the Object Box for Multimodal Model Fine-Tuning
par: Qian, Zekun, et autres
Publié: (2026)
par: Qian, Zekun, et autres
Publié: (2026)
Prompting the Unseen: Detecting Hidden Backdoors in Black-Box Models
par: Huang, Zi-Xuan, et autres
Publié: (2024)
par: Huang, Zi-Xuan, et autres
Publié: (2024)
To See the Unseen: on the Generalization Ability of Transformers in Symbolic Reasoning
par: Lazić, Nevena, et autres
Publié: (2026)
par: Lazić, Nevena, et autres
Publié: (2026)
Sycophantic Chatbots Cause Delusional Spiraling, Even in Ideal Bayesians
par: Chandra, Kartik, et autres
Publié: (2026)
par: Chandra, Kartik, et autres
Publié: (2026)
Assessing Adaptive World Models in Machines with Novel Games
par: Ying, Lance, et autres
Publié: (2025)
par: Ying, Lance, et autres
Publié: (2025)
STAR: A Benchmark for Situated Reasoning in Real-World Videos
par: Wu, Bo, et autres
Publié: (2024)
par: Wu, Bo, et autres
Publié: (2024)
Multiagent Finetuning: Self Improvement with Diverse Reasoning Chains
par: Subramaniam, Vighnesh, et autres
Publié: (2025)
par: Subramaniam, Vighnesh, et autres
Publié: (2025)
ViLBias: Detecting and Reasoning about Bias in Multimodal Content
par: Raza, Shaina, et autres
Publié: (2024)
par: Raza, Shaina, et autres
Publié: (2024)
Infinite Ends from Finite Samples: Open-Ended Goal Inference as Top-Down Bayesian Filtering of Bottom-Up Proposals
par: Zhi-Xuan, Tan, et autres
Publié: (2024)
par: Zhi-Xuan, Tan, et autres
Publié: (2024)
Shoot First, Ask Questions Later? Building Rational Agents that Explore and Act Like People
par: Grand, Gabriel, et autres
Publié: (2025)
par: Grand, Gabriel, et autres
Publié: (2025)
Loose LIPS Sink Ships: Asking Questions in Battleship with Language-Informed Program Sampling
par: Grand, Gabriel, et autres
Publié: (2024)
par: Grand, Gabriel, et autres
Publié: (2024)
Synthesizing world models for bilevel planning
par: Ahmed, Zergham, et autres
Publié: (2025)
par: Ahmed, Zergham, et autres
Publié: (2025)
What Makes a Maze Look Like a Maze?
par: Hsu, Joy, et autres
Publié: (2024)
par: Hsu, Joy, et autres
Publié: (2024)
What Matters in Data Curation for Multimodal Reasoning? Insights from the DCVLR Challenge
par: Shin, Yosub, et autres
Publié: (2026)
par: Shin, Yosub, et autres
Publié: (2026)
Benchmarking LLMs' Mathematical Reasoning with Unseen Random Variables Questions
par: Hong, Zijin, et autres
Publié: (2025)
par: Hong, Zijin, et autres
Publié: (2025)
Behavior Cue Reasoning: Monitorable Reasoning Improves Efficiency and Safety through Oversight
par: Cui, Christopher Z., et autres
Publié: (2026)
par: Cui, Christopher Z., et autres
Publié: (2026)
XEmoGPT: An Explainable Multimodal Emotion Recognition Framework with Cue-Level Perception and Reasoning
par: Zhang, Hanwen, et autres
Publié: (2026)
par: Zhang, Hanwen, et autres
Publié: (2026)
Simulating the Unseen: Crash Prediction Must Learn from What Did Not Happen
par: Li, Zihao, et autres
Publié: (2025)
par: Li, Zihao, et autres
Publié: (2025)
CORN: Contact-based Object Representation for Nonprehensile Manipulation of General Unseen Objects
par: Cho, Yoonyoung, et autres
Publié: (2024)
par: Cho, Yoonyoung, et autres
Publié: (2024)
Documents similaires
-
Reasoning about the Unseen for Efficient Outdoor Object Navigation
par: Xie, Quanting, et autres
Publié: (2023) -
Grounding Language about Belief in a Bayesian Theory-of-Mind
par: Ying, Lance, et autres
Publié: (2024) -
Language-Informed Synthesis of Rational Agent Models for Grounded Theory-of-Mind Reasoning On-The-Fly
par: Ying, Lance, et autres
Publié: (2025) -
People use fast, goal-directed simulation to reason about novel games
par: Zhang, Cedegao E., et autres
Publié: (2024) -
On Benchmarking Human-Like Intelligence in Machines
par: Ying, Lance, et autres
Publié: (2025)