World Models in Words: Auditing Physical State-Transition Commitments in Vision-Language Models
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Bourigault, Emmanuelle |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
FrEVL: Leveraging Frozen Pretrained Embeddings for Efficient Vision-Language Understanding
par: Bourigault, Emmanuelle, et autres
Publié: (2025)
par: Bourigault, Emmanuelle, et autres
Publié: (2025)
MVDiff: Scalable and Flexible Multi-View Diffusion for 3D Object Reconstruction from Single-View
par: Bourigault, Emmanuelle, et autres
Publié: (2024)
par: Bourigault, Emmanuelle, et autres
Publié: (2024)
Commitment Checklist: Auditing Author Commitments in Peer Review
par: Chen, Chung-Chi, et autres
Publié: (2026)
par: Chen, Chung-Chi, et autres
Publié: (2026)
From Word to World: Can Large Language Models be Implicit Text-based World Models?
par: Li, Yixia, et autres
Publié: (2025)
par: Li, Yixia, et autres
Publié: (2025)
Distilling Bayesian Belief States into Language Models for Auditable Negotiation
par: Cui, Zongqi, et autres
Publié: (2026)
par: Cui, Zongqi, et autres
Publié: (2026)
World-to-Words: Grounded Open Vocabulary Acquisition through Fast Mapping in Vision-Language Models
par: Ma, Ziqiao, et autres
Publié: (2023)
par: Ma, Ziqiao, et autres
Publié: (2023)
Word2World: Generating Stories and Worlds through Large Language Models
par: Nasir, Muhammad U., et autres
Publié: (2024)
par: Nasir, Muhammad U., et autres
Publié: (2024)
X-Diffusion: Generating Detailed 3D MRI Volumes From a Single Image Using Cross-Sectional Diffusion Models
par: Bourigault, Emmanuelle, et autres
Publié: (2024)
par: Bourigault, Emmanuelle, et autres
Publié: (2024)
AuditWen:An Open-Source Large Language Model for Audit
par: Huang, Jiajia, et autres
Publié: (2024)
par: Huang, Jiajia, et autres
Publié: (2024)
Do Language Models' Words Refer?
par: Mandelkern, Matthew, et autres
Publié: (2023)
par: Mandelkern, Matthew, et autres
Publié: (2023)
Deferred Commitment Decoding for Diffusion Language Models
par: Shu, Yingte, et autres
Publié: (2026)
par: Shu, Yingte, et autres
Publié: (2026)
Pay Less Attention to Function Words for Free Robustness of Vision-Language Models
par: Tian, Qiwei, et autres
Publié: (2025)
par: Tian, Qiwei, et autres
Publié: (2025)
Statistical Hypothesis Testing for Auditing Robustness in Language Models
par: Rauba, Paulius, et autres
Publié: (2025)
par: Rauba, Paulius, et autres
Publié: (2025)
Word Definitions from Large Language Models
par: Pham, Bach, et autres
Publié: (2023)
par: Pham, Bach, et autres
Publié: (2023)
Words or Vision: Do Vision-Language Models Have Blind Faith in Text?
par: Deng, Ailin, et autres
Publié: (2025)
par: Deng, Ailin, et autres
Publié: (2025)
Risk-Controlled Lean-as-Judge for Natural-Language Mathematical Reasoning
par: Bourigault, Pauline, et autres
Publié: (2026)
par: Bourigault, Pauline, et autres
Publié: (2026)
Automated Benchmark Auditing for AI Agents and Large Language Models
par: Wang, Junlin, et autres
Publié: (2026)
par: Wang, Junlin, et autres
Publié: (2026)
VLMs Need Words: Vision Language Models Ignore Visual Detail In Favor of Semantic Anchors
par: Shahgir, Haz Sameen, et autres
Publié: (2026)
par: Shahgir, Haz Sameen, et autres
Publié: (2026)
Word Meanings in Transformer Language Models
par: Grindrod, Jumbly, et autres
Publié: (2025)
par: Grindrod, Jumbly, et autres
Publié: (2025)
Auditing the Use of Language Models to Guide Hiring Decisions
par: Gaebler, Johann D., et autres
Publié: (2024)
par: Gaebler, Johann D., et autres
Publié: (2024)
UKBOB: One Billion MRI Labeled Masks for Generalizable 3D Medical Image Segmentation
par: Bourigault, Emmanuelle, et autres
Publié: (2025)
par: Bourigault, Emmanuelle, et autres
Publié: (2025)
Non-literal Understanding of Number Words by Language Models
par: Tsvilodub, Polina, et autres
Publié: (2025)
par: Tsvilodub, Polina, et autres
Publié: (2025)
3D Spine Shape Estimation from Single 2D DXA
par: Bourigault, Emmanuelle, et autres
Publié: (2024)
par: Bourigault, Emmanuelle, et autres
Publié: (2024)
Automating Evaluation of Diffusion Model Unlearning with (Vision-) Language Model World Knowledge
par: Yeats, Eric, et autres
Publié: (2025)
par: Yeats, Eric, et autres
Publié: (2025)
Word Synchronization Challenge: A Benchmark for Word Association Responses for Large Language Models
par: Cazalets, Tanguy, et autres
Publié: (2025)
par: Cazalets, Tanguy, et autres
Publié: (2025)
Simulating Task-Oriented Dialogues with State Transition Graphs and Large Language Models
par: Samarinas, Chris, et autres
Publié: (2024)
par: Samarinas, Chris, et autres
Publié: (2024)
A Multi-Dimensional Audit of Politically Aligned Large Language Models
par: Korver, Lisa, et autres
Publié: (2026)
par: Korver, Lisa, et autres
Publié: (2026)
Keeping Up with the Language Models: Systematic Benchmark Extension for Bias Auditing
par: Baldini, Ioana, et autres
Publié: (2023)
par: Baldini, Ioana, et autres
Publié: (2023)
CALM: Curiosity-Driven Auditing for Large Language Models
par: Zheng, Xiang, et autres
Publié: (2025)
par: Zheng, Xiang, et autres
Publié: (2025)
Word Boundary Information Isn't Useful for Encoder Language Models
par: Gow-Smith, Edward, et autres
Publié: (2024)
par: Gow-Smith, Edward, et autres
Publié: (2024)
Large Language Models Lack Understanding of Character Composition of Words
par: Shin, Andrew, et autres
Publié: (2024)
par: Shin, Andrew, et autres
Publié: (2024)
To Word Senses and Beyond: Inducing Concepts with Contextualized Language Models
par: Liétard, Bastien, et autres
Publié: (2024)
par: Liétard, Bastien, et autres
Publié: (2024)
AuditBench: Evaluating Alignment Auditing Techniques on Models with Hidden Behaviors
par: Sheshadri, Abhay, et autres
Publié: (2026)
par: Sheshadri, Abhay, et autres
Publié: (2026)
Words That Make Language Models Perceive
par: Wang, Sophie L., et autres
Publié: (2025)
par: Wang, Sophie L., et autres
Publié: (2025)
PhysBench: Benchmarking and Enhancing Vision-Language Models for Physical World Understanding
par: Chow, Wei, et autres
Publié: (2025)
par: Chow, Wei, et autres
Publié: (2025)
The Point of No Return: Counterfactual Localization of Deceptive Commitment in Language-Model Reasoning
par: Merrill, Scott, et autres
Publié: (2026)
par: Merrill, Scott, et autres
Publié: (2026)
Open World Scene Graph Generation using Vision Language Models
par: Dutta, Amartya, et autres
Publié: (2025)
par: Dutta, Amartya, et autres
Publié: (2025)
When Does a Language Model Commit? A Finite-Answer Theory of Pre-Verbalization Commitment
par: Zhang, Long, et autres
Publié: (2026)
par: Zhang, Long, et autres
Publié: (2026)
Reasoning as State Transition: A Representational Analysis of Reasoning Evolution in Large Language Models
par: Zhang, Siyuan, et autres
Publié: (2026)
par: Zhang, Siyuan, et autres
Publié: (2026)
PRISM: A Methodology for Auditing Biases in Large Language Models
par: Azzopardi, Leif, et autres
Publié: (2024)
par: Azzopardi, Leif, et autres
Publié: (2024)
Documents similaires
-
FrEVL: Leveraging Frozen Pretrained Embeddings for Efficient Vision-Language Understanding
par: Bourigault, Emmanuelle, et autres
Publié: (2025) -
MVDiff: Scalable and Flexible Multi-View Diffusion for 3D Object Reconstruction from Single-View
par: Bourigault, Emmanuelle, et autres
Publié: (2024) -
Commitment Checklist: Auditing Author Commitments in Peer Review
par: Chen, Chung-Chi, et autres
Publié: (2026) -
From Word to World: Can Large Language Models be Implicit Text-based World Models?
par: Li, Yixia, et autres
Publié: (2025) -
Distilling Bayesian Belief States into Language Models for Auditable Negotiation
par: Cui, Zongqi, et autres
Publié: (2026)