Smart Vision-Language Reasoners
Fuente:
arXiv
Saved in:
| Main Authors: | Roberts, Denisa, Roberts, Lucas |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Which Programming Language and Model Work Best With LLM-as-a-Judge For Code Retrieval?
by: Roberts, Lucas, et al.
Published: (2025)
by: Roberts, Lucas, et al.
Published: (2025)
Gender-Neutral Large Language Models for Medical Applications: Reducing Bias in PubMed Abstracts
by: Schaefer, Elizabeth, et al.
Published: (2025)
by: Schaefer, Elizabeth, et al.
Published: (2025)
Human-Alignment and Calibration of Inference-Time Uncertainty in Large Language Models
by: Moore, Kyle, et al.
Published: (2025)
by: Moore, Kyle, et al.
Published: (2025)
Image2Struct: Benchmarking Structure Extraction for Vision-Language Models
by: Roberts, Josselin Somerville, et al.
Published: (2024)
by: Roberts, Josselin Somerville, et al.
Published: (2024)
Exploitation Is All You Need... for Exploration
by: Rentschler, Micah, et al.
Published: (2025)
by: Rentschler, Micah, et al.
Published: (2025)
RL + Transformer = A General-Purpose Problem Solver
by: Rentschler, Micah, et al.
Published: (2025)
by: Rentschler, Micah, et al.
Published: (2025)
From Values to Frameworks: A Qualitative Study of Ethical Reasoning in Agentic AI Practitioners
by: Roberts, Theodore, et al.
Published: (2025)
by: Roberts, Theodore, et al.
Published: (2025)
Integrating Natural Language Processing Techniques of Text Mining Into Financial System: Applications and Limitations
by: Millo, Denisa, et al.
Published: (2024)
by: Millo, Denisa, et al.
Published: (2024)
Do Large Language Models Learn Human-Like Strategic Preferences?
by: Roberts, Jesse, et al.
Published: (2024)
by: Roberts, Jesse, et al.
Published: (2024)
Helios: A Foundational Language Model for Smart Energy Knowledge Reasoning and Application
by: Jiang, Haoyu, et al.
Published: (2025)
by: Jiang, Haoyu, et al.
Published: (2025)
Procedural Knowledge Improves Agentic LLM Workflows
by: Hsiao, Vincent, et al.
Published: (2025)
by: Hsiao, Vincent, et al.
Published: (2025)
Graph-to-Vision: Multi-graph Understanding and Reasoning using Vision-Language Models
by: Ai, Qihang, et al.
Published: (2025)
by: Ai, Qihang, et al.
Published: (2025)
Human-Centric Goal Reasoning with Ripple-Down Rules
by: Brameld, Kenji, et al.
Published: (2024)
by: Brameld, Kenji, et al.
Published: (2024)
Planning with Reasoning using Vision Language World Model
by: Chen, Delong, et al.
Published: (2025)
by: Chen, Delong, et al.
Published: (2025)
Compute Optimal Scaling of Skills: Knowledge vs Reasoning
by: Roberts, Nicholas, et al.
Published: (2025)
by: Roberts, Nicholas, et al.
Published: (2025)
LLMs as Agentic Cooperative Players in Multiplayer UNO
by: Matinez, Yago Romano, et al.
Published: (2025)
by: Matinez, Yago Romano, et al.
Published: (2025)
Can Large Language Models Make the Grade? An Empirical Study Evaluating LLMs Ability to Mark Short Answer Questions in K-12 Education
by: Henkel, Owen, et al.
Published: (2024)
by: Henkel, Owen, et al.
Published: (2024)
Landmark-Assisted Monte Carlo Planning
by: Chan, David H., et al.
Published: (2025)
by: Chan, David H., et al.
Published: (2025)
Vision Language Models Cannot Reason About Physical Transformation
by: Luo, Dezhi, et al.
Published: (2026)
by: Luo, Dezhi, et al.
Published: (2026)
Unveiling the Compositional Ability Gap in Vision-Language Reasoning Model
by: Li, Tianle, et al.
Published: (2025)
by: Li, Tianle, et al.
Published: (2025)
Visual Distraction Undermines Moral Reasoning in Vision-Language Models
by: Yang, Xinyi, et al.
Published: (2026)
by: Yang, Xinyi, et al.
Published: (2026)
Large Language Model Recall Uncertainty is Modulated by the Fan Effect
by: Roberts, Jesse, et al.
Published: (2024)
by: Roberts, Jesse, et al.
Published: (2024)
Continuous Reasoning for Vision-Language-Action
by: Wu, Yueh-Hua, et al.
Published: (2026)
by: Wu, Yueh-Hua, et al.
Published: (2026)
Projected Task-Specific Layers for Multi-Task Reinforcement Learning
by: Roberts, Josselin Somerville, et al.
Published: (2023)
by: Roberts, Josselin Somerville, et al.
Published: (2023)
Generalized invariants meet constitutive neural networks: A novel framework for hyperelastic materials
by: Martonová, Denisa, et al.
Published: (2025)
by: Martonová, Denisa, et al.
Published: (2025)
MindOmni: Unleashing Reasoning Generation in Vision Language Models with RGPO
by: Xiao, Yicheng, et al.
Published: (2025)
by: Xiao, Yicheng, et al.
Published: (2025)
Scaling, Benchmarking, and Reasoning of Vision-Language Agents for Mobile GUI Navigation
by: Qu, Heng, et al.
Published: (2026)
by: Qu, Heng, et al.
Published: (2026)
Jigsaw-Puzzles: From Seeing to Understanding to Reasoning in Vision-Language Models
by: Lyu, Zesen, et al.
Published: (2025)
by: Lyu, Zesen, et al.
Published: (2025)
VHELM: A Holistic Evaluation of Vision Language Models
by: Lee, Tony, et al.
Published: (2024)
by: Lee, Tony, et al.
Published: (2024)
Zero-shot Object Navigation with Vision-Language Models Reasoning
by: Wen, Congcong, et al.
Published: (2024)
by: Wen, Congcong, et al.
Published: (2024)
Commonsense Reasoning for Legged Robot Adaptation with Vision-Language Models
by: Chen, Annie S., et al.
Published: (2024)
by: Chen, Annie S., et al.
Published: (2024)
Probing Mechanical Reasoning in Large Vision Language Models
by: Sun, Haoran, et al.
Published: (2024)
by: Sun, Haoran, et al.
Published: (2024)
Diagnosing Causal Reasoning in Vision-Language Models via Structured Relevance Graphs
by: Pratama, Dhita Putri, et al.
Published: (2026)
by: Pratama, Dhita Putri, et al.
Published: (2026)
Tiny but Trusted: Efficient Vision-Language Reasoning for Time-Series Anomaly Detection
by: Zhou, Xiaona, et al.
Published: (2026)
by: Zhou, Xiaona, et al.
Published: (2026)
TangramSR: Can Vision-Language Models Reason in Continuous Geometric Space?
by: Zong, Yikun, et al.
Published: (2026)
by: Zong, Yikun, et al.
Published: (2026)
Pseudocode-Guided Structured Reasoning for Automating Reliable Inference in Vision-Language Models
by: Ni, Weicong, et al.
Published: (2026)
by: Ni, Weicong, et al.
Published: (2026)
TRACE: A Framework for Analyzing and Enhancing Stepwise Reasoning in Vision-Language Models
by: Imani, Shima, et al.
Published: (2025)
by: Imani, Shima, et al.
Published: (2025)
Machine Learning Techniques with Fairness for Prediction of Completion of Drug and Alcohol Rehabilitation
by: Roberts-Licklider, Karen, et al.
Published: (2024)
by: Roberts-Licklider, Karen, et al.
Published: (2024)
A Smart Multimodal Healthcare Copilot with Powerful LLM Reasoning
by: Zhao, Xuejiao, et al.
Published: (2025)
by: Zhao, Xuejiao, et al.
Published: (2025)
From Perception to Cognition: A Survey of Vision-Language Interactive Reasoning in Multimodal Large Language Models
by: Zhou, Chenyue, et al.
Published: (2025)
by: Zhou, Chenyue, et al.
Published: (2025)
Similar Items
-
Which Programming Language and Model Work Best With LLM-as-a-Judge For Code Retrieval?
by: Roberts, Lucas, et al.
Published: (2025) -
Gender-Neutral Large Language Models for Medical Applications: Reducing Bias in PubMed Abstracts
by: Schaefer, Elizabeth, et al.
Published: (2025) -
Human-Alignment and Calibration of Inference-Time Uncertainty in Large Language Models
by: Moore, Kyle, et al.
Published: (2025) -
Image2Struct: Benchmarking Structure Extraction for Vision-Language Models
by: Roberts, Josselin Somerville, et al.
Published: (2024) -
Exploitation Is All You Need... for Exploration
by: Rentschler, Micah, et al.
Published: (2025)