Salvato in:
| Autori principali: | Yang, Xinyi, Xu, Chenheng, Hong, Weijun, Mo, Ce, Wang, Qian, Fang, Fang, Zhu, Yixin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2603.16445 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Distracted Robot: How Visual Clutter Undermine Robotic Manipulation
di: Rasouli, Amir, et al.
Pubblicazione: (2025)
di: Rasouli, Amir, et al.
Pubblicazione: (2025)
DistractMIA: Black-Box Membership Inference on Vision-Language Models via Semantic Distraction
di: Tang, Hongyi, et al.
Pubblicazione: (2026)
di: Tang, Hongyi, et al.
Pubblicazione: (2026)
Autoregressive Models Rival Diffusion Models at ANY-ORDER Generation
di: Du, Tianqi, et al.
Pubblicazione: (2026)
di: Du, Tianqi, et al.
Pubblicazione: (2026)
Losing Visual Needles in Image Haystacks: Vision Language Models are Easily Distracted in Short and Long Contexts
di: Sharma, Aditya, et al.
Pubblicazione: (2024)
di: Sharma, Aditya, et al.
Pubblicazione: (2024)
Structured Visual Narratives Undermine Safety Alignment in Multimodal Large Language Models
di: Tan, Rui Yang, et al.
Pubblicazione: (2026)
di: Tan, Rui Yang, et al.
Pubblicazione: (2026)
Code over Words: Overcoming Semantic Inertia via Code-Grounded Reasoning
di: Xu, Manjie, et al.
Pubblicazione: (2026)
di: Xu, Manjie, et al.
Pubblicazione: (2026)
SSL4RL: Revisiting Self-supervised Learning as Intrinsic Reward for Visual-Language Reasoning
di: Guo, Xiaojun, et al.
Pubblicazione: (2025)
di: Guo, Xiaojun, et al.
Pubblicazione: (2025)
Seirênes: Adversarial Self-Play with Evolving Distractions for LLM Reasoning
di: Zhang, Chi, et al.
Pubblicazione: (2026)
di: Zhang, Chi, et al.
Pubblicazione: (2026)
Improving Model Representation and Reducing KV Cache via Skip Connections with First Value Heads
di: Wu, Zhoutong, et al.
Pubblicazione: (2025)
di: Wu, Zhoutong, et al.
Pubblicazione: (2025)
Moral Sycophancy in Vision Language Models
di: Rabby, Shadman, et al.
Pubblicazione: (2026)
di: Rabby, Shadman, et al.
Pubblicazione: (2026)
Seeing Through Experts Eyes A Foundational Vision Language Model Trained on Radiologists Gaze and Reasoning
di: Lee, Kinhei, et al.
Pubblicazione: (2026)
di: Lee, Kinhei, et al.
Pubblicazione: (2026)
Distract Large Language Models for Automatic Jailbreak Attack
di: Xiao, Zeguan, et al.
Pubblicazione: (2024)
di: Xiao, Zeguan, et al.
Pubblicazione: (2024)
Rethinking and Benchmarking Large Language Models for Graph Reasoning
di: Hu, Yuwei, et al.
Pubblicazione: (2025)
di: Hu, Yuwei, et al.
Pubblicazione: (2025)
JT-DA: Enhancing Data Analysis with Tool-Integrated Table Reasoning Large Language Models
di: Chi, Ce, et al.
Pubblicazione: (2025)
di: Chi, Ce, et al.
Pubblicazione: (2025)
Zero-shot Object Navigation with Vision-Language Models Reasoning
di: Wen, Congcong, et al.
Pubblicazione: (2024)
di: Wen, Congcong, et al.
Pubblicazione: (2024)
Bring My Cup! Personalizing Vision-Language-Action Models with Visual Attentive Prompting
di: Lee, Sangoh, et al.
Pubblicazione: (2025)
di: Lee, Sangoh, et al.
Pubblicazione: (2025)
ChemVTS-Bench: Evaluating Visual-Textual-Symbolic Reasoning of Multimodal Large Language Models in Chemistry
di: Huang, Zhiyuan, et al.
Pubblicazione: (2025)
di: Huang, Zhiyuan, et al.
Pubblicazione: (2025)
Reason-RFT: Reinforcement Fine-Tuning for Visual Reasoning of Vision Language Models
di: Tan, Huajie, et al.
Pubblicazione: (2025)
di: Tan, Huajie, et al.
Pubblicazione: (2025)
Imagine in Space: Exploring the Frontier of Spatial Intelligence and Reasoning Efficiency in Vision Language Models
di: Lian, Xiaoxing, et al.
Pubblicazione: (2025)
di: Lian, Xiaoxing, et al.
Pubblicazione: (2025)
TReB: A Comprehensive Benchmark for Evaluating Table Reasoning Capabilities of Large Language Models
di: Li, Ce, et al.
Pubblicazione: (2025)
di: Li, Ce, et al.
Pubblicazione: (2025)
Natural Context Drift Undermines the Natural Language Understanding of Large Language Models
di: Wu, Yulong, et al.
Pubblicazione: (2025)
di: Wu, Yulong, et al.
Pubblicazione: (2025)
Scene-LLM: Extending Language Model for 3D Visual Understanding and Reasoning
di: Fu, Rao, et al.
Pubblicazione: (2024)
di: Fu, Rao, et al.
Pubblicazione: (2024)
Heterogeneous Adversarial Play in Interactive Environments
di: Xu, Manjie, et al.
Pubblicazione: (2025)
di: Xu, Manjie, et al.
Pubblicazione: (2025)
Reasoning under Vision: Understanding Visual-Spatial Cognition in Vision-Language Models for CAPTCHA
di: Song, Python, et al.
Pubblicazione: (2025)
di: Song, Python, et al.
Pubblicazione: (2025)
Reasoning or Rhetoric? An Empirical Analysis of Moral Reasoning Explanations in Large Language Models
di: Kasat, Aryan, et al.
Pubblicazione: (2026)
di: Kasat, Aryan, et al.
Pubblicazione: (2026)
Learning to Plan with Personalized Preferences
di: Xu, Manjie, et al.
Pubblicazione: (2025)
di: Xu, Manjie, et al.
Pubblicazione: (2025)
Learning to Check: Unleashing Potentials for Self-Correction in Large Language Models
di: Zhang, Che, et al.
Pubblicazione: (2024)
di: Zhang, Che, et al.
Pubblicazione: (2024)
DixitWorld: Evaluating Multimodal Abductive Reasoning in Vision-Language Models with Multi-Agent Dixit Gameplay
di: Mo, Yunxiang, et al.
Pubblicazione: (2025)
di: Mo, Yunxiang, et al.
Pubblicazione: (2025)
Enhancing Mathematical Reasoning in Large Language Models with Self-Consistency-Based Hallucination Detection
di: Liu, MingShan, et al.
Pubblicazione: (2025)
di: Liu, MingShan, et al.
Pubblicazione: (2025)
The Role of Model Confidence on Bias Effects in Measured Uncertainties for Vision-Language Models
di: Liu, Xinyi, et al.
Pubblicazione: (2025)
di: Liu, Xinyi, et al.
Pubblicazione: (2025)
Language Ranker: A Lightweight Ranking framework for LLM Decoding
di: Zhang, Chenheng, et al.
Pubblicazione: (2025)
di: Zhang, Chenheng, et al.
Pubblicazione: (2025)
Understanding the Effects of Distractors on Reasoning Vision-Language Models
di: Bae, Jiyun, et al.
Pubblicazione: (2025)
di: Bae, Jiyun, et al.
Pubblicazione: (2025)
Reasoning on Graphs: Faithful and Interpretable Large Language Model Reasoning
di: Luo, Linhao, et al.
Pubblicazione: (2023)
di: Luo, Linhao, et al.
Pubblicazione: (2023)
How Is LLM Reasoning Distracted by Irrelevant Context? An Analysis Using a Controlled Benchmark
di: Yang, Minglai, et al.
Pubblicazione: (2025)
di: Yang, Minglai, et al.
Pubblicazione: (2025)
Why Text Prevails: Vision May Undermine Multimodal Medical Decision Making
di: Dai, Siyuan, et al.
Pubblicazione: (2025)
di: Dai, Siyuan, et al.
Pubblicazione: (2025)
Cooperative Strategic Planning Enhances Reasoning Capabilities in Large Language Models
di: Wang, Danqing, et al.
Pubblicazione: (2024)
di: Wang, Danqing, et al.
Pubblicazione: (2024)
From Perception to Cognition: A Survey of Vision-Language Interactive Reasoning in Multimodal Large Language Models
di: Zhou, Chenyue, et al.
Pubblicazione: (2025)
di: Zhou, Chenyue, et al.
Pubblicazione: (2025)
Guiding Language Model Reasoning with Planning Tokens
di: Wang, Xinyi, et al.
Pubblicazione: (2023)
di: Wang, Xinyi, et al.
Pubblicazione: (2023)
Large Language Models Are Neurosymbolic Reasoners
di: Fang, Meng, et al.
Pubblicazione: (2024)
di: Fang, Meng, et al.
Pubblicazione: (2024)
Understanding Reasoning Ability of Language Models From the Perspective of Reasoning Paths Aggregation
di: Wang, Xinyi, et al.
Pubblicazione: (2024)
di: Wang, Xinyi, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Distracted Robot: How Visual Clutter Undermine Robotic Manipulation
di: Rasouli, Amir, et al.
Pubblicazione: (2025) -
DistractMIA: Black-Box Membership Inference on Vision-Language Models via Semantic Distraction
di: Tang, Hongyi, et al.
Pubblicazione: (2026) -
Autoregressive Models Rival Diffusion Models at ANY-ORDER Generation
di: Du, Tianqi, et al.
Pubblicazione: (2026) -
Losing Visual Needles in Image Haystacks: Vision Language Models are Easily Distracted in Short and Long Contexts
di: Sharma, Aditya, et al.
Pubblicazione: (2024) -
Structured Visual Narratives Undermine Safety Alignment in Multimodal Large Language Models
di: Tan, Rui Yang, et al.
Pubblicazione: (2026)