Trust in Vision-Language Models: Insights from a Participatory User Workshop
Fuente:
arXiv
Salvato in:
| Autori principali: | Chiatti, Agnese, Piccolo, Lara, Bernardini, Sara, Matteucci, Matteo, Schiaffonati, Viola |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects
di: Chiatti, Agnese, et al.
Pubblicazione: (2025)
di: Chiatti, Agnese, et al.
Pubblicazione: (2025)
Vision-Integrated LLMs for Autonomous Driving Assistance : Human Performance Comparison and Trust Evaluation
di: Kim, Namhee, et al.
Pubblicazione: (2025)
di: Kim, Namhee, et al.
Pubblicazione: (2025)
Not There Yet: Evaluating Vision Language Models in Simulating the Visual Perception of People with Low Vision
di: Natalie, Rosiana, et al.
Pubblicazione: (2025)
di: Natalie, Rosiana, et al.
Pubblicazione: (2025)
Do Vision Language Models Understand Human Engagement in Games?
di: Wang, Ziyi, et al.
Pubblicazione: (2026)
di: Wang, Ziyi, et al.
Pubblicazione: (2026)
ScreenAgent: A Vision Language Model-driven Computer Control Agent
di: Niu, Runliang, et al.
Pubblicazione: (2024)
di: Niu, Runliang, et al.
Pubblicazione: (2024)
Advancing the Understanding and Evaluation of AR-Generated Scenes: When Vision-Language Models Shine and Stumble
di: Duan, Lin, et al.
Pubblicazione: (2025)
di: Duan, Lin, et al.
Pubblicazione: (2025)
Constructive Apraxia: An Unexpected Limit of Instructible Vision-Language Models and Analog for Human Cognitive Disorders
di: Noever, David, et al.
Pubblicazione: (2024)
di: Noever, David, et al.
Pubblicazione: (2024)
ClickAIXR: On-Device Multimodal Vision-Language Interaction with Real-World Objects in Extended Reality
di: Khan, Dawar, et al.
Pubblicazione: (2026)
di: Khan, Dawar, et al.
Pubblicazione: (2026)
Vision Language Models as Values Detectors
di: Abbo, Giulio Antonio, et al.
Pubblicazione: (2025)
di: Abbo, Giulio Antonio, et al.
Pubblicazione: (2025)
Refusal as Silence: Gendered Disparities in Vision-Language Model Responses
di: Luo, Sha, et al.
Pubblicazione: (2024)
di: Luo, Sha, et al.
Pubblicazione: (2024)
GUICourse: From General Vision Language Models to Versatile GUI Agents
di: Chen, Wentong, et al.
Pubblicazione: (2024)
di: Chen, Wentong, et al.
Pubblicazione: (2024)
Can Vision-Language Models Understand and Interpret Dynamic Gestures from Pedestrians? Pilot Datasets and Exploration Towards Instructive Nonverbal Commands for Cooperative Autonomous Vehicles
di: Bossen, Tonko E. W., et al.
Pubblicazione: (2025)
di: Bossen, Tonko E. W., et al.
Pubblicazione: (2025)
SkinGEN: an Explainable Dermatology Diagnosis-to-Generation Framework with Interactive Vision-Language Models
di: Lin, Bo, et al.
Pubblicazione: (2024)
di: Lin, Bo, et al.
Pubblicazione: (2024)
VISLIX: An XAI Framework for Validating Vision Models with Slice Discovery and Analysis
di: Yan, Xinyuan, et al.
Pubblicazione: (2025)
di: Yan, Xinyuan, et al.
Pubblicazione: (2025)
See What I Mean: Aligning Vision and Language Representations for Video Fine-grained Object Understanding
di: Sun, Boyuan, et al.
Pubblicazione: (2026)
di: Sun, Boyuan, et al.
Pubblicazione: (2026)
ShowUI: One Vision-Language-Action Model for GUI Visual Agent
di: Lin, Kevin Qinghong, et al.
Pubblicazione: (2024)
di: Lin, Kevin Qinghong, et al.
Pubblicazione: (2024)
Neuro-Symbolic Scene Graph Conditioning for Synthetic Image Dataset Generation
di: Savazzi, Giacomo, et al.
Pubblicazione: (2025)
di: Savazzi, Giacomo, et al.
Pubblicazione: (2025)
Training a Vision Language Model as Smartphone Assistant
di: Dorka, Nicolai, et al.
Pubblicazione: (2024)
di: Dorka, Nicolai, et al.
Pubblicazione: (2024)
Learning User Embeddings from Human Gaze for Personalised Saliency Prediction
di: Strohm, Florian, et al.
Pubblicazione: (2024)
di: Strohm, Florian, et al.
Pubblicazione: (2024)
An Egocentric Vision-Language Model based Portable Real-time Smart Assistant
di: Huang, Yifei, et al.
Pubblicazione: (2025)
di: Huang, Yifei, et al.
Pubblicazione: (2025)
Visual Affect Analysis: Predicting Emotions of Image Viewers with Vision-Language Models
di: Nowicki, Filip, et al.
Pubblicazione: (2026)
di: Nowicki, Filip, et al.
Pubblicazione: (2026)
AV-EmoDialog: Chat with Audio-Visual Users Leveraging Emotional Cues
di: Park, Se Jin, et al.
Pubblicazione: (2024)
di: Park, Se Jin, et al.
Pubblicazione: (2024)
GUIDE: A Benchmark for Understanding and Assisting Users in Open-Ended GUI Tasks
di: Yang, Saelyne, et al.
Pubblicazione: (2026)
di: Yang, Saelyne, et al.
Pubblicazione: (2026)
A User-Centric Analysis of Explainability in AI-Based Medical Image Diagnosis
di: Wagner, Julia, et al.
Pubblicazione: (2026)
di: Wagner, Julia, et al.
Pubblicazione: (2026)
HarassGuard: Detecting Harassment Behaviors in Social Virtual Reality with Vision-Language Models
di: Lee, Junhee, et al.
Pubblicazione: (2026)
di: Lee, Junhee, et al.
Pubblicazione: (2026)
InterVLS: Interactive Model Understanding and Improvement with Vision-Language Surrogates
di: Huang, Jinbin, et al.
Pubblicazione: (2023)
di: Huang, Jinbin, et al.
Pubblicazione: (2023)
MAPWise: Evaluating Vision-Language Models for Advanced Map Queries
di: Mukhopadhyay, Srija, et al.
Pubblicazione: (2024)
di: Mukhopadhyay, Srija, et al.
Pubblicazione: (2024)
Regressor-Guided Generative Image Editing Balances User Emotions to Reduce Time Spent Online
di: Gebhardt, Christoph, et al.
Pubblicazione: (2025)
di: Gebhardt, Christoph, et al.
Pubblicazione: (2025)
A Survey on Improving Human Robot Collaboration through Vision-and-Language Navigation
di: Yakolli, Nivedan, et al.
Pubblicazione: (2025)
di: Yakolli, Nivedan, et al.
Pubblicazione: (2025)
Sightation Counts: Leveraging Sighted User Feedback in Building a BLV-aligned Dataset of Diagram Descriptions
di: Kang, Wan Ju, et al.
Pubblicazione: (2025)
di: Kang, Wan Ju, et al.
Pubblicazione: (2025)
Multimodal Attention-Aware Fusion for Diagnosing Distal Myopathy: Evaluating Model Interpretability and Clinician Trust
di: Onari, Mohsen Abbaspour, et al.
Pubblicazione: (2025)
di: Onari, Mohsen Abbaspour, et al.
Pubblicazione: (2025)
Large Language Models estimate fine-grained human color-concept associations
di: Mukherjee, Kushin, et al.
Pubblicazione: (2024)
di: Mukherjee, Kushin, et al.
Pubblicazione: (2024)
MedFoundationHub: A Lightweight and Secure Toolkit for Deploying Medical Vision Language Foundation Models
di: Li, Xiao, et al.
Pubblicazione: (2025)
di: Li, Xiao, et al.
Pubblicazione: (2025)
More than the Sum of Its Parts: Ensembling Backbone Networks for Few-Shot Segmentation
di: Catalano, Nico, et al.
Pubblicazione: (2024)
di: Catalano, Nico, et al.
Pubblicazione: (2024)
"It's trained by non-disabled people": Evaluating How Image Quality Affects Product Captioning with Vision-Language Models
di: Garg, Kapil, et al.
Pubblicazione: (2025)
di: Garg, Kapil, et al.
Pubblicazione: (2025)
Forest-Chat: Adapting Vision-Language Agents for Interactive Forest Change Analysis
di: Brock, James, et al.
Pubblicazione: (2026)
di: Brock, James, et al.
Pubblicazione: (2026)
Achieving Effective Virtual Reality Interactions via Acoustic Gesture Recognition based on Large Language Models
di: Zhang, Xijie, et al.
Pubblicazione: (2025)
di: Zhang, Xijie, et al.
Pubblicazione: (2025)
A Pilot Study on Curator-Guided Multilingual Art Description for Blind and Low-Vision Audiences with Small Vision-Language Models
di: Tsangko, Iosif, et al.
Pubblicazione: (2026)
di: Tsangko, Iosif, et al.
Pubblicazione: (2026)
Scene-Aware Urban Design: A Human-AI Recommendation Framework Using Co-Occurrence Embeddings and Vision-Language Models
di: Gallardo, Rodrigo, et al.
Pubblicazione: (2025)
di: Gallardo, Rodrigo, et al.
Pubblicazione: (2025)
Vision-Language Models Suppress Female Representations Under Ambiguous Input
di: Marin-Llobet, Arnau, et al.
Pubblicazione: (2026)
di: Marin-Llobet, Arnau, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects
di: Chiatti, Agnese, et al.
Pubblicazione: (2025) -
Vision-Integrated LLMs for Autonomous Driving Assistance : Human Performance Comparison and Trust Evaluation
di: Kim, Namhee, et al.
Pubblicazione: (2025) -
Not There Yet: Evaluating Vision Language Models in Simulating the Visual Perception of People with Low Vision
di: Natalie, Rosiana, et al.
Pubblicazione: (2025) -
Do Vision Language Models Understand Human Engagement in Games?
di: Wang, Ziyi, et al.
Pubblicazione: (2026) -
ScreenAgent: A Vision Language Model-driven Computer Control Agent
di: Niu, Runliang, et al.
Pubblicazione: (2024)