Sightation Counts: Leveraging Sighted User Feedback in Building a BLV-aligned Dataset of Diagram Descriptions
Fuente:
arXiv
Saved in:
| Main Authors: | Kang, Wan Ju, Kim, Eunki, An, Na Min, Kim, Sangryul, Choi, Haemin, Kwak, Ki Hoon, Thorne, James |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Learning to Insert [PAUSE] Tokens for Better Reasoning
by: Kim, Eunki, et al.
Published: (2025)
by: Kim, Eunki, et al.
Published: (2025)
How Blind and Low-Vision Individuals Prefer Large Vision-Language Model-Generated Scene Descriptions
by: An, Na Min, et al.
Published: (2025)
by: An, Na Min, et al.
Published: (2025)
Are Large Vision-Language Models Ready to Guide Blind and Low-Vision Individuals?
by: Kim, Eunki, et al.
Published: (2025)
by: Kim, Eunki, et al.
Published: (2025)
Context Filtering with Reward Modeling in Question Answering
by: Kim, Sangryul, et al.
Published: (2024)
by: Kim, Sangryul, et al.
Published: (2024)
I0T: Embedding Standardization Method Towards Zero Modality Gap
by: An, Na Min, et al.
Published: (2024)
by: An, Na Min, et al.
Published: (2024)
Mirroring Users: Towards Building Preference-aligned User Simulator with User Feedback in Recommendation
by: Wei, Tianjun, et al.
Published: (2025)
by: Wei, Tianjun, et al.
Published: (2025)
ProbGate at EHRSQL 2024: Enhancing SQL Query Generation Accuracy through Probabilistic Threshold Filtering and Error Handling
by: Kim, Sangryul, et al.
Published: (2024)
by: Kim, Sangryul, et al.
Published: (2024)
LLM impact on BLV programming
by: Chandrasekar, Prashant, et al.
Published: (2025)
by: Chandrasekar, Prashant, et al.
Published: (2025)
From Evidence to Belief: A Bayesian Epistemology Approach to Language Models
by: Kim, Minsu, et al.
Published: (2025)
by: Kim, Minsu, et al.
Published: (2025)
How Can Haptic Feedback Assist People with Blind and Low Vision (BLV): A Systematic Literature Review
by: Jiang, Chutian, et al.
Published: (2024)
by: Jiang, Chutian, et al.
Published: (2024)
Enabling BLV Developers with LLM-driven Code Debugging
by: Saben, Clark, et al.
Published: (2024)
by: Saben, Clark, et al.
Published: (2024)
Pay What LLM Wants: Can LLM Simulate Economics Experiment with 522 Real-human Persona?
by: Choi, Junhyuk, et al.
Published: (2025)
by: Choi, Junhyuk, et al.
Published: (2025)
Audo-Sight: AI-driven Ambient Perception Across Edge-Cloud for Blind and Low Vision Users
by: Bradshaw, Jacob, et al.
Published: (2026)
by: Bradshaw, Jacob, et al.
Published: (2026)
On the Robustness of Reward Models for Language Model Alignment
by: Hong, Jiwoo, et al.
Published: (2025)
by: Hong, Jiwoo, et al.
Published: (2025)
SurgCheck: Do Vision-Language Models Really Look at Images in Surgical VQA?
by: Shin, Jongmin, et al.
Published: (2026)
by: Shin, Jongmin, et al.
Published: (2026)
FENCE: A Financial and Multimodal Jailbreak Detection Dataset
by: Kim, Mirae, et al.
Published: (2026)
by: Kim, Mirae, et al.
Published: (2026)
Pixel-aligned RGB-NIR Stereo Imaging and Dataset for Robot Vision
by: Kim, Jinnyeong, et al.
Published: (2024)
by: Kim, Jinnyeong, et al.
Published: (2024)
Enginuity: Building an Open Multi-Domain Dataset of Complex Engineering Diagrams
by: Seefried, Ethan, et al.
Published: (2026)
by: Seefried, Ethan, et al.
Published: (2026)
Multimodal Prompt Optimization: Why Not Leverage Multiple Modalities for MLLMs
by: Choi, Yumin, et al.
Published: (2025)
by: Choi, Yumin, et al.
Published: (2025)
Epistemology of Language Models: Do Language Models Have Holistic Knowledge?
by: Kim, Minsu, et al.
Published: (2024)
by: Kim, Minsu, et al.
Published: (2024)
Should I Share this Translation? Evaluating Quality Feedback for User Reliance on Machine Translation
by: Ki, Dayeon, et al.
Published: (2025)
by: Ki, Dayeon, et al.
Published: (2025)
Federated Learning for Face Recognition via Intra-subject Self-supervised Learning
by: Kim, Hansol, et al.
Published: (2024)
by: Kim, Hansol, et al.
Published: (2024)
Referring Video Object Segmentation via Language-aligned Track Selection
by: Kim, Seongchan, et al.
Published: (2024)
by: Kim, Seongchan, et al.
Published: (2024)
Text2Arch: A Dataset for Generating Scientific Architecture Diagrams from Natural Language Descriptions
by: Garg, Shivank, et al.
Published: (2026)
by: Garg, Shivank, et al.
Published: (2026)
Leveraging Large Language Models to Power Chatbots for Collecting User Self-Reported Data
by: Wei, Jing, et al.
Published: (2023)
by: Wei, Jing, et al.
Published: (2023)
eXplainable Bayesian Multi-Perspective Generative Retrieval
by: Song, EuiYul, et al.
Published: (2024)
by: Song, EuiYul, et al.
Published: (2024)
Building UI/UX Dataset for Dark Pattern Detection and YOLOv12x-based Real-Time Object Recognition Detection System
by: Jang, Se-Young, et al.
Published: (2025)
by: Jang, Se-Young, et al.
Published: (2025)
CLIcK: A Benchmark Dataset of Cultural and Linguistic Intelligence in Korean
by: Kim, Eunsu, et al.
Published: (2024)
by: Kim, Eunsu, et al.
Published: (2024)
Pearl: A Review-driven Persona-Knowledge Grounded Conversational Recommendation Dataset
by: Kim, Minjin, et al.
Published: (2024)
by: Kim, Minjin, et al.
Published: (2024)
Susceptibility of Large Language Models to User-Driven Factors in Medical Queries
by: Lim, Kyung Ho, et al.
Published: (2025)
by: Lim, Kyung Ho, et al.
Published: (2025)
ForestPersons: A Large-Scale Dataset for Under-Canopy Missing Person Detection
by: Kim, Deokyun, et al.
Published: (2026)
by: Kim, Deokyun, et al.
Published: (2026)
Analysis of Multi-Source Language Training in Cross-Lingual Transfer
by: Lim, Seong Hoon, et al.
Published: (2024)
by: Lim, Seong Hoon, et al.
Published: (2024)
Super-Polynomial Growth of the Generalized Persistence Diagram
by: Kim, Donghan, et al.
Published: (2024)
by: Kim, Donghan, et al.
Published: (2024)
Feature Structure Distillation with Centered Kernel Alignment in BERT Transferring
by: Jung, Hee-Jun, et al.
Published: (2022)
by: Jung, Hee-Jun, et al.
Published: (2022)
User Feedback in Human-LLM Dialogues: A Lens to Understand Users But Noisy as a Learning Signal
by: Liu, Yuhan, et al.
Published: (2025)
by: Liu, Yuhan, et al.
Published: (2025)
Re3val: Reinforced and Reranked Generative Retrieval
by: Song, EuiYul, et al.
Published: (2024)
by: Song, EuiYul, et al.
Published: (2024)
Leveraging Multimodal LLM for Inspirational User Interface Search
by: Park, Seokhyeon, et al.
Published: (2025)
by: Park, Seokhyeon, et al.
Published: (2025)
WildFeedback: Aligning LLMs With In-situ User Interactions And Feedback
by: Shi, Taiwei, et al.
Published: (2024)
by: Shi, Taiwei, et al.
Published: (2024)
Towards Fully-Automated Materials Discovery via Large-Scale Synthesis Dataset and Expert-Level LLM-as-a-Judge
by: Kim, Heegyu, et al.
Published: (2025)
by: Kim, Heegyu, et al.
Published: (2025)
CountSteer: Steering Attention for Object Counting in Diffusion Models
by: Boo, Hyemin, et al.
Published: (2025)
by: Boo, Hyemin, et al.
Published: (2025)
Similar Items
-
Learning to Insert [PAUSE] Tokens for Better Reasoning
by: Kim, Eunki, et al.
Published: (2025) -
How Blind and Low-Vision Individuals Prefer Large Vision-Language Model-Generated Scene Descriptions
by: An, Na Min, et al.
Published: (2025) -
Are Large Vision-Language Models Ready to Guide Blind and Low-Vision Individuals?
by: Kim, Eunki, et al.
Published: (2025) -
Context Filtering with Reward Modeling in Question Answering
by: Kim, Sangryul, et al.
Published: (2024) -
I0T: Embedding Standardization Method Towards Zero Modality Gap
by: An, Na Min, et al.
Published: (2024)