MarkupLens: Balancing Computer Vision Assistance and Control in Professional Video Annotation for Video-Based Design Tasks
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | He, Tianhao, Niforatos, Evangelos, Kortuem, Gerd |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
DesignMinds: Enhancing Video-Based Design Ideation with Vision-Language Model and Context-Injected Large Language Model
par: He, Tianhao, et autres
Publié: (2024)
par: He, Tianhao, et autres
Publié: (2024)
"A Great Start, But...": Evaluating LLM-Generated Mind Maps for Information Mapping in Video-Based Design
par: He, Tianhao, et autres
Publié: (2025)
par: He, Tianhao, et autres
Publié: (2025)
Understanding Mental Models of Generative Conversational Search and The Effect of Interface Transparency
par: Degachi, Chadha, et autres
Publié: (2025)
par: Degachi, Chadha, et autres
Publié: (2025)
Sphere Window: Challenges and Opportunities of 360° Video in Collaborative Design Workshops
par: Meijer, Wo, et autres
Publié: (2024)
par: Meijer, Wo, et autres
Publié: (2024)
Tangi: a Tool to Create Tangible Artifacts for Sharing Insights from 360$^\circ$ Video
par: Meijer, Wo, et autres
Publié: (2024)
par: Meijer, Wo, et autres
Publié: (2024)
Factory Operators' Perspectives on Cognitive Assistants for Knowledge Sharing: Challenges, Risks, and Impact on Work
par: Freire, Samuel Kernan, et autres
Publié: (2024)
par: Freire, Samuel Kernan, et autres
Publié: (2024)
Conversational Assistants in Knowledge-Intensive Contexts: An Evaluation of LLM- versus Intent-based Systems
par: Freire, Samuel Kernan, et autres
Publié: (2024)
par: Freire, Samuel Kernan, et autres
Publié: (2024)
TaskLens: Generating Task-Conditioned Scaffolded Interfaces for Learning Professional Creative Software
par: Liu, Yimeng, et autres
Publié: (2025)
par: Liu, Yimeng, et autres
Publié: (2025)
The Bots of Persuasion: Examining How Conversational Agents' Linguistic Expressions of Personality Affect User Perceptions and Decisions
par: Genç, Uğur, et autres
Publié: (2026)
par: Genç, Uğur, et autres
Publié: (2026)
Data Playwright: Authoring Data Videos with Annotated Narration
par: Shen, Leixian, et autres
Publié: (2024)
par: Shen, Leixian, et autres
Publié: (2024)
(Computer) Vision in Action: Comparing Remote Sighted Assistance and a Multimodal Voice Agent in Inspection Sequences
par: Rudaz, Damien, et autres
Publié: (2026)
par: Rudaz, Damien, et autres
Publié: (2026)
Exploring the Role of User Comments Throughout the Stages of Video-Based Task-Learning
par: Kim, Nayoung, et autres
Publié: (2026)
par: Kim, Nayoung, et autres
Publié: (2026)
AROMA: Mixed-Initiative AI Assistance for Non-Visual Cooking by Grounding Multi-modal Information Between Reality and Videos
par: Ning, Zheng, et autres
Publié: (2025)
par: Ning, Zheng, et autres
Publié: (2025)
PACT: Proactive Asking for Continual Task Assistance in Human-Robot Collaboration
par: He, Chengbo, et autres
Publié: (2026)
par: He, Chengbo, et autres
Publié: (2026)
Designing Multi-Robot Ground Video Sensemaking with Public Safety Professionals
par: Zhou, Puqi, et autres
Publié: (2026)
par: Zhou, Puqi, et autres
Publié: (2026)
Prompt Orchestration Markup Language
par: Zhang, Yuge, et autres
Publié: (2025)
par: Zhang, Yuge, et autres
Publié: (2025)
Collab: Fostering Critical Identification of Deepfake Videos on Social Media via Synergistic Annotation
par: Zhang, Shuning, et autres
Publié: (2026)
par: Zhang, Shuning, et autres
Publié: (2026)
Making Videos Accessible for Blind and Low Vision Users Using a Multimodal Agent Video Player
par: Olmos, Adriana, et autres
Publié: (2026)
par: Olmos, Adriana, et autres
Publié: (2026)
Laugh at Your Own Pace: Basic Performance Evaluation of Language Learning Assistance by Adjustment of Video Playback Speeds Based on Laughter Detection
par: Nishida, Naoto, et autres
Publié: (2025)
par: Nishida, Naoto, et autres
Publié: (2025)
Emerging Practices for Large Multimodal Model (LMM) Assistance for People with Visual Impairments: Implications for Design
par: Xie, Jingyi, et autres
Publié: (2024)
par: Xie, Jingyi, et autres
Publié: (2024)
Knowledge Sharing in Manufacturing using Large Language Models: User Evaluation and Model Benchmarking
par: Freire, Samuel Kernan, et autres
Publié: (2024)
par: Freire, Samuel Kernan, et autres
Publié: (2024)
VisionTasker: Mobile Task Automation Using Vision Based UI Understanding and LLM Task Planning
par: Song, Yunpeng, et autres
Publié: (2023)
par: Song, Yunpeng, et autres
Publié: (2023)
Creation, Critique, and Consumption: Exploring Generative AI Descriptions for Supporting Blind and Low Vision Professionals with Visual Tasks
par: Jiang, Lucy, et autres
Publié: (2025)
par: Jiang, Lucy, et autres
Publié: (2025)
Reflecting on Design Paradigms of Animated Data Video Tools
par: Shen, Leixian, et autres
Publié: (2025)
par: Shen, Leixian, et autres
Publié: (2025)
RealityEffects: Augmenting 3D Volumetric Videos with Object-Centric Annotation and Dynamic Visual Effects
par: Liao, Jian, et autres
Publié: (2024)
par: Liao, Jian, et autres
Publié: (2024)
Detecting AI Assistance in Abstract Complex Tasks
par: King, Tyler, et autres
Publié: (2025)
par: King, Tyler, et autres
Publié: (2025)
Substantial, Decomposable, and Invisible: Visual Context Misalignment in Instructional Videos for Physical Tasks
par: Li, Yayuan, et autres
Publié: (2026)
par: Li, Yayuan, et autres
Publié: (2026)
WonderFlow: Narration-Centric Design of Animated Data Videos
par: Wang, Yun, et autres
Publié: (2023)
par: Wang, Yun, et autres
Publié: (2023)
FairTalk: Facilitating Balanced Participation in Video Conferencing by Implicit Visualization of Predicted Turn-Grabbing Intention
par: Iijima, Ryo, et autres
Publié: (2025)
par: Iijima, Ryo, et autres
Publié: (2025)
Surveyor: Facilitating Discovery Within Video Games for Blind and Low Vision Players
par: Nair, Vishnu, et autres
Publié: (2024)
par: Nair, Vishnu, et autres
Publié: (2024)
VideoMix: Aggregating How-To Videos for Task-Oriented Learning
par: Yang, Saelyne, et autres
Publié: (2025)
par: Yang, Saelyne, et autres
Publié: (2025)
Vega-Video: Integrating Video into the Grammar of Graphics
par: Winecki, Dominik, et autres
Publié: (2026)
par: Winecki, Dominik, et autres
Publié: (2026)
LAVE: LLM-Powered Agent Assistance and Language Augmentation for Video Editing
par: Wang, Bryan, et autres
Publié: (2024)
par: Wang, Bryan, et autres
Publié: (2024)
Mitigating Trauma in Qualitative Research Infrastructure: Roles for Machine Assistance and Trauma-Informed Design
par: Tseng, Emily, et autres
Publié: (2024)
par: Tseng, Emily, et autres
Publié: (2024)
Human-Centered Design and Evaluation of a Workplace for the Remote Assistance of Highly Automated Vehicles
par: Schrank, Andreas, et autres
Publié: (2023)
par: Schrank, Andreas, et autres
Publié: (2023)
Multi-Sensor Fusion-Based Mobile Manipulator Remote Control for Intelligent Smart Home Assistance
par: Jin, Xiao, et autres
Publié: (2025)
par: Jin, Xiao, et autres
Publié: (2025)
XR-First Design for Productivity: A Conceptual Framework for Enabling Efficient Task Switching in XR
par: Gottsacker, Matt, et autres
Publié: (2025)
par: Gottsacker, Matt, et autres
Publié: (2025)
Integrating Annotations into the Design Process for Sonifications and Physicalizations
par: Sorenson-Graff, Rhys, et autres
Publié: (2024)
par: Sorenson-Graff, Rhys, et autres
Publié: (2024)
The Reel Deal: Designing and Evaluating LLM-Generated Short-Form Educational Videos
par: Stavrinou, Lazaros, et autres
Publié: (2025)
par: Stavrinou, Lazaros, et autres
Publié: (2025)
SimulataR: Rapid Assisted Reality Prototyping using Design-Blended Videos
par: Ram, Ashwin, et autres
Publié: (2025)
par: Ram, Ashwin, et autres
Publié: (2025)
Documents similaires
-
DesignMinds: Enhancing Video-Based Design Ideation with Vision-Language Model and Context-Injected Large Language Model
par: He, Tianhao, et autres
Publié: (2024) -
"A Great Start, But...": Evaluating LLM-Generated Mind Maps for Information Mapping in Video-Based Design
par: He, Tianhao, et autres
Publié: (2025) -
Understanding Mental Models of Generative Conversational Search and The Effect of Interface Transparency
par: Degachi, Chadha, et autres
Publié: (2025) -
Sphere Window: Challenges and Opportunities of 360° Video in Collaborative Design Workshops
par: Meijer, Wo, et autres
Publié: (2024) -
Tangi: a Tool to Create Tangible Artifacts for Sharing Insights from 360$^\circ$ Video
par: Meijer, Wo, et autres
Publié: (2024)