SusBench: An Online Benchmark for Evaluating Dark Pattern Susceptibility of Computer-Use Agents
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Guo, Longjie, Yuan, Chenjie, Zhong, Mingyuan, Wolfe, Robert, Zhong, Ruican, Xu, Yue, Wen, Bingbing, Shen, Hua, Wang, Lucy Lu, Hiniker, Alexis |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ML-EAT: A Multilevel Embedding Association Test for Interpretable and Transparent Social Science
par: Wolfe, Robert, et autres
Publié: (2024)
par: Wolfe, Robert, et autres
Publié: (2024)
What Social Media Use Do People Regret? An Analysis of 34K Smartphone Screenshots with Multimodal LLM
par: Guo, Longjie, et autres
Publié: (2024)
par: Guo, Longjie, et autres
Publié: (2024)
Supporting Students' Reading and Cognition with AI
par: Fu, Yue, et autres
Publié: (2025)
par: Fu, Yue, et autres
Publié: (2025)
Dataset Scale and Societal Consistency Mediate Facial Impression Bias in Vision-Language AI
par: Wolfe, Robert, et autres
Publié: (2024)
par: Wolfe, Robert, et autres
Publié: (2024)
Representation Bias of Adolescents in AI: A Bilingual, Bicultural Study
par: Wolfe, Robert, et autres
Publié: (2024)
par: Wolfe, Robert, et autres
Publié: (2024)
AgentWebBench: Benchmarking Multi-Agent Coordination in Agentic Web
par: Zhong, Shanshan, et autres
Publié: (2026)
par: Zhong, Shanshan, et autres
Publié: (2026)
Towards Designing Social Interventions For Online Climate Change Denialism Discussions
par: Zhong, Ruican, et autres
Publié: (2025)
par: Zhong, Ruican, et autres
Publié: (2025)
Challenges and Opportunities for Participatory Design of Conversational Agents for Young People's Wellbeing
par: Kucirkova, Natalia, et autres
Publié: (2025)
par: Kucirkova, Natalia, et autres
Publié: (2025)
Toward Needs-Conscious Design: Co-Designing a Human-Centered Framework for AI-Mediated Communication
par: Wolfe, Robert, et autres
Publié: (2025)
par: Wolfe, Robert, et autres
Publié: (2025)
The Engagement-Prolonging Designs Teens Encounter on Very Large Online Platforms
par: Chen, Yixin, et autres
Publié: (2024)
par: Chen, Yixin, et autres
Publié: (2024)
DarkBench: Benchmarking Dark Patterns in Large Language Models
par: Kran, Esben, et autres
Publié: (2025)
par: Kran, Esben, et autres
Publié: (2025)
"Sharing, Not Showing Off": How BeReal Approaches Authentic Self-Presentation on Social Media Through Its Design
par: Kim, JaeWon, et autres
Publié: (2024)
par: Kim, JaeWon, et autres
Publié: (2024)
Privacy as Social Norm: Systematically Reducing Dysfunctional Privacy Concerns on Social Media
par: Kim, JaeWon, et autres
Publié: (2024)
par: Kim, JaeWon, et autres
Publié: (2024)
Metaphors as Scaffolds: Spatial, Embodied, Fantastical, and Relational Framings for Youth Usable Privacy Design
par: Kim, JaeWon, et autres
Publié: (2026)
par: Kim, JaeWon, et autres
Publié: (2026)
From Text to Self: Users' Perceptions of Potential of AI on Interpersonal Communication and Self
par: Fu, Yue, et autres
Publié: (2023)
par: Fu, Yue, et autres
Publié: (2023)
Synthetic Heuristic Evaluation: A Comparison between AI- and Human-Powered Usability Evaluation
par: Zhong, Ruican, et autres
Publié: (2025)
par: Zhong, Ruican, et autres
Publié: (2025)
Synthetic Cognitive Walkthrough: Aligning Large Language Model Performance with Human Cognitive Walkthrough
par: Zhong, Ruican, et autres
Publié: (2025)
par: Zhong, Ruican, et autres
Publié: (2025)
Self-Regulated Reading with AI Support: An Eight-Week Study with Students
par: Fu, Yue, et autres
Publié: (2026)
par: Fu, Yue, et autres
Publié: (2026)
Do Language Models Mirror Human Confidence? Exploring Psychological Insights to Address Overconfidence in LLMs
par: Xu, Chenjun, et autres
Publié: (2025)
par: Xu, Chenjun, et autres
Publié: (2025)
VPI-Bench: Visual Prompt Injection Attacks for Computer-Use Agents
par: Cao, Tri, et autres
Publié: (2025)
par: Cao, Tri, et autres
Publié: (2025)
Trust-Enabled Privacy: Social Media Designs to Support Adolescent User Boundary Regulation
par: Kim, JaeWon, et autres
Publié: (2025)
par: Kim, JaeWon, et autres
Publié: (2025)
"Everyone's using it, but no one is allowed to talk about it": College Students' Experiences Navigating the Higher Education Environment in a Generative AI World
par: Fu, Yue, et autres
Publié: (2026)
par: Fu, Yue, et autres
Publié: (2026)
Dark Patterns Meet GUI Agents: LLM Agent Susceptibility to Manipulative Interfaces and the Role of Human Oversight
par: Tang, Jingyu, et autres
Publié: (2025)
par: Tang, Jingyu, et autres
Publié: (2025)
BackportBench: A Multilingual Benchmark for Automated Backporting of Patches
par: Zhong, Zhiqing, et autres
Publié: (2025)
par: Zhong, Zhiqing, et autres
Publié: (2025)
MultiKernelBench: A Multi-Platform Benchmark for Kernel Generation
par: Wen, Zhongzhen, et autres
Publié: (2025)
par: Wen, Zhongzhen, et autres
Publié: (2025)
OfficeBench: Benchmarking Language Agents across Multiple Applications for Office Automation
par: Wang, Zilong, et autres
Publié: (2024)
par: Wang, Zilong, et autres
Publié: (2024)
INR-Bench: A Unified Benchmark for Implicit Neural Representations in Multi-Domain Regression and Reconstruction
par: Li, Linfei, et autres
Publié: (2025)
par: Li, Linfei, et autres
Publié: (2025)
Ask Now, Use Later: Benchmarking the Proactivity Gap in Long-Lived LLM Agents
par: Wu, Bin, et autres
Publié: (2026)
par: Wu, Bin, et autres
Publié: (2026)
Should ChatGPT Write Your Breakup Text? Exploring the Role of AI in Relationship Dissolution
par: Fu, Yue, et autres
Publié: (2024)
par: Fu, Yue, et autres
Publié: (2024)
Learning to Lead: Incentivizing Strategic Agents in the Dark
par: Wu, Yuchen, et autres
Publié: (2025)
par: Wu, Yuchen, et autres
Publié: (2025)
LPS-Bench: Benchmarking Safety Awareness of Computer-Use Agents in Long-Horizon Planning under Benign and Adversarial Scenarios
par: Chen, Tianyu, et autres
Publié: (2026)
par: Chen, Tianyu, et autres
Publié: (2026)
Dual Preintegration for Relative State Estimation
par: Xia, Ruican, et autres
Publié: (2025)
par: Xia, Ruican, et autres
Publié: (2025)
Clarify or Answer: Reinforcement Learning for Agentic VQA with Context Under-specification
par: Cao, Zongwan, et autres
Publié: (2026)
par: Cao, Zongwan, et autres
Publié: (2026)
Characterizing LLM Abstention Behavior in Science QA with Context Perturbations
par: Wen, Bingbing, et autres
Publié: (2024)
par: Wen, Bingbing, et autres
Publié: (2024)
Innovative University-Technology Partnerships: Advice for Academia.
par: Hiniker, LuAnn
Publié: (2002)
par: Hiniker, LuAnn
Publié: (2002)
PaperTok: Exploring the Use of Generative AI for Creating Short-form Videos for Research Communication
par: Cristobal, Meziah Ruby, et autres
Publié: (2026)
par: Cristobal, Meziah Ruby, et autres
Publié: (2026)
FoleyBench: A Benchmark For Video-to-Audio Models
par: Dixit, Satvik, et autres
Publié: (2025)
par: Dixit, Satvik, et autres
Publié: (2025)
ShortcutsBench: A Large-Scale Real-world Benchmark for API-based Agents
par: Shen, Haiyang, et autres
Publié: (2024)
par: Shen, Haiyang, et autres
Publié: (2024)
Bench-NPIN: Benchmarking Non-prehensile Interactive Navigation
par: Zhong, Ninghan, et autres
Publié: (2025)
par: Zhong, Ninghan, et autres
Publié: (2025)
AI-Assisted Causal Pathway Diagram for Human-Centered Design
par: Zhong, Ruican, et autres
Publié: (2024)
par: Zhong, Ruican, et autres
Publié: (2024)
Documents similaires
-
ML-EAT: A Multilevel Embedding Association Test for Interpretable and Transparent Social Science
par: Wolfe, Robert, et autres
Publié: (2024) -
What Social Media Use Do People Regret? An Analysis of 34K Smartphone Screenshots with Multimodal LLM
par: Guo, Longjie, et autres
Publié: (2024) -
Supporting Students' Reading and Cognition with AI
par: Fu, Yue, et autres
Publié: (2025) -
Dataset Scale and Societal Consistency Mediate Facial Impression Bias in Vision-Language AI
par: Wolfe, Robert, et autres
Publié: (2024) -
Representation Bias of Adolescents in AI: A Bilingual, Bicultural Study
par: Wolfe, Robert, et autres
Publié: (2024)