Benchmarking and Understanding Safety Risks in AI Character Platforms
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wei, Yiluo, Zhang, Peixian, Tyson, Gareth |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Understanding Fanchuan in Livestreaming Platforms: A New Form of Online Antisocial Behavior
par: Wei, Yiluo, et autres
Publié: (2025)
par: Wei, Yiluo, et autres
Publié: (2025)
Understanding the Consequences of VTuber Reincarnation
par: Wei, Yiluo, et autres
Publié: (2026)
par: Wei, Yiluo, et autres
Publié: (2026)
Virtual Stars, Real Fans: Understanding the VTuber Ecosystem
par: Wei, Yiluo, et autres
Publié: (2025)
par: Wei, Yiluo, et autres
Publié: (2025)
Even More Kawaii than Real-Person-Driven VTubers? Understanding How Viewers Perceive AI-Driven VTubers
par: Wei, Yiluo, et autres
Publié: (2025)
par: Wei, Yiluo, et autres
Publié: (2025)
How Generative AI Empowers Attackers and Defenders Across the Trust & Safety Landscape
par: Kelley, Patrick Gage, et autres
Publié: (2025)
par: Kelley, Patrick Gage, et autres
Publié: (2025)
Victim-Centred Abuse Investigations and Defenses for Social Media Platforms
par: Hakami, Zaid, et autres
Publié: (2025)
par: Hakami, Zaid, et autres
Publié: (2025)
Understanding Data Collection, Brokerage, and Spam in the Lead Marketing Ecosystem
par: Vekaria, Yash, et autres
Publié: (2026)
par: Vekaria, Yash, et autres
Publié: (2026)
Chatting with Confidants or Corporations? Privacy Management with AI Companions
par: Chiu, Hsuen-Chi, et autres
Publié: (2026)
par: Chiu, Hsuen-Chi, et autres
Publié: (2026)
Secure human oversight of AI: Threat modeling in a socio-technical context
par: Ditz, Jonas C., et autres
Publié: (2025)
par: Ditz, Jonas C., et autres
Publié: (2025)
"Think First, Verify Always": Training Humans to Face AI Risks
par: Aydin, Yuksel
Publié: (2025)
par: Aydin, Yuksel
Publié: (2025)
"These cameras are just like the Eye of Sauron": A Sociotechnical Threat Model for AI-Driven Smart Home Devices as Perceived by UK-Based Domestic Workers
par: He, Shijing, et autres
Publié: (2026)
par: He, Shijing, et autres
Publié: (2026)
SoK (or SoLK?): On the Quantitative Study of Sociodemographic Factors and Computer Security Behaviors
par: Wei, Miranda, et autres
Publié: (2024)
par: Wei, Miranda, et autres
Publié: (2024)
Mind the Gap: Revealing Security Barriers through Situational Awareness of Small and Medium Business Key Decision-Makers
par: Chang, Yuanhaur, et autres
Publié: (2025)
par: Chang, Yuanhaur, et autres
Publié: (2025)
TRIP: Coercion-resistant Registration for E-Voting with Verifiability and Usability in Votegral
par: Merino, Louis-Henri, et autres
Publié: (2022)
par: Merino, Louis-Henri, et autres
Publié: (2022)
Enabling Developers, Protecting Users: Investigating Harassment and Safety in VR
par: B., Abhinaya S., et autres
Publié: (2024)
par: B., Abhinaya S., et autres
Publié: (2024)
Teaching Data Science Students to Sketch Privacy Designs through Heuristics (Extended Technical Report)
par: Wen, Jinhe, et autres
Publié: (2025)
par: Wen, Jinhe, et autres
Publié: (2025)
Digital Nudges Using Emotion Regulation to Reduce Online Disinformation Sharing
par: Suzuki, Haruka Nakajima, et autres
Publié: (2025)
par: Suzuki, Haruka Nakajima, et autres
Publié: (2025)
Exploring the Privacy and Security Challenges Faced by Migrant Domestic Workers in Chinese Smart Homes
par: He, Shijing, et autres
Publié: (2025)
par: He, Shijing, et autres
Publié: (2025)
"I'm 73, you can't expect me to have multiple passwords": Password Management Concerns and Solutions of Irish Older Adults
par: Sheil, Ashley, et autres
Publié: (2025)
par: Sheil, Ashley, et autres
Publié: (2025)
"Your Doctor is Spying on You": An Analysis of Data Practices in Mobile Healthcare Applications
par: Stevenson, Luke, et autres
Publié: (2025)
par: Stevenson, Luke, et autres
Publié: (2025)
Practitioners' Perspectives on a Differential Privacy Deployment Registry
par: Nanayakkara, Priyanka, et autres
Publié: (2025)
par: Nanayakkara, Priyanka, et autres
Publié: (2025)
Cyber Security Educational Games for Children: A Systematic Literature Review
par: Damenu, Temesgen Kitaw, et autres
Publié: (2025)
par: Damenu, Temesgen Kitaw, et autres
Publié: (2025)
Evidence of Cognitive Biases in Capture-the-Flag Cybersecurity Competitions
par: Carreira, Carolina, et autres
Publié: (2025)
par: Carreira, Carolina, et autres
Publié: (2025)
Persuasion and Phishing: Analysing the Interplay of Persuasion Tactics in Cyber Threats
par: Khadka, Kalam
Publié: (2024)
par: Khadka, Kalam
Publié: (2024)
Measuring User Perceived Security of Mobile Banking Applications
par: Apaua, Richard, et autres
Publié: (2022)
par: Apaua, Richard, et autres
Publié: (2022)
The Third-Party Access Effect: An Overlooked Challenge in Secondary Use of Educational Real-World Data
par: Ito, Hibiki, et autres
Publié: (2026)
par: Ito, Hibiki, et autres
Publié: (2026)
Mitigating Smishing: Challenges and Future Work
par: Faklaris, Cori
Publié: (2024)
par: Faklaris, Cori
Publié: (2024)
Are Security Cues Static? Rethinking Warning and Trust Indicators for Life Transitions
par: Tabassum, Sarah
Publié: (2026)
par: Tabassum, Sarah
Publié: (2026)
Privacy Requirements and Realities of Digital Public Goods
par: Gopi, Geetika, et autres
Publié: (2024)
par: Gopi, Geetika, et autres
Publié: (2024)
Learning from Mistakes: Can LLM Self-Recover after Misalignment?
par: Sorokoletova, Olga E., et autres
Publié: (2026)
par: Sorokoletova, Olga E., et autres
Publié: (2026)
Web Privacy based on Contextual Integrity: Measuring the Collapse of Online Contexts
par: Sivan-Sevilla, Ido, et autres
Publié: (2024)
par: Sivan-Sevilla, Ido, et autres
Publié: (2024)
Centering Policy and Practice: Research Gaps around Usable Differential Privacy
par: Cummings, Rachel, et autres
Publié: (2024)
par: Cummings, Rachel, et autres
Publié: (2024)
The Users' Perspective on the Privacy-Utility Trade-offs in Health Recommender Systems
par: Valdez, André Calero, et autres
Publié: (2018)
par: Valdez, André Calero, et autres
Publié: (2018)
Shortchanged: Uncovering and Analyzing Intimate Partner Financial Abuse in Consumer Complaints
par: Bhattacharya, Arkaprabha, et autres
Publié: (2024)
par: Bhattacharya, Arkaprabha, et autres
Publié: (2024)
Access Over Deception: Fighting Deceptive Patterns through Accessibility
par: Pellkvist, Tobias, et autres
Publié: (2026)
par: Pellkvist, Tobias, et autres
Publié: (2026)
Digital Deception: Generative Artificial Intelligence in Social Engineering and Phishing
par: Schmitt, Marc, et autres
Publié: (2023)
par: Schmitt, Marc, et autres
Publié: (2023)
Before the Vicious Cycle Starts: Preventing Burnout Across SOC Roles Through Flow-Aligned Design
par: Thimmaraju, Kashyap, et autres
Publié: (2026)
par: Thimmaraju, Kashyap, et autres
Publié: (2026)
When Feasibility of Fairness Audits Relies on Willingness to Share Data: Examining User Acceptance of Multi-Party Computation Protocols for Fairness Monitoring
par: He, Changyang, et autres
Publié: (2026)
par: He, Changyang, et autres
Publié: (2026)
When Friction Helps: Transaction Confirmation Improves Decision Quality in Blockchain Interactions
par: Chen, Eason, et autres
Publié: (2026)
par: Chen, Eason, et autres
Publié: (2026)
A Survey on the Principles of Persuasion as a Social Engineering Strategy in Phishing
par: Khadka, Kalam, et autres
Publié: (2024)
par: Khadka, Kalam, et autres
Publié: (2024)
Documents similaires
-
Understanding Fanchuan in Livestreaming Platforms: A New Form of Online Antisocial Behavior
par: Wei, Yiluo, et autres
Publié: (2025) -
Understanding the Consequences of VTuber Reincarnation
par: Wei, Yiluo, et autres
Publié: (2026) -
Virtual Stars, Real Fans: Understanding the VTuber Ecosystem
par: Wei, Yiluo, et autres
Publié: (2025) -
Even More Kawaii than Real-Person-Driven VTubers? Understanding How Viewers Perceive AI-Driven VTubers
par: Wei, Yiluo, et autres
Publié: (2025) -
How Generative AI Empowers Attackers and Defenders Across the Trust & Safety Landscape
par: Kelley, Patrick Gage, et autres
Publié: (2025)