Personalized Attacks of Social Engineering in Multi-turn Conversations: LLM Agents for Simulation and Detection
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kumarage, Tharindu, Johnson, Cameron, Adams, Jadie, Ai, Lin, Kirchner, Matthias, Hoogs, Anthony, Garland, Joshua, Hirschberg, Julia, Basharat, Arslan, Liu, Huan |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Defending Against Social Engineering Attacks in the Age of LLMs
par: Ai, Lin, et autres
Publié: (2024)
par: Ai, Lin, et autres
Publié: (2024)
ALIGN: Prompt-based Attribute Alignment for Reliable, Responsible, and Personalized LLM-based Decision-Making
par: Ravichandran, Bharadwaj, et autres
Publié: (2025)
par: Ravichandran, Bharadwaj, et autres
Publié: (2025)
Harnessing Artificial Intelligence to Combat Online Hate: Exploring the Challenges and Opportunities of Large Language Models in Hate Speech Detection
par: Kumarage, Tharindu, et autres
Publié: (2024)
par: Kumarage, Tharindu, et autres
Publié: (2024)
Steerable Pluralism: Pluralistic Alignment via Few-Shot Comparative Regression
par: Adams, Jadie, et autres
Publié: (2025)
par: Adams, Jadie, et autres
Publié: (2025)
Aligning Machiavellian Agents: Behavior Steering via Test-Time Policy Shaping
par: Mujtaba, Dena, et autres
Publié: (2025)
par: Mujtaba, Dena, et autres
Publié: (2025)
A Survey of AI-generated Text Forensic Systems: Detection, Attribution, and Characterization
par: Kumarage, Tharindu, et autres
Publié: (2024)
par: Kumarage, Tharindu, et autres
Publié: (2024)
Can Knowledge Graphs Reduce Hallucinations in LLMs? : A Survey
par: Agrawal, Garima, et autres
Publié: (2023)
par: Agrawal, Garima, et autres
Publié: (2023)
Mindful-RAG: A Study of Points of Failure in Retrieval Augmented Generation
par: Agrawal, Garima, et autres
Publié: (2024)
par: Agrawal, Garima, et autres
Publié: (2024)
Point2SSM++: Self-Supervised Learning of Anatomical Shape Models from Point Clouds
par: Adams, Jadie, et autres
Publié: (2024)
par: Adams, Jadie, et autres
Publié: (2024)
Point2SSM: Learning Morphological Variations of Anatomies from Point Cloud
par: Adams, Jadie, et autres
Publié: (2023)
par: Adams, Jadie, et autres
Publié: (2023)
Cross-Platform Hate Speech Detection with Weakly Supervised Causal Disentanglement
par: Sheth, Paras, et autres
Publié: (2024)
par: Sheth, Paras, et autres
Publié: (2024)
Kaleidoscopic Teaming in Multi Agent Simulations
par: Mehrabi, Ninareh, et autres
Publié: (2025)
par: Mehrabi, Ninareh, et autres
Publié: (2025)
Animating Language Practice: Engagement with Stylized Conversational Agents in Japanese Learning
par: Rackauckas, Zackary, et autres
Publié: (2025)
par: Rackauckas, Zackary, et autres
Publié: (2025)
RedditESS: A Mental Health Social Support Interaction Dataset -- Understanding Effective Social Support to Refine AI-Driven Support Tools
par: Alghamdi, Zeyad, et autres
Publié: (2025)
par: Alghamdi, Zeyad, et autres
Publié: (2025)
Weakly Supervised Bayesian Shape Modeling from Unsegmented Medical Images
par: Adams, Jadie, et autres
Publié: (2024)
par: Adams, Jadie, et autres
Publié: (2024)
Exploring Robustness in Doctor-Patient Conversation Summarization: An Analysis of Out-of-Domain SOAP Notes
par: Chen, Yu-Wen, et autres
Publié: (2024)
par: Chen, Yu-Wen, et autres
Publié: (2024)
SCorP: Statistics-Informed Dense Correspondence Prediction Directly from Unsegmented Medical Images
par: Iyer, Krithika, et autres
Publié: (2024)
par: Iyer, Krithika, et autres
Publié: (2024)
Towards LLM-guided Causal Explainability for Black-box Text Classifiers
par: Bhattacharjee, Amrita, et autres
Publié: (2023)
par: Bhattacharjee, Amrita, et autres
Publié: (2023)
Zero-shot LLM-guided Counterfactual Generation: A Case Study on NLP Model Evaluation
par: Bhattacharjee, Amrita, et autres
Publié: (2024)
par: Bhattacharjee, Amrita, et autres
Publié: (2024)
Re:Member: Emotional Question Generation from Personal Memories
par: Rackauckas, Zackary, et autres
Publié: (2025)
par: Rackauckas, Zackary, et autres
Publié: (2025)
Can LLMs Improve Multimodal Fact-Checking by Asking Relevant Questions?
par: Beigi, Alimohammad, et autres
Publié: (2024)
par: Beigi, Alimohammad, et autres
Publié: (2024)
QASE Enhanced PLMs: Improved Control in Text Generation for MRC
par: Ai, Lin, et autres
Publié: (2024)
par: Ai, Lin, et autres
Publié: (2024)
Enhancing Pre-Trained Generative Language Models with Question Attended Span Extraction on Machine Reading Comprehension
par: Ai, Lin, et autres
Publié: (2024)
par: Ai, Lin, et autres
Publié: (2024)
Estimation and Analysis of Slice Propagation Uncertainty in 3D Anatomy Segmentation
par: Nihalaani, Rachaell, et autres
Publié: (2024)
par: Nihalaani, Rachaell, et autres
Publié: (2024)
REBAR: Reference Ethical Benchmark for Autonomy Readiness
par: Diller, Jonathan, et autres
Publié: (2026)
par: Diller, Jonathan, et autres
Publié: (2026)
Ontology-Aware RAG for Improved Question-Answering in Cybersecurity Education
par: Zhao, Chengshuai, et autres
Publié: (2024)
par: Zhao, Chengshuai, et autres
Publié: (2024)
VoxRAG: A Step Toward Transcription-Free RAG Systems in Spoken Question Answering
par: Rackauckas, Zackary, et autres
Publié: (2025)
par: Rackauckas, Zackary, et autres
Publié: (2025)
Comparative Evaluation of Expressive Japanese Character Text-to-Speech with VITS and Style-BERT-VITS2
par: Rackauckas, Zackary, et autres
Publié: (2025)
par: Rackauckas, Zackary, et autres
Publié: (2025)
EAGLE: A Domain Generalization Framework for AI-generated Text Detection
par: Bhattacharjee, Amrita, et autres
Publié: (2024)
par: Bhattacharjee, Amrita, et autres
Publié: (2024)
NovAScore: A New Automated Metric for Evaluating Document Level Novelty
par: Ai, Lin, et autres
Publié: (2024)
par: Ai, Lin, et autres
Publié: (2024)
Detecting Mental Manipulation in Speech via Synthetic Multi-Speaker Dialogue
par: Chen, Run, et autres
Publié: (2026)
par: Chen, Run, et autres
Publié: (2026)
An Interactive Paradigm for Deep Research
par: Ai, Lin, et autres
Publié: (2026)
par: Ai, Lin, et autres
Publié: (2026)
Adaptable Non-parametric Approach for Speech-based Symptom Assessment: Isolating Private Medical Data in a Retrieval Datastore
par: Chen, Yu-Wen, et autres
Publié: (2025)
par: Chen, Yu-Wen, et autres
Publié: (2025)
A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations
par: Li, Li, et autres
Publié: (2025)
par: Li, Li, et autres
Publié: (2025)
Token Statistics Reveal Conversational Drift in Multi-turn LLM Interaction
par: Hafez, Wael, et autres
Publié: (2026)
par: Hafez, Wael, et autres
Publié: (2026)
LA RELACIÓN ENTRE ADHERENCIA TERAPÉUTICA Y CALIDAD DE VIDA EN LA HIPERTENSIÓN ARTERIAL
par: Silvina Hirschberg
Publié: (2014)
par: Silvina Hirschberg
Publié: (2014)
La autonomía de las escuelas: un estudio de casos sobre la implementación en nuestro país
par: Sonia Hirschberg
Publié: (2005)
par: Sonia Hirschberg
Publié: (2005)
GMTRouter: Personalized LLM Router over Multi-turn User Interactions
par: Xie, Encheng, et autres
Publié: (2025)
par: Xie, Encheng, et autres
Publié: (2025)
CREAM: Comparison-Based Reference-Free ELO-Ranked Automatic Evaluation for Meeting Summarization
par: Gong, Ziwei, et autres
Publié: (2024)
par: Gong, Ziwei, et autres
Publié: (2024)
SYNTHEMPATHY: A Scalable Empathy Corpus Generated Using LLMs Without Any Crowdsourcing
par: Chen, Run, et autres
Publié: (2025)
par: Chen, Run, et autres
Publié: (2025)
Documents similaires
-
Defending Against Social Engineering Attacks in the Age of LLMs
par: Ai, Lin, et autres
Publié: (2024) -
ALIGN: Prompt-based Attribute Alignment for Reliable, Responsible, and Personalized LLM-based Decision-Making
par: Ravichandran, Bharadwaj, et autres
Publié: (2025) -
Harnessing Artificial Intelligence to Combat Online Hate: Exploring the Challenges and Opportunities of Large Language Models in Hate Speech Detection
par: Kumarage, Tharindu, et autres
Publié: (2024) -
Steerable Pluralism: Pluralistic Alignment via Few-Shot Comparative Regression
par: Adams, Jadie, et autres
Publié: (2025) -
Aligning Machiavellian Agents: Behavior Steering via Test-Time Policy Shaping
par: Mujtaba, Dena, et autres
Publié: (2025)