SELF-PERCEPT: Introspection Improves Large Language Models' Detection of Multi-Person Mental Manipulation in Conversations
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Khanna, Danush, Seth, Pratinav, Murali, Sidhaarth Sredharan, Guru, Aditya Kumar, Shukla, Siddharth, Tyagi, Tanuj, Chaurasia, Sandeep, Ghosh, Kripabandhu |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ReGal: A First Look at PPO-based Legal AI for Judgment Prediction and Summarization in India
par: Nigam, Shubham Kumar, et autres
Publié: (2025)
par: Nigam, Shubham Kumar, et autres
Publié: (2025)
Do the Right Thing, Just Debias! Multi-Category Bias Mitigation Using LLMs
par: Roy, Amartya, et autres
Publié: (2024)
par: Roy, Amartya, et autres
Publié: (2024)
Don't Judge a Book by its Cover: Testing LLMs' Robustness Under Logical Obfuscation
par: Borah, Abhilekh, et autres
Publié: (2026)
par: Borah, Abhilekh, et autres
Publié: (2026)
ObfusQAte: A Proposed Framework to Evaluate LLM Robustness on Obfuscated Factual Question Answering
par: Ghosh, Shubhra, et autres
Publié: (2025)
par: Ghosh, Shubhra, et autres
Publié: (2025)
QuickSilver -- Speeding up LLM Inference through Dynamic Token Halting, KV Skipping, Contextual Token Fusion, and Adaptive Matryoshka Quantization
par: Khanna, Danush, et autres
Publié: (2025)
par: Khanna, Danush, et autres
Publié: (2025)
Legal Judgment Reimagined: PredEx and the Rise of Intelligent AI Interpretation in Indian Courts
par: Nigam, Shubham Kumar, et autres
Publié: (2024)
par: Nigam, Shubham Kumar, et autres
Publié: (2024)
$C$-$ΔΘ$: Circuit-Restricted Weight Arithmetic for Selective Refusal
par: Kasliwal, Aditya, et autres
Publié: (2026)
par: Kasliwal, Aditya, et autres
Publié: (2026)
AgriLLM: Harnessing Transformers for Farmer Queries
par: Didwania, Krish, et autres
Publié: (2024)
par: Didwania, Krish, et autres
Publié: (2024)
RL with Learnable Textual Feedback: A Bilevel Approach
par: Singh, Utsav, et autres
Publié: (2026)
par: Singh, Utsav, et autres
Publié: (2026)
Applicability of Large Language Models and Generative Models for Legal Case Judgement Summarization
par: Deroy, Aniket, et autres
Publié: (2024)
par: Deroy, Aniket, et autres
Publié: (2024)
Bridging the Gap in XAI-Why Reliable Metrics Matter for Explainability and Compliance
par: Seth, Pratinav, et autres
Publié: (2025)
par: Seth, Pratinav, et autres
Publié: (2025)
LapGSR: Laplacian Reconstructive Network for Guided Thermal Super-Resolution
par: Kasliwal, Aditya, et autres
Publié: (2024)
par: Kasliwal, Aditya, et autres
Publié: (2024)
Introspectively Envy-Free and Efficient Allocation of Indivisible Mixed Manna
par: Barman, Siddharth, et autres
Publié: (2025)
par: Barman, Siddharth, et autres
Publié: (2025)
SMITE: Enhancing Fairness in LLMs through Optimal In-Context Example Selection via Dynamic Validation
par: Chhikara, Garima, et autres
Publié: (2025)
par: Chhikara, Garima, et autres
Publié: (2025)
Forgetting That Sticks: Quantization-Permanent Unlearning via Circuit Attribution
par: Sadhu, Saisab, et autres
Publié: (2026)
par: Sadhu, Saisab, et autres
Publié: (2026)
Multilingual Controlled Generation And Gold-Standard-Agnostic Evaluation of Code-Mixed Sentences
par: Gupta, Ayushman, et autres
Publié: (2024)
par: Gupta, Ayushman, et autres
Publié: (2024)
Code-Mixer Ya Nahi: Novel Approaches to Measuring Multilingual LLMs' Code-Mixing Capabilities
par: Gupta, Ayushman, et autres
Publié: (2024)
par: Gupta, Ayushman, et autres
Publié: (2024)
Automated Diagnosis of Lower Limb Alignment Deformities Using Deep Learning and Joint Orientation Analysis
par: Aarti Goswami, et autres
Publié: (2026)
par: Aarti Goswami, et autres
Publié: (2026)
GuideAI: A Real-time Personalized Learning Solution with Adaptive Interventions
par: Shukla, Ananya, et autres
Publié: (2026)
par: Shukla, Ananya, et autres
Publié: (2026)
Gathering Autonomous Mobile Robots Under the Adversarial Defected View Model
par: Shukla, Prakhar, et autres
Publié: (2026)
par: Shukla, Prakhar, et autres
Publié: (2026)
Mapping Clinical Doubt: Locating Linguistic Uncertainty in LLMs
par: Sridhar, Srivarshinee, et autres
Publié: (2025)
par: Sridhar, Srivarshinee, et autres
Publié: (2025)
Pose-Transformation and Radial Distance Clustering for Unsupervised Person Re-identification
par: Seth, Siddharth, et autres
Publié: (2024)
par: Seth, Siddharth, et autres
Publié: (2024)
Few-Shot Fairness: Unveiling LLM's Potential for Fairness-Aware Classification
par: Chhikara, Garima, et autres
Publié: (2024)
par: Chhikara, Garima, et autres
Publié: (2024)
Detecting Conversational Mental Manipulation with Intent-Aware Prompting
par: Ma, Jiayuan, et autres
Publié: (2024)
par: Ma, Jiayuan, et autres
Publié: (2024)
MentalManip: A Dataset For Fine-grained Analysis of Mental Manipulation in Conversations
par: Wang, Yuxin, et autres
Publié: (2024)
par: Wang, Yuxin, et autres
Publié: (2024)
CAMBench-QR : A Structure-Aware Benchmark for Post-Hoc Explanations with QR Understanding
par: Chakraborty, Ritabrata, et autres
Publié: (2025)
par: Chakraborty, Ritabrata, et autres
Publié: (2025)
Enhanced Detection of Conversational Mental Manipulation Through Advanced Prompting Techniques
par: Yang, Ivory, et autres
Publié: (2024)
par: Yang, Ivory, et autres
Publié: (2024)
Dynamic Contexts for Generating Suggestion Questions in RAG Based Conversational Systems
par: Tayal, Anuja, et autres
Publié: (2024)
par: Tayal, Anuja, et autres
Publié: (2024)
MARRO: Multi-headed Attention for Rhetorical Role Labeling in Legal Documents
par: Bambroo, Purbid, et autres
Publié: (2025)
par: Bambroo, Purbid, et autres
Publié: (2025)
Reasoning Is Not All You Need: Examining LLMs for Multi-Turn Mental Health Conversations
par: Chandra, Mohit, et autres
Publié: (2025)
par: Chandra, Mohit, et autres
Publié: (2025)
LaMSUM: Amplifying Voices Against Harassment through LLM Guided Extractive Summarization of User Incident Reports
par: Chhikara, Garima, et autres
Publié: (2024)
par: Chhikara, Garima, et autres
Publié: (2024)
Cyber Slavery Infrastructures: A Socio-Technical Study of Forced Criminality in Transnational Cybercrime
par: Sarkar, Gargi, et autres
Publié: (2025)
par: Sarkar, Gargi, et autres
Publié: (2025)
AdversariaL attacK sAfety aLIgnment(ALKALI): Safeguarding LLMs through GRACE: Geometric Representation-Aware Contrastive Enhancement- Introducing Adversarial Vulnerability Quality Index (AVQI)
par: Khanna, Danush, et autres
Publié: (2025)
par: Khanna, Danush, et autres
Publié: (2025)
MultiVox: A Benchmark for Evaluating Voice Assistants for Multimodal Interactions
par: Selvakumar, Ramaneswaran, et autres
Publié: (2025)
par: Selvakumar, Ramaneswaran, et autres
Publié: (2025)
Chatting with Images for Introspective Visual Thinking
par: Wu, Junfei, et autres
Publié: (2026)
par: Wu, Junfei, et autres
Publié: (2026)
Towards Application Aligned Synthetic Surgical Image Synthesis
par: Venkatesh, Danush Kumar, et autres
Publié: (2025)
par: Venkatesh, Danush Kumar, et autres
Publié: (2025)
DLBacktrace: A Model Agnostic Explainability for any Deep Learning Models
par: Sankarapu, Vinay Kumar, et autres
Publié: (2024)
par: Sankarapu, Vinay Kumar, et autres
Publié: (2024)
Do We Need Large VLMs for Spotting Soccer Actions?
par: Chakraborty, Ritabrata, et autres
Publié: (2025)
par: Chakraborty, Ritabrata, et autres
Publié: (2025)
Causal Reasoning Favors Encoders: On The Limits of Decoder-Only Models
par: Roy, Amartya, et autres
Publié: (2025)
par: Roy, Amartya, et autres
Publié: (2025)
Financial Instruction Following Evaluation (FIFE)
par: Matlin, Glenn, et autres
Publié: (2025)
par: Matlin, Glenn, et autres
Publié: (2025)
Documents similaires
-
ReGal: A First Look at PPO-based Legal AI for Judgment Prediction and Summarization in India
par: Nigam, Shubham Kumar, et autres
Publié: (2025) -
Do the Right Thing, Just Debias! Multi-Category Bias Mitigation Using LLMs
par: Roy, Amartya, et autres
Publié: (2024) -
Don't Judge a Book by its Cover: Testing LLMs' Robustness Under Logical Obfuscation
par: Borah, Abhilekh, et autres
Publié: (2026) -
ObfusQAte: A Proposed Framework to Evaluate LLM Robustness on Obfuscated Factual Question Answering
par: Ghosh, Shubhra, et autres
Publié: (2025) -
QuickSilver -- Speeding up LLM Inference through Dynamic Token Halting, KV Skipping, Contextual Token Fusion, and Adaptive Matryoshka Quantization
par: Khanna, Danush, et autres
Publié: (2025)