SNEAK: Evaluating Strategic Communication and Information Leakage in Large Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Avsian, Adar, Heck, Larry |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Emotions Where Art Thou: Understanding and Characterizing the Emotional Latent Space of Large Language Models
by: Reichman, Benjamin, et al.
Published: (2025)
by: Reichman, Benjamin, et al.
Published: (2025)
FLEx: Language Modeling with Few-shot Language Explanations
by: Avsian, Adar, et al.
Published: (2026)
by: Avsian, Adar, et al.
Published: (2026)
Reading with Intent -- Neutralizing Intent
by: Reichman, Benjamin, et al.
Published: (2025)
by: Reichman, Benjamin, et al.
Published: (2025)
iTBLS: A Dataset of Interactive Conversations Over Tabular Information
by: Sundar, Anirudh, et al.
Published: (2024)
by: Sundar, Anirudh, et al.
Published: (2024)
Emotion is Not Just a Label: Latent Emotional Factors in LLM Processing
by: Reichman, Benjamin, et al.
Published: (2026)
by: Reichman, Benjamin, et al.
Published: (2026)
Emotional RAG LLMs: Reading Comprehension for the Open Internet
by: Reichman, Benjamin, et al.
Published: (2024)
by: Reichman, Benjamin, et al.
Published: (2024)
Evaluating Cross-Lingual Unlearning in Multilingual Language Models
by: Lizzo, Tyler, et al.
Published: (2026)
by: Lizzo, Tyler, et al.
Published: (2026)
UNLEARN Efficient Removal of Knowledge in Large Language Models
by: Lizzo, Tyler, et al.
Published: (2024)
by: Lizzo, Tyler, et al.
Published: (2024)
Large Body Language Models
by: Punjwani, Saif, et al.
Published: (2024)
by: Punjwani, Saif, et al.
Published: (2024)
Unlearning in LLMs: Methods, Evaluation, and Open Challenges
by: Lizzo, Tyler, et al.
Published: (2026)
by: Lizzo, Tyler, et al.
Published: (2026)
Spoken Conversational Agents with Large Language Models
by: Yang, Chao-Han Huck, et al.
Published: (2025)
by: Yang, Chao-Han Huck, et al.
Published: (2025)
Allo-AVA: A Large-Scale Multimodal Conversational AI Dataset for Allocentric Avatar Gesture Animation
by: Punjwani, Saif, et al.
Published: (2024)
by: Punjwani, Saif, et al.
Published: (2024)
LEGO: Language Model Building Blocks
by: Bhansali, Shrenik, et al.
Published: (2024)
by: Bhansali, Shrenik, et al.
Published: (2024)
Are Human Conversations Special? A Large Language Model Perspective
by: Jawale, Toshish, et al.
Published: (2024)
by: Jawale, Toshish, et al.
Published: (2024)
Evaluation Methodology for Large Language Models for Multilingual Document Question and Answer
by: Kahana, Adar, et al.
Published: (2024)
by: Kahana, Adar, et al.
Published: (2024)
Dense Passage Retrieval: Is it Retrieving?
by: Reichman, Benjamin, et al.
Published: (2024)
by: Reichman, Benjamin, et al.
Published: (2024)
Evaluating Counterfactual Strategic Reasoning in Large Language Models
by: Georgousis, Dimitrios, et al.
Published: (2026)
by: Georgousis, Dimitrios, et al.
Published: (2026)
Weight-of-Thought Reasoning: Exploring Neural Network Weights for Enhanced LLM Reasoning
by: Punjwani, Saif, et al.
Published: (2025)
by: Punjwani, Saif, et al.
Published: (2025)
TEMPER: Testing Emotional Perturbation in Quantitative Reasoning
by: Dokme, Atahan, et al.
Published: (2026)
by: Dokme, Atahan, et al.
Published: (2026)
Benchmarking Benchmark Leakage in Large Language Models
by: Xu, Ruijie, et al.
Published: (2024)
by: Xu, Ruijie, et al.
Published: (2024)
LLMsPark: A Benchmark for Evaluating Large Language Models in Strategic Gaming Contexts
by: Chen, Junhao, et al.
Published: (2025)
by: Chen, Junhao, et al.
Published: (2025)
Task-Centric Acceleration of Small-Language Models
by: Tsur, Dor, et al.
Published: (2026)
by: Tsur, Dor, et al.
Published: (2026)
gTBLS: Generating Tables from Text by Conditional Question Answering
by: Sundar, Anirudh, et al.
Published: (2024)
by: Sundar, Anirudh, et al.
Published: (2024)
Foresight Optimization for Strategic Reasoning in Large Language Models
by: Wang, Jiashuo, et al.
Published: (2026)
by: Wang, Jiashuo, et al.
Published: (2026)
Sequence-Level Leakage Risk of Training Data in Large Language Models
by: Tiwari, Trishita, et al.
Published: (2024)
by: Tiwari, Trishita, et al.
Published: (2024)
Evaluating Large Language Models on the 2026 Korean CSAT Mathematics Exam: Measuring Mathematical Ability in a Zero-Data-Leakage Setting
by: Pyeon, Goun, et al.
Published: (2025)
by: Pyeon, Goun, et al.
Published: (2025)
Privacy-Aware Decoding: Mitigating Privacy Leakage of Large Language Models in Retrieval-Augmented Generation
by: Wang, Haoran, et al.
Published: (2025)
by: Wang, Haoran, et al.
Published: (2025)
On Leakage of Code Generation Evaluation Datasets
by: Matton, Alexandre, et al.
Published: (2024)
by: Matton, Alexandre, et al.
Published: (2024)
Sanitize Your Responses: Mitigating Privacy Leakage in Large Language Models
by: Fu, Wenjie, et al.
Published: (2025)
by: Fu, Wenjie, et al.
Published: (2025)
LLM as a Mastermind: A Survey of Strategic Reasoning with Large Language Models
by: Zhang, Yadong, et al.
Published: (2024)
by: Zhang, Yadong, et al.
Published: (2024)
Strategic Insights in Human and Large Language Model Tactics at Word Guessing Games
by: Rikters, Matīss, et al.
Published: (2024)
by: Rikters, Matīss, et al.
Published: (2024)
Beyond Screenshots: Evaluating VLMs' Understanding of UI Animations
by: Liang, Chen, et al.
Published: (2026)
by: Liang, Chen, et al.
Published: (2026)
Quantifying Association Capabilities of Large Language Models and Its Implications on Privacy Leakage
by: Shao, Hanyin, et al.
Published: (2023)
by: Shao, Hanyin, et al.
Published: (2023)
The Curious Language Model: Strategic Test-Time Information Acquisition
by: Cooper, Michael, et al.
Published: (2025)
by: Cooper, Michael, et al.
Published: (2025)
SeaPO: Strategic Error Amplification for Robust Preference Optimization of Large Language Models
by: Rao, Jun, et al.
Published: (2025)
by: Rao, Jun, et al.
Published: (2025)
Cooperative Strategic Planning Enhances Reasoning Capabilities in Large Language Models
by: Wang, Danqing, et al.
Published: (2024)
by: Wang, Danqing, et al.
Published: (2024)
Scaling Down Semantic Leakage: Investigating Associative Bias in Smaller Language Models
by: Smilga, Veronika
Published: (2025)
by: Smilga, Veronika
Published: (2025)
Am I Blue or Is My Hobby Counting Teardrops? Expression Leakage in Large Language Models as a Symptom of Irrelevancy Disruption
by: Köprü, Berkay, et al.
Published: (2025)
by: Köprü, Berkay, et al.
Published: (2025)
AI Sandbagging: Language Models can Strategically Underperform on Evaluations
by: van der Weij, Teun, et al.
Published: (2024)
by: van der Weij, Teun, et al.
Published: (2024)
Hallucinations or Attention Misdirection? The Path to Strategic Value Extraction in Business Using Large Language Models
by: Ioste, Aline
Published: (2024)
by: Ioste, Aline
Published: (2024)
Similar Items
-
Emotions Where Art Thou: Understanding and Characterizing the Emotional Latent Space of Large Language Models
by: Reichman, Benjamin, et al.
Published: (2025) -
FLEx: Language Modeling with Few-shot Language Explanations
by: Avsian, Adar, et al.
Published: (2026) -
Reading with Intent -- Neutralizing Intent
by: Reichman, Benjamin, et al.
Published: (2025) -
iTBLS: A Dataset of Interactive Conversations Over Tabular Information
by: Sundar, Anirudh, et al.
Published: (2024) -
Emotion is Not Just a Label: Latent Emotional Factors in LLM Processing
by: Reichman, Benjamin, et al.
Published: (2026)