Short-PHD: Detecting Short LLM-generated Text with Topological Data Analysis After Off-topic Content Insertion
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wei, Dongjun, Mao, Minjia, Fang, Xiao, Chau, Michael |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
A General Method for Detecting Information Generated by Large Language Models
par: Mao, Minjia, et autres
Publié: (2025)
par: Mao, Minjia, et autres
Publié: (2025)
Watermarking Low-entropy Generation for Large Language Models: An Unbiased and Low-risk Method
par: Mao, Minjia, et autres
Publié: (2024)
par: Mao, Minjia, et autres
Publié: (2024)
Early Detection of Misinformation for Infodemic Management: A Domain Adaptation Approach
par: Mao, Minjia, et autres
Publié: (2024)
par: Mao, Minjia, et autres
Publié: (2024)
Early Stopping Chain-of-thoughts in Large Language Models
par: Mao, Minjia, et autres
Publié: (2025)
par: Mao, Minjia, et autres
Publié: (2025)
Measuring Stereotype and Deviation Biases in Large Language Models
par: Wang, Daniel, et autres
Publié: (2025)
par: Wang, Daniel, et autres
Publié: (2025)
SEGMENT+: Long Text Processing with Short-Context Language Models
par: Shi, Wei, et autres
Publié: (2024)
par: Shi, Wei, et autres
Publié: (2024)
ShortCheck: Checkworthiness Detection of Multilingual Short-Form Videos
par: Vatndal, Henrik, et autres
Publié: (2025)
par: Vatndal, Henrik, et autres
Publié: (2025)
Learning to Rewrite: Generalized LLM-Generated Text Detection
par: Li, Ran, et autres
Publié: (2024)
par: Li, Ran, et autres
Publié: (2024)
Human Texts Are Outliers: Detecting LLM-generated Texts via Out-of-distribution Detection
par: Zeng, Cong, et autres
Publié: (2025)
par: Zeng, Cong, et autres
Publié: (2025)
An Enhanced Model-based Approach for Short Text Clustering
par: Cheng, Enhao, et autres
Publié: (2025)
par: Cheng, Enhao, et autres
Publié: (2025)
LLMs Enable Bag-of-Texts Representations for Short-Text Clustering
par: Lin, I-Fan, et autres
Publié: (2025)
par: Lin, I-Fan, et autres
Publié: (2025)
IPS: In-Prompt Process Supervision for Short Video Content Moderation
par: Liu, Mingchao, et autres
Publié: (2024)
par: Liu, Mingchao, et autres
Publié: (2024)
Enhancing Short-Text Topic Modeling with LLM-Driven Context Expansion and Prefix-Tuned VAEs
par: Akash, Pritom Saha, et autres
Publié: (2024)
par: Akash, Pritom Saha, et autres
Publié: (2024)
Optimizing Small Transformer-Based Language Models for Multi-Label Sentiment Analysis in Short Texts
par: Neumann, Julius, et autres
Publié: (2025)
par: Neumann, Julius, et autres
Publié: (2025)
Interpretable Text Classification Applied to the Detection of LLM-generated Creative Writing
par: Suvanto, Minerva, et autres
Publié: (2026)
par: Suvanto, Minerva, et autres
Publié: (2026)
Understanding the Effects of Human-written Paraphrases in LLM-generated Text Detection
par: Lau, Hiu Ting, et autres
Publié: (2024)
par: Lau, Hiu Ting, et autres
Publié: (2024)
Unlocking Efficient Long-to-Short LLM Reasoning with Model Merging
par: Wu, Han, et autres
Publié: (2025)
par: Wu, Han, et autres
Publié: (2025)
A Simple Graph Contrastive Learning Framework for Short Text Classification
par: Liu, Yonghao, et autres
Publié: (2025)
par: Liu, Yonghao, et autres
Publié: (2025)
Boosting Short Text Classification with Multi-Source Information Exploration and Dual-Level Contrastive Learning
par: Liu, Yonghao, et autres
Publié: (2025)
par: Liu, Yonghao, et autres
Publié: (2025)
Beyond Easy Wins: A Text Hardness-Aware Benchmark for LLM-generated Text Detection
par: Ayoobi, Navid, et autres
Publié: (2025)
par: Ayoobi, Navid, et autres
Publié: (2025)
GigaCheck: Detecting LLM-generated Content via Object-Centric Span Localization
par: Tolstykh, Irina, et autres
Publié: (2024)
par: Tolstykh, Irina, et autres
Publié: (2024)
Short-form Text Rewriting with Phi Silica
par: Tadimeti, Divya, et autres
Publié: (2026)
par: Tadimeti, Divya, et autres
Publié: (2026)
Training-free LLM-generated Text Detection by Mining Token Probability Sequences
par: Xu, Yihuai, et autres
Publié: (2024)
par: Xu, Yihuai, et autres
Publié: (2024)
Towards LLM-based Autograding for Short Textual Answers
par: Schneider, Johannes, et autres
Publié: (2023)
par: Schneider, Johannes, et autres
Publié: (2023)
Enhancing LLM-Based Short Answer Grading with Retrieval-Augmented Generation
par: Chu, Yucheng, et autres
Publié: (2025)
par: Chu, Yucheng, et autres
Publié: (2025)
Short-circuiting Shortcuts: Mechanistic Investigation of Shortcuts in Text Classification
par: Eshuijs, Leon, et autres
Publié: (2025)
par: Eshuijs, Leon, et autres
Publié: (2025)
Tokenization Falling Short: On Subword Robustness in Large Language Models
par: Chai, Yekun, et autres
Publié: (2024)
par: Chai, Yekun, et autres
Publié: (2024)
MAGE: Machine-generated Text Detection in the Wild
par: Li, Yafu, et autres
Publié: (2023)
par: Li, Yafu, et autres
Publié: (2023)
Linguistically Informed Graph Model and Semantic Contrastive Learning for Korean Short Text Classification
par: Yoo, JaeGeon, et autres
Publié: (2026)
par: Yoo, JaeGeon, et autres
Publié: (2026)
LLM-based Medical Assistant Personalization with Short- and Long-Term Memory Coordination
par: Zhang, Kai, et autres
Publié: (2023)
par: Zhang, Kai, et autres
Publié: (2023)
Emotion Classification in Short English Texts using Deep Learning Techniques
par: Bhat, Siddhanth
Publié: (2024)
par: Bhat, Siddhanth
Publié: (2024)
Cross-cultural Inspiration Detection and Analysis in Real and LLM-generated Social Media Data
par: Ignat, Oana, et autres
Publié: (2024)
par: Ignat, Oana, et autres
Publié: (2024)
DSIPA: Detecting LLM-Generated Texts via Sentiment-Invariant Patterns Divergence Analysis
par: Li, Siyuan, et autres
Publié: (2026)
par: Li, Siyuan, et autres
Publié: (2026)
Robust Detection of LLM-Generated Text: A Comparative Analysis
par: Su, Yongye, et autres
Publié: (2024)
par: Su, Yongye, et autres
Publié: (2024)
MCS-SQL: Leveraging Multiple Prompts and Multiple-Choice Selection For Text-to-SQL Generation
par: Lee, Dongjun, et autres
Publié: (2024)
par: Lee, Dongjun, et autres
Publié: (2024)
GloCOM: A Short Text Neural Topic Model via Global Clustering Context
par: Nguyen, Quang Duc, et autres
Publié: (2024)
par: Nguyen, Quang Duc, et autres
Publié: (2024)
CAST: Achieving Stable LLM-based Text Analysis for Data Analytics
par: Xie, Jinxiang, et autres
Publié: (2026)
par: Xie, Jinxiang, et autres
Publié: (2026)
Augmenting Bias Detection in LLMs Using Topological Data Analysis
par: Varadarajan, Keshav, et autres
Publié: (2025)
par: Varadarajan, Keshav, et autres
Publié: (2025)
DAHL: Domain-specific Automated Hallucination Evaluation of Long-Form Text through a Benchmark Dataset in Biomedicine
par: Seo, Jean, et autres
Publié: (2024)
par: Seo, Jean, et autres
Publié: (2024)
Are LLMs Effective Backbones for Fine-tuning? An Experimental Investigation of Supervised LLMs on Chinese Short Text Matching
par: Liu, Shulin, et autres
Publié: (2024)
par: Liu, Shulin, et autres
Publié: (2024)
Documents similaires
-
A General Method for Detecting Information Generated by Large Language Models
par: Mao, Minjia, et autres
Publié: (2025) -
Watermarking Low-entropy Generation for Large Language Models: An Unbiased and Low-risk Method
par: Mao, Minjia, et autres
Publié: (2024) -
Early Detection of Misinformation for Infodemic Management: A Domain Adaptation Approach
par: Mao, Minjia, et autres
Publié: (2024) -
Early Stopping Chain-of-thoughts in Large Language Models
par: Mao, Minjia, et autres
Publié: (2025) -
Measuring Stereotype and Deviation Biases in Large Language Models
par: Wang, Daniel, et autres
Publié: (2025)