Chinese Cyberbullying Detection: Dataset, Method, and Validation
Fuente:
arXiv
Saved in:
| Main Authors: | Zhu, Yi, Zou, Xin, Wu, Xindong |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
SynBullying: A Multi LLM Synthetic Conversational Dataset for Cyberbullying Detection
by: Kazemi, Arefeh, et al.
Published: (2025)
by: Kazemi, Arefeh, et al.
Published: (2025)
Relink: Constructing Query-Driven Evidence Graph On-the-Fly for GraphRAG
by: Huang, Manzong, et al.
Published: (2026)
by: Huang, Manzong, et al.
Published: (2026)
Moderating Harm: Benchmarking Large Language Models for Cyberbullying Detection in YouTube Comments
by: Muminovic, Amel
Published: (2025)
by: Muminovic, Amel
Published: (2025)
MultiJustice: A Chinese Dataset for Multi-Party, Multi-Charge Legal Prediction
by: Wang, Xiao, et al.
Published: (2025)
by: Wang, Xiao, et al.
Published: (2025)
CFEVER: A Chinese Fact Extraction and VERification Dataset
by: Lin, Ying-Jia, et al.
Published: (2024)
by: Lin, Ying-Jia, et al.
Published: (2024)
A Hybrid DeBERTa and Gated Broad Learning System for Cyberbullying Detection in English Text
by: Kumar, Devesh
Published: (2025)
by: Kumar, Devesh
Published: (2025)
System Report for CCL25-Eval Task 10: Prompt-Driven Large Language Model Merge for Fine-Grained Chinese Hate Speech Detection
by: Wu, Binglin, et al.
Published: (2025)
by: Wu, Binglin, et al.
Published: (2025)
MCFEND: A Multi-source Benchmark Dataset for Chinese Fake News Detection
by: Li, Yupeng, et al.
Published: (2024)
by: Li, Yupeng, et al.
Published: (2024)
Give Us the Facts: Enhancing Large Language Models with Knowledge Graphs for Fact-aware Language Modeling
by: Yang, Linyao, et al.
Published: (2023)
by: Yang, Linyao, et al.
Published: (2023)
Synthetic vs. Gold: The Role of LLM Generated Labels and Data in Cyberbullying Detection
by: Kazemi, Arefeh, et al.
Published: (2025)
by: Kazemi, Arefeh, et al.
Published: (2025)
CDTP: A Large-Scale Chinese Data-Text Pair Dataset for Comprehensive Evaluation of Chinese LLMs
by: Wu, Chengwei, et al.
Published: (2025)
by: Wu, Chengwei, et al.
Published: (2025)
Towards Comprehensive Detection of Chinese Harmful Memes
by: Lu, Junyu, et al.
Published: (2024)
by: Lu, Junyu, et al.
Published: (2024)
Benchmarking Large Language Models on CFLUE -- A Chinese Financial Language Understanding Evaluation Dataset
by: Zhu, Jie, et al.
Published: (2024)
by: Zhu, Jie, et al.
Published: (2024)
ClaimGen-CN: A Large-scale Chinese Dataset for Legal Claim Generation
by: Zhou, Siying, et al.
Published: (2025)
by: Zhou, Siying, et al.
Published: (2025)
A Piece of Theatre: Investigating How Teachers Design LLM Chatbots to Assist Adolescent Cyberbullying Education
by: Hedderich, Michael A., et al.
Published: (2024)
by: Hedderich, Michael A., et al.
Published: (2024)
Unifying Large Language Models and Knowledge Graphs: A Roadmap
by: Pan, Shirui, et al.
Published: (2023)
by: Pan, Shirui, et al.
Published: (2023)
Knowledge Reasoning Language Model: Unifying Knowledge and Language for Inductive Knowledge Graph Reasoning
by: Zhuo, Xingrui, et al.
Published: (2025)
by: Zhuo, Xingrui, et al.
Published: (2025)
Deep Learning Based Cyberbullying Detection in Bangla Language
by: Nath, Sristy Shidul, et al.
Published: (2024)
by: Nath, Sristy Shidul, et al.
Published: (2024)
Benchmarking the Detection of LLMs-Generated Modern Chinese Poetry
by: Wang, Shanshan, et al.
Published: (2025)
by: Wang, Shanshan, et al.
Published: (2025)
Sentiment Analysis of Cyberbullying Data in Social Media
by: Susmitha, Arvapalli Sai, et al.
Published: (2024)
by: Susmitha, Arvapalli Sai, et al.
Published: (2024)
COIG-Writer: A High-Quality Dataset for Chinese Creative Writing with Thought Processes
by: Li, Yunwen, et al.
Published: (2025)
by: Li, Yunwen, et al.
Published: (2025)
SCCD: A Session-based Dataset for Chinese Cyberbullying Detection
by: Yang, Qingpo, et al.
Published: (2025)
by: Yang, Qingpo, et al.
Published: (2025)
Closing the Data Loop: Using OpenDataArena to Engineer Superior Training Datasets
by: Gao, Xin, et al.
Published: (2025)
by: Gao, Xin, et al.
Published: (2025)
The Use of a Large Language Model for Cyberbullying Detection
by: Ogunleye, Bayode, et al.
Published: (2024)
by: Ogunleye, Bayode, et al.
Published: (2024)
CSCD-NS: a Chinese Spelling Check Dataset for Native Speakers
by: Hu, Yong, et al.
Published: (2022)
by: Hu, Yong, et al.
Published: (2022)
CFMS: Towards Explainable and Fine-Grained Chinese Multimodal Sarcasm Detection Benchmark
by: Zhang, Junzhao, et al.
Published: (2026)
by: Zhang, Junzhao, et al.
Published: (2026)
Do Chinese models speak Chinese languages?
by: Wen-Yi, Andrea W, et al.
Published: (2025)
by: Wen-Yi, Andrea W, et al.
Published: (2025)
A Fusion of context-aware based BanglaBERT and Two-Layer Stacked LSTM Framework for Multi-Label Cyberbullying Detection
by: Raquib, Mirza, et al.
Published: (2026)
by: Raquib, Mirza, et al.
Published: (2026)
BianCang: A Traditional Chinese Medicine Large Language Model
by: Wei, Sibo, et al.
Published: (2024)
by: Wei, Sibo, et al.
Published: (2024)
MERaLiON-TextLLM: Cross-Lingual Understanding of Large Language Models in Chinese, Indonesian, Malay, and Singlish
by: Huang, Xin, et al.
Published: (2024)
by: Huang, Xin, et al.
Published: (2024)
CMDAG: A Chinese Metaphor Dataset with Annotated Grounds as CoT for Boosting Metaphor Generation
by: Shao, Yujie, et al.
Published: (2024)
by: Shao, Yujie, et al.
Published: (2024)
Rethinking LLM Language Adaptation: A Case Study on Chinese Mixtral
by: Cui, Yiming, et al.
Published: (2024)
by: Cui, Yiming, et al.
Published: (2024)
Detection Method for Prompt Injection by Integrating Pre-trained Model and Heuristic Feature Engineering
by: Ji, Yi, et al.
Published: (2025)
by: Ji, Yi, et al.
Published: (2025)
Classic4Children: Adapting Chinese Literary Classics for Children with Large Language Model
by: Chen, Jiali, et al.
Published: (2025)
by: Chen, Jiali, et al.
Published: (2025)
MemeCMD: An Automatically Generated Chinese Multi-turn Dialogue Dataset with Contextually Retrieved Memes
by: Wang, Yuheng, et al.
Published: (2025)
by: Wang, Yuheng, et al.
Published: (2025)
A GAN and LLM-Driven Data Augmentation Framework for Dynamic Linguistic Pattern Modeling in Chinese Sarcasm Detection
by: Wang, Wenxian, et al.
Published: (2026)
by: Wang, Wenxian, et al.
Published: (2026)
Chinese Offensive Language Detection:Current Status and Future Directions
by: Xiao, Yunze, et al.
Published: (2024)
by: Xiao, Yunze, et al.
Published: (2024)
Hengqin-RA-v1: Advanced Large Language Model for Diagnosis and Treatment of Rheumatoid Arthritis with Dataset based Traditional Chinese Medicine
by: Liu, Yishen, et al.
Published: (2025)
by: Liu, Yishen, et al.
Published: (2025)
A Large-Scale Dataset for Molecular Structure-Language Description via a Rule-Regularized Method
by: Cai, Feiyang, et al.
Published: (2026)
by: Cai, Feiyang, et al.
Published: (2026)
TCMBench: A Comprehensive Benchmark for Evaluating Large Language Models in Traditional Chinese Medicine
by: Yue, Wenjing, et al.
Published: (2024)
by: Yue, Wenjing, et al.
Published: (2024)
Similar Items
-
SynBullying: A Multi LLM Synthetic Conversational Dataset for Cyberbullying Detection
by: Kazemi, Arefeh, et al.
Published: (2025) -
Relink: Constructing Query-Driven Evidence Graph On-the-Fly for GraphRAG
by: Huang, Manzong, et al.
Published: (2026) -
Moderating Harm: Benchmarking Large Language Models for Cyberbullying Detection in YouTube Comments
by: Muminovic, Amel
Published: (2025) -
MultiJustice: A Chinese Dataset for Multi-Party, Multi-Charge Legal Prediction
by: Wang, Xiao, et al.
Published: (2025) -
CFEVER: A Chinese Fact Extraction and VERification Dataset
by: Lin, Ying-Jia, et al.
Published: (2024)