Chinese Cyberbullying Detection: Dataset, Method, and Validation
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhu, Yi, Zou, Xin, Wu, Xindong |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
SynBullying: A Multi LLM Synthetic Conversational Dataset for Cyberbullying Detection
por: Kazemi, Arefeh, et al.
Publicado: (2025)
por: Kazemi, Arefeh, et al.
Publicado: (2025)
Relink: Constructing Query-Driven Evidence Graph On-the-Fly for GraphRAG
por: Huang, Manzong, et al.
Publicado: (2026)
por: Huang, Manzong, et al.
Publicado: (2026)
Moderating Harm: Benchmarking Large Language Models for Cyberbullying Detection in YouTube Comments
por: Muminovic, Amel
Publicado: (2025)
por: Muminovic, Amel
Publicado: (2025)
MultiJustice: A Chinese Dataset for Multi-Party, Multi-Charge Legal Prediction
por: Wang, Xiao, et al.
Publicado: (2025)
por: Wang, Xiao, et al.
Publicado: (2025)
CFEVER: A Chinese Fact Extraction and VERification Dataset
por: Lin, Ying-Jia, et al.
Publicado: (2024)
por: Lin, Ying-Jia, et al.
Publicado: (2024)
A Hybrid DeBERTa and Gated Broad Learning System for Cyberbullying Detection in English Text
por: Kumar, Devesh
Publicado: (2025)
por: Kumar, Devesh
Publicado: (2025)
System Report for CCL25-Eval Task 10: Prompt-Driven Large Language Model Merge for Fine-Grained Chinese Hate Speech Detection
por: Wu, Binglin, et al.
Publicado: (2025)
por: Wu, Binglin, et al.
Publicado: (2025)
MCFEND: A Multi-source Benchmark Dataset for Chinese Fake News Detection
por: Li, Yupeng, et al.
Publicado: (2024)
por: Li, Yupeng, et al.
Publicado: (2024)
Give Us the Facts: Enhancing Large Language Models with Knowledge Graphs for Fact-aware Language Modeling
por: Yang, Linyao, et al.
Publicado: (2023)
por: Yang, Linyao, et al.
Publicado: (2023)
Synthetic vs. Gold: The Role of LLM Generated Labels and Data in Cyberbullying Detection
por: Kazemi, Arefeh, et al.
Publicado: (2025)
por: Kazemi, Arefeh, et al.
Publicado: (2025)
CDTP: A Large-Scale Chinese Data-Text Pair Dataset for Comprehensive Evaluation of Chinese LLMs
por: Wu, Chengwei, et al.
Publicado: (2025)
por: Wu, Chengwei, et al.
Publicado: (2025)
Towards Comprehensive Detection of Chinese Harmful Memes
por: Lu, Junyu, et al.
Publicado: (2024)
por: Lu, Junyu, et al.
Publicado: (2024)
Benchmarking Large Language Models on CFLUE -- A Chinese Financial Language Understanding Evaluation Dataset
por: Zhu, Jie, et al.
Publicado: (2024)
por: Zhu, Jie, et al.
Publicado: (2024)
ClaimGen-CN: A Large-scale Chinese Dataset for Legal Claim Generation
por: Zhou, Siying, et al.
Publicado: (2025)
por: Zhou, Siying, et al.
Publicado: (2025)
A Piece of Theatre: Investigating How Teachers Design LLM Chatbots to Assist Adolescent Cyberbullying Education
por: Hedderich, Michael A., et al.
Publicado: (2024)
por: Hedderich, Michael A., et al.
Publicado: (2024)
Unifying Large Language Models and Knowledge Graphs: A Roadmap
por: Pan, Shirui, et al.
Publicado: (2023)
por: Pan, Shirui, et al.
Publicado: (2023)
Knowledge Reasoning Language Model: Unifying Knowledge and Language for Inductive Knowledge Graph Reasoning
por: Zhuo, Xingrui, et al.
Publicado: (2025)
por: Zhuo, Xingrui, et al.
Publicado: (2025)
Deep Learning Based Cyberbullying Detection in Bangla Language
por: Nath, Sristy Shidul, et al.
Publicado: (2024)
por: Nath, Sristy Shidul, et al.
Publicado: (2024)
Benchmarking the Detection of LLMs-Generated Modern Chinese Poetry
por: Wang, Shanshan, et al.
Publicado: (2025)
por: Wang, Shanshan, et al.
Publicado: (2025)
Sentiment Analysis of Cyberbullying Data in Social Media
por: Susmitha, Arvapalli Sai, et al.
Publicado: (2024)
por: Susmitha, Arvapalli Sai, et al.
Publicado: (2024)
COIG-Writer: A High-Quality Dataset for Chinese Creative Writing with Thought Processes
por: Li, Yunwen, et al.
Publicado: (2025)
por: Li, Yunwen, et al.
Publicado: (2025)
SCCD: A Session-based Dataset for Chinese Cyberbullying Detection
por: Yang, Qingpo, et al.
Publicado: (2025)
por: Yang, Qingpo, et al.
Publicado: (2025)
Closing the Data Loop: Using OpenDataArena to Engineer Superior Training Datasets
por: Gao, Xin, et al.
Publicado: (2025)
por: Gao, Xin, et al.
Publicado: (2025)
The Use of a Large Language Model for Cyberbullying Detection
por: Ogunleye, Bayode, et al.
Publicado: (2024)
por: Ogunleye, Bayode, et al.
Publicado: (2024)
CSCD-NS: a Chinese Spelling Check Dataset for Native Speakers
por: Hu, Yong, et al.
Publicado: (2022)
por: Hu, Yong, et al.
Publicado: (2022)
CFMS: Towards Explainable and Fine-Grained Chinese Multimodal Sarcasm Detection Benchmark
por: Zhang, Junzhao, et al.
Publicado: (2026)
por: Zhang, Junzhao, et al.
Publicado: (2026)
Do Chinese models speak Chinese languages?
por: Wen-Yi, Andrea W, et al.
Publicado: (2025)
por: Wen-Yi, Andrea W, et al.
Publicado: (2025)
A Fusion of context-aware based BanglaBERT and Two-Layer Stacked LSTM Framework for Multi-Label Cyberbullying Detection
por: Raquib, Mirza, et al.
Publicado: (2026)
por: Raquib, Mirza, et al.
Publicado: (2026)
BianCang: A Traditional Chinese Medicine Large Language Model
por: Wei, Sibo, et al.
Publicado: (2024)
por: Wei, Sibo, et al.
Publicado: (2024)
MERaLiON-TextLLM: Cross-Lingual Understanding of Large Language Models in Chinese, Indonesian, Malay, and Singlish
por: Huang, Xin, et al.
Publicado: (2024)
por: Huang, Xin, et al.
Publicado: (2024)
CMDAG: A Chinese Metaphor Dataset with Annotated Grounds as CoT for Boosting Metaphor Generation
por: Shao, Yujie, et al.
Publicado: (2024)
por: Shao, Yujie, et al.
Publicado: (2024)
Rethinking LLM Language Adaptation: A Case Study on Chinese Mixtral
por: Cui, Yiming, et al.
Publicado: (2024)
por: Cui, Yiming, et al.
Publicado: (2024)
Detection Method for Prompt Injection by Integrating Pre-trained Model and Heuristic Feature Engineering
por: Ji, Yi, et al.
Publicado: (2025)
por: Ji, Yi, et al.
Publicado: (2025)
Classic4Children: Adapting Chinese Literary Classics for Children with Large Language Model
por: Chen, Jiali, et al.
Publicado: (2025)
por: Chen, Jiali, et al.
Publicado: (2025)
MemeCMD: An Automatically Generated Chinese Multi-turn Dialogue Dataset with Contextually Retrieved Memes
por: Wang, Yuheng, et al.
Publicado: (2025)
por: Wang, Yuheng, et al.
Publicado: (2025)
A GAN and LLM-Driven Data Augmentation Framework for Dynamic Linguistic Pattern Modeling in Chinese Sarcasm Detection
por: Wang, Wenxian, et al.
Publicado: (2026)
por: Wang, Wenxian, et al.
Publicado: (2026)
Chinese Offensive Language Detection:Current Status and Future Directions
por: Xiao, Yunze, et al.
Publicado: (2024)
por: Xiao, Yunze, et al.
Publicado: (2024)
Hengqin-RA-v1: Advanced Large Language Model for Diagnosis and Treatment of Rheumatoid Arthritis with Dataset based Traditional Chinese Medicine
por: Liu, Yishen, et al.
Publicado: (2025)
por: Liu, Yishen, et al.
Publicado: (2025)
A Large-Scale Dataset for Molecular Structure-Language Description via a Rule-Regularized Method
por: Cai, Feiyang, et al.
Publicado: (2026)
por: Cai, Feiyang, et al.
Publicado: (2026)
TCMBench: A Comprehensive Benchmark for Evaluating Large Language Models in Traditional Chinese Medicine
por: Yue, Wenjing, et al.
Publicado: (2024)
por: Yue, Wenjing, et al.
Publicado: (2024)
Ejemplares similares
-
SynBullying: A Multi LLM Synthetic Conversational Dataset for Cyberbullying Detection
por: Kazemi, Arefeh, et al.
Publicado: (2025) -
Relink: Constructing Query-Driven Evidence Graph On-the-Fly for GraphRAG
por: Huang, Manzong, et al.
Publicado: (2026) -
Moderating Harm: Benchmarking Large Language Models for Cyberbullying Detection in YouTube Comments
por: Muminovic, Amel
Publicado: (2025) -
MultiJustice: A Chinese Dataset for Multi-Party, Multi-Charge Legal Prediction
por: Wang, Xiao, et al.
Publicado: (2025) -
CFEVER: A Chinese Fact Extraction and VERification Dataset
por: Lin, Ying-Jia, et al.
Publicado: (2024)