Moderating New Waves of Online Hate with Chain-of-Thought Reasoning in Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Vishwamitra, Nishant, Guo, Keyan, Romit, Farhan Tajwar, Ondracek, Isabelle, Cheng, Long, Zhao, Ziming, Hu, Hongxin |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Moderating Illicit Online Image Promotion for Unsafe User-Generated Content Games Using Large Vision-Language Models
por: Guo, Keyan, et al.
Publicado: (2024)
por: Guo, Keyan, et al.
Publicado: (2024)
An Investigation of Large Language Models for Real-World Hate Speech Detection
por: Guo, Keyan, et al.
Publicado: (2024)
por: Guo, Keyan, et al.
Publicado: (2024)
Moderating Embodied Cyber Threats Using Generative AI
por: Guo, Keyan, et al.
Publicado: (2024)
por: Guo, Keyan, et al.
Publicado: (2024)
AI-Cybersecurity Education Through Designing AI-based Cyberharassment Detection Lab
por: Okpala, Ebuka, et al.
Publicado: (2024)
por: Okpala, Ebuka, et al.
Publicado: (2024)
Image Safeguarding: Reasoning with Conditional Vision Language Model and Obfuscating Unsafe Content Counterfactually
por: Bethany, Mazal, et al.
Publicado: (2024)
por: Bethany, Mazal, et al.
Publicado: (2024)
Can Reinforcement Learning Unlock the Hidden Dangers in Aligned Large Language Models?
por: Karkevandi, Mohammad Bahrami, et al.
Publicado: (2024)
por: Karkevandi, Mohammad Bahrami, et al.
Publicado: (2024)
SynAdapt: Learning Adaptive Reasoning in Large Language Models via Synthetic Continuous Chain-of-Thought
por: Wang, Jianwei, et al.
Publicado: (2025)
por: Wang, Jianwei, et al.
Publicado: (2025)
CoT-Evo: Evolutionary Distillation of Chain-of-Thought for Scientific Reasoning
por: Feng, Kehua, et al.
Publicado: (2025)
por: Feng, Kehua, et al.
Publicado: (2025)
Enhancing Event Reasoning in Large Language Models through Instruction Fine-Tuning with Semantic Causal Graphs
por: Bethany, Mazal, et al.
Publicado: (2024)
por: Bethany, Mazal, et al.
Publicado: (2024)
Bounds of Chain-of-Thought Robustness: Reasoning Steps, Embed Norms, and Beyond
por: Wang, Dingzirui, et al.
Publicado: (2025)
por: Wang, Dingzirui, et al.
Publicado: (2025)
On the Hardness of Faithful Chain-of-Thought Reasoning in Large Language Models
por: Tanneru, Sree Harsha, et al.
Publicado: (2024)
por: Tanneru, Sree Harsha, et al.
Publicado: (2024)
Policy Frameworks for Transparent Chain-of-Thought Reasoning in Large Language Models
por: Chen, Yihang, et al.
Publicado: (2025)
por: Chen, Yihang, et al.
Publicado: (2025)
Deciphering Textual Authenticity: A Generalized Strategy through the Lens of Large Language Semantics for Detecting Human vs. Machine-Generated Text
por: Bethany, Mazal, et al.
Publicado: (2024)
por: Bethany, Mazal, et al.
Publicado: (2024)
Lateral Phishing With Large Language Models: A Large Organization Comparative Study
por: Bethany, Mazal, et al.
Publicado: (2024)
por: Bethany, Mazal, et al.
Publicado: (2024)
Harnessing Chain-of-Thought Reasoning in Multimodal Large Language Models for Face Anti-Spoofing
por: Zhang, Honglu, et al.
Publicado: (2025)
por: Zhang, Honglu, et al.
Publicado: (2025)
Multimodal Chain-of-Thought Reasoning in Language Models
por: Zhang, Zhuosheng, et al.
Publicado: (2023)
por: Zhang, Zhuosheng, et al.
Publicado: (2023)
Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models
por: Chen, Qiguang, et al.
Publicado: (2025)
por: Chen, Qiguang, et al.
Publicado: (2025)
Rethinking Chain-of-Thought Reasoning for Videos
por: Zhong, Yiwu, et al.
Publicado: (2025)
por: Zhong, Yiwu, et al.
Publicado: (2025)
ChainLM: Empowering Large Language Models with Improved Chain-of-Thought Prompting
por: Cheng, Xiaoxue, et al.
Publicado: (2024)
por: Cheng, Xiaoxue, et al.
Publicado: (2024)
SmartThinker: Progressive Chain-of-Thought Length Calibration for Efficient Large Language Model Reasoning
por: Hu, Chenzhi, et al.
Publicado: (2026)
por: Hu, Chenzhi, et al.
Publicado: (2026)
Beyond Chain-of-Thought, Effective Graph-of-Thought Reasoning in Language Models
por: Yao, Yao, et al.
Publicado: (2023)
por: Yao, Yao, et al.
Publicado: (2023)
Interactive Reasoning: Visualizing and Controlling Chain-of-Thought Reasoning in Large Language Models
por: Pang, Rock Yuren, et al.
Publicado: (2025)
por: Pang, Rock Yuren, et al.
Publicado: (2025)
Chain-of-Thought Reasoning Improves Context-Aware Translation with Large Language Models
por: Ataee, Shabnam, et al.
Publicado: (2025)
por: Ataee, Shabnam, et al.
Publicado: (2025)
Enhancing Chain of Thought Prompting in Large Language Models via Reasoning Patterns
por: Zhang, Yufeng, et al.
Publicado: (2024)
por: Zhang, Yufeng, et al.
Publicado: (2024)
Effectiveness of Chain-of-Thought in Distilling Reasoning Capability from Large Language Models
por: Do, Cong-Thanh, et al.
Publicado: (2025)
por: Do, Cong-Thanh, et al.
Publicado: (2025)
Can Large Language Models Detect Errors in Long Chain-of-Thought Reasoning?
por: He, Yancheng, et al.
Publicado: (2025)
por: He, Yancheng, et al.
Publicado: (2025)
Retrieval-augmented Multi-modal Chain-of-Thoughts Reasoning for Large Language Models
por: Liu, Bingshuai, et al.
Publicado: (2023)
por: Liu, Bingshuai, et al.
Publicado: (2023)
CAMOUFLAGE: Exploiting Misinformation Detection Systems Through LLM-driven Adversarial Claim Transformation
por: Bethany, Mazal, et al.
Publicado: (2025)
por: Bethany, Mazal, et al.
Publicado: (2025)
HateModerate: Testing Hate Speech Detectors against Content Moderation Policies
por: Zheng, Jiangrui, et al.
Publicado: (2023)
por: Zheng, Jiangrui, et al.
Publicado: (2023)
Enhancing Zero-Shot Chain-of-Thought Reasoning in Large Language Models through Logic
por: Zhao, Xufeng, et al.
Publicado: (2023)
por: Zhao, Xufeng, et al.
Publicado: (2023)
Unlocking General Long Chain-of-Thought Reasoning Capabilities of Large Language Models via Representation Engineering
por: Tang, Xinyu, et al.
Publicado: (2025)
por: Tang, Xinyu, et al.
Publicado: (2025)
The Enforcement and Feasibility of Hate Speech Moderation on Twitter
por: Tonneau, Manuel, et al.
Publicado: (2026)
por: Tonneau, Manuel, et al.
Publicado: (2026)
Beyond Chains of Thought: Benchmarking Latent-Space Reasoning Abilities in Large Language Models
por: Hagendorff, Thilo, et al.
Publicado: (2025)
por: Hagendorff, Thilo, et al.
Publicado: (2025)
Zero-Shot Chain-of-Thought Reasoning Guided by Evolutionary Algorithms in Large Language Models
por: Jin, Feihu, et al.
Publicado: (2024)
por: Jin, Feihu, et al.
Publicado: (2024)
Chain-of-Thought Reasoning with Large Language Models for Clinical Alzheimer's Disease Assessment and Diagnosis
por: Zhang, Tongze, et al.
Publicado: (2026)
por: Zhang, Tongze, et al.
Publicado: (2026)
Diffusion of Thoughts: Chain-of-Thought Reasoning in Diffusion Language Models
por: Ye, Jiacheng, et al.
Publicado: (2024)
por: Ye, Jiacheng, et al.
Publicado: (2024)
Graph Chain-of-Thought: Augmenting Large Language Models by Reasoning on Graphs
por: Jin, Bowen, et al.
Publicado: (2024)
por: Jin, Bowen, et al.
Publicado: (2024)
Can Small Language Models Help Large Language Models Reason Better?: LM-Guided Chain-of-Thought
por: Lee, Jooyoung, et al.
Publicado: (2024)
por: Lee, Jooyoung, et al.
Publicado: (2024)
AdvChain: Adversarial Chain-of-Thought Tuning for Robust Safety Alignment of Large Reasoning Models
por: Zhu, Zihao, et al.
Publicado: (2025)
por: Zhu, Zihao, et al.
Publicado: (2025)
CoAT: Chain-of-Associated-Thoughts Framework for Enhancing Large Language Models Reasoning
por: Pan, Jianfeng, et al.
Publicado: (2025)
por: Pan, Jianfeng, et al.
Publicado: (2025)
Ejemplares similares
-
Moderating Illicit Online Image Promotion for Unsafe User-Generated Content Games Using Large Vision-Language Models
por: Guo, Keyan, et al.
Publicado: (2024) -
An Investigation of Large Language Models for Real-World Hate Speech Detection
por: Guo, Keyan, et al.
Publicado: (2024) -
Moderating Embodied Cyber Threats Using Generative AI
por: Guo, Keyan, et al.
Publicado: (2024) -
AI-Cybersecurity Education Through Designing AI-based Cyberharassment Detection Lab
por: Okpala, Ebuka, et al.
Publicado: (2024) -
Image Safeguarding: Reasoning with Conditional Vision Language Model and Obfuscating Unsafe Content Counterfactually
por: Bethany, Mazal, et al.
Publicado: (2024)