Improving Regulatory Oversight in Online Content Moderation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Tessa, Benedetta, Amram, Denise, Monreale, Anna, Cresci, Stefano |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Quantifying Feature Importance for Online Content Moderation
par: Tessa, Benedetta, et autres
Publié: (2025)
par: Tessa, Benedetta, et autres
Publié: (2025)
Beyond Trial-and-Error: Predicting User Abandonment After a Moderation Intervention
par: Tessa, Benedetta, et autres
Publié: (2024)
par: Tessa, Benedetta, et autres
Publié: (2024)
When Transparency Falls Short: Auditing Platform Moderation During a High-Stakes Election
par: Tessa, Benedetta, et autres
Publié: (2026)
par: Tessa, Benedetta, et autres
Publié: (2026)
A Year of the DSA Transparency Database: What it (Does Not) Reveal About Platform Moderation During the 2024 European Parliament Election
par: Shahi, Gautam Kishore, et autres
Publié: (2025)
par: Shahi, Gautam Kishore, et autres
Publié: (2025)
Disarranged Harmonization of Transparency Reporting by Social Media Platforms Under the Digital Services Act
par: Trujillo, Amaury, et autres
Publié: (2026)
par: Trujillo, Amaury, et autres
Publié: (2026)
Multimodal Coordinated Online Behavior: Trade-offs and Strategies
par: Mannocci, Lorenzo, et autres
Publié: (2025)
par: Mannocci, Lorenzo, et autres
Publié: (2025)
Detection and Characterization of Coordinated Online Behavior: A Survey
par: Mannocci, Lorenzo, et autres
Publié: (2024)
par: Mannocci, Lorenzo, et autres
Publié: (2024)
The Big Ban Theory: A Pre- and Post-Intervention Dataset of Online Content Moderation Actions
par: Cerulli, Aldo, et autres
Publié: (2026)
par: Cerulli, Aldo, et autres
Publié: (2026)
Investigating the heterogenous effects of a massive content moderation intervention via Difference-in-Differences
par: Cima, Lorenzo, et autres
Publié: (2024)
par: Cima, Lorenzo, et autres
Publié: (2024)
Dark Personality Traits and Online Toxicity: Linking Self-Reports to Reddit Activity
par: Cerulli, Aldo, et autres
Publié: (2025)
par: Cerulli, Aldo, et autres
Publié: (2025)
Oversight in Action: Experiences with Instructor-Moderated LLM Responses in an Online Discussion Forum
par: Qiao, Shuying, et autres
Publié: (2024)
par: Qiao, Shuying, et autres
Publié: (2024)
Anti-Regulatory AI: How "AI Safety" is Leveraged Against Regulatory Oversight
par: Yew, Rui-Jie, et autres
Publié: (2025)
par: Yew, Rui-Jie, et autres
Publié: (2025)
The DSA Transparency Database: Auditing Self-reported Moderation Actions by Social Media
par: Trujillo, Amaury, et autres
Publié: (2023)
par: Trujillo, Amaury, et autres
Publié: (2023)
Content Moderation Futures
par: Blackwell, Lindsay
Publié: (2025)
par: Blackwell, Lindsay
Publié: (2025)
AEGIS: Online Adaptive AI Content Safety Moderation with Ensemble of LLM Experts
par: Ghosh, Shaona, et autres
Publié: (2024)
par: Ghosh, Shaona, et autres
Publié: (2024)
Critical Challenges in Content Moderation for People Who Use Drugs (PWUD): Insights into Online Harm Reduction Practices from Moderators
par: Wang, Kaixuan, et autres
Publié: (2025)
par: Wang, Kaixuan, et autres
Publié: (2025)
AI-Driven Document Redaction in UK Public Authorities: Implementation Gaps, Regulatory Challenges, and the Human Oversight Imperative
par: Chen, Yijun
Publié: (2025)
par: Chen, Yijun
Publié: (2025)
The Hidden Language of Harm: Examining the Role of Emojis in Harmful Online Communication and Content Moderation
par: Zhou, Yuhang, et autres
Publié: (2025)
par: Zhou, Yuhang, et autres
Publié: (2025)
Asking For It: Question-Answering for Predicting Rule Infractions in Online Content Moderation
par: Samory, Mattia, et autres
Publié: (2025)
par: Samory, Mattia, et autres
Publié: (2025)
Talking Back -- human input and explanations to interactive AI systems
par: Dix, Alan, et autres
Publié: (2025)
par: Dix, Alan, et autres
Publié: (2025)
Exploring the Boundaries of Content Moderation in Text-to-Image Generation
par: Riccio, Piera, et autres
Publié: (2024)
par: Riccio, Piera, et autres
Publié: (2024)
On the Quest for Effectiveness in Human Oversight: Interdisciplinary Perspectives
par: Sterz, Sarah, et autres
Publié: (2024)
par: Sterz, Sarah, et autres
Publié: (2024)
Human Oversight of Artificial Intelligence and Technical Standardisation
par: Ho-Dac, Marion, et autres
Publié: (2024)
par: Ho-Dac, Marion, et autres
Publié: (2024)
Temporal Dynamics of Coordinated Online Behavior: Stability, Archetypes, and Influence
par: Tardelli, Serena, et autres
Publié: (2023)
par: Tardelli, Serena, et autres
Publié: (2023)
Safe Spaces or Toxic Places? Content Moderation and Social Dynamics of Online Eating Disorder Communities
par: Lerman, Kristina, et autres
Publié: (2024)
par: Lerman, Kristina, et autres
Publié: (2024)
The Great Ban: Efficacy and Unintended Consequences of a Massive Deplatforming Operation on Reddit
par: Cima, Lorenzo, et autres
Publié: (2024)
par: Cima, Lorenzo, et autres
Publié: (2024)
Personalized Content Moderation and Emergent Outcomes
par: Gurkan, Necdet, et autres
Publié: (2024)
par: Gurkan, Necdet, et autres
Publié: (2024)
Emoji Reactions on Telegram: Unreliable Indicators of Emotional Resonance
par: Tardelli, Serena, et autres
Publié: (2025)
par: Tardelli, Serena, et autres
Publié: (2025)
NoisyHate: Mining Online Human-Written Perturbations for Realistic Robustness Benchmarking of Content Moderation Models
par: Ye, Yiran, et autres
Publié: (2023)
par: Ye, Yiran, et autres
Publié: (2023)
Algorithmic Arbitrariness in Content Moderation
par: Gomez, Juan Felipe, et autres
Publié: (2024)
par: Gomez, Juan Felipe, et autres
Publié: (2024)
Beyond Hate: Differentiating Uncivil and Intolerant Speech in Multimodal Content Moderation
par: Herrmann, Nils A., et autres
Publié: (2026)
par: Herrmann, Nils A., et autres
Publié: (2026)
Longitudinal Monitoring of LLM Content Moderation of Social Issues
par: Dai, Yunlang, et autres
Publié: (2025)
par: Dai, Yunlang, et autres
Publié: (2025)
Scaling Laws For Scalable Oversight
par: Engels, Joshua, et autres
Publié: (2025)
par: Engels, Joshua, et autres
Publié: (2025)
Balancing Innovation and Oversight: AI in the U.S. Treasury and IRS: A Survey
par: Shaikh, Sohail
Publié: (2025)
par: Shaikh, Sohail
Publié: (2025)
Leveraging Content Producer Networks and User Perception to Detect Online Discursive Communities
par: Guarino, Stefano, et autres
Publié: (2024)
par: Guarino, Stefano, et autres
Publié: (2024)
Identity-related Speech Suppression in Generative AI Content Moderation
par: Proebsting, Grace, et autres
Publié: (2024)
par: Proebsting, Grace, et autres
Publié: (2024)
PUFFLE: Balancing Privacy, Utility, and Fairness in Federated Learning
par: Corbucci, Luca, et autres
Publié: (2024)
par: Corbucci, Luca, et autres
Publié: (2024)
Impact of Stricter Content Moderation on Parler's Users' Discourse
par: Kumarswamy, Nihal, et autres
Publié: (2023)
par: Kumarswamy, Nihal, et autres
Publié: (2023)
Towards better social crisis data with HERMES: Hybrid sensing for EmeRgency ManagEment System
par: Avvenuti, Marco, et autres
Publié: (2019)
par: Avvenuti, Marco, et autres
Publié: (2019)
REDDIX-NET: A Novel Dataset and Benchmark for Moderating Online Explicit Services
par: Sathvik, MSVPJ, et autres
Publié: (2025)
par: Sathvik, MSVPJ, et autres
Publié: (2025)
Documents similaires
-
Quantifying Feature Importance for Online Content Moderation
par: Tessa, Benedetta, et autres
Publié: (2025) -
Beyond Trial-and-Error: Predicting User Abandonment After a Moderation Intervention
par: Tessa, Benedetta, et autres
Publié: (2024) -
When Transparency Falls Short: Auditing Platform Moderation During a High-Stakes Election
par: Tessa, Benedetta, et autres
Publié: (2026) -
A Year of the DSA Transparency Database: What it (Does Not) Reveal About Platform Moderation During the 2024 European Parliament Election
par: Shahi, Gautam Kishore, et autres
Publié: (2025) -
Disarranged Harmonization of Transparency Reporting by Social Media Platforms Under the Digital Services Act
par: Trujillo, Amaury, et autres
Publié: (2026)