Measuring AI "Slop" in Text
Fuente:
arXiv
Salvato in:
| Autori principali: | Shaib, Chantal, Chakrabarty, Tuhin, Garcia-Olano, Diego, Wallace, Byron C. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Detection and Measurement of Syntactic Templates in Generated Text
di: Shaib, Chantal, et al.
Pubblicazione: (2024)
di: Shaib, Chantal, et al.
Pubblicazione: (2024)
Who Taught You That? Tracing Teachers in Model Distillation
di: Wadhwa, Somin, et al.
Pubblicazione: (2025)
di: Wadhwa, Somin, et al.
Pubblicazione: (2025)
AI-Slop to AI-Polish? Aligning Language Models through Edit-Based Writing Rewards and Test-time Computation
di: Chakrabarty, Tuhin, et al.
Pubblicazione: (2025)
di: Chakrabarty, Tuhin, et al.
Pubblicazione: (2025)
Standardizing the Measurement of Text Diversity: A Tool and a Comparative Analysis of Scores
di: Shaib, Chantal, et al.
Pubblicazione: (2024)
di: Shaib, Chantal, et al.
Pubblicazione: (2024)
Learning the Wrong Lessons: Syntactic-Domain Spurious Correlations in Language Models
di: Shaib, Chantal, et al.
Pubblicazione: (2025)
di: Shaib, Chantal, et al.
Pubblicazione: (2025)
How Much Annotation is Needed to Compare Summarization Models?
di: Shaib, Chantal, et al.
Pubblicazione: (2024)
di: Shaib, Chantal, et al.
Pubblicazione: (2024)
Measuring Lexical Diversity of Synthetic Data Generated through Fine-Grained Persona Prompting
di: Kambhatla, Gauri, et al.
Pubblicazione: (2025)
di: Kambhatla, Gauri, et al.
Pubblicazione: (2025)
Faithfulness vs. Safety: Evaluating LLM Behavior Under Counterfactual Medical Evidence
di: Mo, Kaijie, et al.
Pubblicazione: (2026)
di: Mo, Kaijie, et al.
Pubblicazione: (2026)
Can Good Writing Be Generative? Expert-Level AI Writing Emerges through Fine-Tuning on High-Quality Books
di: Chakrabarty, Tuhin, et al.
Pubblicazione: (2026)
di: Chakrabarty, Tuhin, et al.
Pubblicazione: (2026)
Readers Prefer Outputs of AI Trained on Copyrighted Books over Expert Human Writers
di: Chakrabarty, Tuhin, et al.
Pubblicazione: (2025)
di: Chakrabarty, Tuhin, et al.
Pubblicazione: (2025)
Can AI writing be salvaged? Mitigating Idiosyncrasies and Improving Human-AI Alignment in the Writing Process through Edits
di: Chakrabarty, Tuhin, et al.
Pubblicazione: (2024)
di: Chakrabarty, Tuhin, et al.
Pubblicazione: (2024)
Why Slop Matters
di: Kommers, Cody, et al.
Pubblicazione: (2025)
di: Kommers, Cody, et al.
Pubblicazione: (2025)
AI Safety Should Prioritize the Future of Work
di: Hazra, Sanchaita, et al.
Pubblicazione: (2025)
di: Hazra, Sanchaita, et al.
Pubblicazione: (2025)
Do Automatic Factuality Metrics Measure Factuality? A Critical Evaluation
di: Ramprasad, Sanjana, et al.
Pubblicazione: (2024)
di: Ramprasad, Sanjana, et al.
Pubblicazione: (2024)
AI Slop or AI-enhancement? Student perceptions of AI-generated media for an English for Academic Purposes course
di: Woo, David James, et al.
Pubblicazione: (2026)
di: Woo, David James, et al.
Pubblicazione: (2026)
Alignment Whack-a-Mole : Finetuning Activates Verbatim Recall of Copyrighted Books in Large Language Models
di: Liu, Xinyue, et al.
Pubblicazione: (2026)
di: Liu, Xinyue, et al.
Pubblicazione: (2026)
Death of the Novel(ty): Beyond n-Gram Novelty as a Metric for Textual Creativity
di: Saakyan, Arkadiy, et al.
Pubblicazione: (2025)
di: Saakyan, Arkadiy, et al.
Pubblicazione: (2025)
Creativity Support in the Age of Large Language Models: An Empirical Study Involving Emerging Writers
di: Chakrabarty, Tuhin, et al.
Pubblicazione: (2023)
di: Chakrabarty, Tuhin, et al.
Pubblicazione: (2023)
Can SAEs reveal and mitigate racial biases of LLMs in healthcare?
di: Ahsan, Hiba, et al.
Pubblicazione: (2025)
di: Ahsan, Hiba, et al.
Pubblicazione: (2025)
Understanding Figurative Meaning through Explainable Visual Entailment
di: Saakyan, Arkadiy, et al.
Pubblicazione: (2024)
di: Saakyan, Arkadiy, et al.
Pubblicazione: (2024)
Circuit Distillation
di: Wadhwa, Somin, et al.
Pubblicazione: (2025)
di: Wadhwa, Somin, et al.
Pubblicazione: (2025)
Revisiting Relation Extraction in the era of Large Language Models
di: Wadhwa, Somin, et al.
Pubblicazione: (2023)
di: Wadhwa, Somin, et al.
Pubblicazione: (2023)
Investigating Mysteries of CoT-Augmented Distillation
di: Wadhwa, Somin, et al.
Pubblicazione: (2024)
di: Wadhwa, Somin, et al.
Pubblicazione: (2024)
Vector Arithmetic in Concept and Token Subspaces
di: Feucht, Sheridan, et al.
Pubblicazione: (2025)
di: Feucht, Sheridan, et al.
Pubblicazione: (2025)
Art or Artifice? Large Language Models and the False Promise of Creativity
di: Chakrabarty, Tuhin, et al.
Pubblicazione: (2023)
di: Chakrabarty, Tuhin, et al.
Pubblicazione: (2023)
Leveraging ChatGPT in Pharmacovigilance Event Extraction: An Empirical Study
di: Sun, Zhaoyue, et al.
Pubblicazione: (2024)
di: Sun, Zhaoyue, et al.
Pubblicazione: (2024)
InfoLossQA: Characterizing and Recovering Information Loss in Text Simplification
di: Trienes, Jan, et al.
Pubblicazione: (2024)
di: Trienes, Jan, et al.
Pubblicazione: (2024)
How do Humans and Language Models Reason About Creativity? A Comparative Analysis
di: Laverghetta Jr., Antonio, et al.
Pubblicazione: (2025)
di: Laverghetta Jr., Antonio, et al.
Pubblicazione: (2025)
Connecting the Dots: Evaluating Abstract Reasoning Capabilities of LLMs Using the New York Times Connections Word Game
di: Samadarshi, Prisha, et al.
Pubblicazione: (2024)
di: Samadarshi, Prisha, et al.
Pubblicazione: (2024)
Identifying Self-Disclosures of Use, Misuse and Addiction in Community-based Social Media Posts
di: Yang, Chenghao, et al.
Pubblicazione: (2023)
di: Yang, Chenghao, et al.
Pubblicazione: (2023)
SlopCodeBench: Benchmarking How Coding Agents Degrade Over Long-Horizon Iterative Tasks
di: Orlanski, Gabriel, et al.
Pubblicazione: (2026)
di: Orlanski, Gabriel, et al.
Pubblicazione: (2026)
Compared to What? Baselines and Metrics for Counterfactual Prompting
di: Yang, Zihao, et al.
Pubblicazione: (2026)
di: Yang, Zihao, et al.
Pubblicazione: (2026)
Don't Pay Attention, PLANT It: Pretraining Attention via Learning-to-Rank
di: Roy, Debjyoti Saha, et al.
Pubblicazione: (2024)
di: Roy, Debjyoti Saha, et al.
Pubblicazione: (2024)
Do Multi-Document Summarization Models Synthesize?
di: DeYoung, Jay, et al.
Pubblicazione: (2023)
di: DeYoung, Jay, et al.
Pubblicazione: (2023)
Learning from Natural Language Explanations for Generalizable Entity Matching
di: Wadhwa, Somin, et al.
Pubblicazione: (2024)
di: Wadhwa, Somin, et al.
Pubblicazione: (2024)
Elucidating Mechanisms of Demographic Bias in LLMs for Healthcare
di: Ahsan, Hiba, et al.
Pubblicazione: (2025)
di: Ahsan, Hiba, et al.
Pubblicazione: (2025)
Evaluating the Factuality of Zero-shot Summarizers Across Varied Domains
di: Ramprasad, Sanjana, et al.
Pubblicazione: (2024)
di: Ramprasad, Sanjana, et al.
Pubblicazione: (2024)
On-the-fly Definition Augmentation of LLMs for Biomedical NER
di: Munnangi, Monica, et al.
Pubblicazione: (2024)
di: Munnangi, Monica, et al.
Pubblicazione: (2024)
Automatically Extracting Numerical Results from Randomized Controlled Trials with Large Language Models
di: Yun, Hye Sun, et al.
Pubblicazione: (2024)
di: Yun, Hye Sun, et al.
Pubblicazione: (2024)
Future Lens: Anticipating Subsequent Tokens from a Single Hidden State
di: Pal, Koyena, et al.
Pubblicazione: (2023)
di: Pal, Koyena, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Detection and Measurement of Syntactic Templates in Generated Text
di: Shaib, Chantal, et al.
Pubblicazione: (2024) -
Who Taught You That? Tracing Teachers in Model Distillation
di: Wadhwa, Somin, et al.
Pubblicazione: (2025) -
AI-Slop to AI-Polish? Aligning Language Models through Edit-Based Writing Rewards and Test-time Computation
di: Chakrabarty, Tuhin, et al.
Pubblicazione: (2025) -
Standardizing the Measurement of Text Diversity: A Tool and a Comparative Analysis of Scores
di: Shaib, Chantal, et al.
Pubblicazione: (2024) -
Learning the Wrong Lessons: Syntactic-Domain Spurious Correlations in Language Models
di: Shaib, Chantal, et al.
Pubblicazione: (2025)