CHEW: A Dataset of CHanging Events in Wikipedia
Fuente:
arXiv
Saved in:
| Main Authors: | Borkakoty, Hsuvas, Espinosa-Anke, Luis |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Hoaxpedia: A Unified Wikipedia Hoax Articles Dataset
by: Borkakoty, Hsuvas, et al.
Published: (2024)
by: Borkakoty, Hsuvas, et al.
Published: (2024)
Wikipedia is Not a Dictionary, Delete! Text Classification as a Proxy for Analysing Wiki Deletion Discussions
by: Borkakoty, Hsuvas, et al.
Published: (2025)
by: Borkakoty, Hsuvas, et al.
Published: (2025)
WiDe-analysis: Enabling One-click Content Moderation Analysis on Wikipedia's Articles for Deletion
by: Borkakoty, Hsuvas, et al.
Published: (2024)
by: Borkakoty, Hsuvas, et al.
Published: (2024)
Where Knowledge Collides: A Mechanistic Study of Intra-Memory Knowledge Conflict in Language Models
by: Pham, Minh Vu, et al.
Published: (2026)
by: Pham, Minh Vu, et al.
Published: (2026)
SCHEMA: State CHangEs MAtter for Procedure Planning in Instructional Videos
by: Niu, Yulei, et al.
Published: (2024)
by: Niu, Yulei, et al.
Published: (2024)
DRIP-R: A Benchmark for Decision-Making and Reasoning Under Real-World Policy Ambiguity in the Retail Domain
by: Borkakoty, Hsuvas, et al.
Published: (2026)
by: Borkakoty, Hsuvas, et al.
Published: (2026)
Shifting Perspectives: Steering Vectors for Robust Bias Mitigation in LLMs
by: Siddique, Zara, et al.
Published: (2025)
by: Siddique, Zara, et al.
Published: (2025)
Examining Gender and Power on Wikipedia Through Face and Politeness
by: Soubki, Adil, et al.
Published: (2024)
by: Soubki, Adil, et al.
Published: (2024)
Automatic Extraction of Metaphoric Analogies from Literary Texts: Task Formulation, Dataset Construction, and Evaluation
by: Boisson, Joanne, et al.
Published: (2024)
by: Boisson, Joanne, et al.
Published: (2024)
Wikipedia in the Era of LLMs: Evolution and Risks
by: Huang, Siming, et al.
Published: (2025)
by: Huang, Siming, et al.
Published: (2025)
WikiContradict: A Benchmark for Evaluating LLMs on Real-World Knowledge Conflicts from Wikipedia
by: Hou, Yufang, et al.
Published: (2024)
by: Hou, Yufang, et al.
Published: (2024)
ALPET: Active Few-shot Learning for Citation Worthiness Detection in Low-Resource Wikipedia Languages
by: Halitaj, Aida, et al.
Published: (2025)
by: Halitaj, Aida, et al.
Published: (2025)
Event-Keyed Summarization
by: Gantt, William, et al.
Published: (2024)
by: Gantt, William, et al.
Published: (2024)
Tagengo: A Multilingual Chat Dataset
by: Devine, Peter
Published: (2024)
by: Devine, Peter
Published: (2024)
A Synthetic Dataset for Personal Attribute Inference
by: Yukhymenko, Hanna, et al.
Published: (2024)
by: Yukhymenko, Hanna, et al.
Published: (2024)
Generative Medical Event Models Improve with Scale
by: Waxler, Shane, et al.
Published: (2025)
by: Waxler, Shane, et al.
Published: (2025)
EUROPA: A Legal Multilingual Keyphrase Generation Dataset
by: Salaün, Olivier, et al.
Published: (2024)
by: Salaün, Olivier, et al.
Published: (2024)
FaithfulSAE: Towards Capturing Faithful Features with Sparse Autoencoders without External Dataset Dependencies
by: Cho, Seonglae, et al.
Published: (2025)
by: Cho, Seonglae, et al.
Published: (2025)
Training Large Language Models to Predict Clinical Events
by: Turtel, Benjamin, et al.
Published: (2026)
by: Turtel, Benjamin, et al.
Published: (2026)
Leveraging Wikidata for Geographically Informed Sociocultural Bias Dataset Creation: Application to Latin America
by: Karmim, Yannis, et al.
Published: (2026)
by: Karmim, Yannis, et al.
Published: (2026)
CRAFT Your Dataset: Task-Specific Synthetic Dataset Generation Through Corpus Retrieval and Augmentation
by: Ziegler, Ingo, et al.
Published: (2024)
by: Ziegler, Ingo, et al.
Published: (2024)
AQuA -- Combining Experts' and Non-Experts' Views To Assess Deliberation Quality in Online Discussions Using LLMs
by: Behrendt, Maike, et al.
Published: (2024)
by: Behrendt, Maike, et al.
Published: (2024)
VITAL: A New Dataset for Benchmarking Pluralistic Alignment in Healthcare
by: Shetty, Anudeex, et al.
Published: (2025)
by: Shetty, Anudeex, et al.
Published: (2025)
FusionBench: A Unified Library and Comprehensive Benchmark for Deep Model Fusion
by: Tang, Anke, et al.
Published: (2024)
by: Tang, Anke, et al.
Published: (2024)
Large Language Model Enhanced Clustering for News Event Detection
by: Tarekegn, Adane Nega
Published: (2024)
by: Tarekegn, Adane Nega
Published: (2024)
FutureSim: Replaying World Events to Evaluate Adaptive Agents
by: Goel, Shashwat, et al.
Published: (2026)
by: Goel, Shashwat, et al.
Published: (2026)
Distilling Multi-Scale Knowledge for Event Temporal Relation Extraction
by: Yao, Hao-Ren, et al.
Published: (2022)
by: Yao, Hao-Ren, et al.
Published: (2022)
Diagnosing Medical Datasets with Training Dynamics
by: Wenderoth, Laura
Published: (2024)
by: Wenderoth, Laura
Published: (2024)
Dataset Reset Policy Optimization for RLHF
by: Chang, Jonathan D., et al.
Published: (2024)
by: Chang, Jonathan D., et al.
Published: (2024)
iTBLS: A Dataset of Interactive Conversations Over Tabular Information
by: Sundar, Anirudh, et al.
Published: (2024)
by: Sundar, Anirudh, et al.
Published: (2024)
ELSA: A Style Aligned Dataset for Emotionally Intelligent Language Generation
by: Gandhi, Vishal, et al.
Published: (2025)
by: Gandhi, Vishal, et al.
Published: (2025)
KodCode: A Diverse, Challenging, and Verifiable Synthetic Dataset for Coding
by: Xu, Zhangchen, et al.
Published: (2025)
by: Xu, Zhangchen, et al.
Published: (2025)
Mind the Gap: A Review of Arabic Post-Training Datasets and Their Limitations
by: Alkhowaiter, Mohammed, et al.
Published: (2025)
by: Alkhowaiter, Mohammed, et al.
Published: (2025)
Classification of Safety Events at Nuclear Sites using Large Language Models
by: de Costa, Mishca, et al.
Published: (2024)
by: de Costa, Mishca, et al.
Published: (2024)
OpenDebateEvidence: A Massive-Scale Argument Mining and Summarization Dataset
by: Roush, Allen, et al.
Published: (2024)
by: Roush, Allen, et al.
Published: (2024)
A Comprehensive Survey of Direct Preference Optimization: Datasets, Theories, Variants, and Applications
by: Xiao, Wenyi, et al.
Published: (2024)
by: Xiao, Wenyi, et al.
Published: (2024)
BookSQL: A Large Scale Text-to-SQL Dataset for Accounting Domain
by: Kumar, Rahul, et al.
Published: (2024)
by: Kumar, Rahul, et al.
Published: (2024)
cPAPERS: A Dataset of Situated and Multimodal Interactive Conversations in Scientific Papers
by: Sundar, Anirudh, et al.
Published: (2024)
by: Sundar, Anirudh, et al.
Published: (2024)
Time-IMM: A Dataset and Benchmark for Irregular Multimodal Multivariate Time Series
by: Chang, Ching, et al.
Published: (2025)
by: Chang, Ching, et al.
Published: (2025)
StyleRec: A Benchmark Dataset for Prompt Recovery in Writing Style Transformation
by: Liu, Shenyang, et al.
Published: (2025)
by: Liu, Shenyang, et al.
Published: (2025)
Similar Items
-
Hoaxpedia: A Unified Wikipedia Hoax Articles Dataset
by: Borkakoty, Hsuvas, et al.
Published: (2024) -
Wikipedia is Not a Dictionary, Delete! Text Classification as a Proxy for Analysing Wiki Deletion Discussions
by: Borkakoty, Hsuvas, et al.
Published: (2025) -
WiDe-analysis: Enabling One-click Content Moderation Analysis on Wikipedia's Articles for Deletion
by: Borkakoty, Hsuvas, et al.
Published: (2024) -
Where Knowledge Collides: A Mechanistic Study of Intra-Memory Knowledge Conflict in Language Models
by: Pham, Minh Vu, et al.
Published: (2026) -
SCHEMA: State CHangEs MAtter for Procedure Planning in Instructional Videos
by: Niu, Yulei, et al.
Published: (2024)