A Benchmark Suite of Reddit-Derived Datasets for Mental Health Detection
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Hasan, Khalid, Saquer, Jamil |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Mental Multi-class Classification on Social Media: Benchmarking Transformer Architectures against LSTM Models
par: Hasan, Khalid, et autres
Publié: (2025)
par: Hasan, Khalid, et autres
Publié: (2025)
A Comparative Analysis of Transformer and LSTM Models for Detecting Suicidal Ideation on Reddit
par: Hasan, Khalid, et autres
Publié: (2024)
par: Hasan, Khalid, et autres
Publié: (2024)
Advancing Mental Disorder Detection: A Comparative Evaluation of Transformer and LSTM Architectures on Social Media
par: Hasan, Khalid, et autres
Publié: (2025)
par: Hasan, Khalid, et autres
Publié: (2025)
Beyond Architectures: Evaluating the Role of Contextual Embeddings in Detecting Bipolar Disorder on Social Media
par: Hasan, Khalid, et autres
Publié: (2025)
par: Hasan, Khalid, et autres
Publié: (2025)
MoTime: A Dataset Suite for Multimodal Time Series Forecasting
par: Zhou, Xin, et autres
Publié: (2025)
par: Zhou, Xin, et autres
Publié: (2025)
Seq vs Seq: An Open Suite of Paired Encoders and Decoders
par: Weller, Orion, et autres
Publié: (2025)
par: Weller, Orion, et autres
Publié: (2025)
PashtoCorp: A 1.25-Billion-Word Corpus, Evaluation Suite, and Reproducible Pipeline for Low-Resource Language Development
par: Rahman, Hanif
Publié: (2026)
par: Rahman, Hanif
Publié: (2026)
REGEN: A Dataset and Benchmarks with Natural Language Critiques and Narratives
par: Su, Kun, et autres
Publié: (2025)
par: Su, Kun, et autres
Publié: (2025)
CAISSON: Concept-Augmented Inference Suite of Self-Organizing Neural Networks
par: Halperin, Igor
Publié: (2024)
par: Halperin, Igor
Publié: (2024)
Constructing the CORD-19 Vaccine Dataset
par: Singh, Manisha, et autres
Publié: (2024)
par: Singh, Manisha, et autres
Publié: (2024)
Dynamic-KGQA: A Scalable Framework for Generating Adaptive Question Answering Datasets
par: Dammu, Preetam Prabhu Srikar, et autres
Publié: (2025)
par: Dammu, Preetam Prabhu Srikar, et autres
Publié: (2025)
MIRB: Mathematical Information Retrieval Benchmark
par: Ju, Haocheng, et autres
Publié: (2025)
par: Ju, Haocheng, et autres
Publié: (2025)
A Platform for Investigating Public Health Content with Efficient Concern Classification
par: Li, Christopher, et autres
Publié: (2025)
par: Li, Christopher, et autres
Publié: (2025)
LaMP-QA: A Benchmark for Personalized Long-form Question Answering
par: Salemi, Alireza, et autres
Publié: (2025)
par: Salemi, Alireza, et autres
Publié: (2025)
A Systematic Evaluation of LLM Strategies for Mental Health Text Analysis: Fine-tuning vs. Prompt Engineering vs. RAG
par: Kermani, Arshia, et autres
Publié: (2025)
par: Kermani, Arshia, et autres
Publié: (2025)
OAEI-LLM-T: A TBox Benchmark Dataset for Understanding Large Language Model Hallucinations in Ontology Matching
par: Qiang, Zhangcheng, et autres
Publié: (2025)
par: Qiang, Zhangcheng, et autres
Publié: (2025)
Utilizing Large Language Models to Identify Reddit Users Considering Vaping Cessation for Digital Interventions
par: Vuruma, Sai Krishna Revanth, et autres
Publié: (2024)
par: Vuruma, Sai Krishna Revanth, et autres
Publié: (2024)
FaMTEB: Massive Text Embedding Benchmark in Persian Language
par: Zinvandi, Erfan, et autres
Publié: (2025)
par: Zinvandi, Erfan, et autres
Publié: (2025)
Enhancing Q&A Text Retrieval with Ranking Models: Benchmarking, fine-tuning and deploying Rerankers for RAG
par: Moreira, Gabriel de Souza P., et autres
Publié: (2024)
par: Moreira, Gabriel de Souza P., et autres
Publié: (2024)
mFollowIR: a Multilingual Benchmark for Instruction Following in Retrieval
par: Weller, Orion, et autres
Publié: (2025)
par: Weller, Orion, et autres
Publié: (2025)
HealthBranches: Synthesizing Clinically-Grounded Question Answering Datasets via Decision Pathways
par: Cosentino, Cristian, et autres
Publié: (2025)
par: Cosentino, Cristian, et autres
Publié: (2025)
Towards a Realistic Long-Term Benchmark for Open-Web Research Agents
par: Mühlbacher, Peter, et autres
Publié: (2024)
par: Mühlbacher, Peter, et autres
Publié: (2024)
RAG over Tables: Hierarchical Memory Index, Multi-Stage Retrieval, and Benchmarking
par: Zou, Jiaru, et autres
Publié: (2025)
par: Zou, Jiaru, et autres
Publié: (2025)
FLEX: Expert-level False-Less EXecution Metric for Reliable Text-to-SQL Benchmark
par: Kim, Heegyu, et autres
Publié: (2024)
par: Kim, Heegyu, et autres
Publié: (2024)
LLM vs. Lawyers: Identifying a Subset of Summary Judgments in a Large UK Case Law Dataset
par: Izzidien, Ahmed, et autres
Publié: (2024)
par: Izzidien, Ahmed, et autres
Publié: (2024)
What's happening in your neighborhood? A Weakly Supervised Approach to Detect Local News
par: Shah, Deven Santosh, et autres
Publié: (2023)
par: Shah, Deven Santosh, et autres
Publié: (2023)
SyllabusQA: A Course Logistics Question Answering Dataset
par: Fernandez, Nigel, et autres
Publié: (2024)
par: Fernandez, Nigel, et autres
Publié: (2024)
Diagnosing Translated Benchmarks: An Automated Quality Assurance Study of the EU20 Benchmark Suite
par: Thellmann, Klaudia, et autres
Publié: (2026)
par: Thellmann, Klaudia, et autres
Publié: (2026)
A Benchmark for Deep Information Synthesis
par: Paul, Debjit, et autres
Publié: (2026)
par: Paul, Debjit, et autres
Publié: (2026)
When SMILES have Language: Drug Classification using Text Classification Methods on Drug SMILES Strings
par: Wasi, Azmine Toushik, et autres
Publié: (2024)
par: Wasi, Azmine Toushik, et autres
Publié: (2024)
LogEval: A Comprehensive Benchmark Suite for Large Language Models In Log Analysis
par: Cui, Tianyu, et autres
Publié: (2024)
par: Cui, Tianyu, et autres
Publié: (2024)
BookWorm: A Dataset for Character Description and Analysis
par: Papoudakis, Argyrios, et autres
Publié: (2024)
par: Papoudakis, Argyrios, et autres
Publié: (2024)
InstructIE: A Bilingual Instruction-based Information Extraction Dataset
par: Gui, Honghao, et autres
Publié: (2023)
par: Gui, Honghao, et autres
Publié: (2023)
BIRCO: A Benchmark of Information Retrieval Tasks with Complex Objectives
par: Wang, Xiaoyue, et autres
Publié: (2024)
par: Wang, Xiaoyue, et autres
Publié: (2024)
IRPAPERS: A Visual Document Benchmark for Scientific Retrieval and Question Answering
par: Shorten, Connor, et autres
Publié: (2026)
par: Shorten, Connor, et autres
Publié: (2026)
LangProBe: a Language Programs Benchmark
par: Tan, Shangyin, et autres
Publié: (2025)
par: Tan, Shangyin, et autres
Publié: (2025)
ChineseHarm-Bench: A Chinese Harmful Content Detection Benchmark
par: Liu, Kangwei, et autres
Publié: (2025)
par: Liu, Kangwei, et autres
Publié: (2025)
CXMArena: Unified Dataset to benchmark performance in realistic CXM Scenarios
par: Garg, Raghav, et autres
Publié: (2025)
par: Garg, Raghav, et autres
Publié: (2025)
A comparative analysis of embedding models for patent similarity
par: Ascione, Grazia Sveva, et autres
Publié: (2024)
par: Ascione, Grazia Sveva, et autres
Publié: (2024)
A Trio Neural Model for Dynamic Entity Relatedness Ranking
par: Nguyen, Tu, et autres
Publié: (2018)
par: Nguyen, Tu, et autres
Publié: (2018)
Documents similaires
-
Mental Multi-class Classification on Social Media: Benchmarking Transformer Architectures against LSTM Models
par: Hasan, Khalid, et autres
Publié: (2025) -
A Comparative Analysis of Transformer and LSTM Models for Detecting Suicidal Ideation on Reddit
par: Hasan, Khalid, et autres
Publié: (2024) -
Advancing Mental Disorder Detection: A Comparative Evaluation of Transformer and LSTM Architectures on Social Media
par: Hasan, Khalid, et autres
Publié: (2025) -
Beyond Architectures: Evaluating the Role of Contextual Embeddings in Detecting Bipolar Disorder on Social Media
par: Hasan, Khalid, et autres
Publié: (2025) -
MoTime: A Dataset Suite for Multimodal Time Series Forecasting
par: Zhou, Xin, et autres
Publié: (2025)