JobResQA: A Benchmark for LLM Machine Reading Comprehension on Multilingual Résumés and JDs
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Carrino, Casimiro Pio, Estrella, Paula, Zbib, Rabih, Escolano, Carlos, Fonollosa, José A. R. |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MELO: An Evaluation Benchmark for Multilingual Entity Linking of Occupations
par: Retyk, Federico, et autres
Publié: (2024)
par: Retyk, Federico, et autres
Publié: (2024)
InterPilot: Exploring the Design Space of AI-assisted Job Interview Support for HR Professionals
par: Xu, Zhengtao, et autres
Publié: (2026)
par: Xu, Zhengtao, et autres
Publié: (2026)
Measuring Gender Bias in Job Title Matching for Grammatical Gender Languages
par: García-Sardiña, Laura, et autres
Publié: (2025)
par: García-Sardiña, Laura, et autres
Publié: (2025)
Overview of the TalentCLEF 2025: Skill and Job Title Intelligence for Human Capital Management
par: Gasco, Luis, et autres
Publié: (2025)
par: Gasco, Luis, et autres
Publié: (2025)
MultiWikiQA: A Reading Comprehension Benchmark in 300+ Languages
par: Smart, Dan Saattrup
Publié: (2025)
par: Smart, Dan Saattrup
Publié: (2025)
ViQA-COVID: COVID-19 Machine Reading Comprehension Dataset for Vietnamese
par: Nguyen-Phung, Hai-Chung, et autres
Publié: (2025)
par: Nguyen-Phung, Hai-Chung, et autres
Publié: (2025)
ConFit v3: Improving Resume-Job Matching with LLM-based Re-Ranking
par: Yu, Xiao, et autres
Publié: (2026)
par: Yu, Xiao, et autres
Publié: (2026)
Experiments on Language Normalization for Spanish to English Machine Translation
par: Paula Estrella
Publié: (2005)
par: Paula Estrella
Publié: (2005)
VlogQA: Task, Dataset, and Baseline Models for Vietnamese Spoken-Based Machine Reading Comprehension
par: Ngo, Thinh Phuoc, et autres
Publié: (2024)
par: Ngo, Thinh Phuoc, et autres
Publié: (2024)
Optimizing Multilingual LLMs via Federated Learning: A Study of Client Language Composition
par: Sant, Aleix, et autres
Publié: (2026)
par: Sant, Aleix, et autres
Publié: (2026)
Multilingual Multi-Aspect Explainability Analyses on Machine Reading Comprehension Models
par: Cui, Yiming, et autres
Publié: (2021)
par: Cui, Yiming, et autres
Publié: (2021)
Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs
par: Restrepo, David, et autres
Publié: (2024)
par: Restrepo, David, et autres
Publié: (2024)
ResumeFlow: An LLM-facilitated Pipeline for Personalized Resume Generation and Refinement
par: Zinjad, Saurabh Bhausaheb, et autres
Publié: (2024)
par: Zinjad, Saurabh Bhausaheb, et autres
Publié: (2024)
Evaluating Bias in LLMs for Job-Resume Matching: Gender, Race, and Education
par: Iso, Hayate, et autres
Publié: (2025)
par: Iso, Hayate, et autres
Publié: (2025)
ConFit v2: Improving Resume-Job Matching using Hypothetical Resume Embedding and Runner-Up Hard-Negative Mining
par: Yu, Xiao, et autres
Publié: (2025)
par: Yu, Xiao, et autres
Publié: (2025)
MRCEval: A Comprehensive, Challenging and Accessible Machine Reading Comprehension Benchmark
par: Ma, Shengkun, et autres
Publié: (2025)
par: Ma, Shengkun, et autres
Publié: (2025)
Medical Knowledge Graph QA for Drug-Drug Interaction Prediction based on Multi-hop Machine Reading Comprehension
par: Gao, Peng, et autres
Publié: (2022)
par: Gao, Peng, et autres
Publié: (2022)
CareerBERT: Matching Resumes to ESCO Jobs in a Shared Embedding Space for Generic Job Recommendations
par: Rosenberger, Julian, et autres
Publié: (2025)
par: Rosenberger, Julian, et autres
Publié: (2025)
Reading Between the Lines: Classifying Resume Seniority with Large Language Models
par: Cohen, Matan, et autres
Publié: (2025)
par: Cohen, Matan, et autres
Publié: (2025)
PaperHelper: Knowledge-Based LLM QA Paper Reading Assistant
par: Yin, Congrui, et autres
Publié: (2025)
par: Yin, Congrui, et autres
Publié: (2025)
ConFit: Improving Resume-Job Matching using Data Augmentation and Contrastive Learning
par: Yu, Xiao, et autres
Publié: (2024)
par: Yu, Xiao, et autres
Publié: (2024)
MedExpQA: Multilingual Benchmarking of Large Language Models for Medical Question Answering
par: Alonso, Iñigo, et autres
Publié: (2024)
par: Alonso, Iñigo, et autres
Publié: (2024)
AutoScreen-FW: An LLM-based Framework for Resume Screening
par: Xu, Zhelin, et autres
Publié: (2026)
par: Xu, Zhelin, et autres
Publié: (2026)
RJUA-QA: A Comprehensive QA Dataset for Urology
par: Lyu, Shiwei, et autres
Publié: (2023)
par: Lyu, Shiwei, et autres
Publié: (2023)
DisastQA: A Comprehensive Benchmark for Evaluating Question Answering in Disaster Management
par: Chen, Zhitong, et autres
Publié: (2026)
par: Chen, Zhitong, et autres
Publié: (2026)
Investigating a Benchmark for Training-set free Evaluation of Linguistic Capabilities in Machine Reading Comprehension
par: Schlegel, Viktor, et autres
Publié: (2024)
par: Schlegel, Viktor, et autres
Publié: (2024)
Multilingual JobBERT for Cross-Lingual Job Title Matching
par: Decorte, Jens-Joris, et autres
Publié: (2025)
par: Decorte, Jens-Joris, et autres
Publié: (2025)
Application of LLM Agents in Recruitment: A Novel Framework for Resume Screening
par: Gan, Chengguang, et autres
Publié: (2024)
par: Gan, Chengguang, et autres
Publié: (2024)
Benchmarking LLM Guardrails in Handling Multilingual Toxicity
par: Yang, Yahan, et autres
Publié: (2024)
par: Yang, Yahan, et autres
Publié: (2024)
Evaluating Monolingual and Multilingual Large Language Models for Greek Question Answering: The DemosQA Benchmark
par: Mastrokostas, Charalampos, et autres
Publié: (2026)
par: Mastrokostas, Charalampos, et autres
Publié: (2026)
Multilingual Open QA on the MIA Shared Task
par: Yarrabelly, Navya, et autres
Publié: (2025)
par: Yarrabelly, Navya, et autres
Publié: (2025)
Tiny QA Benchmark++: Ultra-Lightweight, Synthetic Multilingual Dataset Generation & Smoke-Tests for Continuous LLM Evaluation
par: Koc, Vincent
Publié: (2025)
par: Koc, Vincent
Publié: (2025)
EXECUTE: A Multilingual Benchmark for LLM Token Understanding
par: Edman, Lukas, et autres
Publié: (2025)
par: Edman, Lukas, et autres
Publié: (2025)
ChatGPT v.s. Media Bias: A Comparative Study of GPT-3.5 and Fine-tuned Language Models
par: Wen, Zehao, et autres
Publié: (2024)
par: Wen, Zehao, et autres
Publié: (2024)
M2QA: Multi-domain Multilingual Question Answering
par: Engländer, Leon, et autres
Publié: (2024)
par: Engländer, Leon, et autres
Publié: (2024)
Pushing the Limits of Zero-shot End-to-End Speech Translation
par: Tsiamas, Ioannis, et autres
Publié: (2024)
par: Tsiamas, Ioannis, et autres
Publié: (2024)
ThReadMed-QA: A Multi-Turn Medical Dialogue Benchmark from Real Patient Questions
par: Munnangi, Monica, et autres
Publié: (2026)
par: Munnangi, Monica, et autres
Publié: (2026)
EHRNoteQA: An LLM Benchmark for Real-World Clinical Practice Using Discharge Summaries
par: Kweon, Sunjun, et autres
Publié: (2024)
par: Kweon, Sunjun, et autres
Publié: (2024)
IntentionQA: A Benchmark for Evaluating Purchase Intention Comprehension Abilities of Language Models in E-commerce
par: Ding, Wenxuan, et autres
Publié: (2024)
par: Ding, Wenxuan, et autres
Publié: (2024)
DiscoTrack: A Multilingual LLM Benchmark for Discourse Tracking
par: Bu, Lanni, et autres
Publié: (2025)
par: Bu, Lanni, et autres
Publié: (2025)
Documents similaires
-
MELO: An Evaluation Benchmark for Multilingual Entity Linking of Occupations
par: Retyk, Federico, et autres
Publié: (2024) -
InterPilot: Exploring the Design Space of AI-assisted Job Interview Support for HR Professionals
par: Xu, Zhengtao, et autres
Publié: (2026) -
Measuring Gender Bias in Job Title Matching for Grammatical Gender Languages
par: García-Sardiña, Laura, et autres
Publié: (2025) -
Overview of the TalentCLEF 2025: Skill and Job Title Intelligence for Human Capital Management
par: Gasco, Luis, et autres
Publié: (2025) -
MultiWikiQA: A Reading Comprehension Benchmark in 300+ Languages
par: Smart, Dan Saattrup
Publié: (2025)