Speak & Improve Challenge 2025: Tasks and Baseline Systems
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Qian, Mengjie, Knill, Kate, Banno, Stefano, Tang, Siyuan, Karanasou, Penny, Gales, Mark J. F., Nicholls, Diane |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Exploiting the English Grammar Profile for L2 grammatical analysis with LLMs
par: Bannò, Stefano, et autres
Publié: (2026)
par: Bannò, Stefano, et autres
Publié: (2026)
Data Augmentation for Spoken Grammatical Error Correction
par: Karanasou, Penny, et autres
Publié: (2025)
par: Karanasou, Penny, et autres
Publié: (2025)
Speak & Improve Corpus 2025: an L2 English Speech Corpus for Language Assessment and Feedback
par: Knill, Kate, et autres
Publié: (2024)
par: Knill, Kate, et autres
Publié: (2024)
Towards Self-Referential Analytic Assessment: A Profile-Based Approach to L2 Writing Evaluation with LLMs
par: Bannò, Stefano, et autres
Publié: (2026)
par: Bannò, Stefano, et autres
Publié: (2026)
Natural Language-based Assessment of L2 Oral Proficiency using LLMs
par: Bannò, Stefano, et autres
Publié: (2025)
par: Bannò, Stefano, et autres
Publié: (2025)
Exploiting the English Vocabulary Profile for L2 word-level vocabulary assessment with LLMs
par: Bannò, Stefano, et autres
Publié: (2025)
par: Bannò, Stefano, et autres
Publié: (2025)
Scaling and Prompting for Improved End-to-End Spoken Grammatical Error Correction
par: Qian, Mengjie, et autres
Publié: (2025)
par: Qian, Mengjie, et autres
Publié: (2025)
Grammatical Error Feedback: An Implicit Evaluation Approach
par: Bannò, Stefano, et autres
Publié: (2024)
par: Bannò, Stefano, et autres
Publié: (2024)
Assessment of L2 Oral Proficiency using Speech Large Language Models
par: Ma, Rao, et autres
Publié: (2025)
par: Ma, Rao, et autres
Publié: (2025)
Towards End-to-End Spoken Grammatical Error Correction
par: Bannò, Stefano, et autres
Publié: (2023)
par: Bannò, Stefano, et autres
Publié: (2023)
End-to-End Spoken Grammatical Error Correction
par: Qian, Mengjie, et autres
Publié: (2025)
par: Qian, Mengjie, et autres
Publié: (2025)
Cross-Lingual Transfer Learning for Speech Translation
par: Ma, Rao, et autres
Publié: (2024)
par: Ma, Rao, et autres
Publié: (2024)
Can GPT-4 do L2 analytic assessment?
par: Bannò, Stefano, et autres
Publié: (2024)
par: Bannò, Stefano, et autres
Publié: (2024)
ASR Error Correction using Large Language Models
par: Ma, Rao, et autres
Publié: (2024)
par: Ma, Rao, et autres
Publié: (2024)
Learn and Don't Forget: Adding a New Language to ASR Foundation Models
par: Qian, Mengjie, et autres
Publié: (2024)
par: Qian, Mengjie, et autres
Publié: (2024)
Who can we trust? LLM-as-a-jury for Comparative Assessment
par: Qian, Mengjie, et autres
Publié: (2026)
par: Qian, Mengjie, et autres
Publié: (2026)
Universal Acoustic Adversarial Attacks for Flexible Control of Speech-LLMs
par: Ma, Rao, et autres
Publié: (2025)
par: Ma, Rao, et autres
Publié: (2025)
Zero-shot Audio Topic Reranking using Large Language Models
par: Qian, Mengjie, et autres
Publié: (2023)
par: Qian, Mengjie, et autres
Publié: (2023)
Speaker Retrieval in the Wild: Challenges, Effectiveness and Robustness
par: Loweimi, Erfan, et autres
Publié: (2025)
par: Loweimi, Erfan, et autres
Publié: (2025)
The Impact of Editorial Intervention on Detecting Native Language Traces
par: Uluslu, Ahmet Yavuz, et autres
Publié: (2026)
par: Uluslu, Ahmet Yavuz, et autres
Publié: (2026)
Investigating the Emergent Audio Classification Ability of ASR Foundation Models
par: Ma, Rao, et autres
Publié: (2023)
par: Ma, Rao, et autres
Publié: (2023)
Muting Whisper: A Universal Acoustic Adversarial Attack on Speech Foundation Models
par: Raina, Vyas, et autres
Publié: (2024)
par: Raina, Vyas, et autres
Publié: (2024)
Finetuning LLMs for Comparative Assessment Tasks
par: Raina, Vatsal, et autres
Publié: (2024)
par: Raina, Vatsal, et autres
Publié: (2024)
An Information-Theoretic Approach to Analyze NLP Classification Tasks
par: Wang, Luran, et autres
Publié: (2024)
par: Wang, Luran, et autres
Publié: (2024)
LLM Task Interference: An Initial Study on the Impact of Task-Switch in Conversational History
par: Gupta, Akash, et autres
Publié: (2024)
par: Gupta, Akash, et autres
Publié: (2024)
Question-Based Retrieval using Atomic Units for Enterprise RAG
par: Raina, Vatsal, et autres
Publié: (2024)
par: Raina, Vatsal, et autres
Publié: (2024)
Efficient Sample-Specific Encoder Perturbations
par: Fathullah, Yassir, et autres
Publié: (2024)
par: Fathullah, Yassir, et autres
Publié: (2024)
WaterJudge: Quality-Detection Trade-off when Watermarking Large Language Models
par: Molenda, Piotr, et autres
Publié: (2024)
par: Molenda, Piotr, et autres
Publié: (2024)
Teacher-Student Training for Debiasing: General Permutation Debiasing for Large Language Models
par: Liusie, Adian, et autres
Publié: (2024)
par: Liusie, Adian, et autres
Publié: (2024)
LLM Comparative Assessment: Zero-shot NLG Evaluation through Pairwise Comparisons using Large Language Models
par: Liusie, Adian, et autres
Publié: (2023)
par: Liusie, Adian, et autres
Publié: (2023)
Opportunities and Challenges of LLMs in Education: An NLP Perspective
par: Vajjala, Sowmya, et autres
Publié: (2025)
par: Vajjala, Sowmya, et autres
Publié: (2025)
LLMs in Education: Novel Perspectives, Challenges, and Opportunities
par: Alhafni, Bashar, et autres
Publié: (2024)
par: Alhafni, Bashar, et autres
Publié: (2024)
Question Difficulty Ranking for Multiple-Choice Reading Comprehension
par: Raina, Vatsal, et autres
Publié: (2024)
par: Raina, Vatsal, et autres
Publié: (2024)
Effectiveness of Chain-of-Thought in Distilling Reasoning Capability from Large Language Models
par: Do, Cong-Thanh, et autres
Publié: (2025)
par: Do, Cong-Thanh, et autres
Publié: (2025)
Controlling Whisper: Universal Acoustic Adversarial Attacks to Control Speech Foundation Models
par: Raina, Vyas, et autres
Publié: (2024)
par: Raina, Vyas, et autres
Publié: (2024)
Is it Possible to Modify Text to a Target Readability Level? An Initial Investigation Using Zero-Shot Large Language Models
par: Farajidizaji, Asma, et autres
Publié: (2023)
par: Farajidizaji, Asma, et autres
Publié: (2023)
Is LLM-as-a-Judge Robust? Investigating Universal Adversarial Attacks on Zero-shot LLM Assessment
par: Raina, Vyas, et autres
Publié: (2024)
par: Raina, Vyas, et autres
Publié: (2024)
Dual-Space Knowledge Distillation with Key-Query Matching for Large Language Models with Vocabulary Mismatch
par: Tsiapali, Stella Eva, et autres
Publié: (2026)
par: Tsiapali, Stella Eva, et autres
Publié: (2026)
Multi-Dialect Vietnamese: Task, Dataset, Baseline Models and Challenges
par: Van Dinh, Nguyen, et autres
Publié: (2024)
par: Van Dinh, Nguyen, et autres
Publié: (2024)
Efficient LLM Comparative Assessment: a Product of Experts Framework for Pairwise Comparisons
par: Liusie, Adian, et autres
Publié: (2024)
par: Liusie, Adian, et autres
Publié: (2024)
Documents similaires
-
Exploiting the English Grammar Profile for L2 grammatical analysis with LLMs
par: Bannò, Stefano, et autres
Publié: (2026) -
Data Augmentation for Spoken Grammatical Error Correction
par: Karanasou, Penny, et autres
Publié: (2025) -
Speak & Improve Corpus 2025: an L2 English Speech Corpus for Language Assessment and Feedback
par: Knill, Kate, et autres
Publié: (2024) -
Towards Self-Referential Analytic Assessment: A Profile-Based Approach to L2 Writing Evaluation with LLMs
par: Bannò, Stefano, et autres
Publié: (2026) -
Natural Language-based Assessment of L2 Oral Proficiency using LLMs
par: Bannò, Stefano, et autres
Publié: (2025)