Enregistré dans:
| Auteurs principaux: | Vasselli, Justin, Kardinata, Eunike Andriani, Sakai, Yusuke, Watanabe, Taro |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2509.22086 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Beyond Film Subtitles: Is YouTube the Best Approximation of Spoken Vocabulary?
par: Nohejl, Adam, et autres
Publié: (2024)
par: Nohejl, Adam, et autres
Publié: (2024)
Measuring the Robustness of Reference-Free Dialogue Evaluation Systems
par: Vasselli, Justin, et autres
Publié: (2025)
par: Vasselli, Justin, et autres
Publié: (2025)
Improving Explainability of Sentence-level Metrics via Edit-level Attribution for Grammatical Error Correction
par: Goto, Takumi, et autres
Publié: (2024)
par: Goto, Takumi, et autres
Publié: (2024)
Dictionaries to the Rescue: Cross-Lingual Vocabulary Transfer for Low-Resource Languages Using Bilingual Dictionaries
par: Sakajo, Haruki, et autres
Publié: (2025)
par: Sakajo, Haruki, et autres
Publié: (2025)
How to Make the Most of LLMs' Grammatical Knowledge for Acceptability Judgments
par: Ide, Yusuke, et autres
Publié: (2024)
par: Ide, Yusuke, et autres
Publié: (2024)
mCSQA: Multilingual Commonsense Reasoning Dataset with Unified Creation Strategy by Language Models and Humans
par: Sakai, Yusuke, et autres
Publié: (2024)
par: Sakai, Yusuke, et autres
Publié: (2024)
CoAM: Corpus of All-Type Multiword Expressions
par: Ide, Yusuke, et autres
Publié: (2024)
par: Ide, Yusuke, et autres
Publié: (2024)
Multilinguality of Large Language Models From a Structural Perspective
par: Sakajo, Haruki, et autres
Publié: (2026)
par: Sakajo, Haruki, et autres
Publié: (2026)
Revisiting Compositional Generalization Capability of Large Language Models Considering Instruction Following Ability
par: Sakai, Yusuke, et autres
Publié: (2025)
par: Sakai, Yusuke, et autres
Publié: (2025)
gec-metrics: A Unified Library for Grammatical Error Correction Evaluation
par: Goto, Takumi, et autres
Publié: (2025)
par: Goto, Takumi, et autres
Publié: (2025)
Reliability Crisis of Reference-free Metrics for Grammatical Error Correction
par: Goto, Takumi, et autres
Publié: (2025)
par: Goto, Takumi, et autres
Publié: (2025)
Rethinking Evaluation Metrics for Grammatical Error Correction: Why Use a Different Evaluation Process than Human?
par: Goto, Takumi, et autres
Publié: (2025)
par: Goto, Takumi, et autres
Publié: (2025)
Edit-level Majority Voting Mitigates Over-Correction in LLM-based Grammatical Error Correction
par: Goto, Takumi, et autres
Publié: (2026)
par: Goto, Takumi, et autres
Publié: (2026)
Grammatical Error Correction Evaluation by Optimally Transporting Edit Representation
par: Goto, Takumi, et autres
Publié: (2026)
par: Goto, Takumi, et autres
Publié: (2026)
IMPARA-GED: Grammatical Error Detection is Boosting Reference-free Grammatical Error Quality Estimator
par: Sakai, Yusuke, et autres
Publié: (2025)
par: Sakai, Yusuke, et autres
Publié: (2025)
HalluCitation Matters: Revealing the Impact of Hallucinated References with 300 Hallucinated Papers in ACL Conferences
par: Sakai, Yusuke, et autres
Publié: (2026)
par: Sakai, Yusuke, et autres
Publié: (2026)
HalluCiteChecker: A Lightweight Toolkit for Hallucinated Citation Detection and Verification in the Era of AI Scientists
par: Sakai, Yusuke, et autres
Publié: (2026)
par: Sakai, Yusuke, et autres
Publié: (2026)
mbrs: A Library for Minimum Bayes Risk Decoding
par: Deguchi, Hiroyuki, et autres
Publié: (2024)
par: Deguchi, Hiroyuki, et autres
Publié: (2024)
Conversational Feedback in Scripted versus Spontaneous Dialogues: A Comparative Analysis
par: Pilán, Ildikó, et autres
Publié: (2023)
par: Pilán, Ildikó, et autres
Publié: (2023)
Tonguescape: Exploring Language Models Understanding of Vowel Articulation
par: Sakajo, Haruki, et autres
Publié: (2025)
par: Sakajo, Haruki, et autres
Publié: (2025)
ECoh: Turn-level Coherence Evaluation for Multilingual Dialogues
par: Mendonça, John, et autres
Publié: (2024)
par: Mendonça, John, et autres
Publié: (2024)
Does Pre-trained Language Model Actually Infer Unseen Links in Knowledge Graph Completion?
par: Sakai, Yusuke, et autres
Publié: (2023)
par: Sakai, Yusuke, et autres
Publié: (2023)
Diversity Explains Inference Scaling Laws: Through a Case Study of Minimum Bayes Risk Decoding
par: Kamigaito, Hidetaka, et autres
Publié: (2024)
par: Kamigaito, Hidetaka, et autres
Publié: (2024)
AdTEC: A Unified Benchmark for Evaluating Text Quality in Search Engine Advertising
par: Zhang, Peinan, et autres
Publié: (2024)
par: Zhang, Peinan, et autres
Publié: (2024)
Diagnosing Vision Language Models' Perception by Leveraging Human Methods for Color Vision Deficiencies
par: Hayashi, Kazuki, et autres
Publié: (2025)
par: Hayashi, Kazuki, et autres
Publié: (2025)
Transition-Matrix Regularization for Next Dialogue Act Prediction in Counselling Conversations
par: Rudolph, Eric, et autres
Publié: (2026)
par: Rudolph, Eric, et autres
Publié: (2026)
Exploring ReAct Prompting for Task-Oriented Dialogue: Insights and Shortcomings
par: Elizabeth, Michelle, et autres
Publié: (2024)
par: Elizabeth, Michelle, et autres
Publié: (2024)
StructLens: A Structural Lens for Language Models via Maximum Spanning Trees
par: Sakajo, Haruki, et autres
Publié: (2026)
par: Sakajo, Haruki, et autres
Publié: (2026)
Simultaneous Interpretation Corpus Construction by Large Language Models in Distant Language Pair
par: Sakai, Yusuke, et autres
Publié: (2024)
par: Sakai, Yusuke, et autres
Publié: (2024)
MEDAL: A Framework for Benchmarking LLMs as Multilingual Open-Domain Dialogue Evaluators
par: Mendonça, John, et autres
Publié: (2025)
par: Mendonça, John, et autres
Publié: (2025)
Efficient Multilingual Dialogue Processing via Translation Pipelines and Distilled Language Models
par: Novoa, Santiago Martínez, et autres
Publié: (2026)
par: Novoa, Santiago Martínez, et autres
Publié: (2026)
Self-Emotion Blended Dialogue Generation in Social Simulation Agents
par: Zhang, Qiang, et autres
Publié: (2024)
par: Zhang, Qiang, et autres
Publié: (2024)
DiaSynth: Synthetic Dialogue Generation Framework for Low Resource Dialogue Applications
par: Suresh, Sathya Krishnan, et autres
Publié: (2024)
par: Suresh, Sathya Krishnan, et autres
Publié: (2024)
Towards Negotiative Dialogue for the Talkamatic Dialogue Manager
par: Larsson, Staffan, et autres
Publié: (2024)
par: Larsson, Staffan, et autres
Publié: (2024)
BQA: Body Language Question Answering Dataset for Video Large Language Models
par: Ozaki, Shintaro, et autres
Publié: (2024)
par: Ozaki, Shintaro, et autres
Publié: (2024)
Towards Cross-Lingual Explanation of Artwork in Large-scale Vision Language Models
par: Ozaki, Shintaro, et autres
Publié: (2024)
par: Ozaki, Shintaro, et autres
Publié: (2024)
Centroid-Based Efficient Minimum Bayes Risk Decoding
par: Deguchi, Hiroyuki, et autres
Publié: (2024)
par: Deguchi, Hiroyuki, et autres
Publié: (2024)
Does Collaborative Human-LM Dialogue Generation Help Information Extraction from Human Dialogues?
par: Lu, Bo-Ru, et autres
Publié: (2023)
par: Lu, Bo-Ru, et autres
Publié: (2023)
Agreement-Constrained Probabilistic Minimum Bayes Risk Decoding
par: Natsumi, Koki, et autres
Publié: (2025)
par: Natsumi, Koki, et autres
Publié: (2025)
Toward the Evaluation of Large Language Models Considering Score Variance across Instruction Templates
par: Sakai, Yusuke, et autres
Publié: (2024)
par: Sakai, Yusuke, et autres
Publié: (2024)
Documents similaires
-
Beyond Film Subtitles: Is YouTube the Best Approximation of Spoken Vocabulary?
par: Nohejl, Adam, et autres
Publié: (2024) -
Measuring the Robustness of Reference-Free Dialogue Evaluation Systems
par: Vasselli, Justin, et autres
Publié: (2025) -
Improving Explainability of Sentence-level Metrics via Edit-level Attribution for Grammatical Error Correction
par: Goto, Takumi, et autres
Publié: (2024) -
Dictionaries to the Rescue: Cross-Lingual Vocabulary Transfer for Low-Resource Languages Using Bilingual Dictionaries
par: Sakajo, Haruki, et autres
Publié: (2025) -
How to Make the Most of LLMs' Grammatical Knowledge for Acceptability Judgments
par: Ide, Yusuke, et autres
Publié: (2024)