LUNA: A Framework for Language Understanding and Naturalness Assessment
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Saidov, Marat, Bakalova, Aleksandra, Taktasheva, Ekaterina, Mikhailov, Vladislav, Artemova, Ekaterina |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
RuBLiMP: Russian Benchmark of Linguistic Minimal Pairs
par: Taktasheva, Ekaterina, et autres
Publié: (2024)
par: Taktasheva, Ekaterina, et autres
Publié: (2024)
AIpom at SemEval-2024 Task 8: Detecting AI-produced Outputs in M4
par: Shirnin, Alexander, et autres
Publié: (2024)
par: Shirnin, Alexander, et autres
Publié: (2024)
Papilusion at DAGPap24: Paper or Illusion? Detecting AI-generated Scientific Papers
par: Andreev, Nikita, et autres
Publié: (2024)
par: Andreev, Nikita, et autres
Publié: (2024)
REPA: Russian Error Types Annotation for Evaluating Text Generation and Judgment Capabilities
par: Pugachev, Alexander, et autres
Publié: (2025)
par: Pugachev, Alexander, et autres
Publié: (2025)
TAPS: Tool-Augmented Personalisation via Structured Tagging
par: Taktasheva, Ekaterina, et autres
Publié: (2025)
par: Taktasheva, Ekaterina, et autres
Publié: (2025)
Beemo: Benchmark of Expert-edited Machine-generated Outputs
par: Artemova, Ekaterina, et autres
Publié: (2024)
par: Artemova, Ekaterina, et autres
Publié: (2024)
RuBia: A Russian Language Bias Detection Dataset
par: Grigoreva, Veronika, et autres
Publié: (2024)
par: Grigoreva, Veronika, et autres
Publié: (2024)
Exploring the Robustness of Task-oriented Dialogue Systems for Colloquial German Varieties
par: Artemova, Ekaterina, et autres
Publié: (2024)
par: Artemova, Ekaterina, et autres
Publié: (2024)
A Family of Pretrained Transformer Language Models for Russian
par: Zmitrovich, Dmitry, et autres
Publié: (2023)
par: Zmitrovich, Dmitry, et autres
Publié: (2023)
Voices of Freelance Professional Writers on AI: Limitations, Expectations, and Fears
par: Ivanova, Anastasiia, et autres
Publié: (2025)
par: Ivanova, Anastasiia, et autres
Publié: (2025)
Donkii: Can Annotation Error Detection Methods Find Errors in Instruction-Tuning Datasets?
par: Weber-Genzel, Leon, et autres
Publié: (2023)
par: Weber-Genzel, Leon, et autres
Publié: (2023)
Low-Resource, High-Impact: Building Corpora for Inclusive Language Technologies
par: Artemova, Ekaterina, et autres
Publié: (2025)
par: Artemova, Ekaterina, et autres
Publié: (2025)
JEEM: Vision-Language Understanding in Four Arabic Dialects
par: Kadaoui, Karima, et autres
Publié: (2025)
par: Kadaoui, Karima, et autres
Publié: (2025)
SemEval-2026 Task 4: Narrative Story Similarity and Narrative Representation Learning
par: Hatzel, Hans Ole, et autres
Publié: (2026)
par: Hatzel, Hans Ole, et autres
Publié: (2026)
Density Matrices for Metaphor Understanding
par: Owers, Jay, et autres
Publié: (2024)
par: Owers, Jay, et autres
Publié: (2024)
Hands-On Tutorial: Labeling with LLM and Human-in-the-Loop
par: Artemova, Ekaterina, et autres
Publié: (2024)
par: Artemova, Ekaterina, et autres
Publié: (2024)
Sebastian, Basti, Wastl?! Recognizing Named Entities in Bavarian Dialectal Data
par: Peng, Siyao, et autres
Publié: (2024)
par: Peng, Siyao, et autres
Publié: (2024)
A Fully Automated Pipeline for Conversational Discourse Annotation: Tree Scheme Generation and Labeling with Large Language Models
par: Petukhova, Kseniia, et autres
Publié: (2025)
par: Petukhova, Kseniia, et autres
Publié: (2025)
U-MATH: A University-Level Benchmark for Evaluating Mathematical Skills in LLMs
par: Chernyshev, Konstantin, et autres
Publié: (2024)
par: Chernyshev, Konstantin, et autres
Publié: (2024)
NorEval: A Norwegian Language Understanding and Generation Evaluation Benchmark
par: Mikhailov, Vladislav, et autres
Publié: (2025)
par: Mikhailov, Vladislav, et autres
Publié: (2025)
A Multidimensional Framework for Evaluating Lexical Semantic Change with Social Science Applications
par: Baes, Naomi, et autres
Publié: (2024)
par: Baes, Naomi, et autres
Publié: (2024)
Contextualize-then-Aggregate: Circuits for In-Context Learning in Gemma-2 2B
par: Bakalova, Aleksandra, et autres
Publié: (2025)
par: Bakalova, Aleksandra, et autres
Publié: (2025)
Metaphor Understanding Challenge Dataset for LLMs
par: Tong, Xiaoyu, et autres
Publié: (2024)
par: Tong, Xiaoyu, et autres
Publié: (2024)
REFeREE: A REference-FREE Model-Based Metric for Text Simplification
par: Huang, Yichen, et autres
Publié: (2024)
par: Huang, Yichen, et autres
Publié: (2024)
Scientific Reasoning: Assessment of Multimodal Generative LLMs
par: Dreyer, Florian, et autres
Publié: (2025)
par: Dreyer, Florian, et autres
Publié: (2025)
Vavanagi: a Community-run Platform for Documentation of the Hula Language in Papua New Guinea
par: Olewale, Bri, et autres
Publié: (2026)
par: Olewale, Bri, et autres
Publié: (2026)
Online vs Offline: A Comparative Study of First-Party and Third-Party Evaluations of Social Chatbots
par: Svikhnushina, Ekaterina, et autres
Publié: (2024)
par: Svikhnushina, Ekaterina, et autres
Publié: (2024)
Induction Heads as an Essential Mechanism for Pattern Matching in In-context Learning
par: Crosbie, Joy, et autres
Publié: (2024)
par: Crosbie, Joy, et autres
Publié: (2024)
Self-Alignment: Improving Alignment of Cultural Values in LLMs via In-Context Learning
par: Choenni, Rochelle, et autres
Publié: (2024)
par: Choenni, Rochelle, et autres
Publié: (2024)
Intent Matters: Enhancing AI Tutoring with Fine-Grained Pedagogical Intent Annotation
par: Petukhova, Kseniia, et autres
Publié: (2025)
par: Petukhova, Kseniia, et autres
Publié: (2025)
Towards Reward Modeling for AI Tutors in Math Mistake Remediation
par: Petukhova, Kseniia, et autres
Publié: (2026)
par: Petukhova, Kseniia, et autres
Publié: (2026)
Benchmarking Abstractive Summarisation: A Dataset of Human-authored Summaries of Norwegian News Articles
par: Touileb, Samia, et autres
Publié: (2025)
par: Touileb, Samia, et autres
Publié: (2025)
Small Languages, Big Models: A Study of Continual Training on Languages of Norway
par: Samuel, David, et autres
Publié: (2024)
par: Samuel, David, et autres
Publié: (2024)
Teaching Through Analogies: A Modular Pipeline for Educational Analogy Generation
par: Barakat, Mariam, et autres
Publié: (2026)
par: Barakat, Mariam, et autres
Publié: (2026)
Linguacodus: A Synergistic Framework for Transformative Code Generation in Machine Learning Pipelines
par: Trofimova, Ekaterina, et autres
Publié: (2024)
par: Trofimova, Ekaterina, et autres
Publié: (2024)
Tendem: A Hybrid AI+Human Platform
par: Chernyshev, Konstantin, et autres
Publié: (2026)
par: Chernyshev, Konstantin, et autres
Publié: (2026)
SelectLLM: Query-Aware Efficient Selection Algorithm for Large Language Models
par: Maurya, Kaushal Kumar, et autres
Publié: (2024)
par: Maurya, Kaushal Kumar, et autres
Publié: (2024)
What Makes Math Word Problems Challenging for LLMs?
par: Srivatsa, KV Aditya, et autres
Publié: (2024)
par: Srivatsa, KV Aditya, et autres
Publié: (2024)
Pedagogy-driven Evaluation of Generative AI-powered Intelligent Tutoring Systems
par: Maurya, Kaushal Kumar, et autres
Publié: (2025)
par: Maurya, Kaushal Kumar, et autres
Publié: (2025)
A framework for annotating and modelling intentions behind metaphor use
par: Michelli, Gianluca, et autres
Publié: (2024)
par: Michelli, Gianluca, et autres
Publié: (2024)
Documents similaires
-
RuBLiMP: Russian Benchmark of Linguistic Minimal Pairs
par: Taktasheva, Ekaterina, et autres
Publié: (2024) -
AIpom at SemEval-2024 Task 8: Detecting AI-produced Outputs in M4
par: Shirnin, Alexander, et autres
Publié: (2024) -
Papilusion at DAGPap24: Paper or Illusion? Detecting AI-generated Scientific Papers
par: Andreev, Nikita, et autres
Publié: (2024) -
REPA: Russian Error Types Annotation for Evaluating Text Generation and Judgment Capabilities
par: Pugachev, Alexander, et autres
Publié: (2025) -
TAPS: Tool-Augmented Personalisation via Structured Tagging
par: Taktasheva, Ekaterina, et autres
Publié: (2025)