A Study on How Attention Scores in the BERT Model are Aware of Lexical Categories in Syntactic and Semantic Tasks on the GLUE Benchmark
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Jang, Dongjun, Byun, Sungjoo, Shin, Hyopil |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
KIT-19: A Comprehensive Korean Instruction Toolkit on 19 Tasks for Fine-Tuning Korean Large Language Models
par: Jang, Dongjun, et autres
Publié: (2024)
par: Jang, Dongjun, et autres
Publié: (2024)
CARBD-Ko: A Contextually Annotated Review Benchmark Dataset for Aspect-Level Sentiment Classification in Korean
par: Jang, Dongjun, et autres
Publié: (2024)
par: Jang, Dongjun, et autres
Publié: (2024)
RCScore: Quantifying Response Consistency in Large Language Models
par: Jang, Dongjun, et autres
Publié: (2025)
par: Jang, Dongjun, et autres
Publié: (2025)
P-CoT: A Pedagogically-motivated Participatory Chain-of-Thought Prompting for Phonological Reasoning in LLMs
par: Jang, Dongjun, et autres
Publié: (2025)
par: Jang, Dongjun, et autres
Publié: (2025)
Korean Bio-Medical Corpus (KBMC) for Medical Named Entity Recognition
par: Byun, Sungjoo, et autres
Publié: (2024)
par: Byun, Sungjoo, et autres
Publié: (2024)
DAHL: Domain-specific Automated Hallucination Evaluation of Long-Form Text through a Benchmark Dataset in Biomedicine
par: Seo, Jean, et autres
Publié: (2024)
par: Seo, Jean, et autres
Publié: (2024)
How does a Language-Specific Tokenizer affect LLMs?
par: Seo, Jean, et autres
Publié: (2025)
par: Seo, Jean, et autres
Publié: (2025)
KoBALT: Korean Benchmark For Advanced Linguistic Tasks
par: Shin, Hyopil, et autres
Publié: (2025)
par: Shin, Hyopil, et autres
Publié: (2025)
Same Meaning, Different Scores: Lexical and Syntactic Sensitivity in LLM Evaluation
par: Kostić, Bogdan, et autres
Publié: (2026)
par: Kostić, Bogdan, et autres
Publié: (2026)
BenchCLAMP: A Benchmark for Evaluating Language Models on Syntactic and Semantic Parsing
par: Roy, Subhro, et autres
Publié: (2022)
par: Roy, Subhro, et autres
Publié: (2022)
Mergen: The First Manchu-Korean Machine Translation Model Trained on Augmented Data
par: Seo, Jean, et autres
Publié: (2023)
par: Seo, Jean, et autres
Publié: (2023)
Training Models on Dialects of Translationese Shows How Lexical Diversity and Source-Target Syntactic Similarity Shape Learning
par: Kunz, Jenny
Publié: (2026)
par: Kunz, Jenny
Publié: (2026)
Incorporating Lexical and Syntactic Knowledge for Unsupervised Cross-Lingual Transfer
par: Zheng, Jianyu, et autres
Publié: (2024)
par: Zheng, Jianyu, et autres
Publié: (2024)
MoFE: Mixture of Frozen Experts Architecture
par: Seo, Jean, et autres
Publié: (2025)
par: Seo, Jean, et autres
Publié: (2025)
PORTULAN ExtraGLUE Datasets and Models: Kick-starting a Benchmark for the Neural Processing of Portuguese
par: Osório, Tomás, et autres
Publié: (2024)
par: Osório, Tomás, et autres
Publié: (2024)
ManWav: The First Manchu ASR Model
par: Seo, Jean, et autres
Publié: (2024)
par: Seo, Jean, et autres
Publié: (2024)
Enhancing Automatic Term Extraction with Large Language Models via Syntactic Retrieval
par: Chun, Yongchan, et autres
Publié: (2025)
par: Chun, Yongchan, et autres
Publié: (2025)
Do Syntactic Categories Help in Developmentally Motivated Curriculum Learning for Language Models?
par: Güven, Arzu Burcu, et autres
Publié: (2025)
par: Güven, Arzu Burcu, et autres
Publié: (2025)
VL-GLUE: A Suite of Fundamental yet Challenging Visuo-Linguistic Reasoning Tasks
par: Sampat, Shailaja Keyur, et autres
Publié: (2024)
par: Sampat, Shailaja Keyur, et autres
Publié: (2024)
Towards LogiGLUE: A Brief Survey and A Benchmark for Analyzing Logical Reasoning Capabilities of Language Models
par: Luo, Man, et autres
Publié: (2023)
par: Luo, Man, et autres
Publié: (2023)
TaxoLLaMA: WordNet-based Model for Solving Multiple Lexical Semantic Tasks
par: Moskvoretskii, Viktor, et autres
Publié: (2024)
par: Moskvoretskii, Viktor, et autres
Publié: (2024)
JuniperLiu at CoMeDi Shared Task: Models as Annotators in Lexical Semantics Disagreements
par: Liu, Zhu, et autres
Publié: (2024)
par: Liu, Zhu, et autres
Publié: (2024)
Incremental Comprehension of Garden-Path Sentences by Large Language Models: Semantic Interpretation, Syntactic Re-Analysis, and Attention
par: Li, Andrew, et autres
Publié: (2024)
par: Li, Andrew, et autres
Publié: (2024)
ltzGLUE: Luxembourgish General Language Understanding Evaluation
par: Plum, Alistair, et autres
Publié: (2026)
par: Plum, Alistair, et autres
Publié: (2026)
VISLA Benchmark: Evaluating Embedding Sensitivity to Semantic and Lexical Alterations
par: Dumpala, Sri Harsha, et autres
Publié: (2024)
par: Dumpala, Sri Harsha, et autres
Publié: (2024)
SpeechGLUE: How Well Can Self-Supervised Speech Models Capture Linguistic Knowledge?
par: Ashihara, Takanori, et autres
Publié: (2023)
par: Ashihara, Takanori, et autres
Publié: (2023)
Mapping Semantic & Syntactic Relationships with Geometric Rotation
par: Freenor, Michael, et autres
Publié: (2025)
par: Freenor, Michael, et autres
Publié: (2025)
Breaking MLPerf Training: A Case Study on Optimizing BERT
par: Kim, Yongdeok, et autres
Publié: (2024)
par: Kim, Yongdeok, et autres
Publié: (2024)
Healing Powers of BERT: How Task-Specific Fine-Tuning Recovers Corrupted Language Models
par: Han, Shijie, et autres
Publié: (2024)
par: Han, Shijie, et autres
Publié: (2024)
Introducing TrGLUE and SentiTurca: A Comprehensive Benchmark for Turkish General Language Understanding and Sentiment Analysis
par: Altinok, Duygu
Publié: (2025)
par: Altinok, Duygu
Publié: (2025)
Evaluating the Evaluator: Problems with SemEval-2020 Task 1 for Lexical Semantic Change Detection
par: Phan-Tat, Bach, et autres
Publié: (2026)
par: Phan-Tat, Bach, et autres
Publié: (2026)
Model-GLUE: Democratized LLM Scaling for A Large Model Zoo in the Wild
par: Zhao, Xinyu, et autres
Publié: (2024)
par: Zhao, Xinyu, et autres
Publié: (2024)
SAP: Syntactic Attention Pruning for Transformer-based Language Models
par: Lee, Tzu-Yun, et autres
Publié: (2025)
par: Lee, Tzu-Yun, et autres
Publié: (2025)
TabiBERT: A Large-Scale ModernBERT Foundation Model and A Unified Benchmark for Turkish
par: Türker, Melikşah, et autres
Publié: (2025)
par: Türker, Melikşah, et autres
Publié: (2025)
Attention on Multiword Expressions: A Multilingual Study of BERT-based Models with Regard to Idiomaticity and Microsyntax
par: Zaitova, Iuliia, et autres
Publié: (2025)
par: Zaitova, Iuliia, et autres
Publié: (2025)
How Lexical is Bilingual Lexicon Induction?
par: Kohli, Harsh, et autres
Publié: (2024)
par: Kohli, Harsh, et autres
Publié: (2024)
How Gender Interacts with Political Values: A Case Study on Czech BERT Models
par: Ali, Adnan Al, et autres
Publié: (2024)
par: Ali, Adnan Al, et autres
Publié: (2024)
Polarization and Morality: Lexical Analysis of Abortion Discourse on Reddit
par: Stanier, Tessa, et autres
Publié: (2024)
par: Stanier, Tessa, et autres
Publié: (2024)
Analyzing Semantic Change through Lexical Replacements
par: Periti, Francesco, et autres
Publié: (2024)
par: Periti, Francesco, et autres
Publié: (2024)
Rethinking Metrics for Lexical Semantic Change Detection
par: Goworek, Roksana, et autres
Publié: (2026)
par: Goworek, Roksana, et autres
Publié: (2026)
Documents similaires
-
KIT-19: A Comprehensive Korean Instruction Toolkit on 19 Tasks for Fine-Tuning Korean Large Language Models
par: Jang, Dongjun, et autres
Publié: (2024) -
CARBD-Ko: A Contextually Annotated Review Benchmark Dataset for Aspect-Level Sentiment Classification in Korean
par: Jang, Dongjun, et autres
Publié: (2024) -
RCScore: Quantifying Response Consistency in Large Language Models
par: Jang, Dongjun, et autres
Publié: (2025) -
P-CoT: A Pedagogically-motivated Participatory Chain-of-Thought Prompting for Phonological Reasoning in LLMs
par: Jang, Dongjun, et autres
Publié: (2025) -
Korean Bio-Medical Corpus (KBMC) for Medical Named Entity Recognition
par: Byun, Sungjoo, et autres
Publié: (2024)