Learning Shortcuts: On the Misleading Promise of NLU in Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Bihani, Geetanjali, Rayz, Julia Taylor |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
The Reliability Paradox: Exploring How Shortcut Learning Undermines Language Model Calibration
par: Bihani, Geetanjali, et autres
Publié: (2024)
par: Bihani, Geetanjali, et autres
Publié: (2024)
A Fuzzy Evaluation of Sentence Encoders on Grooming Risk Classification
par: Bihani, Geetanjali, et autres
Publié: (2025)
par: Bihani, Geetanjali, et autres
Publié: (2025)
Evaluating Language Models on Grooming Risk Estimation Using Fuzzy Theory
par: Bihani, Geetanjali, et autres
Publié: (2025)
par: Bihani, Geetanjali, et autres
Publié: (2025)
Calibration Error Estimation Using Fuzzy Binning
par: Bihani, Geetanjali, et autres
Publié: (2023)
par: Bihani, Geetanjali, et autres
Publié: (2023)
Hire Me or Not? Examining Language Model's Behavior with Occupation Attributes
par: Zhang, Damin, et autres
Publié: (2024)
par: Zhang, Damin, et autres
Publié: (2024)
1-800-SHARED-TASKS @ NLU of Devanagari Script Languages: Detection of Language, Hate Speech, and Targets using LLMs
par: Purbey, Jebish, et autres
Publié: (2024)
par: Purbey, Jebish, et autres
Publié: (2024)
Enhancing Text Generation in Joint NLG/NLU Learning Through Curriculum Learning, Semi-Supervised Training, and Advanced Optimization Techniques
par: Shaik, Rahimanuddin, et autres
Publié: (2024)
par: Shaik, Rahimanuddin, et autres
Publié: (2024)
CURE: Controlled Unlearning for Robust Embeddings -- Mitigating Conceptual Shortcuts in Pre-Trained Language Models
par: Kocak, Aysenur, et autres
Publié: (2025)
par: Kocak, Aysenur, et autres
Publié: (2025)
Encoder vs Decoder: Comparative Analysis of Encoder and Decoder Language Models on Multilingual NLU Tasks
par: Nielsen, Dan Saattrup, et autres
Publié: (2024)
par: Nielsen, Dan Saattrup, et autres
Publié: (2024)
Exploring Response Uncertainty in MLLMs: An Empirical Evaluation under Misleading Scenarios
par: Dang, Yunkai, et autres
Publié: (2024)
par: Dang, Yunkai, et autres
Publié: (2024)
Survey of NLU Benchmarks Diagnosing Linguistic Phenomena: Why not Standardize Diagnostics Benchmarks?
par: Jallad, Khloud AL, et autres
Publié: (2025)
par: Jallad, Khloud AL, et autres
Publié: (2025)
Adaptive Large Language Models By Layerwise Attention Shortcuts
par: Verma, Prateek, et autres
Publié: (2024)
par: Verma, Prateek, et autres
Publié: (2024)
Transforming NLU with Babylon: A Case Study in Development of Real-time, Edge-Efficient, Multi-Intent Translation System for Automated Drive-Thru Ordering
par: Varzaneh, Mostafa, et autres
Publié: (2024)
par: Varzaneh, Mostafa, et autres
Publié: (2024)
Quagmires in SFT-RL Post-Training: When High SFT Scores Mislead and What to Use Instead
par: Kang, Feiyang, et autres
Publié: (2025)
par: Kang, Feiyang, et autres
Publié: (2025)
Readability $\ne$ Learnability: Rethinking the Role of Simplicity in Training Small Language Models
par: Lee, Ivan, et autres
Publié: (2025)
par: Lee, Ivan, et autres
Publié: (2025)
Beyond Benchmarks: On The False Promise of AI Regulation
par: Stanovsky, Gabriel, et autres
Publié: (2025)
par: Stanovsky, Gabriel, et autres
Publié: (2025)
Eliciting Latent Knowledge from Quirky Language Models
par: Mallen, Alex, et autres
Publié: (2023)
par: Mallen, Alex, et autres
Publié: (2023)
LaFFi: Leveraging Hybrid Natural Language Feedback for Fine-tuning Language Models
par: Li, Qianxi, et autres
Publié: (2023)
par: Li, Qianxi, et autres
Publié: (2023)
Learning to Model the World with Language
par: Lin, Jessy, et autres
Publié: (2023)
par: Lin, Jessy, et autres
Publié: (2023)
LLäMmlein: Transparent, Compact and Competitive German-Only Language Models from Scratch
par: Pfister, Jan, et autres
Publié: (2024)
par: Pfister, Jan, et autres
Publié: (2024)
From Shortcuts to Triggers: Backdoor Defense with Denoised PoE
par: Liu, Qin, et autres
Publié: (2023)
par: Liu, Qin, et autres
Publié: (2023)
Constrained Sampling for Language Models Should Be Easy: An MCMC Perspective
par: Gonzalez, Emmanuel Anaya, et autres
Publié: (2025)
par: Gonzalez, Emmanuel Anaya, et autres
Publié: (2025)
Physics of Language Models: Part 1, Learning Hierarchical Language Structures
par: Allen-Zhu, Zeyuan, et autres
Publié: (2023)
par: Allen-Zhu, Zeyuan, et autres
Publié: (2023)
Learning Mathematical Rules with Large Language Models
par: Gorceix, Antoine, et autres
Publié: (2024)
par: Gorceix, Antoine, et autres
Publié: (2024)
Unlocking Continual Learning Abilities in Language Models
par: Du, Wenyu, et autres
Publié: (2024)
par: Du, Wenyu, et autres
Publié: (2024)
Active Preference Learning for Large Language Models
par: Muldrew, William, et autres
Publié: (2024)
par: Muldrew, William, et autres
Publié: (2024)
Learning to Interpret Weight Differences in Language Models
par: Goel, Avichal, et autres
Publié: (2025)
par: Goel, Avichal, et autres
Publié: (2025)
Integration of Large Language Models and Federated Learning
par: Chen, Chaochao, et autres
Publié: (2023)
par: Chen, Chaochao, et autres
Publié: (2023)
Test-Time Learning for Large Language Models
par: Hu, Jinwu, et autres
Publié: (2025)
par: Hu, Jinwu, et autres
Publié: (2025)
Learning to Route for Dynamic Adapter Composition in Continual Learning with Language Models
par: Araujo, Vladimir, et autres
Publié: (2024)
par: Araujo, Vladimir, et autres
Publié: (2024)
Limits of Transformer Language Models on Learning to Compose Algorithms
par: Thomm, Jonathan, et autres
Publié: (2024)
par: Thomm, Jonathan, et autres
Publié: (2024)
YODA: Teacher-Student Progressive Learning for Language Models
par: Lu, Jianqiao, et autres
Publié: (2024)
par: Lu, Jianqiao, et autres
Publié: (2024)
Fine-Tuning Language Models with Reward Learning on Policy
par: Lang, Hao, et autres
Publié: (2024)
par: Lang, Hao, et autres
Publié: (2024)
Token-Efficient Leverage Learning in Large Language Models
par: Zeng, Yuanhao, et autres
Publié: (2024)
par: Zeng, Yuanhao, et autres
Publié: (2024)
Personalized Wireless Federated Learning for Large Language Models
par: Jiang, Feibo, et autres
Publié: (2024)
par: Jiang, Feibo, et autres
Publié: (2024)
Revisiting In-Context Learning with Long Context Language Models
par: Baek, Jinheon, et autres
Publié: (2024)
par: Baek, Jinheon, et autres
Publié: (2024)
Routoo: Learning to Route to Large Language Models Effectively
par: Mohammadshahi, Alireza, et autres
Publié: (2024)
par: Mohammadshahi, Alireza, et autres
Publié: (2024)
The Entropy Mechanism of Reinforcement Learning for Reasoning Language Models
par: Cui, Ganqu, et autres
Publié: (2025)
par: Cui, Ganqu, et autres
Publié: (2025)
Teaching Language Models to Critique via Reinforcement Learning
par: Xie, Zhihui, et autres
Publié: (2025)
par: Xie, Zhihui, et autres
Publié: (2025)
Offline Learning and Forgetting for Reasoning with Large Language Models
par: Ni, Tianwei, et autres
Publié: (2025)
par: Ni, Tianwei, et autres
Publié: (2025)
Documents similaires
-
The Reliability Paradox: Exploring How Shortcut Learning Undermines Language Model Calibration
par: Bihani, Geetanjali, et autres
Publié: (2024) -
A Fuzzy Evaluation of Sentence Encoders on Grooming Risk Classification
par: Bihani, Geetanjali, et autres
Publié: (2025) -
Evaluating Language Models on Grooming Risk Estimation Using Fuzzy Theory
par: Bihani, Geetanjali, et autres
Publié: (2025) -
Calibration Error Estimation Using Fuzzy Binning
par: Bihani, Geetanjali, et autres
Publié: (2023) -
Hire Me or Not? Examining Language Model's Behavior with Occupation Attributes
par: Zhang, Damin, et autres
Publié: (2024)