Explore Spurious Correlations at the Concept Level in Language Models for Text Classification
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhou, Yuhang, Xu, Paiheng, Liu, Xiaoyu, An, Bang, Ai, Wei, Huang, Furong |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Multi-Stage Balanced Distillation: Addressing Long-Tail Challenges in Sequence-Level Knowledge Distillation
par: Zhou, Yuhang, et autres
Publié: (2024)
par: Zhou, Yuhang, et autres
Publié: (2024)
Large Language Models and Causal Inference in Collaboration: A Survey
par: Liu, Xiaoyu, et autres
Publié: (2024)
par: Liu, Xiaoyu, et autres
Publié: (2024)
DISCO Balances the Scales: Adaptive Domain- and Difficulty-Aware Reinforcement Learning on Imbalanced Data
par: Zhou, Yuhang, et autres
Publié: (2025)
par: Zhou, Yuhang, et autres
Publié: (2025)
The Promises and Pitfalls of Using Language Models to Measure Instruction Quality in Education
par: Xu, Paiheng, et autres
Publié: (2024)
par: Xu, Paiheng, et autres
Publié: (2024)
Emojis Decoded: Leveraging ChatGPT for Enhanced Understanding in Social Media Communications
par: Zhou, Yuhang, et autres
Publié: (2024)
par: Zhou, Yuhang, et autres
Publié: (2024)
Teaching-Assistant-in-the-Loop: Improving Knowledge Distillation from Imperfect Teacher Models in Low-Budget Scenarios
par: Zhou, Yuhang, et autres
Publié: (2024)
par: Zhou, Yuhang, et autres
Publié: (2024)
Assessing Robustness to Spurious Correlations in Post-Training Language Models
par: Shuieh, Julia, et autres
Publié: (2025)
par: Shuieh, Julia, et autres
Publié: (2025)
GFairHint: Improving Individual Fairness for Graph Neural Networks via Fairness Hint
par: Xu, Paiheng, et autres
Publié: (2023)
par: Xu, Paiheng, et autres
Publié: (2023)
MergeME: Model Merging Techniques for Homogeneous and Heterogeneous MoEs
par: Zhou, Yuhang, et autres
Publié: (2025)
par: Zhou, Yuhang, et autres
Publié: (2025)
Spurious Correlations and Beyond: Understanding and Mitigating Shortcut Learning in SDOH Extraction with Large Language Models
par: Sakib, Fardin Ahsan, et autres
Publié: (2025)
par: Sakib, Fardin Ahsan, et autres
Publié: (2025)
CoBA: Counterbias Text Augmentation for Mitigating Various Spurious Correlations via Semantic Triples
par: Jin, Kyohoon, et autres
Publié: (2025)
par: Jin, Kyohoon, et autres
Publié: (2025)
ConceptViz: A Visual Analytics Approach for Exploring Concepts in Large Language Models
par: Li, Haoxuan, et autres
Publié: (2025)
par: Li, Haoxuan, et autres
Publié: (2025)
Towards Understanding In-Context Learning with Contrastive Demonstrations and Saliency Maps
par: Liu, Fuxiao, et autres
Publié: (2023)
par: Liu, Fuxiao, et autres
Publié: (2023)
The Devil Is in the Details: Tackling Unimodal Spurious Correlations for Generalizable Multimodal Reward Models
par: Li, Zichao, et autres
Publié: (2025)
par: Li, Zichao, et autres
Publié: (2025)
Token-Level LLM Collaboration via FusionRoute
par: Xiong, Nuoya, et autres
Publié: (2026)
par: Xiong, Nuoya, et autres
Publié: (2026)
Concept Based Continuous Prompts for Interpretable Text Classification
par: Chen, Qian, et autres
Publié: (2024)
par: Chen, Qian, et autres
Publié: (2024)
DocMEdit: Towards Document-Level Model Editing
par: Zeng, Li, et autres
Publié: (2025)
par: Zeng, Li, et autres
Publié: (2025)
ASPIRE: Language-Guided Data Augmentation for Improving Robustness Against Spurious Correlations
par: Ghosh, Sreyan, et autres
Publié: (2023)
par: Ghosh, Sreyan, et autres
Publié: (2023)
PerceptionCLIP: Visual Classification by Inferring and Conditioning on Contexts
par: An, Bang, et autres
Publié: (2023)
par: An, Bang, et autres
Publié: (2023)
Exploring Variability in Fine-Tuned Models for Text Classification with DistilBERT
par: Lorenzoni, Giuliano, et autres
Publié: (2024)
par: Lorenzoni, Giuliano, et autres
Publié: (2024)
Mitigating Boundary Ambiguity and Inherent Bias for Text Classification in the Era of Large Language Models
par: Lu, Zhenyi, et autres
Publié: (2024)
par: Lu, Zhenyi, et autres
Publié: (2024)
Mementos: A Comprehensive Benchmark for Multimodal Large Language Model Reasoning over Image Sequences
par: Wang, Xiyao, et autres
Publié: (2024)
par: Wang, Xiyao, et autres
Publié: (2024)
From Adoption to Adaption: Tracing the Diffusion of New Emojis on Twitter
par: Zhou, Yuhang, et autres
Publié: (2024)
par: Zhou, Yuhang, et autres
Publié: (2024)
Reliability Analysis of Psychological Concept Extraction and Classification in User-penned Text
par: Garg, Muskan, et autres
Publié: (2024)
par: Garg, Muskan, et autres
Publié: (2024)
Language Models for Text Classification: Is In-Context Learning Enough?
par: Edwards, Aleksandra, et autres
Publié: (2024)
par: Edwards, Aleksandra, et autres
Publié: (2024)
ECLM: Entity Level Language Model for Spoken Language Understanding with Chain of Intent
par: Yin, Shangjian, et autres
Publié: (2024)
par: Yin, Shangjian, et autres
Publié: (2024)
Beyond Spurious Signals: Debiasing Multimodal Large Language Models via Counterfactual Inference and Adaptive Expert Routing
par: Wu, Zichen, et autres
Publié: (2025)
par: Wu, Zichen, et autres
Publié: (2025)
Understanding and Mitigating Spurious Correlations in Text Classification with Neighborhood Analysis
par: Chew, Oscar, et autres
Publié: (2023)
par: Chew, Oscar, et autres
Publié: (2023)
Batch Aggregation: An Approach to Enhance Text Classification with Correlated Augmented Data
par: Hui, Charco, et autres
Publié: (2025)
par: Hui, Charco, et autres
Publié: (2025)
Bengali Text Classification: An Evaluation of Large Language Model Approaches
par: Hoque, Md Mahmudul, et autres
Publié: (2026)
par: Hoque, Md Mahmudul, et autres
Publié: (2026)
Exploring Concept Depth: How Large Language Models Acquire Knowledge and Concept at Different Layers?
par: Jin, Mingyu, et autres
Publié: (2024)
par: Jin, Mingyu, et autres
Publié: (2024)
Exploring Large Language Models for Word Games:Who is the Spy?
par: Wei, Chentian, et autres
Publié: (2025)
par: Wei, Chentian, et autres
Publié: (2025)
Annotation Guidelines-Based Knowledge Augmentation: Towards Enhancing Large Language Models for Educational Text Classification
par: Liu, Shiqi, et autres
Publié: (2024)
par: Liu, Shiqi, et autres
Publié: (2024)
MERaLiON-TextLLM: Cross-Lingual Understanding of Large Language Models in Chinese, Indonesian, Malay, and Singlish
par: Huang, Xin, et autres
Publié: (2024)
par: Huang, Xin, et autres
Publié: (2024)
ALaRM: Align Language Models via Hierarchical Rewards Modeling
par: Lai, Yuhang, et autres
Publié: (2024)
par: Lai, Yuhang, et autres
Publié: (2024)
Evolution of Concepts in Language Model Pre-Training
par: Ge, Xuyang, et autres
Publié: (2025)
par: Ge, Xuyang, et autres
Publié: (2025)
Removing Spurious Correlation from Neural Network Interpretations
par: Fotouhi, Milad, et autres
Publié: (2024)
par: Fotouhi, Milad, et autres
Publié: (2024)
ConceptMath: A Bilingual Concept-wise Benchmark for Measuring Mathematical Reasoning of Large Language Models
par: Wu, Yanan, et autres
Publié: (2024)
par: Wu, Yanan, et autres
Publié: (2024)
Mask-guided BERT for Few Shot Text Classification
par: Liao, Wenxiong, et autres
Publié: (2023)
par: Liao, Wenxiong, et autres
Publié: (2023)
Exploring Multi-Temperature Strategies for Token- and Rollout-Level Control in RLVR
par: Zhuang, Haomin, et autres
Publié: (2025)
par: Zhuang, Haomin, et autres
Publié: (2025)
Documents similaires
-
Multi-Stage Balanced Distillation: Addressing Long-Tail Challenges in Sequence-Level Knowledge Distillation
par: Zhou, Yuhang, et autres
Publié: (2024) -
Large Language Models and Causal Inference in Collaboration: A Survey
par: Liu, Xiaoyu, et autres
Publié: (2024) -
DISCO Balances the Scales: Adaptive Domain- and Difficulty-Aware Reinforcement Learning on Imbalanced Data
par: Zhou, Yuhang, et autres
Publié: (2025) -
The Promises and Pitfalls of Using Language Models to Measure Instruction Quality in Education
par: Xu, Paiheng, et autres
Publié: (2024) -
Emojis Decoded: Leveraging ChatGPT for Enhanced Understanding in Social Media Communications
par: Zhou, Yuhang, et autres
Publié: (2024)