Through the LLM Looking Glass: A Socratic Probing of Donkeys, Elephants, and Markets
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kennedy, Molly, Imani, Ayyoob, Spinde, Timo, Aizawa, Akiko, Schütze, Hinrich |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
RET-LLM: Towards a General Read-Write Memory for Large Language Models
par: Modarressi, Ali, et autres
Publié: (2023)
par: Modarressi, Ali, et autres
Publié: (2023)
MemLLM: Finetuning LLMs to Use An Explicit Read-Write Memory
par: Modarressi, Ali, et autres
Publié: (2024)
par: Modarressi, Ali, et autres
Publié: (2024)
GlotLID: Language Identification for Low-Resource Languages
par: Kargaran, Amir Hossein, et autres
Publié: (2023)
par: Kargaran, Amir Hossein, et autres
Publié: (2023)
Left, Right, or Center? Evaluating LLM Framing in News Classification and Generation
par: Kennedy, Molly, et autres
Publié: (2026)
par: Kennedy, Molly, et autres
Publié: (2026)
Taxi1500: A Multilingual Dataset for Text Classification in 1500 Languages
par: Ma, Chunlan, et autres
Publié: (2023)
par: Ma, Chunlan, et autres
Publié: (2023)
MURI: High-Quality Instruction Tuning Datasets for Low-Resource Languages via Reverse Instructions
par: Köksal, Abdullatif, et autres
Publié: (2024)
par: Köksal, Abdullatif, et autres
Publié: (2024)
The Promises and Pitfalls of LLM Annotations in Dataset Labeling: a Case Study on Media Bias Detection
par: Horych, Tomas, et autres
Publié: (2024)
par: Horych, Tomas, et autres
Publié: (2024)
How Transliterations Improve Crosslingual Alignment
par: Liu, Yihong, et autres
Publié: (2024)
par: Liu, Yihong, et autres
Publié: (2024)
Hybrid Human-LLM Corpus Construction and LLM Evaluation for Rare Linguistic Phenomena
par: Weissweiler, Leonie, et autres
Publié: (2024)
par: Weissweiler, Leonie, et autres
Publié: (2024)
MAGPIE: Multi-Task Media-Bias Analysis Generalization for Pre-Trained Identification of Expressions
par: Horych, Tomáš, et autres
Publié: (2024)
par: Horych, Tomáš, et autres
Publié: (2024)
GKnow: Measuring the Entanglement of Gender Bias and Factual Gender
par: Veloso, Leonor, et autres
Publié: (2026)
par: Veloso, Leonor, et autres
Publié: (2026)
GLUScope: A Tool for Analyzing GLU Neurons in Transformer Language Models
par: Gerstner, Sebastian, et autres
Publié: (2026)
par: Gerstner, Sebastian, et autres
Publié: (2026)
Are Emotions Arranged in a Circle? Geometric Analysis of Emotion Representations via Hyperspherical Contrastive Learning
par: Yamauchi, Yusuke, et autres
Publié: (2026)
par: Yamauchi, Yusuke, et autres
Publié: (2026)
Unsupervised Domain Adaptation for Keyphrase Generation using Citation Contexts
par: Boudin, Florian, et autres
Publié: (2024)
par: Boudin, Florian, et autres
Publié: (2024)
Leveraging Large Language Models for Automated Definition Extraction with TaxoMatic A Case Study on Media Bias
par: Spinde, Timo, et autres
Publié: (2025)
par: Spinde, Timo, et autres
Publié: (2025)
LongForm: Effective Instruction Tuning with Reverse Instructions
par: Köksal, Abdullatif, et autres
Publié: (2023)
par: Köksal, Abdullatif, et autres
Publié: (2023)
Understanding Gated Neurons in Transformers from Their Input-Output Functionality
par: Gerstner, Sebastian, et autres
Publié: (2025)
par: Gerstner, Sebastian, et autres
Publié: (2025)
Refining and Reusing Annotation Guidelines for LLM Annotation
par: Kim, Kon Woo, et autres
Publié: (2026)
par: Kim, Kon Woo, et autres
Publié: (2026)
Harnessing PDF Data for Improving Japanese Large Multimodal Models
par: Baek, Jeonghun, et autres
Publié: (2025)
par: Baek, Jeonghun, et autres
Publié: (2025)
Do We Know What LLMs Don't Know? A Study of Consistency in Knowledge Probing
par: Zhao, Raoyuan, et autres
Publié: (2025)
par: Zhao, Raoyuan, et autres
Publié: (2025)
HYPEROFA: Expanding LLM Vocabulary to New Languages via Hypernetwork-Based Embedding Initialization
par: Özeren, Enes, et autres
Publié: (2025)
par: Özeren, Enes, et autres
Publié: (2025)
Reassessing Extractive QA Datasets at Scale: LLM-as-a-Judge and In-Depth Analyses
par: Ho, Xanh, et autres
Publié: (2025)
par: Ho, Xanh, et autres
Publié: (2025)
An Analysis of Datasets, Metrics and Models in Keyphrase Generation
par: Boudin, Florian, et autres
Publié: (2025)
par: Boudin, Florian, et autres
Publié: (2025)
Preface to the Special Issue of the TAL Journal on Scholarly Document Processing
par: Boudin, Florian, et autres
Publié: (2025)
par: Boudin, Florian, et autres
Publié: (2025)
Mechanistic Understanding and Mitigation of Language Confusion in English-Centric Large Language Models
par: Nie, Ercong, et autres
Publié: (2025)
par: Nie, Ercong, et autres
Publié: (2025)
Consistent Document-Level Relation Extraction via Counterfactuals
par: Modarressi, Ali, et autres
Publié: (2024)
par: Modarressi, Ali, et autres
Publié: (2024)
Evaluating Contextually Mediated Factual Recall in Multilingual Large Language Models
par: Liu, Yihong, et autres
Publié: (2026)
par: Liu, Yihong, et autres
Publié: (2026)
Why Better Cross-Lingual Alignment Fails for Better Cross-Lingual Transfer: Case of Encoders
par: Veitsman, Yana, et autres
Publié: (2026)
par: Veitsman, Yana, et autres
Publié: (2026)
The Anatomy of an Edit: Mechanism-Guided Activation Steering for Knowledge Editing
par: Cao, Yuan, et autres
Publié: (2026)
par: Cao, Yuan, et autres
Publié: (2026)
Breaking the Script Barrier in Multilingual Pre-Trained Language Models with Transliteration-Based Post-Training Alignment
par: Xhelili, Orgest, et autres
Publié: (2024)
par: Xhelili, Orgest, et autres
Publié: (2024)
JMedBench: A Benchmark for Evaluating Japanese Biomedical Large Language Models
par: Jiang, Junfeng, et autres
Publié: (2024)
par: Jiang, Junfeng, et autres
Publié: (2024)
A Recipe of Parallel Corpora Exploitation for Multilingual Large Language Models
par: Lin, Peiqin, et autres
Publié: (2024)
par: Lin, Peiqin, et autres
Publié: (2024)
GlotScript: A Resource and Tool for Low Resource Writing System Identification
par: Kargaran, Amir Hossein, et autres
Publié: (2023)
par: Kargaran, Amir Hossein, et autres
Publié: (2023)
CRAFT Your Dataset: Task-Specific Synthetic Dataset Generation Through Corpus Retrieval and Augmentation
par: Ziegler, Ingo, et autres
Publié: (2024)
par: Ziegler, Ingo, et autres
Publié: (2024)
Automatically Suggesting Diverse Example Sentences for L2 Japanese Learners Using Pre-Trained Language Models
par: Benedetti, Enrico, et autres
Publié: (2025)
par: Benedetti, Enrico, et autres
Publié: (2025)
Bring Your Own Knowledge: A Survey of Methods for LLM Knowledge Expansion
par: Wang, Mingyang, et autres
Publié: (2025)
par: Wang, Mingyang, et autres
Publié: (2025)
Through the Looking Glass, and what Horn Clause Programs Found There
par: Tarau, Paul
Publié: (2024)
par: Tarau, Paul
Publié: (2024)
MaskLID: Code-Switching Language Identification through Iterative Masking
par: Kargaran, Amir Hossein, et autres
Publié: (2024)
par: Kargaran, Amir Hossein, et autres
Publié: (2024)
XAMPLER: Learning to Retrieve Cross-Lingual In-Context Examples
par: Lin, Peiqin, et autres
Publié: (2024)
par: Lin, Peiqin, et autres
Publié: (2024)
Relational Linearity is a Predictor of Hallucinations
par: Lu, Yuetian, et autres
Publié: (2026)
par: Lu, Yuetian, et autres
Publié: (2026)
Documents similaires
-
RET-LLM: Towards a General Read-Write Memory for Large Language Models
par: Modarressi, Ali, et autres
Publié: (2023) -
MemLLM: Finetuning LLMs to Use An Explicit Read-Write Memory
par: Modarressi, Ali, et autres
Publié: (2024) -
GlotLID: Language Identification for Low-Resource Languages
par: Kargaran, Amir Hossein, et autres
Publié: (2023) -
Left, Right, or Center? Evaluating LLM Framing in News Classification and Generation
par: Kennedy, Molly, et autres
Publié: (2026) -
Taxi1500: A Multilingual Dataset for Text Classification in 1500 Languages
par: Ma, Chunlan, et autres
Publié: (2023)