Code-Switched Language Identification is Harder Than You Think
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Burchell, Laurie, Birch, Alexandra, Thompson, Robert P., Heafield, Kenneth |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Think Multilingual, Not Harder: A Data-Efficient Framework for Teaching Reasoning Models to Code-Switch
von: Lin, Eleanor M., et al.
Veröffentlicht: (2026)
von: Lin, Eleanor M., et al.
Veröffentlicht: (2026)
Iterative Translation Refinement with Large Language Models
von: Chen, Pinzhen, et al.
Veröffentlicht: (2023)
von: Chen, Pinzhen, et al.
Veröffentlicht: (2023)
Controlling What You Share: Assessing Language Model Adherence to Privacy Preferences
von: Ramírez, Guillem, et al.
Veröffentlicht: (2025)
von: Ramírez, Guillem, et al.
Veröffentlicht: (2025)
LoRA Is Slower Than You Think
von: Ko, Seokmin
Veröffentlicht: (2025)
von: Ko, Seokmin
Veröffentlicht: (2025)
Adaptive Loops and Memory in Transformers: Think Harder or Know More?
von: Frey, Markus, et al.
Veröffentlicht: (2026)
von: Frey, Markus, et al.
Veröffentlicht: (2026)
CoDAR: Continuous Diffusion Language Models are More Powerful Than You Think
von: Shen, Junzhe, et al.
Veröffentlicht: (2026)
von: Shen, Junzhe, et al.
Veröffentlicht: (2026)
Low-Resource, High-Impact: Building Corpora for Inclusive Language Technologies
von: Artemova, Ekaterina, et al.
Veröffentlicht: (2025)
von: Artemova, Ekaterina, et al.
Veröffentlicht: (2025)
Fine-tuning MLLMs Without Forgetting Is Easier Than You Think
von: Li, He, et al.
Veröffentlicht: (2026)
von: Li, He, et al.
Veröffentlicht: (2026)
MaskLID: Code-Switching Language Identification through Iterative Masking
von: Kargaran, Amir Hossein, et al.
Veröffentlicht: (2024)
von: Kargaran, Amir Hossein, et al.
Veröffentlicht: (2024)
LLMs are Better Than You Think: Label-Guided In-Context Learning for Named Entity Recognition
von: Bai, Fan, et al.
Veröffentlicht: (2025)
von: Bai, Fan, et al.
Veröffentlicht: (2025)
Using Perspectival Words Is Harder Than Vocabulary Words for Humans and Even More So for Multimodal Language Models
von: Dong, Dota Tianai, et al.
Veröffentlicht: (2025)
von: Dong, Dota Tianai, et al.
Veröffentlicht: (2025)
Reasoning with Sampling: Your Base Model is Smarter Than You Think
von: Karan, Aayush, et al.
Veröffentlicht: (2025)
von: Karan, Aayush, et al.
Veröffentlicht: (2025)
Your Agent is More Brittle Than You Think: Uncovering Indirect Injection Vulnerabilities in Agentic LLMs
von: Zhu, Wenhui, et al.
Veröffentlicht: (2026)
von: Zhu, Wenhui, et al.
Veröffentlicht: (2026)
Facts are Harder Than Opinions -- A Multilingual, Comparative Analysis of LLM-Based Fact-Checking Reliability
von: Saju, Lorraine, et al.
Veröffentlicht: (2025)
von: Saju, Lorraine, et al.
Veröffentlicht: (2025)
No Train but Gain: Language Arithmetic for training-free Language Adapters enhancement
von: Klimaszewski, Mateusz, et al.
Veröffentlicht: (2024)
von: Klimaszewski, Mateusz, et al.
Veröffentlicht: (2024)
Monolingual or Multilingual Instruction Tuning: Which Makes a Better Alpaca
von: Chen, Pinzhen, et al.
Veröffentlicht: (2023)
von: Chen, Pinzhen, et al.
Veröffentlicht: (2023)
Multimodal Representation Alignment for Image Generation: Text-Image Interleaved Control Is Easier Than You Think
von: Chen, Liang, et al.
Veröffentlicht: (2025)
von: Chen, Liang, et al.
Veröffentlicht: (2025)
Optimising Calls to Large Language Models with Uncertainty-Based Two-Tier Selection
von: Ramírez, Guillem, et al.
Veröffentlicht: (2024)
von: Ramírez, Guillem, et al.
Veröffentlicht: (2024)
Leveraging Zipformer Model for Effective Language Identification in Code-Switched Child-Directed Speech
von: Shankar, Lavanya, et al.
Veröffentlicht: (2025)
von: Shankar, Lavanya, et al.
Veröffentlicht: (2025)
The Harder The Better: Maintaining Supervised Fine-tuning Generalization with Less but Harder Data
von: Shang, Zhaoyang, et al.
Veröffentlicht: (2025)
von: Shang, Zhaoyang, et al.
Veröffentlicht: (2025)
Teaching Language Models to Think in Code
von: Hwang, Hyeon, et al.
Veröffentlicht: (2026)
von: Hwang, Hyeon, et al.
Veröffentlicht: (2026)
The Ups and Downs of Large Language Model Inference with Vocabulary Trimming by Language Heuristics
von: Bogoychev, Nikolay, et al.
Veröffentlicht: (2023)
von: Bogoychev, Nikolay, et al.
Veröffentlicht: (2023)
Overtrained Language Models Are Harder to Fine-Tune
von: Springer, Jacob Mitchell, et al.
Veröffentlicht: (2025)
von: Springer, Jacob Mitchell, et al.
Veröffentlicht: (2025)
Bridging the Language Gaps in Large Language Models with Inference-Time Cross-Lingual Intervention
von: Wang, Weixuan, et al.
Veröffentlicht: (2024)
von: Wang, Weixuan, et al.
Veröffentlicht: (2024)
ShortGPT: Layers in Large Language Models are More Redundant Than You Expect
von: Men, Xin, et al.
Veröffentlicht: (2024)
von: Men, Xin, et al.
Veröffentlicht: (2024)
The Zero-Step Thinking: An Empirical Study of Mode Selection as Harder Early Exit in Reasoning Models
von: Tan, Yuqiao, et al.
Veröffentlicht: (2025)
von: Tan, Yuqiao, et al.
Veröffentlicht: (2025)
Can Language Models Be Tricked by Language Illusions? Easier with Syntax, Harder with Semantics
von: Zhang, Yuhan, et al.
Veröffentlicht: (2023)
von: Zhang, Yuhan, et al.
Veröffentlicht: (2023)
DIVERS-Bench: Evaluating Language Identification Across Domain Shifts and Code-Switching
von: Ojo, Jessica, et al.
Veröffentlicht: (2025)
von: Ojo, Jessica, et al.
Veröffentlicht: (2025)
Do as We Do, Not as You Think: the Conformity of Large Language Models
von: Weng, Zhiyuan, et al.
Veröffentlicht: (2025)
von: Weng, Zhiyuan, et al.
Veröffentlicht: (2025)
HBO: Hierarchical Balancing Optimization for Fine-Tuning Large Language Models
von: Wang, Weixuan, et al.
Veröffentlicht: (2025)
von: Wang, Weixuan, et al.
Veröffentlicht: (2025)
Not All Tokens Are What You Need In Thinking
von: Yuan, Hang, et al.
Veröffentlicht: (2025)
von: Yuan, Hang, et al.
Veröffentlicht: (2025)
Increasing the Thinking Budget is Not All You Need
von: Iacobacci, Ignacio, et al.
Veröffentlicht: (2025)
von: Iacobacci, Ignacio, et al.
Veröffentlicht: (2025)
Methods of Automatic Matrix Language Determination for Code-Switched Speech
von: Iakovenko, Olga, et al.
Veröffentlicht: (2024)
von: Iakovenko, Olga, et al.
Veröffentlicht: (2024)
Enhancing Multilingual Language Models for Code-Switched Input Data
von: Xie, Katherine, et al.
Veröffentlicht: (2025)
von: Xie, Katherine, et al.
Veröffentlicht: (2025)
OLA: Output Language Alignment in Code-Switched LLM Interactions
von: Oh, Juhyun, et al.
Veröffentlicht: (2026)
von: Oh, Juhyun, et al.
Veröffentlicht: (2026)
Sharing Matters: Analysing Neurons Across Languages and Tasks in LLMs
von: Wang, Weixuan, et al.
Veröffentlicht: (2024)
von: Wang, Weixuan, et al.
Veröffentlicht: (2024)
Cache & Distil: Optimising API Calls to Large Language Models
von: Ramírez, Guillem, et al.
Veröffentlicht: (2023)
von: Ramírez, Guillem, et al.
Veröffentlicht: (2023)
Is Modularity Transferable? A Case Study through the Lens of Knowledge Distillation
von: Klimaszewski, Mateusz, et al.
Veröffentlicht: (2024)
von: Klimaszewski, Mateusz, et al.
Veröffentlicht: (2024)
Evaluating Long-Term Memory for Long-Context Question Answering
von: Terranova, Alessandra, et al.
Veröffentlicht: (2025)
von: Terranova, Alessandra, et al.
Veröffentlicht: (2025)
Liaozhai through the Looking-Glass: On Paratextual Explicitation of Culture-Bound Terms in Machine Translation
von: Shen, Sherrie, et al.
Veröffentlicht: (2025)
von: Shen, Sherrie, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Think Multilingual, Not Harder: A Data-Efficient Framework for Teaching Reasoning Models to Code-Switch
von: Lin, Eleanor M., et al.
Veröffentlicht: (2026) -
Iterative Translation Refinement with Large Language Models
von: Chen, Pinzhen, et al.
Veröffentlicht: (2023) -
Controlling What You Share: Assessing Language Model Adherence to Privacy Preferences
von: Ramírez, Guillem, et al.
Veröffentlicht: (2025) -
LoRA Is Slower Than You Think
von: Ko, Seokmin
Veröffentlicht: (2025) -
Adaptive Loops and Memory in Transformers: Think Harder or Know More?
von: Frey, Markus, et al.
Veröffentlicht: (2026)