Teaching Large Language Models an Unseen Language on the Fly
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Chen, Liu, Xiao, Lin, Jiuheng, Feng, Yansong |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Read it in Two Steps: Translating Extremely Low-Resource Languages with Code-Augmented Grammar Books
par: Zhang, Chen, et autres
Publié: (2025)
par: Zhang, Chen, et autres
Publié: (2025)
Efficient Low-Resource Language Adaptation via Multi-Source Dynamic Logit Fusion
par: Zhang, Chen, et autres
Publié: (2026)
par: Zhang, Chen, et autres
Publié: (2026)
Chain of Condition: Construct, Verify and Solve Conditions for Conditional Question Answering
par: Lin, Jiuheng, et autres
Publié: (2024)
par: Lin, Jiuheng, et autres
Publié: (2024)
MC$^2$: Towards Transparent and Culturally-Aware NLP for Minority Languages in China
par: Zhang, Chen, et autres
Publié: (2023)
par: Zhang, Chen, et autres
Publié: (2023)
CLARity: Reasoning Consistency Alone Can Teach Reinforced Experts
par: Lin, Jiuheng, et autres
Publié: (2025)
par: Lin, Jiuheng, et autres
Publié: (2025)
Syntax Without Semantics: Teaching Large Language Models to Code in an Unseen Language
par: Kumar, Vinayshekhar Bannihatti, et autres
Publié: (2026)
par: Kumar, Vinayshekhar Bannihatti, et autres
Publié: (2026)
Can Perplexity Reflect Large Language Model's Ability in Long Text Understanding?
par: Hu, Yutong, et autres
Publié: (2024)
par: Hu, Yutong, et autres
Publié: (2024)
Teaching Smaller Language Models To Generalise To Unseen Compositional Questions (Full Thesis)
par: Hartill, Tim
Publié: (2024)
par: Hartill, Tim
Publié: (2024)
On-the-Fly Fusion of Large Language Models and Machine Translation
par: Hoang, Hieu, et autres
Publié: (2023)
par: Hoang, Hieu, et autres
Publié: (2023)
Prompting Large Language Models with Partial Knowledge for Answering Questions with Unseen Entities
par: Yan, Zhichao, et autres
Publié: (2025)
par: Yan, Zhichao, et autres
Publié: (2025)
DiNeR: a Large Realistic Dataset for Evaluating Compositional Generalization
par: Hu, Chengang, et autres
Publié: (2024)
par: Hu, Chengang, et autres
Publié: (2024)
Enhancing Speech Large Language Models through Reinforced Behavior Alignment
par: Liu, Yansong, et autres
Publié: (2025)
par: Liu, Yansong, et autres
Publié: (2025)
Teaching Large Language Models to Express Knowledge Boundary from Their Own Signals
par: Chen, Lida, et autres
Publié: (2024)
par: Chen, Lida, et autres
Publié: (2024)
Probing Multimodal Large Language Models for Global and Local Semantic Representations
par: Tao, Mingxu, et autres
Publié: (2024)
par: Tao, Mingxu, et autres
Publié: (2024)
Biomedical Large Languages Models Seem not to be Superior to Generalist Models on Unseen Medical Data
par: Dorfner, Felix J., et autres
Publié: (2024)
par: Dorfner, Felix J., et autres
Publié: (2024)
MiLiC-Eval: Benchmarking Multilingual LLMs for China's Minority Languages
par: Zhang, Chen, et autres
Publié: (2025)
par: Zhang, Chen, et autres
Publié: (2025)
MASTER: Enhancing Large Language Model via Multi-Agent Simulated Teaching
par: Yue, Liang, et autres
Publié: (2025)
par: Yue, Liang, et autres
Publié: (2025)
Automated Annotation of Evolving Corpora for Augmenting Longitudinal Network Data: A Framework Integrating Large Language Models and Expert Knowledge
par: Liu, Xiao, et autres
Publié: (2025)
par: Liu, Xiao, et autres
Publié: (2025)
LLMCRIT: Teaching Large Language Models to Use Criteria
par: Yuan, Weizhe, et autres
Publié: (2024)
par: Yuan, Weizhe, et autres
Publié: (2024)
RECKON: Large-scale Reference-based Efficient Knowledge Evaluation for Large Language Model
par: Zhang, Lin, et autres
Publié: (2025)
par: Zhang, Lin, et autres
Publié: (2025)
HieraVid: Hierarchical Token Pruning for Fast Video Large Language Models
par: Guo, Yansong, et autres
Publié: (2026)
par: Guo, Yansong, et autres
Publié: (2026)
Privacy-Preserving Parameter-Efficient Fine-Tuning for Large Language Model Services
par: Li, Yansong, et autres
Publié: (2023)
par: Li, Yansong, et autres
Publié: (2023)
Enhancing Multilingual ASR for Unseen Languages via Language Embedding Modeling
par: Huang, Shao-Syuan, et autres
Publié: (2024)
par: Huang, Shao-Syuan, et autres
Publié: (2024)
MOOSE-Chem: Large Language Models for Rediscovering Unseen Chemistry Scientific Hypotheses
par: Yang, Zonglin, et autres
Publié: (2024)
par: Yang, Zonglin, et autres
Publié: (2024)
Do Androids Dream of Unseen Puppeteers? Probing for a Conspiracy Mindset in Large Language Models
par: Corso, Francesco, et autres
Publié: (2025)
par: Corso, Francesco, et autres
Publié: (2025)
Unleashing the Unseen: Harnessing Benign Datasets for Jailbreaking Large Language Models
par: Zhao, Wei, et autres
Publié: (2024)
par: Zhao, Wei, et autres
Publié: (2024)
What Kinds of Tokens Benefit from Distant Text? An Analysis on Long Context Language Modeling
par: Hu, Yutong, et autres
Publié: (2024)
par: Hu, Yutong, et autres
Publié: (2024)
Harnessing the Unseen: The Hidden Influence of Intrinsic Knowledge in Long-Context Language Models
par: Fu, Yu, et autres
Publié: (2025)
par: Fu, Yu, et autres
Publié: (2025)
Confidence in Large Language Model Evaluation: A Bayesian Approach to Limited-Sample Challenges
par: Xiao, Xiao, et autres
Publié: (2025)
par: Xiao, Xiao, et autres
Publié: (2025)
Teaching Large Language Models Number-Focused Headline Generation With Key Element Rationales
par: Qian, Zhen, et autres
Publié: (2025)
par: Qian, Zhen, et autres
Publié: (2025)
The Impact of Model Scaling on Seen and Unseen Language Performance
par: Pokharel, Rhitabrat, et autres
Publié: (2025)
par: Pokharel, Rhitabrat, et autres
Publié: (2025)
LightReasoner: Can Small Language Models Teach Large Language Models Reasoning?
par: Wang, Jingyuan, et autres
Publié: (2025)
par: Wang, Jingyuan, et autres
Publié: (2025)
Unlocking the Potential of Model Merging for Low-Resource Languages
par: Tao, Mingxu, et autres
Publié: (2024)
par: Tao, Mingxu, et autres
Publié: (2024)
TIM: Teaching Large Language Models to Translate with Comparison
par: Zeng, Jiali, et autres
Publié: (2023)
par: Zeng, Jiali, et autres
Publié: (2023)
Agent-FLAN: Designing Data and Methods of Effective Agent Tuning for Large Language Models
par: Chen, Zehui, et autres
Publié: (2024)
par: Chen, Zehui, et autres
Publié: (2024)
A Comprehensive Survey of Large Language Models and Multimodal Large Language Models in Medicine
par: Xiao, Hanguang, et autres
Publié: (2024)
par: Xiao, Hanguang, et autres
Publié: (2024)
Teaching Language Models to Self-Improve by Learning from Language Feedback
par: Hu, Chi, et autres
Publié: (2024)
par: Hu, Chi, et autres
Publié: (2024)
Boosting Large Language Models with Socratic Method for Conversational Mathematics Teaching
par: Ding, Yuyang, et autres
Publié: (2024)
par: Ding, Yuyang, et autres
Publié: (2024)
FIRST: Teach A Reliable Large Language Model Through Efficient Trustworthy Distillation
par: Shum, KaShun, et autres
Publié: (2024)
par: Shum, KaShun, et autres
Publié: (2024)
Chain-of-Tools: Utilizing Massive Unseen Tools in the CoT Reasoning of Frozen Language Models
par: Wu, Mengsong, et autres
Publié: (2025)
par: Wu, Mengsong, et autres
Publié: (2025)
Documents similaires
-
Read it in Two Steps: Translating Extremely Low-Resource Languages with Code-Augmented Grammar Books
par: Zhang, Chen, et autres
Publié: (2025) -
Efficient Low-Resource Language Adaptation via Multi-Source Dynamic Logit Fusion
par: Zhang, Chen, et autres
Publié: (2026) -
Chain of Condition: Construct, Verify and Solve Conditions for Conditional Question Answering
par: Lin, Jiuheng, et autres
Publié: (2024) -
MC$^2$: Towards Transparent and Culturally-Aware NLP for Minority Languages in China
par: Zhang, Chen, et autres
Publié: (2023) -
CLARity: Reasoning Consistency Alone Can Teach Reinforced Experts
par: Lin, Jiuheng, et autres
Publié: (2025)