Zero-Shot Cross-Lingual Transfer using Prefix-Based Adaptation
Fuente:
arXiv
Guardado en:
| Autores principales: | A, Snegha, Sen, Sayambhu, Pasi, Piyush Singh, Singhania, Abhishek, Jyothi, Preethi |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
DeFTX: Denoised Sparse Fine-Tuning for Zero-Shot Cross-Lingual Transfer
por: Simon, Sona Elza, et al.
Publicado: (2025)
por: Simon, Sona Elza, et al.
Publicado: (2025)
Language-specific Neurons Do Not Facilitate Cross-Lingual Transfer
por: Mondal, Soumen Kumar, et al.
Publicado: (2025)
por: Mondal, Soumen Kumar, et al.
Publicado: (2025)
The Unreasonable Effectiveness of Model Merging for Cross-Lingual Transfer in LLMs
por: Bandarkar, Lucas, et al.
Publicado: (2025)
por: Bandarkar, Lucas, et al.
Publicado: (2025)
Beyond Prefixes: Graph-as-Memory Cross-Attention for Knowledge Graph Completion with Large Language Models
por: Liu, Ruitong, et al.
Publicado: (2025)
por: Liu, Ruitong, et al.
Publicado: (2025)
How Instruction-Tuning Imparts Length Control: A Cross-Lingual Mechanistic Analysis
por: Rocchetti, Elisabetta, et al.
Publicado: (2025)
por: Rocchetti, Elisabetta, et al.
Publicado: (2025)
A Case Study of Cross-Lingual Zero-Shot Generalization for Classical Languages in LLMs
por: Akavarapu, V. S. D. S. Mahesh, et al.
Publicado: (2025)
por: Akavarapu, V. S. D. S. Mahesh, et al.
Publicado: (2025)
Zero-Shot Spam Email Classification Using Pre-trained Large Language Models
por: Rojas-Galeano, Sergio
Publicado: (2024)
por: Rojas-Galeano, Sergio
Publicado: (2024)
Fine-Tuned 'Small' LLMs (Still) Significantly Outperform Zero-Shot Generative AI Models in Text Classification
por: Bucher, Martin Juan José, et al.
Publicado: (2024)
por: Bucher, Martin Juan José, et al.
Publicado: (2024)
Text-Based Approaches to Item Difficulty Modeling in Large-Scale Assessments: A Systematic Review
por: Peters, Sydney, et al.
Publicado: (2025)
por: Peters, Sydney, et al.
Publicado: (2025)
RomanLens: The Role Of Latent Romanization In Multilinguality In LLMs
por: Saji, Alan, et al.
Publicado: (2025)
por: Saji, Alan, et al.
Publicado: (2025)
Luth: Efficient French Specialization for Small Language Models and Cross-Lingual Transfer
por: Lasbordes, Maxence, et al.
Publicado: (2025)
por: Lasbordes, Maxence, et al.
Publicado: (2025)
Dialect Matters: Cross-Lingual ASR Transfer for Low-Resource Indic Language Varieties
por: Dhasmana, Akriti, et al.
Publicado: (2026)
por: Dhasmana, Akriti, et al.
Publicado: (2026)
Robustness of Large Language Models to Perturbations in Text
por: Singh, Ayush, et al.
Publicado: (2024)
por: Singh, Ayush, et al.
Publicado: (2024)
Prompting Encoder Models for Zero-Shot Classification: A Cross-Domain Study in Italian
por: Auriemma, Serena, et al.
Publicado: (2024)
por: Auriemma, Serena, et al.
Publicado: (2024)
Generative Active Testing: Efficient LLM Evaluation via Proxy Task Adaptation
por: Ramakrishnan, Aashish Anantha, et al.
Publicado: (2026)
por: Ramakrishnan, Aashish Anantha, et al.
Publicado: (2026)
Budget-Xfer: Budget-Constrained Source Language Selection for Cross-Lingual Transfer to African Languages
por: Idris, Tewodros Kederalah, et al.
Publicado: (2026)
por: Idris, Tewodros Kederalah, et al.
Publicado: (2026)
SPRInG: Continual LLM Personalization via Selective Parametric Adaptation and Retrieval-Interpolated Generation
por: Kim, Seoyeon, et al.
Publicado: (2026)
por: Kim, Seoyeon, et al.
Publicado: (2026)
Detecting AI-Generated Texts in Cross-Domains
por: Zhou, You, et al.
Publicado: (2024)
por: Zhou, You, et al.
Publicado: (2024)
PSST: A Benchmark for Evaluation-driven Text Public-Speaking Style Transfer
por: Sun, Huashan, et al.
Publicado: (2023)
por: Sun, Huashan, et al.
Publicado: (2023)
TRACE: Trajectory Correction from Cross-layer Evidence for Hallucination Reduction
por: Ranade, Tej Sanibh
Publicado: (2026)
por: Ranade, Tej Sanibh
Publicado: (2026)
More Is Not Always Better: Cross-Component Interference in LLM Agent Scaffolding
por: Liu, Ming
Publicado: (2026)
por: Liu, Ming
Publicado: (2026)
Low-Resource Court Judgment Summarization for Common Law Systems
por: Liu, Shuaiqi, et al.
Publicado: (2024)
por: Liu, Shuaiqi, et al.
Publicado: (2024)
USTCCTSU at SemEval-2024 Task 1: Reducing Anisotropy for Cross-lingual Semantic Textual Relatedness Task
por: Li, Jianjian, et al.
Publicado: (2024)
por: Li, Jianjian, et al.
Publicado: (2024)
OEMA: Ontology-Enhanced Multi-Agent Collaboration Framework for Zero-Shot Clinical Named Entity Recognition
por: Tao, Xinli, et al.
Publicado: (2025)
por: Tao, Xinli, et al.
Publicado: (2025)
Evaluating the Efficacy of Hybrid Deep Learning Models in Distinguishing AI-Generated Text
por: Oketunji, Abiodun Finbarrs
Publicado: (2023)
por: Oketunji, Abiodun Finbarrs
Publicado: (2023)
ReTreVal: Reasoning Tree with Validation -- A Hybrid Framework for Enhanced LLM Multi-Step Reasoning
por: HS, Abhishek, et al.
Publicado: (2026)
por: HS, Abhishek, et al.
Publicado: (2026)
Multilingual jailbreaking of LLMs using low-resource languages
por: Marx, Dylan, et al.
Publicado: (2026)
por: Marx, Dylan, et al.
Publicado: (2026)
Domain-specific ChatBots for Science using Embeddings
por: Yager, Kevin G.
Publicado: (2023)
por: Yager, Kevin G.
Publicado: (2023)
Plain language adaptations of biomedical text using LLMs: Comparision of evaluation metrics
por: Kocbek, Primoz, et al.
Publicado: (2025)
por: Kocbek, Primoz, et al.
Publicado: (2025)
Analyzing Large language models chatbots: An experimental approach using a probability test
por: Peruchini, Melise, et al.
Publicado: (2024)
por: Peruchini, Melise, et al.
Publicado: (2024)
Enhancing Long-Term Memory using Hierarchical Aggregate Tree for Retrieval Augmented Generation
por: A, Aadharsh Aadhithya, et al.
Publicado: (2024)
por: A, Aadharsh Aadhithya, et al.
Publicado: (2024)
A Practical Review of Mechanistic Interpretability for Transformer-Based Language Models
por: Rai, Daking, et al.
Publicado: (2024)
por: Rai, Daking, et al.
Publicado: (2024)
Assessment of Transformer-Based Encoder-Decoder Model for Human-Like Summarization
por: Nair, Sindhu, et al.
Publicado: (2024)
por: Nair, Sindhu, et al.
Publicado: (2024)
ImmigrationQA: A Source-Grounded Dataset and Small-Model Adaptation for U.S. Immigration Law
por: Shportun, Nazarii
Publicado: (2026)
por: Shportun, Nazarii
Publicado: (2026)
Not a nuisance but a useful heuristic: Outlier dimensions favor frequent tokens in language models
por: Macocco, Iuri, et al.
Publicado: (2025)
por: Macocco, Iuri, et al.
Publicado: (2025)
Machine Translation Hallucination Detection for Low and High Resource Languages using Large Language Models
por: Benkirane, Kenza, et al.
Publicado: (2024)
por: Benkirane, Kenza, et al.
Publicado: (2024)
AEyeDE: An Attention-Based Attribution Framework for AI-Generated Text Detection
por: Nourbakhsh, Aria, et al.
Publicado: (2026)
por: Nourbakhsh, Aria, et al.
Publicado: (2026)
SECURA: Sigmoid-Enhanced CUR Decomposition with Uninterrupted Retention and Low-Rank Adaptation in Large Language Models
por: Zhang, Yuxuan
Publicado: (2025)
por: Zhang, Yuxuan
Publicado: (2025)
Interactive-KBQA: Multi-Turn Interactions for Knowledge Base Question Answering with Large Language Models
por: Xiong, Guanming, et al.
Publicado: (2024)
por: Xiong, Guanming, et al.
Publicado: (2024)
NinjaLLM: Fast, Scalable and Cost-effective RAG using Amazon SageMaker and AWS Trainium and Inferentia2
por: Xue, Tengfei, et al.
Publicado: (2024)
por: Xue, Tengfei, et al.
Publicado: (2024)
Ejemplares similares
-
DeFTX: Denoised Sparse Fine-Tuning for Zero-Shot Cross-Lingual Transfer
por: Simon, Sona Elza, et al.
Publicado: (2025) -
Language-specific Neurons Do Not Facilitate Cross-Lingual Transfer
por: Mondal, Soumen Kumar, et al.
Publicado: (2025) -
The Unreasonable Effectiveness of Model Merging for Cross-Lingual Transfer in LLMs
por: Bandarkar, Lucas, et al.
Publicado: (2025) -
Beyond Prefixes: Graph-as-Memory Cross-Attention for Knowledge Graph Completion with Large Language Models
por: Liu, Ruitong, et al.
Publicado: (2025) -
How Instruction-Tuning Imparts Length Control: A Cross-Lingual Mechanistic Analysis
por: Rocchetti, Elisabetta, et al.
Publicado: (2025)