Facilitating large language model Russian adaptation with Learned Embedding Propagation
Fuente:
arXiv
Guardado en:
| Autores principales: | Tikhomirov, Mikhail, Chernyshev, Daniil |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Exploring Prompt-Based Methods for Zero-Shot Hypernym Prediction with Large Language Models
por: Tikhomirov, Mikhail, et al.
Publicado: (2024)
por: Tikhomirov, Mikhail, et al.
Publicado: (2024)
Dissociating language and thought in large language models
por: Mahowald, Kyle, et al.
Publicado: (2023)
por: Mahowald, Kyle, et al.
Publicado: (2023)
A dataset and benchmark for hospital course summarization with adapted large language models
por: Aali, Asad, et al.
Publicado: (2024)
por: Aali, Asad, et al.
Publicado: (2024)
On the attribution of confidence to large language models
por: Keeling, Geoff, et al.
Publicado: (2024)
por: Keeling, Geoff, et al.
Publicado: (2024)
Multi-round jailbreak attack on large language models
por: Zhou, Yihua, et al.
Publicado: (2024)
por: Zhou, Yihua, et al.
Publicado: (2024)
The 20 questions game to distinguish large language models
por: Richardeau, Gurvan, et al.
Publicado: (2024)
por: Richardeau, Gurvan, et al.
Publicado: (2024)
Quantifying non deterministic drift in large language models
por: Nicholson, Claire
Publicado: (2026)
por: Nicholson, Claire
Publicado: (2026)
Can large language models build causal graphs?
por: Long, Stephanie, et al.
Publicado: (2023)
por: Long, Stephanie, et al.
Publicado: (2023)
Response: Emergent analogical reasoning in large language models
por: Hodel, Damian, et al.
Publicado: (2023)
por: Hodel, Damian, et al.
Publicado: (2023)
Representation in large language models
por: Yetman, Cameron
Publicado: (2025)
por: Yetman, Cameron
Publicado: (2025)
Failure of contextual invariance in large language models
por: Kumar, Sagar, et al.
Publicado: (2026)
por: Kumar, Sagar, et al.
Publicado: (2026)
A survey of textual cyber abuse detection using cutting-edge language models and large language models
por: Diaz-Garcia, Jose A., et al.
Publicado: (2025)
por: Diaz-Garcia, Jose A., et al.
Publicado: (2025)
Fine-tuning large language models for domain adaptation: Exploration of training strategies, scaling, model merging and synergistic capabilities
por: Lu, Wei, et al.
Publicado: (2024)
por: Lu, Wei, et al.
Publicado: (2024)
Strong and weak alignment of large language models with human values
por: Khamassi, Mehdi, et al.
Publicado: (2024)
por: Khamassi, Mehdi, et al.
Publicado: (2024)
Correcting misinformation on social media with a large language model
por: Zhou, Xinyi, et al.
Publicado: (2024)
por: Zhou, Xinyi, et al.
Publicado: (2024)
A review on the use of large language models as virtual tutors
por: García-Méndez, Silvia, et al.
Publicado: (2024)
por: García-Méndez, Silvia, et al.
Publicado: (2024)
Evaluating large language models in medical applications: a survey
por: Chen, Xiaolan, et al.
Publicado: (2024)
por: Chen, Xiaolan, et al.
Publicado: (2024)
MathDivide: Improved mathematical reasoning by large language models
por: Srivastava, Saksham Sahai, et al.
Publicado: (2024)
por: Srivastava, Saksham Sahai, et al.
Publicado: (2024)
Streamlining evidence based clinical recommendations with large language models
por: Li, Dubai, et al.
Publicado: (2025)
por: Li, Dubai, et al.
Publicado: (2025)
Re-evaluating Theory of Mind evaluation in large language models
por: Hu, Jennifer, et al.
Publicado: (2025)
por: Hu, Jennifer, et al.
Publicado: (2025)
Disentangling generalization and memorization in large language models using chess
por: Pleiss, Leonard S., et al.
Publicado: (2026)
por: Pleiss, Leonard S., et al.
Publicado: (2026)
AI-AI Bias: large language models favor communications generated by large language models
por: Laurito, Walter, et al.
Publicado: (2024)
por: Laurito, Walter, et al.
Publicado: (2024)
Alignment faking in large language models
por: Greenblatt, Ryan, et al.
Publicado: (2024)
por: Greenblatt, Ryan, et al.
Publicado: (2024)
Optimizing watermarks for large language models
por: Wouters, Bram
Publicado: (2023)
por: Wouters, Bram
Publicado: (2023)
Multimodal Evaluation of Russian-language Architectures
por: Chervyakov, Artem, et al.
Publicado: (2025)
por: Chervyakov, Artem, et al.
Publicado: (2025)
Uncovering inequalities in new knowledge learning by large language models across different languages
por: Wang, Chenglong, et al.
Publicado: (2025)
por: Wang, Chenglong, et al.
Publicado: (2025)
Entry-level guide to the use of large language models for medical research
por: Jin, Qiao, et al.
Publicado: (2024)
por: Jin, Qiao, et al.
Publicado: (2024)
MacBehaviour: An R package for behavioural experimentation on large language models
por: Duan, Xufeng, et al.
Publicado: (2024)
por: Duan, Xufeng, et al.
Publicado: (2024)
Hyacinth6B: A large language model for Traditional Chinese
por: Song, Chih-Wei, et al.
Publicado: (2024)
por: Song, Chih-Wei, et al.
Publicado: (2024)
Can large language models understand uncommon meanings of common words?
por: Wu, Jinyang, et al.
Publicado: (2024)
por: Wu, Jinyang, et al.
Publicado: (2024)
Generating bilingual example sentences with large language models as lexicography assistants
por: Merx, Raphael, et al.
Publicado: (2024)
por: Merx, Raphael, et al.
Publicado: (2024)
Leveraging large language models for efficient representation learning for entity resolution
por: Xu, Xiaowei, et al.
Publicado: (2024)
por: Xu, Xiaowei, et al.
Publicado: (2024)
TelcoLM: collecting data, adapting, and benchmarking language models for the telecommunication domain
por: Barboule, Camille, et al.
Publicado: (2024)
por: Barboule, Camille, et al.
Publicado: (2024)
Are they human? Detecting large language models by probing human memory constraints
por: Schug, Simon, et al.
Publicado: (2026)
por: Schug, Simon, et al.
Publicado: (2026)
A blind spot for large language models: Supradiegetic linguistic information
por: Zimmerman, Julia Witte, et al.
Publicado: (2023)
por: Zimmerman, Julia Witte, et al.
Publicado: (2023)
ARC-Encoder: learning compressed text representations for large language models
por: Pilchen, Hippolyte, et al.
Publicado: (2025)
por: Pilchen, Hippolyte, et al.
Publicado: (2025)
Enhancing reasoning accuracy in large language models during inference time
por: Sharma, Vinay, et al.
Publicado: (2026)
por: Sharma, Vinay, et al.
Publicado: (2026)
ZNO-Eval: Benchmarking reasoning capabilities of large language models in Ukrainian
por: Syromiatnikov, Mykyta, et al.
Publicado: (2025)
por: Syromiatnikov, Mykyta, et al.
Publicado: (2025)
ChildEval: When large language models meet children's personalities
por: Luo, Yanyan, et al.
Publicado: (2026)
por: Luo, Yanyan, et al.
Publicado: (2026)
Emergent effects of scaling on the functional hierarchies within large language models
por: Bogdan, Paul C.
Publicado: (2025)
por: Bogdan, Paul C.
Publicado: (2025)
Ejemplares similares
-
Exploring Prompt-Based Methods for Zero-Shot Hypernym Prediction with Large Language Models
por: Tikhomirov, Mikhail, et al.
Publicado: (2024) -
Dissociating language and thought in large language models
por: Mahowald, Kyle, et al.
Publicado: (2023) -
A dataset and benchmark for hospital course summarization with adapted large language models
por: Aali, Asad, et al.
Publicado: (2024) -
On the attribution of confidence to large language models
por: Keeling, Geoff, et al.
Publicado: (2024) -
Multi-round jailbreak attack on large language models
por: Zhou, Yihua, et al.
Publicado: (2024)