GigaEmbeddings: Efficient Russian Language Embedding Model
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kolodin, Egor, Khomich, Daria, Savushkin, Nikita, Ianina, Anastasia, Minkin, Fyodor |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
GigaChat Family: Efficient Russian Language Modeling Through Mixture of Experts Architecture
par: GigaChat team, et autres
Publié: (2025)
par: GigaChat team, et autres
Publié: (2025)
GigaAM: Efficient Self-Supervised Learner for Speech Recognition
par: Kutsakov, Aleksandr, et autres
Publié: (2025)
par: Kutsakov, Aleksandr, et autres
Publié: (2025)
Comparative Analysis of Encoder-Based NER and Large Language Models for Skill Extraction from Russian Job Vacancies
par: Matkin, Nikita, et autres
Publié: (2024)
par: Matkin, Nikita, et autres
Publié: (2024)
MERA: A Comprehensive LLM Evaluation in Russian
par: Fenogenova, Alena, et autres
Publié: (2024)
par: Fenogenova, Alena, et autres
Publié: (2024)
Contrastive Learning Using Graph Embeddings for Domain Adaptation of Language Models in the Process Industry
par: Zhukova, Anastasia, et autres
Publié: (2025)
par: Zhukova, Anastasia, et autres
Publié: (2025)
Semantic Shifts of Psychological Concepts in Scientific and Popular Media Discourse: A Distributional Semantics Analysis of Russian-Language Corpora
par: Anastasia, Orlova
Publié: (2026)
par: Anastasia, Orlova
Publié: (2026)
Efficient Code Embeddings from Code Generation Models
par: Kryvosheieva, Daria, et autres
Publié: (2025)
par: Kryvosheieva, Daria, et autres
Publié: (2025)
RusLICA: A Russian-Language Platform for Automated Linguistic Inquiry and Category Analysis
par: Sigdel, Elina, et autres
Publié: (2026)
par: Sigdel, Elina, et autres
Publié: (2026)
EmbedGrad: Gradient-Based Prompt Optimization in Embedding Space for Large Language Models
par: Hou, Xiaoming, et autres
Publié: (2025)
par: Hou, Xiaoming, et autres
Publié: (2025)
Facilitating large language model Russian adaptation with Learned Embedding Propagation
par: Tikhomirov, Mikhail, et autres
Publié: (2024)
par: Tikhomirov, Mikhail, et autres
Publié: (2024)
SONAR-LLM: Autoregressive Transformer that Thinks in Sentence Embeddings and Speaks in Tokens
par: Dragunov, Nikita, et autres
Publié: (2025)
par: Dragunov, Nikita, et autres
Publié: (2025)
Hierarchical Embedding Fusion for Retrieval-Augmented Code Generation
par: Sorokin, Nikita, et autres
Publié: (2026)
par: Sorokin, Nikita, et autres
Publié: (2026)
Arctic-Embed: Scalable, Efficient, and Accurate Text Embedding Models
par: Merrick, Luke, et autres
Publié: (2024)
par: Merrick, Luke, et autres
Publié: (2024)
BanglaEmbed: Efficient Sentence Embedding Models for a Low-Resource Language Using Cross-Lingual Distillation Techniques
par: Kabir, Muhammad Rafsan, et autres
Publié: (2024)
par: Kabir, Muhammad Rafsan, et autres
Publié: (2024)
Leveraging Passage Embeddings for Efficient Listwise Reranking with Large Language Models
par: Liu, Qi, et autres
Publié: (2024)
par: Liu, Qi, et autres
Publié: (2024)
Scaling Embedding Layers in Language Models
par: Yu, Da, et autres
Publié: (2025)
par: Yu, Da, et autres
Publié: (2025)
Repetition Improves Language Model Embeddings
par: Springer, Jacob Mitchell, et autres
Publié: (2024)
par: Springer, Jacob Mitchell, et autres
Publié: (2024)
ML-Embed: Inclusive and Efficient Embeddings for a Multilingual World
par: Zhang, Ziyin, et autres
Publié: (2026)
par: Zhang, Ziyin, et autres
Publié: (2026)
T-pro 2.0: An Efficient Russian Hybrid-Reasoning Model and Playground
par: Stoianov, Dmitrii, et autres
Publié: (2025)
par: Stoianov, Dmitrii, et autres
Publié: (2025)
Multi-Sense Embeddings for Language Models and Knowledge Distillation
par: Wang, Qitong, et autres
Publié: (2025)
par: Wang, Qitong, et autres
Publié: (2025)
Efficient Knowledge Probing of Large Language Models by Adapting Pre-trained Embeddings
par: Sharma, Kartik, et autres
Publié: (2025)
par: Sharma, Kartik, et autres
Publié: (2025)
Embedding-to-Prefix: Parameter-Efficient Personalization for Pre-Trained Large Language Models
par: Huber, Bernd, et autres
Publié: (2025)
par: Huber, Bernd, et autres
Publié: (2025)
Efficient Ternary Weight Embedding Model: Bridging Scalability and Performance
par: Chen, Jiayi, et autres
Publié: (2024)
par: Chen, Jiayi, et autres
Publié: (2024)
BGE Landmark Embedding: A Chunking-Free Embedding Method For Retrieval Augmented Long-Context Large Language Models
par: Luo, Kun, et autres
Publié: (2024)
par: Luo, Kun, et autres
Publié: (2024)
Semantic Structure in Large Language Model Embeddings
par: Kozlowski, Austin C., et autres
Publié: (2025)
par: Kozlowski, Austin C., et autres
Publié: (2025)
Developing Healthcare Language Model Embedding Spaces
par: Taylor, Niall, et autres
Publié: (2024)
par: Taylor, Niall, et autres
Publié: (2024)
Improving Text Embeddings with Large Language Models
par: Wang, Liang, et autres
Publié: (2023)
par: Wang, Liang, et autres
Publié: (2023)
Bootstrapping Embeddings for Low Resource Languages
par: Basoz, Merve, et autres
Publié: (2026)
par: Basoz, Merve, et autres
Publié: (2026)
Structural Embedding Projection for Contextual Large Language Model Inference
par: Enoasmo, Vincent, et autres
Publié: (2025)
par: Enoasmo, Vincent, et autres
Publié: (2025)
Stable Language Model Pre-training by Reducing Embedding Variability
par: Chung, Woojin, et autres
Publié: (2024)
par: Chung, Woojin, et autres
Publié: (2024)
Embedding Inversion via Conditional Masked Diffusion Language Models
par: Xiao, Han
Publié: (2026)
par: Xiao, Han
Publié: (2026)
Simple Techniques for Enhancing Sentence Embeddings in Generative Language Models
par: Zhang, Bowen, et autres
Publié: (2024)
par: Zhang, Bowen, et autres
Publié: (2024)
ctELM: Decoding and Manipulating Embeddings of Clinical Trials with Embedding Language Models
par: Ondov, Brian, et autres
Publié: (2026)
par: Ondov, Brian, et autres
Publié: (2026)
How to Train Your Latent Diffusion Language Model Jointly With the Latent Space
par: Meshchaninov, Viacheslav, et autres
Publié: (2026)
par: Meshchaninov, Viacheslav, et autres
Publié: (2026)
Linked Multi-Model Data on Russian Domestic and Foreign Policy Speeches
par: Blinova, Daria, et autres
Publié: (2026)
par: Blinova, Daria, et autres
Publié: (2026)
Word Embeddings Are Steers for Language Models
par: Han, Chi, et autres
Publié: (2023)
par: Han, Chi, et autres
Publié: (2023)
Qwen3 Embedding: Advancing Text Embedding and Reranking Through Foundation Models
par: Zhang, Yanzhao, et autres
Publié: (2025)
par: Zhang, Yanzhao, et autres
Publié: (2025)
Resource-Efficient Adaptation of Large Language Models for Text Embeddings via Prompt Engineering and Contrastive Fine-tuning
par: Roth, Benedikt, et autres
Publié: (2025)
par: Roth, Benedikt, et autres
Publié: (2025)
Embedding-Aligned Language Models
par: Tennenholtz, Guy, et autres
Publié: (2024)
par: Tennenholtz, Guy, et autres
Publié: (2024)
Lost in Embeddings: Information Loss in Vision-Language Models
par: Li, Wenyan, et autres
Publié: (2025)
par: Li, Wenyan, et autres
Publié: (2025)
Documents similaires
-
GigaChat Family: Efficient Russian Language Modeling Through Mixture of Experts Architecture
par: GigaChat team, et autres
Publié: (2025) -
GigaAM: Efficient Self-Supervised Learner for Speech Recognition
par: Kutsakov, Aleksandr, et autres
Publié: (2025) -
Comparative Analysis of Encoder-Based NER and Large Language Models for Skill Extraction from Russian Job Vacancies
par: Matkin, Nikita, et autres
Publié: (2024) -
MERA: A Comprehensive LLM Evaluation in Russian
par: Fenogenova, Alena, et autres
Publié: (2024) -
Contrastive Learning Using Graph Embeddings for Domain Adaptation of Language Models in the Process Industry
par: Zhukova, Anastasia, et autres
Publié: (2025)