CoRoVA: Compressed Representations for Vector-Augmented Code Completion
Fuente:
arXiv
Guardado en:
| Autores principales: | Cherniuk, Daria, Sukhorukov, Nikita, Gusak, Danil, Sushko, Nikita, Sivtsov, Danil, Tutubalina, Elena, Frolov, Evgeny |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Maximum Impact with Fewer Features: Efficient Feature Selection for Cold-Start Recommenders through Collaborative Importance Weighting
por: Sukhorukov, Nikita, et al.
Publicado: (2025)
por: Sukhorukov, Nikita, et al.
Publicado: (2025)
Recommendation Is a Dish Better Served Warm
por: Gusak, Danil, et al.
Publicado: (2025)
por: Gusak, Danil, et al.
Publicado: (2025)
SynthDetoxM: Modern LLMs are Few-Shot Parallel Detoxification Data Annotators
por: Moskovskiy, Daniil, et al.
Publicado: (2025)
por: Moskovskiy, Daniil, et al.
Publicado: (2025)
Scalable Cross-Entropy Loss for Sequential Recommendations with Large Item Catalogs
por: Mezentsev, Gleb, et al.
Publicado: (2024)
por: Mezentsev, Gleb, et al.
Publicado: (2024)
RECE: Reduced Cross-Entropy Loss for Large-Catalogue Sequential Recommenders
por: Gusak, Danil, et al.
Publicado: (2024)
por: Gusak, Danil, et al.
Publicado: (2024)
Birch SGD: A Tree Graph Framework for Local and Asynchronous SGD Methods
por: Tyurin, Alexander, et al.
Publicado: (2025)
por: Tyurin, Alexander, et al.
Publicado: (2025)
The Chronicles of RiDiC: Generating Datasets with Controlled Popularity Distribution for Long-form Factuality Evaluation
por: Braslavski, Pavel, et al.
Publicado: (2026)
por: Braslavski, Pavel, et al.
Publicado: (2026)
Diagonal Batching Unlocks Parallelism in Recurrent Memory Transformers for Long Contexts
por: Sivtsov, Danil, et al.
Publicado: (2025)
por: Sivtsov, Danil, et al.
Publicado: (2025)
Memorization in Fine-Tuned Large Language Models
por: Savine, Danil
Publicado: (2025)
por: Savine, Danil
Publicado: (2025)
Time to Split: Exploring Data Splitting Strategies for Offline Evaluation of Sequential Recommenders
por: Gusak, Danil, et al.
Publicado: (2025)
por: Gusak, Danil, et al.
Publicado: (2025)
Cluster Topology-Driven Placement of Experts Reduces Network Traffic in MoE Inference
por: Sivtsov, Danil, et al.
Publicado: (2025)
por: Sivtsov, Danil, et al.
Publicado: (2025)
One Task Vector is not Enough: A Large-Scale Study for In-Context Learning
por: Tikhonov, Pavel, et al.
Publicado: (2025)
por: Tikhonov, Pavel, et al.
Publicado: (2025)
SplitLight: An Exploratory Toolkit for Recommender Systems Datasets and Splits
por: Volodkevich, Anna, et al.
Publicado: (2026)
por: Volodkevich, Anna, et al.
Publicado: (2026)
The Polish Vocabulary Size Test: A Novel Adaptive Test for Receptive Vocabulary Assessment
por: Fokin, Danil, et al.
Publicado: (2025)
por: Fokin, Danil, et al.
Publicado: (2025)
Strategies for Span Labeling with Large Language Models
por: Semin, Danil, et al.
Publicado: (2026)
por: Semin, Danil, et al.
Publicado: (2026)
Hierarchical Embedding Fusion for Retrieval-Augmented Code Generation
por: Sorokin, Nikita, et al.
Publicado: (2026)
por: Sorokin, Nikita, et al.
Publicado: (2026)
Fine-tuning RoBERTa for CVE-to-CWE Classification: A 125M Parameter Model Competitive with LLMs
por: Mosievskiy, Nikita
Publicado: (2026)
por: Mosievskiy, Nikita
Publicado: (2026)
Team Anotheroption at SemEval-2025 Task 8: Bridging the Gap Between Open-Source and Proprietary LLMs in Table QA
por: Evkarpidi, Nikolas, et al.
Publicado: (2025)
por: Evkarpidi, Nikolas, et al.
Publicado: (2025)
BALI: Enhancing Biomedical Language Representations through Knowledge Graph and Language Model Alignment
por: Sakhovskiy, Andrey, et al.
Publicado: (2025)
por: Sakhovskiy, Andrey, et al.
Publicado: (2025)
LoTR: Low Tensor Rank Weight Adaptation
por: Bershatsky, Daniel, et al.
Publicado: (2024)
por: Bershatsky, Daniel, et al.
Publicado: (2024)
From Internal Representations to Text Quality: A Geometric Approach to LLM Evaluation
por: Yusupov, Viacheslav, et al.
Publicado: (2025)
por: Yusupov, Viacheslav, et al.
Publicado: (2025)
Generalized Fisher-Weighted SVD: Scalable Kronecker-Factored Fisher Approximation for Compressing Large Language Models
por: Chekalina, Viktoriia, et al.
Publicado: (2025)
por: Chekalina, Viktoriia, et al.
Publicado: (2025)
Confidence Estimation for Error Detection in Text-to-SQL Systems
por: Somov, Oleg, et al.
Publicado: (2025)
por: Somov, Oleg, et al.
Publicado: (2025)
Emergent Misalignment via In-Context Learning: Narrow in-context examples can produce broadly misaligned LLMs
por: Afonin, Nikita, et al.
Publicado: (2025)
por: Afonin, Nikita, et al.
Publicado: (2025)
Same Content, Different Representations: A Controlled Study for Table QA
por: Zhang, Yue, et al.
Publicado: (2025)
por: Zhang, Yue, et al.
Publicado: (2025)
Computational models of learning and synaptic plasticity
por: Tyulmankov, Danil
Publicado: (2024)
por: Tyulmankov, Danil
Publicado: (2024)
Autoregressive Generation Strategies for Top-K Sequential Recommendations
por: Volodkevich, Anna, et al.
Publicado: (2024)
por: Volodkevich, Anna, et al.
Publicado: (2024)
GigaEmbeddings: Efficient Russian Language Embedding Model
por: Kolodin, Egor, et al.
Publicado: (2025)
por: Kolodin, Egor, et al.
Publicado: (2025)
Eye of Judgement: Dissecting the Evaluation of Russian-speaking LLMs with POLLUX
por: Martynov, Nikita, et al.
Publicado: (2025)
por: Martynov, Nikita, et al.
Publicado: (2025)
Quantization of Large Language Models with an Overdetermined Basis
por: Merkulov, Daniil, et al.
Publicado: (2024)
por: Merkulov, Daniil, et al.
Publicado: (2024)
Retrieval Helps or Hurts? A Deeper Dive into the Efficacy of Retrieval Augmentation to Language Models
por: Maekawa, Seiji, et al.
Publicado: (2024)
por: Maekawa, Seiji, et al.
Publicado: (2024)
Anatomy of Unlearning: The Dual Impact of Fact Salience and Model Fine-Tuning
por: Borisiuk, Anna, et al.
Publicado: (2026)
por: Borisiuk, Anna, et al.
Publicado: (2026)
Nidus: Externalized Reasoning for AI-Assisted Engineering
por: Gorinevski, Danil
Publicado: (2026)
por: Gorinevski, Danil
Publicado: (2026)
RoCoIns: Enhancing Robustness of Large Language Models through Code-Style Instructions
por: Zhang, Yuansen, et al.
Publicado: (2024)
por: Zhang, Yuansen, et al.
Publicado: (2024)
Iterative Self-Training for Code Generation via Reinforced Re-Ranking
por: Sorokin, Nikita, et al.
Publicado: (2025)
por: Sorokin, Nikita, et al.
Publicado: (2025)
Token Homogenization under Positional Bias
por: Yusupov, Viacheslav, et al.
Publicado: (2025)
por: Yusupov, Viacheslav, et al.
Publicado: (2025)
Searching by Code: a New SearchBySnippet Dataset and SnippeR Retrieval Model for Searching by Code Snippets
por: Sedykh, Ivan, et al.
Publicado: (2023)
por: Sedykh, Ivan, et al.
Publicado: (2023)
T-pro 2.0: An Efficient Russian Hybrid-Reasoning Model and Playground
por: Stoianov, Dmitrii, et al.
Publicado: (2025)
por: Stoianov, Dmitrii, et al.
Publicado: (2025)
Detecting Overflow in Compressed Token Representations for Retrieval-Augmented Generation
por: Belikova, Julia, et al.
Publicado: (2026)
por: Belikova, Julia, et al.
Publicado: (2026)
Mathematical Foundations for Peer-to-Peer Lattice Computation
por: Gorinevski, Danil
Publicado: (2026)
por: Gorinevski, Danil
Publicado: (2026)
Ejemplares similares
-
Maximum Impact with Fewer Features: Efficient Feature Selection for Cold-Start Recommenders through Collaborative Importance Weighting
por: Sukhorukov, Nikita, et al.
Publicado: (2025) -
Recommendation Is a Dish Better Served Warm
por: Gusak, Danil, et al.
Publicado: (2025) -
SynthDetoxM: Modern LLMs are Few-Shot Parallel Detoxification Data Annotators
por: Moskovskiy, Daniil, et al.
Publicado: (2025) -
Scalable Cross-Entropy Loss for Sequential Recommendations with Large Item Catalogs
por: Mezentsev, Gleb, et al.
Publicado: (2024) -
RECE: Reduced Cross-Entropy Loss for Large-Catalogue Sequential Recommenders
por: Gusak, Danil, et al.
Publicado: (2024)