Matryoshka-Adaptor: Unsupervised and Supervised Tuning for Smaller Embedding Dimensions
Fuente:
arXiv
Guardado en:
| Autores principales: | Yoon, Jinsung, Sinha, Raj, Arik, Sercan O, Pfister, Tomas |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Search-Adaptor: Embedding Customization for Information Retrieval
por: Yoon, Jinsung, et al.
Publicado: (2023)
por: Yoon, Jinsung, et al.
Publicado: (2023)
Long-Context LLMs Meet RAG: Overcoming Challenges for Long Inputs in RAG
por: Jin, Bowen, et al.
Publicado: (2024)
por: Jin, Bowen, et al.
Publicado: (2024)
Large Language Models Can Automatically Engineer Features for Few-Shot Tabular Learning
por: Han, Sungwon, et al.
Publicado: (2024)
por: Han, Sungwon, et al.
Publicado: (2024)
Learning to Clarify: Multi-turn Conversations with Action-Based Contrastive Self-Training
por: Chen, Maximillian, et al.
Publicado: (2024)
por: Chen, Maximillian, et al.
Publicado: (2024)
CROME: Cross-Modal Adapters for Efficient Multimodal LLM
por: Ebrahimi, Sayna, et al.
Publicado: (2024)
por: Ebrahimi, Sayna, et al.
Publicado: (2024)
MLE-STAR: Machine Learning Engineering Agent via Search and Targeted Refinement
por: Nam, Jaehyun, et al.
Publicado: (2025)
por: Nam, Jaehyun, et al.
Publicado: (2025)
ASPEST: Bridging the Gap Between Active Learning and Selective Prediction
por: Chen, Jiefeng, et al.
Publicado: (2023)
por: Chen, Jiefeng, et al.
Publicado: (2023)
TEMPO: Prompt-based Generative Pre-trained Transformer for Time Series Forecasting
por: Cao, Defu, et al.
Publicado: (2023)
por: Cao, Defu, et al.
Publicado: (2023)
SQL-GEN: Bridging the Dialect Gap for Text-to-SQL Via Synthetic Data And Model Merging
por: Pourreza, Mohammadreza, et al.
Publicado: (2024)
por: Pourreza, Mohammadreza, et al.
Publicado: (2024)
2D Matryoshka Sentence Embeddings
por: Li, Xianming, et al.
Publicado: (2024)
por: Li, Xianming, et al.
Publicado: (2024)
COSTAR: Improved Temporal Counterfactual Estimation with Self-Supervised Learning
por: Meng, Chuizheng, et al.
Publicado: (2023)
por: Meng, Chuizheng, et al.
Publicado: (2023)
Effective Large Language Model Adaptation for Improved Grounding and Citation Generation
por: Ye, Xi, et al.
Publicado: (2023)
por: Ye, Xi, et al.
Publicado: (2023)
Teach Better or Show Smarter? On Instructions and Exemplars in Automatic Prompt Optimization
por: Wan, Xingchen, et al.
Publicado: (2024)
por: Wan, Xingchen, et al.
Publicado: (2024)
Fine-Tuning LLMs for Report Summarization: Analysis on Supervised and Unsupervised Data
por: Rallapalli, Swati, et al.
Publicado: (2025)
por: Rallapalli, Swati, et al.
Publicado: (2025)
SMEC: Rethinking Matryoshka Representation Learning for Retrieval Embedding Compression
por: Zhang, Biao, et al.
Publicado: (2025)
por: Zhang, Biao, et al.
Publicado: (2025)
Learned Feature Importance Scores for Automated Feature Engineering
por: Dong, Yihe, et al.
Publicado: (2024)
por: Dong, Yihe, et al.
Publicado: (2024)
HEART: Emotionally-Driven Test-Time Scaling of Language Models
por: Pinto, Gabriela, et al.
Publicado: (2025)
por: Pinto, Gabriela, et al.
Publicado: (2025)
LANISTR: Multimodal Learning from Structured and Unstructured Data
por: Ebrahimi, Sayna, et al.
Publicado: (2023)
por: Ebrahimi, Sayna, et al.
Publicado: (2023)
Retrieval Augmented Time Series Forecasting
por: Han, Sungwon, et al.
Publicado: (2025)
por: Han, Sungwon, et al.
Publicado: (2025)
Astute RAG: Overcoming Imperfect Retrieval Augmentation and Knowledge Conflicts for Large Language Models
por: Wang, Fei, et al.
Publicado: (2024)
por: Wang, Fei, et al.
Publicado: (2024)
DynScaling: Efficient Verifier-free Inference Scaling via Dynamic and Integrated Sampling
por: Wang, Fei, et al.
Publicado: (2025)
por: Wang, Fei, et al.
Publicado: (2025)
An Empirical Study on Reinforcement Learning for Reasoning-Search Interleaved LLM Agents
por: Jin, Bowen, et al.
Publicado: (2025)
por: Jin, Bowen, et al.
Publicado: (2025)
To MRL or not to MRL: Text Embeddings are Robust to Truncation Without Matryoshka Learning, Except In Heavy Truncation Scenarios
por: Takeshita, Sotaro, et al.
Publicado: (2026)
por: Takeshita, Sotaro, et al.
Publicado: (2026)
Learn-by-interact: A Data-Centric Framework for Self-Adaptive Agents in Realistic Environments
por: Su, Hongjin, et al.
Publicado: (2025)
por: Su, Hongjin, et al.
Publicado: (2025)
Nexus : An Agentic Framework for Time Series Forecasting
por: Das, Sarkar Snigdha Sarathi, et al.
Publicado: (2026)
por: Das, Sarkar Snigdha Sarathi, et al.
Publicado: (2026)
LLM-Based Multi-Agent Blackboard System for Information Discovery in Data Science
por: Salemi, Alireza, et al.
Publicado: (2025)
por: Salemi, Alireza, et al.
Publicado: (2025)
Chain of Agents: Large Language Models Collaborating on Long-Context Tasks
por: Zhang, Yusen, et al.
Publicado: (2024)
por: Zhang, Yusen, et al.
Publicado: (2024)
MatryoshkaLoRA: Learning Accurate Hierarchical Low-Rank Representations for LLM Fine-Tuning
por: Modoranu, Ionut-Vlad, et al.
Publicado: (2026)
por: Modoranu, Ionut-Vlad, et al.
Publicado: (2026)
Matryoshka Multimodal Models
por: Cai, Mu, et al.
Publicado: (2024)
por: Cai, Mu, et al.
Publicado: (2024)
SETS: Leveraging Self-Verification and Self-Correction for Improved Test-Time Scaling
por: Chen, Jiefeng, et al.
Publicado: (2025)
por: Chen, Jiefeng, et al.
Publicado: (2025)
Measuring Intrinsic Dimension of Token Embeddings
por: Kataiwa, Takuya, et al.
Publicado: (2025)
por: Kataiwa, Takuya, et al.
Publicado: (2025)
ATLAS: Adaptive Transfer Scaling Laws for Multilingual Pretraining, Finetuning, and Decoding the Curse of Multilinguality
por: Longpre, Shayne, et al.
Publicado: (2025)
por: Longpre, Shayne, et al.
Publicado: (2025)
Anchored Supervised Fine-Tuning
por: Zhu, He, et al.
Publicado: (2025)
por: Zhu, He, et al.
Publicado: (2025)
PaperOrchestra: A Multi-Agent Framework for Automated AI Research Paper Writing
por: Song, Yiwen, et al.
Publicado: (2026)
por: Song, Yiwen, et al.
Publicado: (2026)
Is Smaller Always Faster? Tradeoffs in Compressing Self-Supervised Speech Transformers
por: Lin, Tzu-Quan, et al.
Publicado: (2022)
por: Lin, Tzu-Quan, et al.
Publicado: (2022)
Matryoshka Query Transformer for Large Vision-Language Models
por: Hu, Wenbo, et al.
Publicado: (2024)
por: Hu, Wenbo, et al.
Publicado: (2024)
MatMamba: A Matryoshka State Space Model
por: Shukla, Abhinav, et al.
Publicado: (2024)
por: Shukla, Abhinav, et al.
Publicado: (2024)
Matryoshka Pilot: Learning to Drive Black-Box LLMs with LLMs
por: Li, Changhao, et al.
Publicado: (2024)
por: Li, Changhao, et al.
Publicado: (2024)
The Semantic Illusion: Certified Limits of Embedding-Based Hallucination Detection in RAG Systems
por: Sinha, Debu
Publicado: (2025)
por: Sinha, Debu
Publicado: (2025)
Multi-Agent Design: Optimizing Agents with Better Prompts and Topologies
por: Zhou, Han, et al.
Publicado: (2025)
por: Zhou, Han, et al.
Publicado: (2025)
Ejemplares similares
-
Search-Adaptor: Embedding Customization for Information Retrieval
por: Yoon, Jinsung, et al.
Publicado: (2023) -
Long-Context LLMs Meet RAG: Overcoming Challenges for Long Inputs in RAG
por: Jin, Bowen, et al.
Publicado: (2024) -
Large Language Models Can Automatically Engineer Features for Few-Shot Tabular Learning
por: Han, Sungwon, et al.
Publicado: (2024) -
Learning to Clarify: Multi-turn Conversations with Action-Based Contrastive Self-Training
por: Chen, Maximillian, et al.
Publicado: (2024) -
CROME: Cross-Modal Adapters for Efficient Multimodal LLM
por: Ebrahimi, Sayna, et al.
Publicado: (2024)