GISTEmbed: Guided In-sample Selection of Training Negatives for Text Embedding Fine-tuning
Fuente:
arXiv
Salvato in:
| Autore principale: | Solatorio, Aivin V. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Proof-Carrying Numbers (PCN): A Protocol for Trustworthy Numeric Answers from LLMs via Claim Verification
di: Solatorio, Aivin V.
Pubblicazione: (2025)
di: Solatorio, Aivin V.
Pubblicazione: (2025)
Large Language Models and Synthetic Data for Monitoring Dataset Mentions in Research Papers
di: Solatorio, Aivin V., et al.
Pubblicazione: (2025)
di: Solatorio, Aivin V., et al.
Pubblicazione: (2025)
AI for Monitoring and Classifying Data Used in Research Literature
di: Macalaba, Rafael, et al.
Pubblicazione: (2026)
di: Macalaba, Rafael, et al.
Pubblicazione: (2026)
Double Jeopardy and Climate Impact in the Use of Large Language Models: Socio-economic Disparities and Reduced Utility for Non-English Speakers
di: Solatorio, Aivin V., et al.
Pubblicazione: (2024)
di: Solatorio, Aivin V., et al.
Pubblicazione: (2024)
PMSS: Pretrained Matrices Skeleton Selection for LLM Fine-tuning
di: Wang, Qibin, et al.
Pubblicazione: (2024)
di: Wang, Qibin, et al.
Pubblicazione: (2024)
Improving Sampling Methods for Fine-tuning SentenceBERT in Text Streams
di: Garcia, Cristiano Mesquita, et al.
Pubblicazione: (2024)
di: Garcia, Cristiano Mesquita, et al.
Pubblicazione: (2024)
Learn Hard Problems During RL with Reference Guided Fine-tuning
di: Wu, Yangzhen, et al.
Pubblicazione: (2026)
di: Wu, Yangzhen, et al.
Pubblicazione: (2026)
Memento: Fine-tuning LLM Agents without Fine-tuning LLMs
di: Zhou, Huichi, et al.
Pubblicazione: (2025)
di: Zhou, Huichi, et al.
Pubblicazione: (2025)
Information Guided Regularization for Fine-tuning Language Models
di: Sharma, Mandar, et al.
Pubblicazione: (2024)
di: Sharma, Mandar, et al.
Pubblicazione: (2024)
Match & Choose: Model Selection Framework for Fine-tuning Text-to-Image Diffusion Models
di: Lewandowski, Basile, et al.
Pubblicazione: (2025)
di: Lewandowski, Basile, et al.
Pubblicazione: (2025)
Attention with Trained Embeddings Provably Selects Important Tokens
di: Wu, Diyuan, et al.
Pubblicazione: (2025)
di: Wu, Diyuan, et al.
Pubblicazione: (2025)
APE: Selective Fine-tuning with Acceptance Criteria for Language Model Adaptation
di: Marín, Javier
Pubblicazione: (2025)
di: Marín, Javier
Pubblicazione: (2025)
Selecting Large Language Model to Fine-tune via Rectified Scaling Law
di: Lin, Haowei, et al.
Pubblicazione: (2024)
di: Lin, Haowei, et al.
Pubblicazione: (2024)
Utility-Diversity Aware Online Batch Selection for LLM Supervised Fine-tuning
di: Zou, Heming, et al.
Pubblicazione: (2025)
di: Zou, Heming, et al.
Pubblicazione: (2025)
SmallToLarge (S2L): Scalable Data Selection for Fine-tuning Large Language Models by Summarizing Training Trajectories of Small Models
di: Yang, Yu, et al.
Pubblicazione: (2024)
di: Yang, Yu, et al.
Pubblicazione: (2024)
Optimal Embedding Guided Negative Sample Generation for Knowledge Graph Link Prediction
di: Takamoto, Makoto, et al.
Pubblicazione: (2025)
di: Takamoto, Makoto, et al.
Pubblicazione: (2025)
Topic Modeling with Fine-tuning LLMs and Bag of Sentences
di: Schneider, Johannes
Pubblicazione: (2024)
di: Schneider, Johannes
Pubblicazione: (2024)
On the Loss of Context-awareness in General Instruction Fine-tuning
di: Wang, Yihan, et al.
Pubblicazione: (2024)
di: Wang, Yihan, et al.
Pubblicazione: (2024)
SEE: Continual Fine-tuning with Sequential Ensemble of Experts
di: Wang, Zhilin, et al.
Pubblicazione: (2025)
di: Wang, Zhilin, et al.
Pubblicazione: (2025)
RiverText: A Python Library for Training and Evaluating Incremental Word Embeddings from Text Data Streams
di: Iturra-Bocaz, Gabriel, et al.
Pubblicazione: (2025)
di: Iturra-Bocaz, Gabriel, et al.
Pubblicazione: (2025)
Fine-tuning Large Language Models with Limited Data: A Survey and Practical Guide
di: Szep, Marton, et al.
Pubblicazione: (2024)
di: Szep, Marton, et al.
Pubblicazione: (2024)
Zero2Text: Zero-Training Cross-Domain Inversion Attacks on Textual Embeddings
di: Kim, Doohyun, et al.
Pubblicazione: (2026)
di: Kim, Doohyun, et al.
Pubblicazione: (2026)
SEAL: Safety-enhanced Aligned LLM Fine-tuning via Bilevel Data Selection
di: Shen, Han, et al.
Pubblicazione: (2024)
di: Shen, Han, et al.
Pubblicazione: (2024)
LoRA vs Full Fine-tuning: An Illusion of Equivalence
di: Shuttleworth, Reece, et al.
Pubblicazione: (2024)
di: Shuttleworth, Reece, et al.
Pubblicazione: (2024)
Advancing Parameter Efficiency in Fine-tuning via Representation Editing
di: Wu, Muling, et al.
Pubblicazione: (2024)
di: Wu, Muling, et al.
Pubblicazione: (2024)
Whispering in Amharic: Fine-tuning Whisper for Low-resource Language
di: Gete, Dawit Ketema, et al.
Pubblicazione: (2025)
di: Gete, Dawit Ketema, et al.
Pubblicazione: (2025)
Efficient Ensemble for Fine-tuning Language Models on Multiple Datasets
di: Li, Dongyue, et al.
Pubblicazione: (2025)
di: Li, Dongyue, et al.
Pubblicazione: (2025)
Relational Knowledge Distillation Using Fine-tuned Function Vectors
di: Kang, Andrea, et al.
Pubblicazione: (2026)
di: Kang, Andrea, et al.
Pubblicazione: (2026)
Mechanistic Fine-tuning for In-context Learning
di: Cho, Hakaze, et al.
Pubblicazione: (2025)
di: Cho, Hakaze, et al.
Pubblicazione: (2025)
Fine-tuning Large Language Models for Domain-specific Machine Translation
di: Zheng, Jiawei, et al.
Pubblicazione: (2024)
di: Zheng, Jiawei, et al.
Pubblicazione: (2024)
What Makes and Breaks Safety Fine-tuning? A Mechanistic Study
di: Jain, Samyak, et al.
Pubblicazione: (2024)
di: Jain, Samyak, et al.
Pubblicazione: (2024)
Automatic Pruning of Fine-tuning Datasets for Transformer-based Language Models
di: Tayaranian, Mohammadreza, et al.
Pubblicazione: (2024)
di: Tayaranian, Mohammadreza, et al.
Pubblicazione: (2024)
Algorithm Selection with Zero Domain Knowledge via Text Embeddings
di: Szeider, Stefan
Pubblicazione: (2026)
di: Szeider, Stefan
Pubblicazione: (2026)
A General Framework to Enhance Fine-tuning-based LLM Unlearning
di: Ren, Jie, et al.
Pubblicazione: (2025)
di: Ren, Jie, et al.
Pubblicazione: (2025)
Two-stage LLM Fine-tuning with Less Specialization and More Generalization
di: Wang, Yihan, et al.
Pubblicazione: (2022)
di: Wang, Yihan, et al.
Pubblicazione: (2022)
Aletheia: Gradient-Guided Layer Selection for Efficient LoRA Fine-Tuning Across Architectures
di: Saket, Abdulmalek
Pubblicazione: (2026)
di: Saket, Abdulmalek
Pubblicazione: (2026)
GSQ-Tuning: Group-Shared Exponents Integer in Fully Quantized Training for LLMs On-Device Fine-tuning
di: Zhou, Sifan, et al.
Pubblicazione: (2025)
di: Zhou, Sifan, et al.
Pubblicazione: (2025)
RAG vs Fine-tuning: Pipelines, Tradeoffs, and a Case Study on Agriculture
di: Balaguer, Angels, et al.
Pubblicazione: (2024)
di: Balaguer, Angels, et al.
Pubblicazione: (2024)
RIFF: Learning to Rephrase Inputs for Few-shot Fine-tuning of Language Models
di: Najafi, Saeed, et al.
Pubblicazione: (2024)
di: Najafi, Saeed, et al.
Pubblicazione: (2024)
Robust and Efficient Fine-tuning of LLMs with Bayesian Reparameterization of Low-Rank Adaptation
di: Sengupta, Ayan, et al.
Pubblicazione: (2024)
di: Sengupta, Ayan, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Proof-Carrying Numbers (PCN): A Protocol for Trustworthy Numeric Answers from LLMs via Claim Verification
di: Solatorio, Aivin V.
Pubblicazione: (2025) -
Large Language Models and Synthetic Data for Monitoring Dataset Mentions in Research Papers
di: Solatorio, Aivin V., et al.
Pubblicazione: (2025) -
AI for Monitoring and Classifying Data Used in Research Literature
di: Macalaba, Rafael, et al.
Pubblicazione: (2026) -
Double Jeopardy and Climate Impact in the Use of Large Language Models: Socio-economic Disparities and Reduced Utility for Non-English Speakers
di: Solatorio, Aivin V., et al.
Pubblicazione: (2024) -
PMSS: Pretrained Matrices Skeleton Selection for LLM Fine-tuning
di: Wang, Qibin, et al.
Pubblicazione: (2024)