Efficient Ternary Weight Embedding Model: Bridging Scalability and Performance
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Chen, Jiayi, Wu, Chen, Zhang, Shaoqun, Li, Nan, Zhang, Liangjie, Zhang, Qi |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
TernaryCLIP: Efficiently Compressing Vision-Language Models with Ternary Weights and Distilled Knowledge
von: Zhang, Shu-Hao, et al.
Veröffentlicht: (2025)
von: Zhang, Shu-Hao, et al.
Veröffentlicht: (2025)
SWIFT:A Scalable lightWeight Infrastructure for Fine-Tuning
von: Zhao, Yuze, et al.
Veröffentlicht: (2024)
von: Zhao, Yuze, et al.
Veröffentlicht: (2024)
Leveraging Passage Embeddings for Efficient Listwise Reranking with Large Language Models
von: Liu, Qi, et al.
Veröffentlicht: (2024)
von: Liu, Qi, et al.
Veröffentlicht: (2024)
Examining the Robustness of Large Language Models across Language Complexity
von: Zhang, Jiayi
Veröffentlicht: (2025)
von: Zhang, Jiayi
Veröffentlicht: (2025)
Arctic-Embed: Scalable, Efficient, and Accurate Text Embedding Models
von: Merrick, Luke, et al.
Veröffentlicht: (2024)
von: Merrick, Luke, et al.
Veröffentlicht: (2024)
Efficient Sequential Decision Making with Large Language Models
von: Chen, Dingyang, et al.
Veröffentlicht: (2024)
von: Chen, Dingyang, et al.
Veröffentlicht: (2024)
ReaLM: Residual Quantization Bridging Knowledge Graph Embeddings and Large Language Models
von: Guo, Wenbin, et al.
Veröffentlicht: (2025)
von: Guo, Wenbin, et al.
Veröffentlicht: (2025)
Robust and Scalable Model Editing for Large Language Models
von: Chen, Yingfa, et al.
Veröffentlicht: (2024)
von: Chen, Yingfa, et al.
Veröffentlicht: (2024)
Refining the Use of the Web (and Web Search) as a Language Teaching and Learning Resource
von: Wu, Shaoqun, et al.
Veröffentlicht: (2009)
von: Wu, Shaoqun, et al.
Veröffentlicht: (2009)
WebSailor-V2: Bridging the Chasm to Proprietary Agents via Synthetic Data and Scalable Reinforcement Learning
von: Li, Kuan, et al.
Veröffentlicht: (2025)
von: Li, Kuan, et al.
Veröffentlicht: (2025)
Utilizing Lexical Data from a Web-Derived Corpus to Expand Productive Collocation Knowledge
von: Wu, Shaoqun, et al.
Veröffentlicht: (2010)
von: Wu, Shaoqun, et al.
Veröffentlicht: (2010)
Beyond Accuracy: The Role of Calibration in Self-Improving Large Language Models
von: Huang, Liangjie, et al.
Veröffentlicht: (2025)
von: Huang, Liangjie, et al.
Veröffentlicht: (2025)
ConfClip: Confidence-Weighted and Clipped Reward for Reinforcement Learning in LLMs
von: Zhang, Bonan, et al.
Veröffentlicht: (2025)
von: Zhang, Bonan, et al.
Veröffentlicht: (2025)
Making Large Language Models Perform Better in Knowledge Graph Completion
von: Zhang, Yichi, et al.
Veröffentlicht: (2023)
von: Zhang, Yichi, et al.
Veröffentlicht: (2023)
Scalable Environments Drive Generalizable Agents
von: Zhang, Jiayi, et al.
Veröffentlicht: (2026)
von: Zhang, Jiayi, et al.
Veröffentlicht: (2026)
LongEmbed: Extending Embedding Models for Long Context Retrieval
von: Zhu, Dawei, et al.
Veröffentlicht: (2024)
von: Zhu, Dawei, et al.
Veröffentlicht: (2024)
Empirical Study of Named Entity Recognition Performance Using Distribution-aware Word Embedding
von: Chen, Xin, et al.
Veröffentlicht: (2021)
von: Chen, Xin, et al.
Veröffentlicht: (2021)
Countering Catastrophic Forgetting of Large Language Models for Better Instruction Following via Weight-Space Model Merging
von: Lyu, Mengxian, et al.
Veröffentlicht: (2026)
von: Lyu, Mengxian, et al.
Veröffentlicht: (2026)
LANTERN: Scalable Distillation of Large Language Models for Job-Person Fit and Explanation
von: Fu, Zhoutong, et al.
Veröffentlicht: (2025)
von: Fu, Zhoutong, et al.
Veröffentlicht: (2025)
Investigating an Open Methodology for Designing Domain-Specific Language Collections
von: Fitzgerald, Alannah, et al.
Veröffentlicht: (2014)
von: Fitzgerald, Alannah, et al.
Veröffentlicht: (2014)
EmbedGrad: Gradient-Based Prompt Optimization in Embedding Space for Large Language Models
von: Hou, Xiaoming, et al.
Veröffentlicht: (2025)
von: Hou, Xiaoming, et al.
Veröffentlicht: (2025)
Simple Techniques for Enhancing Sentence Embeddings in Generative Language Models
von: Zhang, Bowen, et al.
Veröffentlicht: (2024)
von: Zhang, Bowen, et al.
Veröffentlicht: (2024)
Bridging Passive and Active: Enhancing Conversation Starter Recommendation via Active Expression Modeling
von: Wu, Yiqing, et al.
Veröffentlicht: (2026)
von: Wu, Yiqing, et al.
Veröffentlicht: (2026)
Stop Overthinking: A Survey on Efficient Reasoning for Large Language Models
von: Sui, Yang, et al.
Veröffentlicht: (2025)
von: Sui, Yang, et al.
Veröffentlicht: (2025)
F2LLM-v2: Inclusive, Performant, and Efficient Embeddings for a Multilingual World
von: Zhang, Ziyin, et al.
Veröffentlicht: (2026)
von: Zhang, Ziyin, et al.
Veröffentlicht: (2026)
CEO: Corpus-based Open-Domain Event Ontology Induction
von: Xu, Nan, et al.
Veröffentlicht: (2023)
von: Xu, Nan, et al.
Veröffentlicht: (2023)
Confidence Before Answering: A Paradigm Shift for Efficient LLM Uncertainty Estimation
von: Li, Changcheng, et al.
Veröffentlicht: (2026)
von: Li, Changcheng, et al.
Veröffentlicht: (2026)
EG-MLA: Embedding-Gated Multi-head Latent Attention for Scalable and Efficient LLMs
von: Cai, Zhengge, et al.
Veröffentlicht: (2025)
von: Cai, Zhengge, et al.
Veröffentlicht: (2025)
GigaEmbeddings: Efficient Russian Language Embedding Model
von: Kolodin, Egor, et al.
Veröffentlicht: (2025)
von: Kolodin, Egor, et al.
Veröffentlicht: (2025)
ML-Embed: Inclusive and Efficient Embeddings for a Multilingual World
von: Zhang, Ziyin, et al.
Veröffentlicht: (2026)
von: Zhang, Ziyin, et al.
Veröffentlicht: (2026)
Qwen3 Embedding: Advancing Text Embedding and Reranking Through Foundation Models
von: Zhang, Yanzhao, et al.
Veröffentlicht: (2025)
von: Zhang, Yanzhao, et al.
Veröffentlicht: (2025)
Optimizing Sentence Embedding with Pseudo-Labeling and Model Ensembles: A Hierarchical Framework for Enhanced NLP Tasks
von: Liu, Ziwei, et al.
Veröffentlicht: (2025)
von: Liu, Ziwei, et al.
Veröffentlicht: (2025)
Enhancing Large Language Model Performance with Gradient-Based Parameter Selection
von: Li, Haoling, et al.
Veröffentlicht: (2024)
von: Li, Haoling, et al.
Veröffentlicht: (2024)
Robust Asynchronous Planning via Auto-Formalization
von: Zhang, Jiayi, et al.
Veröffentlicht: (2026)
von: Zhang, Jiayi, et al.
Veröffentlicht: (2026)
Improving General Text Embedding Model: Tackling Task Conflict and Data Imbalance through Model Merging
von: Li, Mingxin, et al.
Veröffentlicht: (2024)
von: Li, Mingxin, et al.
Veröffentlicht: (2024)
Prompting Disentangled Embeddings for Knowledge Graph Completion with Pre-trained Language Model
von: Geng, Yuxia, et al.
Veröffentlicht: (2023)
von: Geng, Yuxia, et al.
Veröffentlicht: (2023)
TS-Align: A Teacher-Student Collaborative Framework for Scalable Iterative Finetuning of Large Language Models
von: Zhang, Chen, et al.
Veröffentlicht: (2024)
von: Zhang, Chen, et al.
Veröffentlicht: (2024)
Diffusion vs. Autoregressive Language Models: A Text Embedding Perspective
von: Zhang, Siyue, et al.
Veröffentlicht: (2025)
von: Zhang, Siyue, et al.
Veröffentlicht: (2025)
ChatTime: A Unified Multimodal Time Series Foundation Model Bridging Numerical and Textual Data
von: Wang, Chengsen, et al.
Veröffentlicht: (2024)
von: Wang, Chengsen, et al.
Veröffentlicht: (2024)
KaLM-Embedding: Superior Training Data Brings A Stronger Embedding Model
von: Hu, Xinshuo, et al.
Veröffentlicht: (2025)
von: Hu, Xinshuo, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
TernaryCLIP: Efficiently Compressing Vision-Language Models with Ternary Weights and Distilled Knowledge
von: Zhang, Shu-Hao, et al.
Veröffentlicht: (2025) -
SWIFT:A Scalable lightWeight Infrastructure for Fine-Tuning
von: Zhao, Yuze, et al.
Veröffentlicht: (2024) -
Leveraging Passage Embeddings for Efficient Listwise Reranking with Large Language Models
von: Liu, Qi, et al.
Veröffentlicht: (2024) -
Examining the Robustness of Large Language Models across Language Complexity
von: Zhang, Jiayi
Veröffentlicht: (2025) -
Arctic-Embed: Scalable, Efficient, and Accurate Text Embedding Models
von: Merrick, Luke, et al.
Veröffentlicht: (2024)