Learning to Compress: Unlocking the Potential of Large Language Models for Text Representation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Yeqin, Zhao, Yizheng, Hu, Chen, Jiao, Binxing, Jiang, Daxin, Miao, Ruihang, Nguyen, Cam-Tu |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Retrospex: Language Agent Meets Offline Reinforcement Learning Critic
par: Xiang, Yufei, et autres
Publié: (2025)
par: Xiang, Yufei, et autres
Publié: (2025)
LLM-based Embeddings: Attention Values Encode Sentence Semantics Better Than Hidden States
par: Zhang, Yeqin, et autres
Publié: (2026)
par: Zhang, Yeqin, et autres
Publié: (2026)
Mitigating the Impact of False Negatives in Dense Retrieval with Contrastive Confidence Regularization
par: Wang, Shiqi, et autres
Publié: (2023)
par: Wang, Shiqi, et autres
Publié: (2023)
A Survey on Retrieval-Augmented Text Generation for Large Language Models
par: Huang, Yizheng, et autres
Publié: (2024)
par: Huang, Yizheng, et autres
Publié: (2024)
Unlocking Anticipatory Text Generation: A Constrained Approach for Large Language Models Decoding
par: Tu, Lifu, et autres
Publié: (2023)
par: Tu, Lifu, et autres
Publié: (2023)
Unlocking the Potential of Model Merging for Low-Resource Languages
par: Tao, Mingxu, et autres
Publié: (2024)
par: Tao, Mingxu, et autres
Publié: (2024)
XGrammar: Flexible and Efficient Structured Generation Engine for Large Language Models
par: Dong, Yixin, et autres
Publié: (2024)
par: Dong, Yixin, et autres
Publié: (2024)
Unlocking the Potential: Benchmarking Large Language Models in Water Engineering and Research
par: Xu, Boyan, et autres
Publié: (2024)
par: Xu, Boyan, et autres
Publié: (2024)
Text Embeddings by Weakly-Supervised Contrastive Pre-training
par: Wang, Liang, et autres
Publié: (2022)
par: Wang, Liang, et autres
Publié: (2022)
Mixed Preference Optimization: Reinforcement Learning with Data Selection and Better Reference Model
par: Gou, Qi, et autres
Publié: (2024)
par: Gou, Qi, et autres
Publié: (2024)
WizardCoder: Empowering Code Large Language Models with Evol-Instruct
par: Luo, Ziyang, et autres
Publié: (2023)
par: Luo, Ziyang, et autres
Publié: (2023)
Reward Difference Optimization For Sample Reweighting In Offline RLHF
par: Wang, Shiqi, et autres
Publié: (2024)
par: Wang, Shiqi, et autres
Publié: (2024)
Unlocking the Potential of Large Language Models for Clinical Text Anonymization: A Comparative Study
par: Pissarra, David, et autres
Publié: (2024)
par: Pissarra, David, et autres
Publié: (2024)
Unlocking the Power of Large Language Models for Entity Alignment
par: Jiang, Xuhui, et autres
Publié: (2024)
par: Jiang, Xuhui, et autres
Publié: (2024)
CMT: A Memory Compression Method for Continual Knowledge Learning of Large Language Models
par: Li, Dongfang, et autres
Publié: (2024)
par: Li, Dongfang, et autres
Publié: (2024)
EmbedLLM: Learning Compact Representations of Large Language Models
par: Zhuang, Richard, et autres
Publié: (2024)
par: Zhuang, Richard, et autres
Publié: (2024)
Large Language Model Enhanced Knowledge Representation Learning: A Survey
par: Wang, Xin, et autres
Publié: (2024)
par: Wang, Xin, et autres
Publié: (2024)
All Languages Matter: On the Multilingual Safety of Large Language Models
par: Wang, Wenxuan, et autres
Publié: (2023)
par: Wang, Wenxuan, et autres
Publié: (2023)
Unlocking the Potential of Diffusion Language Models through Template Infilling
par: Lee, Junhoo, et autres
Publié: (2025)
par: Lee, Junhoo, et autres
Publié: (2025)
Unveiling the Misuse Potential of Base Large Language Models via In-Context Learning
par: Wang, Xiao, et autres
Publié: (2024)
par: Wang, Xiao, et autres
Publié: (2024)
Random Policy Valuation is Enough for LLM Reasoning with Verifiable Rewards
par: He, Haoran, et autres
Publié: (2025)
par: He, Haoran, et autres
Publié: (2025)
Improving Attributed Text Generation of Large Language Models via Preference Learning
par: Li, Dongfang, et autres
Publié: (2024)
par: Li, Dongfang, et autres
Publié: (2024)
Adam: Dense Retrieval Distillation with Adaptive Dark Examples
par: Tao, Chongyang, et autres
Publié: (2022)
par: Tao, Chongyang, et autres
Publié: (2022)
Adaptive Ability Decomposing for Unlocking Large Reasoning Model Effective Reinforcement Learning
par: Chen, Zhipeng, et autres
Publié: (2026)
par: Chen, Zhipeng, et autres
Publié: (2026)
Dynamic Compressing Prompts for Efficient Inference of Large Language Models
par: Hu, Jinwu, et autres
Publié: (2025)
par: Hu, Jinwu, et autres
Publié: (2025)
Streamlining Redundant Layers to Compress Large Language Models
par: Chen, Xiaodong, et autres
Publié: (2024)
par: Chen, Xiaodong, et autres
Publié: (2024)
MiMo: Unlocking the Reasoning Potential of Language Model -- From Pretraining to Posttraining
par: Xiaomi, LLM-Core, et autres
Publié: (2025)
par: Xiaomi, LLM-Core, et autres
Publié: (2025)
Q-Mirror: Unlocking the Multi-Modal Potential of Scientific Text-Only QA Pairs
par: Wang, Junying, et autres
Publié: (2025)
par: Wang, Junying, et autres
Publié: (2025)
Automated Triaging and Transfer Learning of Incident Learning Safety Reports Using Large Language Representational Models
par: Beidler, Peter, et autres
Publié: (2025)
par: Beidler, Peter, et autres
Publié: (2025)
A Survey of Theory of Mind in Large Language Models: Evaluations, Representations, and Safety Risks
par: Nguyen, Hieu Minh "Jord"
Publié: (2025)
par: Nguyen, Hieu Minh "Jord"
Publié: (2025)
Large Language Models for Detection of Life-Threatening Texts
par: Nguyen, Thanh Thi, et autres
Publié: (2025)
par: Nguyen, Thanh Thi, et autres
Publié: (2025)
Mini-Gemini: Mining the Potential of Multi-modality Vision Language Models
par: Li, Yanwei, et autres
Publié: (2024)
par: Li, Yanwei, et autres
Publié: (2024)
Information Capacity: Evaluating the Efficiency of Large Language Models via Text Compression
par: Yuan, Cheng, et autres
Publié: (2025)
par: Yuan, Cheng, et autres
Publié: (2025)
Revisiting Entropy Regularization: Adaptive Coefficient Unlocks Its Potential for LLM Reinforcement Learning
par: Zhang, Xiaoyun, et autres
Publié: (2025)
par: Zhang, Xiaoyun, et autres
Publié: (2025)
In-context Autoencoder for Context Compression in a Large Language Model
par: Ge, Tao, et autres
Publié: (2023)
par: Ge, Tao, et autres
Publié: (2023)
Probing the Decision Boundaries of In-context Learning in Large Language Models
par: Zhao, Siyan, et autres
Publié: (2024)
par: Zhao, Siyan, et autres
Publié: (2024)
TOOLCAD: Exploring Tool-Using Large Language Models in Text-to-CAD Generation with Reinforcement Learning
par: Gong, Yifei, et autres
Publié: (2026)
par: Gong, Yifei, et autres
Publié: (2026)
Unlocking Multimodal Mathematical Reasoning via Process Reward Model
par: Luo, Ruilin, et autres
Publié: (2025)
par: Luo, Ruilin, et autres
Publié: (2025)
Unlocking the Working Memory of Large Language Models for Latent Reasoning
par: Aichberger, Lukas, et autres
Publié: (2026)
par: Aichberger, Lukas, et autres
Publié: (2026)
Unlocking Reasoning Capability on Machine Translation in Large Language Models
par: Rajaee, Sara, et autres
Publié: (2026)
par: Rajaee, Sara, et autres
Publié: (2026)
Documents similaires
-
Retrospex: Language Agent Meets Offline Reinforcement Learning Critic
par: Xiang, Yufei, et autres
Publié: (2025) -
LLM-based Embeddings: Attention Values Encode Sentence Semantics Better Than Hidden States
par: Zhang, Yeqin, et autres
Publié: (2026) -
Mitigating the Impact of False Negatives in Dense Retrieval with Contrastive Confidence Regularization
par: Wang, Shiqi, et autres
Publié: (2023) -
A Survey on Retrieval-Augmented Text Generation for Large Language Models
par: Huang, Yizheng, et autres
Publié: (2024) -
Unlocking Anticipatory Text Generation: A Constrained Approach for Large Language Models Decoding
par: Tu, Lifu, et autres
Publié: (2023)