Following the Autoregressive Nature of LLM Embeddings via Compression and Alignment
Fuente:
arXiv
Salvato in:
| Autori principali: | Deng, Jingcheng, Jiang, Zhongtao, Pang, Liang, Chen, Liwei, Xu, Kun, Wei, Zihao, Shen, Huawei, Cheng, Xueqi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
LLM Latent Reasoning as Chain of Superposition
di: Deng, Jingcheng, et al.
Pubblicazione: (2025)
di: Deng, Jingcheng, et al.
Pubblicazione: (2025)
MLaKE: Multilingual Knowledge Editing Benchmark for Large Language Models
di: Wei, Zihao, et al.
Pubblicazione: (2024)
di: Wei, Zihao, et al.
Pubblicazione: (2024)
Everything is Editable: Extend Knowledge Editing to Unstructured Data in Large Language Models
di: Deng, Jingcheng, et al.
Pubblicazione: (2024)
di: Deng, Jingcheng, et al.
Pubblicazione: (2024)
Stable Knowledge Editing in Large Language Models
di: Wei, Zihao, et al.
Pubblicazione: (2024)
di: Wei, Zihao, et al.
Pubblicazione: (2024)
The Evolution of Thought: Tracking LLM Overthinking via Reasoning Dynamics Analysis
di: Wei, Zihao, et al.
Pubblicazione: (2025)
di: Wei, Zihao, et al.
Pubblicazione: (2025)
On the Diminishing Returns of Complex Robust RAG Training in the Era of Powerful LLMs
di: Ding, Hanxing, et al.
Pubblicazione: (2025)
di: Ding, Hanxing, et al.
Pubblicazione: (2025)
RLKD: Distilling LLMs' Reasoning via Reinforcement Learning
di: Xu, Shicheng, et al.
Pubblicazione: (2025)
di: Xu, Shicheng, et al.
Pubblicazione: (2025)
Rowen: Adaptive Retrieval-Augmented Generation for Hallucination Mitigation in LLMs
di: Ding, Hanxing, et al.
Pubblicazione: (2024)
di: Ding, Hanxing, et al.
Pubblicazione: (2024)
Think Before You Speak: Cultivating Communication Skills of Large Language Models via Inner Monologue
di: Zhou, Junkai, et al.
Pubblicazione: (2023)
di: Zhou, Junkai, et al.
Pubblicazione: (2023)
Reverse Physician-AI Relationship: Full-process Clinical Diagnosis Driven by a Large Language Model
di: Xu, Shicheng, et al.
Pubblicazione: (2025)
di: Xu, Shicheng, et al.
Pubblicazione: (2025)
A Theory for Token-Level Harmonization in Retrieval-Augmented Generation
di: Xu, Shicheng, et al.
Pubblicazione: (2024)
di: Xu, Shicheng, et al.
Pubblicazione: (2024)
Latent-GRPO: Group Relative Policy Optimization for Latent Reasoning
di: Deng, Jingcheng, et al.
Pubblicazione: (2026)
di: Deng, Jingcheng, et al.
Pubblicazione: (2026)
D-Models and E-Models: Diversity-Stability Trade-offs in the Sampling Behavior of Large Language Models
di: Gu, Jia, et al.
Pubblicazione: (2026)
di: Gu, Jia, et al.
Pubblicazione: (2026)
Enhancing Training Data Attribution for Large Language Models with Fitting Error Consideration
di: Wu, Kangxi, et al.
Pubblicazione: (2024)
di: Wu, Kangxi, et al.
Pubblicazione: (2024)
Do LLMs Play Dice? Exploring Probability Distribution Sampling in Large Language Models for Behavioral Simulation
di: Gu, Jia, et al.
Pubblicazione: (2024)
di: Gu, Jia, et al.
Pubblicazione: (2024)
List-aware Reranking-Truncation Joint Model for Search and Retrieval-augmented Generation
di: Xu, Shicheng, et al.
Pubblicazione: (2024)
di: Xu, Shicheng, et al.
Pubblicazione: (2024)
Search-in-the-Chain: Interactively Enhancing Large Language Models with Search for Knowledge-intensive Tasks
di: Xu, Shicheng, et al.
Pubblicazione: (2023)
di: Xu, Shicheng, et al.
Pubblicazione: (2023)
Qsnail: A Questionnaire Dataset for Sequential Question Generation
di: Lei, Yan, et al.
Pubblicazione: (2024)
di: Lei, Yan, et al.
Pubblicazione: (2024)
Cross-Modal Safety Mechanism Transfer in Large Vision-Language Models
di: Xu, Shicheng, et al.
Pubblicazione: (2024)
di: Xu, Shicheng, et al.
Pubblicazione: (2024)
ToolCoder: A Systematic Code-Empowered Tool Learning Framework for Large Language Models
di: Ding, Hanxing, et al.
Pubblicazione: (2025)
di: Ding, Hanxing, et al.
Pubblicazione: (2025)
Knowledge Boundary and Persona Dynamic Shape A Better Social Media Agent
di: Zhou, Junkai, et al.
Pubblicazione: (2024)
di: Zhou, Junkai, et al.
Pubblicazione: (2024)
Invisible Relevance Bias: Text-Image Retrieval Models Prefer AI-Generated Images
di: Xu, Shicheng, et al.
Pubblicazione: (2023)
di: Xu, Shicheng, et al.
Pubblicazione: (2023)
Large Language Model Sourcing: A Survey
di: Pang, Liang, et al.
Pubblicazione: (2025)
di: Pang, Liang, et al.
Pubblicazione: (2025)
Cross-Model Comparative Loss for Enhancing Neuronal Utility in Language Understanding
di: Zhu, Yunchang, et al.
Pubblicazione: (2023)
di: Zhu, Yunchang, et al.
Pubblicazione: (2023)
Unsupervised Information Refinement Training of Large Language Models for Retrieval-Augmented Generation
di: Xu, Shicheng, et al.
Pubblicazione: (2024)
di: Xu, Shicheng, et al.
Pubblicazione: (2024)
Improving Multimodal Contrastive Learning of Sentence Embeddings with Object-Phrase Alignment
di: Zhao, Kaiyan, et al.
Pubblicazione: (2025)
di: Zhao, Kaiyan, et al.
Pubblicazione: (2025)
Inference-time Alignment in Continuous Space
di: Yuan, Yige, et al.
Pubblicazione: (2025)
di: Yuan, Yige, et al.
Pubblicazione: (2025)
GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace
di: Duan, Zenghao, et al.
Pubblicazione: (2025)
di: Duan, Zenghao, et al.
Pubblicazione: (2025)
ALiiCE: Evaluating Positional Fine-grained Citation Generation
di: Xu, Yilong, et al.
Pubblicazione: (2024)
di: Xu, Yilong, et al.
Pubblicazione: (2024)
Enhancing Cross-lingual Sentence Embedding for Low-resource Languages with Word Alignment
di: Miao, Zhongtao, et al.
Pubblicazione: (2024)
di: Miao, Zhongtao, et al.
Pubblicazione: (2024)
Improving Video Corpus Moment Retrieval with Partial Relevance Enhancement
di: Hou, Danyang, et al.
Pubblicazione: (2024)
di: Hou, Danyang, et al.
Pubblicazione: (2024)
Event-aware Video Corpus Moment Retrieval
di: Hou, Danyang, et al.
Pubblicazione: (2024)
di: Hou, Danyang, et al.
Pubblicazione: (2024)
Training a Utility-based Retriever Through Shared Context Attribution for Retrieval-Augmented Language Models
di: Xu, Yilong, et al.
Pubblicazione: (2025)
di: Xu, Yilong, et al.
Pubblicazione: (2025)
GRC: Unifying Reasoning-Driven Generation, Retrieval and Compression
di: Miao, Zhongtao, et al.
Pubblicazione: (2026)
di: Miao, Zhongtao, et al.
Pubblicazione: (2026)
Fact-Level Confidence Calibration and Self-Correction
di: Yuan, Yige, et al.
Pubblicazione: (2024)
di: Yuan, Yige, et al.
Pubblicazione: (2024)
Unlocking the Power of Large Language Models for Entity Alignment
di: Jiang, Xuhui, et al.
Pubblicazione: (2024)
di: Jiang, Xuhui, et al.
Pubblicazione: (2024)
Projecting Out the Malice: A Global Subspace Approach to LLM Detoxification
di: Duan, Zenghao, et al.
Pubblicazione: (2026)
di: Duan, Zenghao, et al.
Pubblicazione: (2026)
From Outcomes to Processes: Guiding PRM Learning from ORM for Inference-Time Alignment
di: Xie, Bin, et al.
Pubblicazione: (2025)
di: Xie, Bin, et al.
Pubblicazione: (2025)
Word Alignment as Preference for Machine Translation
di: Wu, Qiyu, et al.
Pubblicazione: (2024)
di: Wu, Qiyu, et al.
Pubblicazione: (2024)
Related Knowledge Perturbation Matters: Rethinking Multiple Pieces of Knowledge Editing in Same-Subject
di: Duan, Zenghao, et al.
Pubblicazione: (2025)
di: Duan, Zenghao, et al.
Pubblicazione: (2025)
Documenti analoghi
-
LLM Latent Reasoning as Chain of Superposition
di: Deng, Jingcheng, et al.
Pubblicazione: (2025) -
MLaKE: Multilingual Knowledge Editing Benchmark for Large Language Models
di: Wei, Zihao, et al.
Pubblicazione: (2024) -
Everything is Editable: Extend Knowledge Editing to Unstructured Data in Large Language Models
di: Deng, Jingcheng, et al.
Pubblicazione: (2024) -
Stable Knowledge Editing in Large Language Models
di: Wei, Zihao, et al.
Pubblicazione: (2024) -
The Evolution of Thought: Tracking LLM Overthinking via Reasoning Dynamics Analysis
di: Wei, Zihao, et al.
Pubblicazione: (2025)