REAL: Response Embedding-based Alignment for LLMs
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Honggen, Zhao, Xufeng, Molybog, Igor, Zhang, June |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
mRNA2vec: mRNA Embedding with Language Model in the 5'UTR-CDS for mRNA Design
di: Zhang, Honggen, et al.
Pubblicazione: (2024)
di: Zhang, Honggen, et al.
Pubblicazione: (2024)
Beyond Audio and Pose: A General-Purpose Framework for Video Synchronization
di: Shin, Yosub, et al.
Pubblicazione: (2025)
di: Shin, Yosub, et al.
Pubblicazione: (2025)
Unlocking Recursive Thinking of LLMs: Alignment via Refinement
di: Zhang, Haoke, et al.
Pubblicazione: (2025)
di: Zhang, Haoke, et al.
Pubblicazione: (2025)
Fake Alignment: Are LLMs Really Aligned Well?
di: Wang, Yixu, et al.
Pubblicazione: (2023)
di: Wang, Yixu, et al.
Pubblicazione: (2023)
PAD: Personalized Alignment of LLMs at Decoding-Time
di: Chen, Ruizhe, et al.
Pubblicazione: (2024)
di: Chen, Ruizhe, et al.
Pubblicazione: (2024)
ALI-Agent: Assessing LLMs' Alignment with Human Values via Agent-based Evaluation
di: Zheng, Jingnan, et al.
Pubblicazione: (2024)
di: Zheng, Jingnan, et al.
Pubblicazione: (2024)
Knowledgeable Preference Alignment for LLMs in Domain-specific Question Answering
di: Zhang, Yichi, et al.
Pubblicazione: (2023)
di: Zhang, Yichi, et al.
Pubblicazione: (2023)
Soundwave: Less is More for Speech-Text Alignment in LLMs
di: Zhang, Yuhao, et al.
Pubblicazione: (2025)
di: Zhang, Yuhao, et al.
Pubblicazione: (2025)
Using Optimal Transport as Alignment Objective for fine-tuning Multilingual Contextualized Embeddings
di: Alqahtani, Sawsan, et al.
Pubblicazione: (2021)
di: Alqahtani, Sawsan, et al.
Pubblicazione: (2021)
Step-On-Feet Tuning: Scaling Self-Alignment of LLMs via Bootstrapping
di: Wang, Haoyu, et al.
Pubblicazione: (2024)
di: Wang, Haoyu, et al.
Pubblicazione: (2024)
Circumventing Safety Alignment in Large Language Models Through Embedding Space Toxicity Attenuation
di: Zhang, Zhibo, et al.
Pubblicazione: (2025)
di: Zhang, Zhibo, et al.
Pubblicazione: (2025)
A Systematic Evaluation of Preference Aggregation in Federated RLHF for Pluralistic Alignment of LLMs
di: Srewa, Mahmoud, et al.
Pubblicazione: (2025)
di: Srewa, Mahmoud, et al.
Pubblicazione: (2025)
m2sv: A Scalable Benchmark for Map-to-Street-View Spatial Reasoning
di: Shin, Yosub, et al.
Pubblicazione: (2026)
di: Shin, Yosub, et al.
Pubblicazione: (2026)
Empathy Level Alignment via Reinforcement Learning for Empathetic Response Generation
di: Ma, Hui, et al.
Pubblicazione: (2024)
di: Ma, Hui, et al.
Pubblicazione: (2024)
Self-Alignment for Factuality: Mitigating Hallucinations in LLMs via Self-Evaluation
di: Zhang, Xiaoying, et al.
Pubblicazione: (2024)
di: Zhang, Xiaoying, et al.
Pubblicazione: (2024)
LLMs as Zero-shot Graph Learners: Alignment of GNN Representations with LLM Token Embeddings
di: Wang, Duo, et al.
Pubblicazione: (2024)
di: Wang, Duo, et al.
Pubblicazione: (2024)
ALIGN: Prompt-based Attribute Alignment for Reliable, Responsible, and Personalized LLM-based Decision-Making
di: Ravichandran, Bharadwaj, et al.
Pubblicazione: (2025)
di: Ravichandran, Bharadwaj, et al.
Pubblicazione: (2025)
Beyond Textual Context: Structural Graph Encoding with Adaptive Space Alignment to alleviate the hallucination of LLMs
di: Zhang, Yifang, et al.
Pubblicazione: (2025)
di: Zhang, Yifang, et al.
Pubblicazione: (2025)
Do LLMs Know Tool Irrelevance? Demystifying Structural Alignment Bias in Tool Invocations
di: Liu, Yilong, et al.
Pubblicazione: (2026)
di: Liu, Yilong, et al.
Pubblicazione: (2026)
HAL: Inducing Human-likeness in LLMs with Alignment
di: Hasan, Masum, et al.
Pubblicazione: (2026)
di: Hasan, Masum, et al.
Pubblicazione: (2026)
Do LLMs Align with My Task? Evaluating Text-to-SQL via Dataset Alignment
di: Rafiei, Davood, et al.
Pubblicazione: (2025)
di: Rafiei, Davood, et al.
Pubblicazione: (2025)
Are LLMs (Really) Ideological? An IRT-based Analysis and Alignment Tool for Perceived Socio-Economic Bias in LLMs
di: Wachter, Jasmin, et al.
Pubblicazione: (2025)
di: Wachter, Jasmin, et al.
Pubblicazione: (2025)
Temporal Alignment of LLMs through Cycle Encoding for Long-Range Time Representations
di: Han, Xue, et al.
Pubblicazione: (2025)
di: Han, Xue, et al.
Pubblicazione: (2025)
How Good Are LLMs for Literary Translation, Really? Literary Translation Evaluation with Humans and LLMs
di: Zhang, Ran, et al.
Pubblicazione: (2024)
di: Zhang, Ran, et al.
Pubblicazione: (2024)
The Alignment Tax: Response Homogenization in Aligned LLMs and Its Implications for Uncertainty Estimation
di: Liu, Mingyi
Pubblicazione: (2026)
di: Liu, Mingyi
Pubblicazione: (2026)
Flames: Benchmarking Value Alignment of LLMs in Chinese
di: Huang, Kexin, et al.
Pubblicazione: (2023)
di: Huang, Kexin, et al.
Pubblicazione: (2023)
How Does Alignment Enhance LLMs' Multilingual Capabilities? A Language Neurons Perspective
di: Zhang, Shimao, et al.
Pubblicazione: (2025)
di: Zhang, Shimao, et al.
Pubblicazione: (2025)
Confident RAG: Enhancing the Performance of LLMs for Mathematics Question Answering through Multi-Embedding and Confidence Scoring
di: Chen, Shiting, et al.
Pubblicazione: (2025)
di: Chen, Shiting, et al.
Pubblicazione: (2025)
Pruning via Merging: Compressing LLMs via Manifold Alignment Based Layer Merging
di: Liu, Deyuan, et al.
Pubblicazione: (2024)
di: Liu, Deyuan, et al.
Pubblicazione: (2024)
Poser: Unmasking Alignment Faking LLMs by Manipulating Their Internals
di: Clymer, Joshua, et al.
Pubblicazione: (2024)
di: Clymer, Joshua, et al.
Pubblicazione: (2024)
Judging the Judges: Evaluating Alignment and Vulnerabilities in LLMs-as-Judges
di: Thakur, Aman Singh, et al.
Pubblicazione: (2024)
di: Thakur, Aman Singh, et al.
Pubblicazione: (2024)
Bounded Rationality for LLMs: Satisficing Alignment at Inference-Time
di: Chehade, Mohamad, et al.
Pubblicazione: (2025)
di: Chehade, Mohamad, et al.
Pubblicazione: (2025)
Enhancing Reasoning Abilities of Small LLMs with Cognitive Alignment
di: Cai, Wenrui, et al.
Pubblicazione: (2025)
di: Cai, Wenrui, et al.
Pubblicazione: (2025)
Extending the Context of Pretrained LLMs by Dropping Their Positional Embeddings
di: Gelberg, Yoav, et al.
Pubblicazione: (2025)
di: Gelberg, Yoav, et al.
Pubblicazione: (2025)
How Syntax Specialization Emerges in Language Models
di: Duan, Xufeng, et al.
Pubblicazione: (2025)
di: Duan, Xufeng, et al.
Pubblicazione: (2025)
EchoDistill:Alignment Noisy-to-Clean Self-Distillation for Robust Audio LLMs
di: Lin, Liang, et al.
Pubblicazione: (2026)
di: Lin, Liang, et al.
Pubblicazione: (2026)
Let LLMs Speak Embedding Languages: Generative Text Embeddings via Iterative Contrastive Refinement
di: Tsai, Yu-Che, et al.
Pubblicazione: (2025)
di: Tsai, Yu-Che, et al.
Pubblicazione: (2025)
PKU-SafeRLHF: Towards Multi-Level Safety Alignment for LLMs with Human Preference
di: Ji, Jiaming, et al.
Pubblicazione: (2024)
di: Ji, Jiaming, et al.
Pubblicazione: (2024)
HyKGE: A Hypothesis Knowledge Graph Enhanced Framework for Accurate and Reliable Medical LLMs Responses
di: Jiang, Xinke, et al.
Pubblicazione: (2023)
di: Jiang, Xinke, et al.
Pubblicazione: (2023)
Large Language Models for Automated Literature Review: An Evaluation of Reference Generation, Abstract Writing, and Review Composition
di: Tang, Xuemei, et al.
Pubblicazione: (2024)
di: Tang, Xuemei, et al.
Pubblicazione: (2024)
Documenti analoghi
-
mRNA2vec: mRNA Embedding with Language Model in the 5'UTR-CDS for mRNA Design
di: Zhang, Honggen, et al.
Pubblicazione: (2024) -
Beyond Audio and Pose: A General-Purpose Framework for Video Synchronization
di: Shin, Yosub, et al.
Pubblicazione: (2025) -
Unlocking Recursive Thinking of LLMs: Alignment via Refinement
di: Zhang, Haoke, et al.
Pubblicazione: (2025) -
Fake Alignment: Are LLMs Really Aligned Well?
di: Wang, Yixu, et al.
Pubblicazione: (2023) -
PAD: Personalized Alignment of LLMs at Decoding-Time
di: Chen, Ruizhe, et al.
Pubblicazione: (2024)