On the Low-Rank Parametrization of Reward Models for Controlled Language Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Troshin, Sergey, Niculae, Vlad, Fokkens, Antske |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Asking a Language Model for Diverse Responses
par: Troshin, Sergey, et autres
Publié: (2025)
par: Troshin, Sergey, et autres
Publié: (2025)
Control the Temperature: Selective Sampling for Diverse and High-Quality LLM Outputs
par: Troshin, Sergey, et autres
Publié: (2025)
par: Troshin, Sergey, et autres
Publié: (2025)
Angular Dispersion Accelerates $k$-Nearest Neighbors Machine Translation
par: Tokarchuk, Evgeniia, et autres
Publié: (2025)
par: Tokarchuk, Evgeniia, et autres
Publié: (2025)
Representation Collapse in Machine Translation Through the Lens of Angular Dispersion
par: Tokarchuk, Evgeniia, et autres
Publié: (2026)
par: Tokarchuk, Evgeniia, et autres
Publié: (2026)
DefVerify: Do Hate Speech Models Reflect Their Dataset's Definition?
par: Khurana, Urja, et autres
Publié: (2024)
par: Khurana, Urja, et autres
Publié: (2024)
Investigating the Robustness of Modelling Decisions for Few-Shot Cross-Topic Stance Detection: A Preregistered Study
par: Reuver, Myrthe, et autres
Publié: (2024)
par: Reuver, Myrthe, et autres
Publié: (2024)
Balancing the Scales: Reinforcement Learning for Fair Classification
par: Eshuijs, Leon, et autres
Publié: (2024)
par: Eshuijs, Leon, et autres
Publié: (2024)
The Role of Syntactic Span Preferences in Post-Hoc Explanation Disagreement
par: Kamp, Jonathan, et autres
Publié: (2024)
par: Kamp, Jonathan, et autres
Publié: (2024)
Learning from Sufficient Rationales: Analysing the Relationship Between Explanation Faithfulness and Token-level Regularisation Strategies
par: Kamp, Jonathan, et autres
Publié: (2025)
par: Kamp, Jonathan, et autres
Publié: (2025)
Improving Causal Interventions in Amnesic Probing with Mean Projection or LEACE
par: Dobrzeniecka, Alicja, et autres
Publié: (2025)
par: Dobrzeniecka, Alicja, et autres
Publié: (2025)
Short-circuiting Shortcuts: Mechanistic Investigation of Shortcuts in Text Classification
par: Eshuijs, Leon, et autres
Publié: (2025)
par: Eshuijs, Leon, et autres
Publié: (2025)
Crowd-Calibrator: Can Annotator Disagreement Inform Calibration in Subjective Tasks?
par: Khurana, Urja, et autres
Publié: (2024)
par: Khurana, Urja, et autres
Publié: (2024)
Context-Aware or Context-Insensitive? Assessing LLMs' Performance in Document-Level Translation
par: Mohammed, Wafaa, et autres
Publié: (2024)
par: Mohammed, Wafaa, et autres
Publié: (2024)
On Measuring Context Utilization in Document-Level MT Systems
par: Mohammed, Wafaa, et autres
Publié: (2024)
par: Mohammed, Wafaa, et autres
Publié: (2024)
The Unreasonable Effectiveness of Random Target Embeddings for Continuous-Output Neural Machine Translation
par: Tokarchuk, Evgeniia, et autres
Publié: (2023)
par: Tokarchuk, Evgeniia, et autres
Publié: (2023)
Your Multimodal Speech Model Says I Have a Face for Radio
par: Nachesa, Maya K., et autres
Publié: (2026)
par: Nachesa, Maya K., et autres
Publié: (2026)
Unlocking Latent Discourse Translation in LLMs Through Quality-Aware Decoding
par: Mohammed, Wafaa, et autres
Publié: (2025)
par: Mohammed, Wafaa, et autres
Publié: (2025)
kNN For Whisper And Its Effect On Bias And Speaker Adaptation
par: Nachesa, Maya K., et autres
Publié: (2024)
par: Nachesa, Maya K., et autres
Publié: (2024)
Not All Subjectivity Is the Same! Defining Desiderata for the Evaluation of Subjectivity in NLP
par: Khurana, Urja, et autres
Publié: (2026)
par: Khurana, Urja, et autres
Publié: (2026)
Safety Training Modulates Harmful Misalignment Under On-Policy RL, But Direction Depends on Environment Design
par: Eshuijs, Leon, et autres
Publié: (2026)
par: Eshuijs, Leon, et autres
Publié: (2026)
A Retrieval-Based Approach to Medical Procedure Matching in Romanian
par: Niculae, Andrei, et autres
Publié: (2025)
par: Niculae, Andrei, et autres
Publié: (2025)
AdaSplash-2: Faster Differentiable Sparse Attention
par: Gonçalves, Nuno, et autres
Publié: (2026)
par: Gonçalves, Nuno, et autres
Publié: (2026)
LoRe: Personalizing LLMs via Low-Rank Reward Modeling
par: Bose, Avinandan, et autres
Publié: (2025)
par: Bose, Avinandan, et autres
Publié: (2025)
SR-GRPO: Stable Rank as an Intrinsic Geometric Reward for Large Language Model Alignment
par: Tang, Yixuan, et autres
Publié: (2025)
par: Tang, Yixuan, et autres
Publié: (2025)
MatryoshkaLoRA: Learning Accurate Hierarchical Low-Rank Representations for LLM Fine-Tuning
par: Modoranu, Ionut-Vlad, et autres
Publié: (2026)
par: Modoranu, Ionut-Vlad, et autres
Publié: (2026)
Reward-Augmented Decoding: Efficient Controlled Text Generation With a Unidirectional Reward Model
par: Deng, Haikang, et autres
Publié: (2023)
par: Deng, Haikang, et autres
Publié: (2023)
Controlled Low-Rank Adaptation with Subspace Regularization for Continued Training on Large Language Models
par: Lu, Yuheng, et autres
Publié: (2024)
par: Lu, Yuheng, et autres
Publié: (2024)
Process Reward Model with Q-Value Rankings
par: Li, Wendi, et autres
Publié: (2024)
par: Li, Wendi, et autres
Publié: (2024)
OLoRA: Orthonormal Low-Rank Adaptation of Large Language Models
par: Büyükakyüz, Kerim
Publié: (2024)
par: Büyükakyüz, Kerim
Publié: (2024)
Derivative-Free Optimization for Low-Rank Adaptation in Large Language Models
par: Jin, Feihu, et autres
Publié: (2024)
par: Jin, Feihu, et autres
Publié: (2024)
Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples
par: Ghosal, Soumya Suvra, et autres
Publié: (2025)
par: Ghosal, Soumya Suvra, et autres
Publié: (2025)
Dr.Copilot: A Multi-Agent Prompt Optimized Assistant for Improving Patient-Doctor Communication in Romanian
par: Niculae, Andrei, et autres
Publié: (2025)
par: Niculae, Andrei, et autres
Publié: (2025)
RankAlign: A Ranking View of the Generator-Validator Gap in Large Language Models
par: Rodriguez, Juan Diego, et autres
Publié: (2025)
par: Rodriguez, Juan Diego, et autres
Publié: (2025)
Investigating Low-Rank Training in Transformer Language Models: Efficiency and Scaling Analysis
par: Wei, Xiuying, et autres
Publié: (2024)
par: Wei, Xiuying, et autres
Publié: (2024)
DiffLoRA: Differential Low-Rank Adapters for Large Language Models
par: Misrahi, Alexandre, et autres
Publié: (2025)
par: Misrahi, Alexandre, et autres
Publié: (2025)
Gated Integration of Low-Rank Adaptation for Continual Learning of Large Language Models
par: Liang, Yan-Shuo, et autres
Publié: (2025)
par: Liang, Yan-Shuo, et autres
Publié: (2025)
NLoRA: Nyström-Initiated Low-Rank Adaptation for Large Language Models
par: Guo, Chenlu, et autres
Publié: (2025)
par: Guo, Chenlu, et autres
Publié: (2025)
Generating Tables from the Parametric Knowledge of Language Models
par: Berkovitch, Yevgeni, et autres
Publié: (2024)
par: Berkovitch, Yevgeni, et autres
Publié: (2024)
Flexora: Flexible Low Rank Adaptation for Large Language Models
par: Wei, Chenxing, et autres
Publié: (2024)
par: Wei, Chenxing, et autres
Publié: (2024)
VL-RewardBench: A Challenging Benchmark for Vision-Language Generative Reward Models
par: Li, Lei, et autres
Publié: (2024)
par: Li, Lei, et autres
Publié: (2024)
Documents similaires
-
Asking a Language Model for Diverse Responses
par: Troshin, Sergey, et autres
Publié: (2025) -
Control the Temperature: Selective Sampling for Diverse and High-Quality LLM Outputs
par: Troshin, Sergey, et autres
Publié: (2025) -
Angular Dispersion Accelerates $k$-Nearest Neighbors Machine Translation
par: Tokarchuk, Evgeniia, et autres
Publié: (2025) -
Representation Collapse in Machine Translation Through the Lens of Angular Dispersion
par: Tokarchuk, Evgeniia, et autres
Publié: (2026) -
DefVerify: Do Hate Speech Models Reflect Their Dataset's Definition?
par: Khurana, Urja, et autres
Publié: (2024)