Reuse Your Rewards: Reward Model Transfer for Zero-Shot Cross-Lingual Alignment
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Wu, Zhaofeng, Balashankar, Ananth, Kim, Yoon, Eisenstein, Jacob, Beirami, Ahmad |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Robust Preference Optimization through Reward Model Distillation
von: Fisch, Adam, et al.
Veröffentlicht: (2024)
von: Fisch, Adam, et al.
Veröffentlicht: (2024)
Implicit Cross-Lingual Rewarding for Efficient Multilingual Preference Alignment
von: Yang, Wen, et al.
Veröffentlicht: (2025)
von: Yang, Wen, et al.
Veröffentlicht: (2025)
Parallel-SFT: Improving Zero-Shot Cross-Programming-Language Transfer for Code RL
von: Wu, Zhaofeng, et al.
Veröffentlicht: (2026)
von: Wu, Zhaofeng, et al.
Veröffentlicht: (2026)
Generalization Measures for Zero-Shot Cross-Lingual Transfer
von: Bassi, Saksham, et al.
Veröffentlicht: (2024)
von: Bassi, Saksham, et al.
Veröffentlicht: (2024)
reWordBench: Benchmarking and Improving the Robustness of Reward Models with Transformed Inputs
von: Wu, Zhaofeng, et al.
Veröffentlicht: (2025)
von: Wu, Zhaofeng, et al.
Veröffentlicht: (2025)
Model-Based Ranking of Source Languages for Zero-Shot Cross-Lingual Transfer
von: Ebrahimi, Abteen, et al.
Veröffentlicht: (2025)
von: Ebrahimi, Abteen, et al.
Veröffentlicht: (2025)
Cross-lingual Transfer of Reward Models in Multilingual Alignment
von: Hong, Jiwoo, et al.
Veröffentlicht: (2024)
von: Hong, Jiwoo, et al.
Veröffentlicht: (2024)
Best-of-L: Cross-Lingual Reward Modeling for Mathematical Reasoning
von: Rajaee, Sara, et al.
Veröffentlicht: (2025)
von: Rajaee, Sara, et al.
Veröffentlicht: (2025)
Layer Swapping for Zero-Shot Cross-Lingual Transfer in Large Language Models
von: Bandarkar, Lucas, et al.
Veröffentlicht: (2024)
von: Bandarkar, Lucas, et al.
Veröffentlicht: (2024)
InfAlign: Inference-aware language model alignment
von: Balashankar, Ananth, et al.
Veröffentlicht: (2024)
von: Balashankar, Ananth, et al.
Veröffentlicht: (2024)
Cascade Reward Sampling for Efficient Decoding-Time Alignment
von: Li, Bolian, et al.
Veröffentlicht: (2024)
von: Li, Bolian, et al.
Veröffentlicht: (2024)
BEFT: Bias-Efficient Fine-Tuning of Language Models in Low-Data Regimes
von: Huang, Baichuan, et al.
Veröffentlicht: (2025)
von: Huang, Baichuan, et al.
Veröffentlicht: (2025)
Improving Zero-Shot Cross-Lingual Transfer via Progressive Code-Switching
von: Li, Zhuoran, et al.
Veröffentlicht: (2024)
von: Li, Zhuoran, et al.
Veröffentlicht: (2024)
Why Better Cross-Lingual Alignment Fails for Better Cross-Lingual Transfer: Case of Encoders
von: Veitsman, Yana, et al.
Veröffentlicht: (2026)
von: Veitsman, Yana, et al.
Veröffentlicht: (2026)
Zero-Shot Cross-Lingual Transfer using Prefix-Based Adaptation
von: A, Snegha, et al.
Veröffentlicht: (2025)
von: A, Snegha, et al.
Veröffentlicht: (2025)
Zero-Shot Detection of LLM-Generated Text via Implicit Reward Model
von: Liu, Runheng, et al.
Veröffentlicht: (2026)
von: Liu, Runheng, et al.
Veröffentlicht: (2026)
On the Applicability of Zero-Shot Cross-Lingual Transfer Learning for Sentiment Classification in Distant Language Pairs
von: Rusli, Andre, et al.
Veröffentlicht: (2024)
von: Rusli, Andre, et al.
Veröffentlicht: (2024)
Inducing Group Fairness in Prompt-Based Language Model Decisions
von: Atwood, James, et al.
Veröffentlicht: (2024)
von: Atwood, James, et al.
Veröffentlicht: (2024)
mOthello: When Do Cross-Lingual Representation Alignment and Cross-Lingual Transfer Emerge in Multilingual Models?
von: Hua, Tianze, et al.
Veröffentlicht: (2024)
von: Hua, Tianze, et al.
Veröffentlicht: (2024)
Deep Exploration of Cross-Lingual Zero-Shot Generalization in Instruction Tuning
von: Han, Janghoon, et al.
Veröffentlicht: (2024)
von: Han, Janghoon, et al.
Veröffentlicht: (2024)
Reusing Embeddings: Reproducible Reward Model Research in Large Language Model Alignment without GPUs
von: Sun, Hao, et al.
Veröffentlicht: (2025)
von: Sun, Hao, et al.
Veröffentlicht: (2025)
Cross-Lingual IPA Contrastive Learning for Zero-Shot NER
von: Sohn, Jimin, et al.
Veröffentlicht: (2025)
von: Sohn, Jimin, et al.
Veröffentlicht: (2025)
Marvelous Agglutinative Language Effect on Cross Lingual Transfer Learning
von: Kim, Wooyoung, et al.
Veröffentlicht: (2022)
von: Kim, Wooyoung, et al.
Veröffentlicht: (2022)
DeFTX: Denoised Sparse Fine-Tuning for Zero-Shot Cross-Lingual Transfer
von: Simon, Sona Elza, et al.
Veröffentlicht: (2025)
von: Simon, Sona Elza, et al.
Veröffentlicht: (2025)
SumTra: A Differentiable Pipeline for Few-Shot Cross-Lingual Summarization
von: Parnell, Jacob, et al.
Veröffentlicht: (2024)
von: Parnell, Jacob, et al.
Veröffentlicht: (2024)
RewardBench 2: Advancing Reward Model Evaluation
von: Malik, Saumya, et al.
Veröffentlicht: (2025)
von: Malik, Saumya, et al.
Veröffentlicht: (2025)
Zero-Shot Cross-Lingual Document-Level Event Causality Identification with Heterogeneous Graph Contrastive Transfer Learning
von: He, Zhitao, et al.
Veröffentlicht: (2024)
von: He, Zhitao, et al.
Veröffentlicht: (2024)
Zero-Shot Morphological Discovery in Low-Resource Bantu Languages via Cross-Lingual Transfer and Unsupervised Clustering
von: Mutisya, Hillary, et al.
Veröffentlicht: (2026)
von: Mutisya, Hillary, et al.
Veröffentlicht: (2026)
Transforming and Combining Rewards for Aligning Large Language Models
von: Wang, Zihao, et al.
Veröffentlicht: (2024)
von: Wang, Zihao, et al.
Veröffentlicht: (2024)
GenARM: Reward Guided Generation with Autoregressive Reward Model for Test-time Alignment
von: Xu, Yuancheng, et al.
Veröffentlicht: (2024)
von: Xu, Yuancheng, et al.
Veröffentlicht: (2024)
PreAlign: Boosting Cross-Lingual Transfer by Early Establishment of Multilingual Alignment
von: Li, Jiahuan, et al.
Veröffentlicht: (2024)
von: Li, Jiahuan, et al.
Veröffentlicht: (2024)
RadZero: Similarity-Based Cross-Attention for Explainable Vision-Language Alignment in Chest X-ray with Zero-Shot Multi-Task Capability
von: Park, Jonggwon, et al.
Veröffentlicht: (2025)
von: Park, Jonggwon, et al.
Veröffentlicht: (2025)
On the Robustness of Reward Models for Language Model Alignment
von: Hong, Jiwoo, et al.
Veröffentlicht: (2025)
von: Hong, Jiwoo, et al.
Veröffentlicht: (2025)
Rethinking the Role of Proxy Rewards in Language Model Alignment
von: Kim, Sungdong, et al.
Veröffentlicht: (2024)
von: Kim, Sungdong, et al.
Veröffentlicht: (2024)
Analysis of Multi-Source Language Training in Cross-Lingual Transfer
von: Lim, Seong Hoon, et al.
Veröffentlicht: (2024)
von: Lim, Seong Hoon, et al.
Veröffentlicht: (2024)
Comparative Study of Zero-Shot Cross-Lingual Transfer for Bodo POS and NER Tagging Using Gemini 2.0 Flash Thinking Experimental Model
von: Narzary, Sanjib, et al.
Veröffentlicht: (2025)
von: Narzary, Sanjib, et al.
Veröffentlicht: (2025)
Don't Forget Your Reward Values: Language Model Alignment via Value-based Calibration
von: Mao, Xin, et al.
Veröffentlicht: (2024)
von: Mao, Xin, et al.
Veröffentlicht: (2024)
Gradient-Based Language Model Red Teaming
von: Wichers, Nevan, et al.
Veröffentlicht: (2024)
von: Wichers, Nevan, et al.
Veröffentlicht: (2024)
RMB: Comprehensively Benchmarking Reward Models in LLM Alignment
von: Zhou, Enyu, et al.
Veröffentlicht: (2024)
von: Zhou, Enyu, et al.
Veröffentlicht: (2024)
XTRA: Cross-Lingual Topic Modeling with Topic and Representation Alignments
von: Nguyen, Tien Phat, et al.
Veröffentlicht: (2025)
von: Nguyen, Tien Phat, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Robust Preference Optimization through Reward Model Distillation
von: Fisch, Adam, et al.
Veröffentlicht: (2024) -
Implicit Cross-Lingual Rewarding for Efficient Multilingual Preference Alignment
von: Yang, Wen, et al.
Veröffentlicht: (2025) -
Parallel-SFT: Improving Zero-Shot Cross-Programming-Language Transfer for Code RL
von: Wu, Zhaofeng, et al.
Veröffentlicht: (2026) -
Generalization Measures for Zero-Shot Cross-Lingual Transfer
von: Bassi, Saksham, et al.
Veröffentlicht: (2024) -
reWordBench: Benchmarking and Improving the Robustness of Reward Models with Transformed Inputs
von: Wu, Zhaofeng, et al.
Veröffentlicht: (2025)