SR-GRPO: Stable Rank as an Intrinsic Geometric Reward for Large Language Model Alignment
Fuente:
arXiv
Salvato in:
| Autori principali: | Tang, Yixuan, Yang, Yi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Multi-Reward GRPO Fine-Tuning for De-biasing Large Language Models: A Study Based on Chinese-Context Discrimination Data
di: Yixuan, Deng, et al.
Pubblicazione: (2025)
di: Yixuan, Deng, et al.
Pubblicazione: (2025)
Mind the Shift: Decoding Monetary Policy Stance from FOMC Statements with Large Language Models
di: Tang, Yixuan, et al.
Pubblicazione: (2026)
di: Tang, Yixuan, et al.
Pubblicazione: (2026)
Personality Alignment of Large Language Models
di: Zhu, Minjun, et al.
Pubblicazione: (2024)
di: Zhu, Minjun, et al.
Pubblicazione: (2024)
GAPrune: Gradient-Alignment Pruning for Domain-Aware Embeddings
di: Tang, Yixuan, et al.
Pubblicazione: (2025)
di: Tang, Yixuan, et al.
Pubblicazione: (2025)
Process Reward Model with Q-Value Rankings
di: Li, Wendi, et al.
Pubblicazione: (2024)
di: Li, Wendi, et al.
Pubblicazione: (2024)
LaF-GRPO: In-Situ Navigation Instruction Generation for the Visually Impaired via GRPO with LLM-as-Follower Reward
di: Zhao, Yi, et al.
Pubblicazione: (2025)
di: Zhao, Yi, et al.
Pubblicazione: (2025)
S-GRPO: Unified Post-Training for Large Vision-Language Models
di: Yan, Yuming, et al.
Pubblicazione: (2026)
di: Yan, Yuming, et al.
Pubblicazione: (2026)
GTPO and GRPO-S: Token and Sequence-Level Reward Shaping with Policy Entropy
di: Tan, Hongze, et al.
Pubblicazione: (2025)
di: Tan, Hongze, et al.
Pubblicazione: (2025)
On the Robustness of Reward Models for Language Model Alignment
di: Hong, Jiwoo, et al.
Pubblicazione: (2025)
di: Hong, Jiwoo, et al.
Pubblicazione: (2025)
ARGS: Alignment as Reward-Guided Search
di: Khanov, Maxim, et al.
Pubblicazione: (2024)
di: Khanov, Maxim, et al.
Pubblicazione: (2024)
SR-LLM: Rethinking the Structured Representation in Large Language Model
di: Zhang, Jiahuan, et al.
Pubblicazione: (2025)
di: Zhang, Jiahuan, et al.
Pubblicazione: (2025)
Pooling And Attention: What Are Effective Designs For LLM-Based Embedding Models?
di: Tang, Yixuan, et al.
Pubblicazione: (2024)
di: Tang, Yixuan, et al.
Pubblicazione: (2024)
Do We Need Domain-Specific Embedding Models? An Empirical Investigation
di: Tang, Yixuan, et al.
Pubblicazione: (2024)
di: Tang, Yixuan, et al.
Pubblicazione: (2024)
Shaping Explanations: Semantic Reward Modeling with Encoder-Only Transformers for GRPO
di: Pappone, Francesco, et al.
Pubblicazione: (2025)
di: Pappone, Francesco, et al.
Pubblicazione: (2025)
AlphaMaze: Enhancing Large Language Models' Spatial Intelligence via GRPO
di: Dao, Alan, et al.
Pubblicazione: (2025)
di: Dao, Alan, et al.
Pubblicazione: (2025)
CoSToM:Causal-oriented Steering for Intrinsic Theory-of-Mind Alignment in Large Language Models
di: Li, Mengfan, et al.
Pubblicazione: (2026)
di: Li, Mengfan, et al.
Pubblicazione: (2026)
Generalist Reward Models: Found Inside Large Language Models
di: Li, Yi-Chen, et al.
Pubblicazione: (2025)
di: Li, Yi-Chen, et al.
Pubblicazione: (2025)
PERM: Psychology-grounded Empathetic Reward Modeling for Large Language Models
di: Wang, Chengbing, et al.
Pubblicazione: (2026)
di: Wang, Chengbing, et al.
Pubblicazione: (2026)
Confidence Matters: Revisiting Intrinsic Self-Correction Capabilities of Large Language Models
di: Li, Loka, et al.
Pubblicazione: (2024)
di: Li, Loka, et al.
Pubblicazione: (2024)
LLM4SR: A Survey on Large Language Models for Scientific Research
di: Luo, Ziming, et al.
Pubblicazione: (2025)
di: Luo, Ziming, et al.
Pubblicazione: (2025)
MultiHop-RAG: Benchmarking Retrieval-Augmented Generation for Multi-Hop Queries
di: Tang, Yixuan, et al.
Pubblicazione: (2024)
di: Tang, Yixuan, et al.
Pubblicazione: (2024)
Crowded in B-Space: Calibrating Shared Directions for LoRA Merging
di: Tang, Yixuan, et al.
Pubblicazione: (2026)
di: Tang, Yixuan, et al.
Pubblicazione: (2026)
KV-Embedding: Training-free Text Embedding via Internal KV Re-routing in Decoder-only LLMs
di: Tang, Yixuan, et al.
Pubblicazione: (2026)
di: Tang, Yixuan, et al.
Pubblicazione: (2026)
AI Research Agents Narrow Scientific Exploration
di: Tang, Yixuan, et al.
Pubblicazione: (2026)
di: Tang, Yixuan, et al.
Pubblicazione: (2026)
On the Low-Rank Parametrization of Reward Models for Controlled Language Generation
di: Troshin, Sergey, et al.
Pubblicazione: (2024)
di: Troshin, Sergey, et al.
Pubblicazione: (2024)
Reviving The Classics: Active Reward Modeling in Large Language Model Alignment
di: Shen, Yunyi, et al.
Pubblicazione: (2025)
di: Shen, Yunyi, et al.
Pubblicazione: (2025)
Improving Generalization in Intent Detection: GRPO with Reward-Based Curriculum Sampling
di: Feng, Zihao, et al.
Pubblicazione: (2025)
di: Feng, Zihao, et al.
Pubblicazione: (2025)
Tournament-GRPO: Group-Wise Tournament Rewards for Reinforcement Learning in Open-Ended Long-Form Generation
di: Yang, Zixuan, et al.
Pubblicazione: (2026)
di: Yang, Zixuan, et al.
Pubblicazione: (2026)
Efficient Safety Alignment of Large Language Models via Preference Re-ranking and Representation-based Reward Modeling
di: Deng, Qiyuan, et al.
Pubblicazione: (2025)
di: Deng, Qiyuan, et al.
Pubblicazione: (2025)
Online Intrinsic Rewards for Decision Making Agents from Large Language Model Feedback
di: Zheng, Qinqing, et al.
Pubblicazione: (2024)
di: Zheng, Qinqing, et al.
Pubblicazione: (2024)
Fast-Slow Thinking GRPO for Large Vision-Language Model Reasoning
di: Xiao, Wenyi, et al.
Pubblicazione: (2025)
di: Xiao, Wenyi, et al.
Pubblicazione: (2025)
MMR-GRPO: Accelerating GRPO-Style Training through Diversity-Aware Reward Reweighting
di: Wei, Kangda, et al.
Pubblicazione: (2026)
di: Wei, Kangda, et al.
Pubblicazione: (2026)
Noise Contrastive Alignment of Language Models with Explicit Rewards
di: Chen, Huayu, et al.
Pubblicazione: (2024)
di: Chen, Huayu, et al.
Pubblicazione: (2024)
FinMTEB: Finance Massive Text Embedding Benchmark
di: Tang, Yixuan, et al.
Pubblicazione: (2025)
di: Tang, Yixuan, et al.
Pubblicazione: (2025)
Gradient-Based LoRA Rank Allocation Under GRPO: An Empirical Study
di: Sawant, Yash Ganpat
Pubblicazione: (2026)
di: Sawant, Yash Ganpat
Pubblicazione: (2026)
Energy-Based Reward Models for Robust Language Model Alignment
di: Lochab, Anamika, et al.
Pubblicazione: (2025)
di: Lochab, Anamika, et al.
Pubblicazione: (2025)
Revealing the Intrinsic Ethical Vulnerability of Aligned Large Language Models
di: Lian, Jiawei, et al.
Pubblicazione: (2025)
di: Lian, Jiawei, et al.
Pubblicazione: (2025)
RAIDEN-R1: Improving Role-awareness of LLMs via GRPO with Verifiable Reward
di: Wang, Zongsheng, et al.
Pubblicazione: (2025)
di: Wang, Zongsheng, et al.
Pubblicazione: (2025)
Bridging the Semantic Gap: Contrastive Rewards for Multilingual Text-to-SQL with GRPO
di: Kattamuri, Ashish, et al.
Pubblicazione: (2025)
di: Kattamuri, Ashish, et al.
Pubblicazione: (2025)
R1-Reward: Training Multimodal Reward Model Through Stable Reinforcement Learning
di: Zhang, Yi-Fan, et al.
Pubblicazione: (2025)
di: Zhang, Yi-Fan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Multi-Reward GRPO Fine-Tuning for De-biasing Large Language Models: A Study Based on Chinese-Context Discrimination Data
di: Yixuan, Deng, et al.
Pubblicazione: (2025) -
Mind the Shift: Decoding Monetary Policy Stance from FOMC Statements with Large Language Models
di: Tang, Yixuan, et al.
Pubblicazione: (2026) -
Personality Alignment of Large Language Models
di: Zhu, Minjun, et al.
Pubblicazione: (2024) -
GAPrune: Gradient-Alignment Pruning for Domain-Aware Embeddings
di: Tang, Yixuan, et al.
Pubblicazione: (2025) -
Process Reward Model with Q-Value Rankings
di: Li, Wendi, et al.
Pubblicazione: (2024)