Learning to Align, Aligning to Learn: A Unified Approach for Self-Optimized Alignment
Fuente:
arXiv
Saved in:
| Main Authors: | Wang, Haowen, Yue, Yun, Ye, Zhiling, Zhang, Shuowen, Fan, Lei, Liang, Jiaxin, Jiang, Jiadi, Wei, Cheng, Deng, Jingyuan, Han, Xudong, Li, Ji, Guo, Chunxiao, Wei, Peng, Wang, Jian, Gu, Jinjie |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Self-Rewarding Rubric-Based Reinforcement Learning for Open-Ended Reasoning
by: Ye, Zhiling, et al.
Published: (2025)
by: Ye, Zhiling, et al.
Published: (2025)
ClinAlign: Scaling Healthcare Alignment from Clinician Preference
by: Lyu, Shiwei, et al.
Published: (2026)
by: Lyu, Shiwei, et al.
Published: (2026)
RuleAlign: Making Large Language Models Better Physicians with Diagnostic Rule Alignment
by: Wang, Xiaohan, et al.
Published: (2024)
by: Wang, Xiaohan, et al.
Published: (2024)
OrchMoE: Efficient Multi-Adapter Learning with Task-Skill Synergy
by: Wang, Haowen, et al.
Published: (2024)
by: Wang, Haowen, et al.
Published: (2024)
EDiT: A Local-SGD-Based Efficient Distributed Training Method for Large Language Models
by: Cheng, Jialiang, et al.
Published: (2024)
by: Cheng, Jialiang, et al.
Published: (2024)
AGD: an Auto-switchable Optimizer using Stepwise Gradient Difference for Preconditioning Matrix
by: Yue, Yun, et al.
Published: (2023)
by: Yue, Yun, et al.
Published: (2023)
FactAlign: Long-form Factuality Alignment of Large Language Models
by: Huang, Chao-Wei, et al.
Published: (2024)
by: Huang, Chao-Wei, et al.
Published: (2024)
SelfCodeAlign: Self-Alignment for Code Generation
by: Wei, Yuxiang, et al.
Published: (2024)
by: Wei, Yuxiang, et al.
Published: (2024)
Sharpness-Aware Minimization Revisited: Weighted Sharpness as a Regularization Term
by: Yue, Yun, et al.
Published: (2023)
by: Yue, Yun, et al.
Published: (2023)
AlignedGen: Aligning Style Across Generated Images
by: Zhang, Jiexuan, et al.
Published: (2025)
by: Zhang, Jiexuan, et al.
Published: (2025)
Aligning by Misaligning: Boundary-aware Curriculum Learning for Multimodal Alignment
by: Ye, Hua, et al.
Published: (2025)
by: Ye, Hua, et al.
Published: (2025)
RefAlign: Representation Alignment for Reference-to-Video Generation
by: Wang, Lei, et al.
Published: (2026)
by: Wang, Lei, et al.
Published: (2026)
OmniAlpha: Aligning Transparency-Aware Generation via Multi-Task Unified Reinforcement Learning
by: Yu, Hao, et al.
Published: (2025)
by: Yu, Hao, et al.
Published: (2025)
Align to the Pivot: Dual Alignment with Self-Feedback for Multilingual Math Reasoning
by: Zhao, Chunxu, et al.
Published: (2026)
by: Zhao, Chunxu, et al.
Published: (2026)
ReflectDrive-2: Reinforcement-Learning-Aligned Self-Editing for Discrete Diffusion Driving
by: Wang, Huimin, et al.
Published: (2026)
by: Wang, Huimin, et al.
Published: (2026)
DecAlign: Hierarchical Cross-Modal Alignment for Decoupled Multimodal Representation Learning
by: Qian, Chengxuan, et al.
Published: (2025)
by: Qian, Chengxuan, et al.
Published: (2025)
AlignBench: Benchmarking Chinese Alignment of Large Language Models
by: Liu, Xiao, et al.
Published: (2023)
by: Liu, Xiao, et al.
Published: (2023)
CALM: Unleashing the Cross-Lingual Self-Aligning Ability of Language Model Question Answering
by: Wang, Yumeng, et al.
Published: (2025)
by: Wang, Yumeng, et al.
Published: (2025)
Align$^3$GR: Unified Multi-Level Alignment for LLM-based Generative Recommendation
by: Ye, Wencai, et al.
Published: (2025)
by: Ye, Wencai, et al.
Published: (2025)
Electricity‐Driven Strategies for Bioinspired Multifunctional Swimming Marangoni Robots Based on Super‐Aligned Carbon Nanotube Composites
by: Hai Lin, et al.
Published: (2024)
by: Hai Lin, et al.
Published: (2024)
AlignIQL: Policy Alignment in Implicit Q-Learning through Constrained Optimization
by: He, Longxiang, et al.
Published: (2024)
by: He, Longxiang, et al.
Published: (2024)
AlphaAlign: Incentivizing Safety Alignment with Extremely Simplified Reinforcement Learning
by: Zhang, Yi, et al.
Published: (2025)
by: Zhang, Yi, et al.
Published: (2025)
Towards Transformer-Based Aligned Generation with Self-Coherence Guidance
by: Wang, Shulei, et al.
Published: (2025)
by: Wang, Shulei, et al.
Published: (2025)
TagAlign: Improving Vision-Language Alignment with Multi-Tag Classification
by: Liu, Qinying, et al.
Published: (2023)
by: Liu, Qinying, et al.
Published: (2023)
Self‐Reinforcing Carbon Nanotube Framework with Aligned Network Structure for Flexible and Compact Energy Storage
by: Mingyu Ye, et al.
Published: (2025)
by: Mingyu Ye, et al.
Published: (2025)
Learning to Edit: Aligning LLMs with Knowledge Editing
by: Jiang, Yuxin, et al.
Published: (2024)
by: Jiang, Yuxin, et al.
Published: (2024)
TinyAlign: Boosting Lightweight Vision-Language Models by Mitigating Modal Alignment Bottlenecks
by: Hu, Yuanze, et al.
Published: (2025)
by: Hu, Yuanze, et al.
Published: (2025)
CombAlign: Enhancing Model Expressiveness in Unsupervised Graph Alignment
by: Chen, Songyang, et al.
Published: (2024)
by: Chen, Songyang, et al.
Published: (2024)
UrbanAlign: Post-hoc Semantic Calibration for VLM-Human Preference Alignment
by: Zhang, Yecheng, et al.
Published: (2026)
by: Zhang, Yecheng, et al.
Published: (2026)
IterAlign: Iterative Constitutional Alignment of Large Language Models
by: Chen, Xiusi, et al.
Published: (2024)
by: Chen, Xiusi, et al.
Published: (2024)
MedResearcher-R1: Expert-Level Medical Deep Researcher via A Knowledge-Informed Trajectory Synthesis Framework
by: Yu, Ailing, et al.
Published: (2025)
by: Yu, Ailing, et al.
Published: (2025)
UniTriGen: Unified Triplet Generation of Aligned Visible-Infrared-Label for Few-Shot RGB-T Semantic Segmentation
by: Zhou, Ping, et al.
Published: (2026)
by: Zhou, Ping, et al.
Published: (2026)
Structurally Aligned Subtask-Level Memory for Software Engineering Agents
by: Shen, Kangning, et al.
Published: (2026)
by: Shen, Kangning, et al.
Published: (2026)
SQL-Commenter: Aligning Large Language Models for SQL Comment Generation with Direct Preference Optimization
by: Yu, Lei, et al.
Published: (2026)
by: Yu, Lei, et al.
Published: (2026)
SHARP: Synthesizing High-quality Aligned Reasoning Problems for Large Reasoning Models Reinforcement Learning
by: Wu, Xiong Jun, et al.
Published: (2025)
by: Wu, Xiong Jun, et al.
Published: (2025)
AlignFreeNet: Is Cross-Modal Pre-Alignment Necessary? An End-to-End Alignment-Free Lightweight Network for Visible-Infrared Object Detection
by: Zhu, Dingkun, et al.
Published: (2025)
by: Zhu, Dingkun, et al.
Published: (2025)
QAEncoder: Towards Aligned Representation Learning in Question Answering Systems
by: Wang, Zhengren, et al.
Published: (2024)
by: Wang, Zhengren, et al.
Published: (2024)
ReAlign: Optimizing the Visual Document Retriever with Reasoning-Guided Fine-Grained Alignment
by: Yang, Hao, et al.
Published: (2026)
by: Yang, Hao, et al.
Published: (2026)
Towards Improved Text-Aligned Codebook Learning: Multi-Hierarchical Codebook-Text Alignment with Long Text
by: Liang, Guotao, et al.
Published: (2025)
by: Liang, Guotao, et al.
Published: (2025)
To Align or Not to Align: Strategic Multimodal Representation Alignment for Optimal Performance
by: Fang, Wanlong, et al.
Published: (2025)
by: Fang, Wanlong, et al.
Published: (2025)
Similar Items
-
Self-Rewarding Rubric-Based Reinforcement Learning for Open-Ended Reasoning
by: Ye, Zhiling, et al.
Published: (2025) -
ClinAlign: Scaling Healthcare Alignment from Clinician Preference
by: Lyu, Shiwei, et al.
Published: (2026) -
RuleAlign: Making Large Language Models Better Physicians with Diagnostic Rule Alignment
by: Wang, Xiaohan, et al.
Published: (2024) -
OrchMoE: Efficient Multi-Adapter Learning with Task-Skill Synergy
by: Wang, Haowen, et al.
Published: (2024) -
EDiT: A Local-SGD-Based Efficient Distributed Training Method for Large Language Models
by: Cheng, Jialiang, et al.
Published: (2024)