Stream Aligner: Efficient Sentence-Level Alignment via Distribution Induction
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lou, Hantao, Ji, Jiaming, Wang, Kaile, Yang, Yaodong |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Aligner: Efficient Alignment by Learning to Correct
par: Ji, Jiaming, et autres
Publié: (2024)
par: Ji, Jiaming, et autres
Publié: (2024)
SAE-V: Interpreting Multimodal Models for Enhanced Alignment
par: Lou, Hantao, et autres
Publié: (2025)
par: Lou, Hantao, et autres
Publié: (2025)
Language Models Resist Alignment: Evidence From Data Compression
par: Ji, Jiaming, et autres
Publié: (2024)
par: Ji, Jiaming, et autres
Publié: (2024)
NeMo-Aligner: Scalable Toolkit for Efficient Model Alignment
par: Shen, Gerald, et autres
Publié: (2024)
par: Shen, Gerald, et autres
Publié: (2024)
SentenceKV: Efficient LLM Inference via Sentence-Level Semantic KV Caching
par: Zhu, Yuxuan, et autres
Publié: (2025)
par: Zhu, Yuxuan, et autres
Publié: (2025)
Aligners: Decoupling LLMs and Alignment
par: Ngweta, Lilian, et autres
Publié: (2024)
par: Ngweta, Lilian, et autres
Publié: (2024)
Reward Generalization in RLHF: A Topological Perspective
par: Qiu, Tianyi, et autres
Publié: (2024)
par: Qiu, Tianyi, et autres
Publié: (2024)
ProgressGym: Alignment with a Millennium of Moral Progress
par: Qiu, Tianyi, et autres
Publié: (2024)
par: Qiu, Tianyi, et autres
Publié: (2024)
Aligner-Guided Training Paradigm: Advancing Text-to-Speech Models with Aligner Guided Duration
par: Lou, Haowei, et autres
Publié: (2024)
par: Lou, Haowei, et autres
Publié: (2024)
Align Once, Benefit Multilingually: Enforcing Multilingual Consistency for LLM Safety Alignment
par: Bu, Yuyan, et autres
Publié: (2026)
par: Bu, Yuyan, et autres
Publié: (2026)
Persona-Coded Poly-Encoder: Persona-Guided Multi-Stream Conversational Sentence Scoring
par: Liu, Junfeng, et autres
Publié: (2023)
par: Liu, Junfeng, et autres
Publié: (2023)
PKU-SafeRLHF: Towards Multi-Level Safety Alignment for LLMs with Human Preference
par: Ji, Jiaming, et autres
Publié: (2024)
par: Ji, Jiaming, et autres
Publié: (2024)
Efficient Preference-based Reinforcement Learning via Aligned Experience Estimation
par: Bai, Fengshuo, et autres
Publié: (2024)
par: Bai, Fengshuo, et autres
Publié: (2024)
Bridging the Gap Between Preference Alignment and Machine Unlearning
par: Feng, Xiaohua, et autres
Publié: (2025)
par: Feng, Xiaohua, et autres
Publié: (2025)
Interpretable Next-token Prediction via the Generalized Induction Head
par: Kim, Eunji, et autres
Publié: (2024)
par: Kim, Eunji, et autres
Publié: (2024)
Towards Efficient Neurally-Guided Program Induction for ARC-AGI
par: Ouellette, Simon
Publié: (2024)
par: Ouellette, Simon
Publié: (2024)
Enhancing Time Series Forecasting via Multi-Level Text Alignment with LLMs
par: Zhao, Taibiao, et autres
Publié: (2025)
par: Zhao, Taibiao, et autres
Publié: (2025)
Segment Any Text: A Universal Approach for Robust, Efficient and Adaptable Sentence Segmentation
par: Frohmann, Markus, et autres
Publié: (2024)
par: Frohmann, Markus, et autres
Publié: (2024)
2-Tier SimCSE: Elevating BERT for Robust Sentence Embeddings
par: Wang, Yumeng, et autres
Publié: (2025)
par: Wang, Yumeng, et autres
Publié: (2025)
RedStar: Does Scaling Long-CoT Data Unlock Better Slow-Reasoning Systems?
par: Xu, Haotian, et autres
Publié: (2025)
par: Xu, Haotian, et autres
Publié: (2025)
Model Extrapolation Expedites Alignment
par: Zheng, Chujie, et autres
Publié: (2024)
par: Zheng, Chujie, et autres
Publié: (2024)
VISPA: Pluralistic Alignment via Automatic Value Selection and Activation
par: Zheng, Shenyan, et autres
Publié: (2026)
par: Zheng, Shenyan, et autres
Publié: (2026)
Towards Robust Alignment of Language Models: Distributionally Robustifying Direct Preference Optimization
par: Wu, Junkang, et autres
Publié: (2024)
par: Wu, Junkang, et autres
Publié: (2024)
Sample-Efficient Alignment for LLMs
par: Liu, Zichen, et autres
Publié: (2024)
par: Liu, Zichen, et autres
Publié: (2024)
Static Word Embeddings for Sentence Semantic Representation
par: Wada, Takashi, et autres
Publié: (2025)
par: Wada, Takashi, et autres
Publié: (2025)
Knowledge-Level Consistency Reinforcement Learning: Dual-Fact Alignment for Long-Form Factuality
par: Li, Junliang, et autres
Publié: (2025)
par: Li, Junliang, et autres
Publié: (2025)
Annotation-Efficient Language Model Alignment via Diverse and Representative Response Texts
par: Jinnai, Yuu, et autres
Publié: (2024)
par: Jinnai, Yuu, et autres
Publié: (2024)
AliMark: Enhancing Robustness of Sentence-Level Watermarking Against Text Paraphrasing
par: Li, Yuexin, et autres
Publié: (2026)
par: Li, Yuexin, et autres
Publié: (2026)
Heterogeneous Value Alignment Evaluation for Large Language Models
par: Zhang, Zhaowei, et autres
Publié: (2023)
par: Zhang, Zhaowei, et autres
Publié: (2023)
Crystal-KV: Efficient KV Cache Management for Chain-of-Thought LLMs via Answer-First Principle
par: Wang, Zihan, et autres
Publié: (2026)
par: Wang, Zihan, et autres
Publié: (2026)
Low-Cost Generation and Evaluation of Dictionary Example Sentences
par: Cai, Bill, et autres
Publié: (2024)
par: Cai, Bill, et autres
Publié: (2024)
ROM: Real-time Overthinking Mitigation via Streaming Detection and Intervention
par: Wang, Xinyan, et autres
Publié: (2026)
par: Wang, Xinyan, et autres
Publié: (2026)
Combining Induction and Transduction for Abstract Reasoning
par: Li, Wen-Ding, et autres
Publié: (2024)
par: Li, Wen-Ding, et autres
Publié: (2024)
Universal Response and Emergence of Induction in LLMs
par: Luick, Niclas
Publié: (2024)
par: Luick, Niclas
Publié: (2024)
Self-Play Preference Optimization for Language Model Alignment
par: Wu, Yue, et autres
Publié: (2024)
par: Wu, Yue, et autres
Publié: (2024)
Sparse but Critical: A Token-Level Analysis of Distributional Shifts in RLVR Fine-Tuning of LLMs
par: Meng, Haoming, et autres
Publié: (2026)
par: Meng, Haoming, et autres
Publié: (2026)
Towards Linguistic Neural Representation Learning and Sentence Retrieval from Electroencephalogram Recordings
par: Zhou, Jinzhao, et autres
Publié: (2024)
par: Zhou, Jinzhao, et autres
Publié: (2024)
Self-Play with Adversarial Critic: Provable and Scalable Offline Alignment for Language Models
par: Ji, Xiang, et autres
Publié: (2024)
par: Ji, Xiang, et autres
Publié: (2024)
A Fuzzy Evaluation of Sentence Encoders on Grooming Risk Classification
par: Bihani, Geetanjali, et autres
Publié: (2025)
par: Bihani, Geetanjali, et autres
Publié: (2025)
Multilingual Safety Alignment via Self-Distillation
par: Qin, Ruiyang, et autres
Publié: (2026)
par: Qin, Ruiyang, et autres
Publié: (2026)
Documents similaires
-
Aligner: Efficient Alignment by Learning to Correct
par: Ji, Jiaming, et autres
Publié: (2024) -
SAE-V: Interpreting Multimodal Models for Enhanced Alignment
par: Lou, Hantao, et autres
Publié: (2025) -
Language Models Resist Alignment: Evidence From Data Compression
par: Ji, Jiaming, et autres
Publié: (2024) -
NeMo-Aligner: Scalable Toolkit for Efficient Model Alignment
par: Shen, Gerald, et autres
Publié: (2024) -
SentenceKV: Efficient LLM Inference via Sentence-Level Semantic KV Caching
par: Zhu, Yuxuan, et autres
Publié: (2025)