Reformatted Alignment
Fuente:
arXiv
Guardado en:
| Autores principales: | Fan, Run-Ze, Li, Xuefeng, Zou, Haoyang, Li, Junlong, He, Shwai, Chern, Ethan, Hu, Jiewen, Liu, Pengfei |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
LIMR: Less is More for RL Scaling
por: Li, Xuefeng, et al.
Publicado: (2025)
por: Li, Xuefeng, et al.
Publicado: (2025)
MegaScience: Pushing the Frontiers of Post-Training Datasets for Science Reasoning
por: Fan, Run-Ze, et al.
Publicado: (2025)
por: Fan, Run-Ze, et al.
Publicado: (2025)
Benchmarking Benchmark Leakage in Large Language Models
por: Xu, Ruijie, et al.
Publicado: (2024)
por: Xu, Ruijie, et al.
Publicado: (2024)
Programming Every Example: Lifting Pre-training Data Quality Like Experts at Scale
por: Zhou, Fan, et al.
Publicado: (2024)
por: Zhou, Fan, et al.
Publicado: (2024)
OctoThinker: Mid-training Incentivizes Reinforcement Learning Scaling
por: Wang, Zengzhi, et al.
Publicado: (2025)
por: Wang, Zengzhi, et al.
Publicado: (2025)
What Matters in Transformers? Not All Attention is Needed
por: He, Shwai, et al.
Publicado: (2024)
por: He, Shwai, et al.
Publicado: (2024)
Capacity-Aware Inference: Mitigating the Straggler Effect in Mixture of Experts
por: He, Shwai, et al.
Publicado: (2025)
por: He, Shwai, et al.
Publicado: (2025)
Generative AI Act II: Test Time Scaling Drives Cognition Engineering
por: Xia, Shijie, et al.
Publicado: (2025)
por: Xia, Shijie, et al.
Publicado: (2025)
MathPile: A Billion-Token-Scale Pretraining Corpus for Math
por: Wang, Zengzhi, et al.
Publicado: (2023)
por: Wang, Zengzhi, et al.
Publicado: (2023)
Selective Reflection-Tuning: Student-Selected Data Recycling for LLM Instruction-Tuning
por: Li, Ming, et al.
Publicado: (2024)
por: Li, Ming, et al.
Publicado: (2024)
miniCTX: Neural Theorem Proving with (Long-)Contexts
por: Hu, Jiewen, et al.
Publicado: (2024)
por: Hu, Jiewen, et al.
Publicado: (2024)
Alignment for Honesty
por: Yang, Yuqing, et al.
Publicado: (2023)
por: Yang, Yuqing, et al.
Publicado: (2023)
O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?
por: Huang, Zhen, et al.
Publicado: (2024)
por: Huang, Zhen, et al.
Publicado: (2024)
Halu-J: Critique-Based Hallucination Judge
por: Wang, Binjie, et al.
Publicado: (2024)
por: Wang, Binjie, et al.
Publicado: (2024)
Can Large Language Models be Trusted for Evaluation? Scalable Meta-Evaluation of LLMs as Evaluators via Agent Debate
por: Chern, Steffi, et al.
Publicado: (2024)
por: Chern, Steffi, et al.
Publicado: (2024)
On Evaluating LLM Alignment by Evaluating LLMs as Judges
por: Liu, Yixin, et al.
Publicado: (2025)
por: Liu, Yixin, et al.
Publicado: (2025)
Decoupling KL and Trajectories: A Unified Perspective for SFT, DAgger, Offline RL, and OPD in LLM Distillation
por: Zhao, Anhao, et al.
Publicado: (2026)
por: Zhao, Anhao, et al.
Publicado: (2026)
Parameter Efficient Instruction Tuning: An Empirical Study
por: He, Pengfei
Publicado: (2024)
por: He, Pengfei
Publicado: (2024)
Diving into Self-Evolving Training for Multimodal Reasoning
por: Liu, Wei, et al.
Publicado: (2024)
por: Liu, Wei, et al.
Publicado: (2024)
Efficient Agent Training for Computer Use
por: He, Yanheng, et al.
Publicado: (2025)
por: He, Yanheng, et al.
Publicado: (2025)
UniCL: A Universal Contrastive Learning Framework for Large Time Series Models
por: Li, Jiawei, et al.
Publicado: (2024)
por: Li, Jiawei, et al.
Publicado: (2024)
Breach in the Shield: Unveiling the Vulnerabilities of Large Language Models
por: Dai, Runpeng, et al.
Publicado: (2025)
por: Dai, Runpeng, et al.
Publicado: (2025)
Towards Unified Alignment Between Agents, Humans, and Environment
por: Yang, Zonghan, et al.
Publicado: (2024)
por: Yang, Zonghan, et al.
Publicado: (2024)
NPHardEval: Dynamic Benchmark on Reasoning Ability of Large Language Models via Complexity Classes
por: Fan, Lizhou, et al.
Publicado: (2023)
por: Fan, Lizhou, et al.
Publicado: (2023)
Adversarial Preference Optimization: Enhancing Your Alignment via RM-LLM Game
por: Cheng, Pengyu, et al.
Publicado: (2023)
por: Cheng, Pengyu, et al.
Publicado: (2023)
Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples
por: Gao, Chengqian, et al.
Publicado: (2025)
por: Gao, Chengqian, et al.
Publicado: (2025)
Efficient Text-Attributed Graph Learning through Selective Annotation and Graph Alignment
por: Xie, Huanyi, et al.
Publicado: (2025)
por: Xie, Huanyi, et al.
Publicado: (2025)
Pareto Multi-Objective Alignment for Language Models
por: He, Qiang, et al.
Publicado: (2025)
por: He, Qiang, et al.
Publicado: (2025)
Multilingual Safety Alignment via Self-Distillation
por: Qin, Ruiyang, et al.
Publicado: (2026)
por: Qin, Ruiyang, et al.
Publicado: (2026)
What Makes Good Data for Alignment? A Comprehensive Study of Automatic Data Selection in Instruction Tuning
por: Liu, Wei, et al.
Publicado: (2023)
por: Liu, Wei, et al.
Publicado: (2023)
Gradient-Adaptive Policy Optimization: Towards Multi-Objective Alignment of Large Language Models
por: Li, Chengao, et al.
Publicado: (2025)
por: Li, Chengao, et al.
Publicado: (2025)
ARGS: Alignment as Reward-Guided Search
por: Khanov, Maxim, et al.
Publicado: (2024)
por: Khanov, Maxim, et al.
Publicado: (2024)
BeHonest: Benchmarking Honesty in Large Language Models
por: Chern, Steffi, et al.
Publicado: (2024)
por: Chern, Steffi, et al.
Publicado: (2024)
Teaching Your Models to Understand Code via Focal Preference Alignment
por: Wu, Jie, et al.
Publicado: (2025)
por: Wu, Jie, et al.
Publicado: (2025)
Better Alignment with Instruction Back-and-Forth Translation
por: Nguyen, Thao, et al.
Publicado: (2024)
por: Nguyen, Thao, et al.
Publicado: (2024)
Reward-free Alignment for Conflicting Objectives
por: Chen, Peter, et al.
Publicado: (2026)
por: Chen, Peter, et al.
Publicado: (2026)
Understanding Multimodal LLMs Under Distribution Shifts: An Information-Theoretic Approach
por: Oh, Changdae, et al.
Publicado: (2025)
por: Oh, Changdae, et al.
Publicado: (2025)
LifeAlign: Lifelong Alignment for Large Language Models with Memory-Augmented Focalized Preference Optimization
por: Li, Junsong, et al.
Publicado: (2025)
por: Li, Junsong, et al.
Publicado: (2025)
Accelerated Preference Optimization for Large Language Model Alignment
por: He, Jiafan, et al.
Publicado: (2024)
por: He, Jiafan, et al.
Publicado: (2024)
Bridging the Gap Between Preference Alignment and Machine Unlearning
por: Feng, Xiaohua, et al.
Publicado: (2025)
por: Feng, Xiaohua, et al.
Publicado: (2025)
Ejemplares similares
-
LIMR: Less is More for RL Scaling
por: Li, Xuefeng, et al.
Publicado: (2025) -
MegaScience: Pushing the Frontiers of Post-Training Datasets for Science Reasoning
por: Fan, Run-Ze, et al.
Publicado: (2025) -
Benchmarking Benchmark Leakage in Large Language Models
por: Xu, Ruijie, et al.
Publicado: (2024) -
Programming Every Example: Lifting Pre-training Data Quality Like Experts at Scale
por: Zhou, Fan, et al.
Publicado: (2024) -
OctoThinker: Mid-training Incentivizes Reinforcement Learning Scaling
por: Wang, Zengzhi, et al.
Publicado: (2025)