Weak-to-Strong Search: Align Large Language Models via Searching over Small Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhou, Zhanhui, Liu, Zhixuan, Liu, Jie, Dong, Zhichen, Yang, Chao, Qiao, Yu |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Emulated Disalignment: Safety Alignment for Large Language Models May Backfire!
por: Zhou, Zhanhui, et al.
Publicado: (2024)
por: Zhou, Zhanhui, et al.
Publicado: (2024)
Inference-Time Language Model Alignment via Integrated Value Guidance
por: Liu, Zhixuan, et al.
Publicado: (2024)
por: Liu, Zhixuan, et al.
Publicado: (2024)
Attacks, Defenses and Evaluations for LLM Conversation Safety: A Survey
por: Dong, Zhichen, et al.
Publicado: (2024)
por: Dong, Zhichen, et al.
Publicado: (2024)
Iterative Length-Regularized Direct Preference Optimization: A Case Study on Improving 7B Language Models to GPT-4 Level
por: Liu, Jie, et al.
Publicado: (2024)
por: Liu, Jie, et al.
Publicado: (2024)
Purifying Large Language Models by Ensembling a Small Language Model
por: Li, Tianlin, et al.
Publicado: (2024)
por: Li, Tianlin, et al.
Publicado: (2024)
Emergent Response Planning in LLMs
por: Dong, Zhichen, et al.
Publicado: (2025)
por: Dong, Zhichen, et al.
Publicado: (2025)
Scaling Multimodal Search and Recommendation with Small Language Models via Upside-Down Reinforcement Learning
por: Lin, Yu-Chen, et al.
Publicado: (2025)
por: Lin, Yu-Chen, et al.
Publicado: (2025)
SPaR: Self-Play with Tree-Search Refinement to Improve Instruction-Following in Large Language Models
por: Cheng, Jiale, et al.
Publicado: (2024)
por: Cheng, Jiale, et al.
Publicado: (2024)
Synthesizing Programmatic Reinforcement Learning Policies with Large Language Model Guided Search
por: Liu, Max, et al.
Publicado: (2024)
por: Liu, Max, et al.
Publicado: (2024)
dLLM: Simple Diffusion Language Modeling
por: Zhou, Zhanhui, et al.
Publicado: (2026)
por: Zhou, Zhanhui, et al.
Publicado: (2026)
Tree Search for Language Model Agents
por: Koh, Jing Yu, et al.
Publicado: (2024)
por: Koh, Jing Yu, et al.
Publicado: (2024)
Weak-to-Strong GraphRAG: Aligning Weak Retrievers with Large Language Models for Graph-based Retrieval Augmented Generation
por: Zou, Deyu, et al.
Publicado: (2025)
por: Zou, Deyu, et al.
Publicado: (2025)
GUNDAM: Aligning Large Language Models with Graph Understanding
por: Ouyang, Sheng, et al.
Publicado: (2024)
por: Ouyang, Sheng, et al.
Publicado: (2024)
Demystifying and Enhancing the Efficiency of Large Language Model Based Search Agents
por: Yang, Tiannuo, et al.
Publicado: (2025)
por: Yang, Tiannuo, et al.
Publicado: (2025)
AlignBench: Benchmarking Chinese Alignment of Large Language Models
por: Liu, Xiao, et al.
Publicado: (2023)
por: Liu, Xiao, et al.
Publicado: (2023)
Mitigating Geospatial Knowledge Hallucination in Large Language Models: Benchmarking and Dynamic Factuality Aligning
por: Wang, Shengyuan, et al.
Publicado: (2025)
por: Wang, Shengyuan, et al.
Publicado: (2025)
Self-Play Fine-Tuning Converts Weak Language Models to Strong Language Models
por: Chen, Zixiang, et al.
Publicado: (2024)
por: Chen, Zixiang, et al.
Publicado: (2024)
Gaining Wisdom from Setbacks: Aligning Large Language Models via Mistake Analysis
por: Chen, Kai, et al.
Publicado: (2023)
por: Chen, Kai, et al.
Publicado: (2023)
E-Sparse: Boosting the Large Language Model Inference through Entropy-based N:M Sparsity
por: Li, Yun, et al.
Publicado: (2023)
por: Li, Yun, et al.
Publicado: (2023)
AutoDetect: Towards a Unified Framework for Automated Weakness Detection in Large Language Models
por: Cheng, Jiale, et al.
Publicado: (2024)
por: Cheng, Jiale, et al.
Publicado: (2024)
Stream of Search (SoS): Learning to Search in Language
por: Gandhi, Kanishk, et al.
Publicado: (2024)
por: Gandhi, Kanishk, et al.
Publicado: (2024)
Aligning with Human Judgement: The Role of Pairwise Preference in Large Language Model Evaluators
por: Liu, Yinhong, et al.
Publicado: (2024)
por: Liu, Yinhong, et al.
Publicado: (2024)
Aligning Large Language Models via Fine-grained Supervision
por: Xu, Dehong, et al.
Publicado: (2024)
por: Xu, Dehong, et al.
Publicado: (2024)
ALaRM: Align Language Models via Hierarchical Rewards Modeling
por: Lai, Yuhang, et al.
Publicado: (2024)
por: Lai, Yuhang, et al.
Publicado: (2024)
Self-Rewarding PPO: Aligning Large Language Models with Demonstrations Only
por: Zhang, Qingru, et al.
Publicado: (2025)
por: Zhang, Qingru, et al.
Publicado: (2025)
Mitigating Over-Refusal in Aligned Large Language Models via Inference-Time Activation Energy
por: Jiang, Eric Hanchen, et al.
Publicado: (2025)
por: Jiang, Eric Hanchen, et al.
Publicado: (2025)
Aligning Large Language Models by On-Policy Self-Judgment
por: Lee, Sangkyu, et al.
Publicado: (2024)
por: Lee, Sangkyu, et al.
Publicado: (2024)
Language Models "Grok" to Copy
por: Lv, Ang, et al.
Publicado: (2024)
por: Lv, Ang, et al.
Publicado: (2024)
Accelerating Large Language Model Reasoning via Speculative Search
por: Wang, Zhihai, et al.
Publicado: (2025)
por: Wang, Zhihai, et al.
Publicado: (2025)
Align to Structure: Aligning Large Language Models with Structural Information
por: Kim, Zae Myung, et al.
Publicado: (2025)
por: Kim, Zae Myung, et al.
Publicado: (2025)
Hypothesis Search: Inductive Reasoning with Language Models
por: Wang, Ruocheng, et al.
Publicado: (2023)
por: Wang, Ruocheng, et al.
Publicado: (2023)
LifeAlign: Lifelong Alignment for Large Language Models with Memory-Augmented Focalized Preference Optimization
por: Li, Junsong, et al.
Publicado: (2025)
por: Li, Junsong, et al.
Publicado: (2025)
BIPEFT: Budget-Guided Iterative Search for Parameter Efficient Fine-Tuning of Large Pretrained Language Models
por: Chang, Aofei, et al.
Publicado: (2024)
por: Chang, Aofei, et al.
Publicado: (2024)
Large Language Models can be Strong Self-Detoxifiers
por: Ko, Ching-Yun, et al.
Publicado: (2024)
por: Ko, Ching-Yun, et al.
Publicado: (2024)
Explanation, Debate, Align: A Weak-to-Strong Framework for Language Model Generalization
por: Zakershahrak, Mehrdad, et al.
Publicado: (2024)
por: Zakershahrak, Mehrdad, et al.
Publicado: (2024)
Large Language Model Unlearning via Embedding-Corrupted Prompts
por: Liu, Chris Yuhao, et al.
Publicado: (2024)
por: Liu, Chris Yuhao, et al.
Publicado: (2024)
DavIR: Data Selection via Implicit Reward for Large Language Models
por: Zhou, Haotian, et al.
Publicado: (2023)
por: Zhou, Haotian, et al.
Publicado: (2023)
SmallToLarge (S2L): Scalable Data Selection for Fine-tuning Large Language Models by Summarizing Training Trajectories of Small Models
por: Yang, Yu, et al.
Publicado: (2024)
por: Yang, Yu, et al.
Publicado: (2024)
Over-Searching in Search-Augmented Large Language Models
por: Xie, Roy, et al.
Publicado: (2026)
por: Xie, Roy, et al.
Publicado: (2026)
Squat: Quant Small Language Models on the Edge
por: Shen, Xuan, et al.
Publicado: (2024)
por: Shen, Xuan, et al.
Publicado: (2024)
Ejemplares similares
-
Emulated Disalignment: Safety Alignment for Large Language Models May Backfire!
por: Zhou, Zhanhui, et al.
Publicado: (2024) -
Inference-Time Language Model Alignment via Integrated Value Guidance
por: Liu, Zhixuan, et al.
Publicado: (2024) -
Attacks, Defenses and Evaluations for LLM Conversation Safety: A Survey
por: Dong, Zhichen, et al.
Publicado: (2024) -
Iterative Length-Regularized Direct Preference Optimization: A Case Study on Improving 7B Language Models to GPT-4 Level
por: Liu, Jie, et al.
Publicado: (2024) -
Purifying Large Language Models by Ensembling a Small Language Model
por: Li, Tianlin, et al.
Publicado: (2024)