A Survey on Self-Evolution of Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Tao, Zhengwei, Lin, Ting-En, Chen, Xiancai, Li, Hangyu, Wu, Yuchuan, Li, Yongbin, Jin, Zhi, Huang, Fei, Tao, Dacheng, Zhou, Jingren |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Reverse Preference Optimization for Complex Instruction Following
par: Huang, Xiang, et autres
Publié: (2025)
par: Huang, Xiang, et autres
Publié: (2025)
Fortify the Shortest Stave in Attention: Enhancing Context Awareness of Large Language Models for Effective Tool Use
par: Chen, Yuhan, et autres
Publié: (2023)
par: Chen, Yuhan, et autres
Publié: (2023)
SpokenWOZ: A Large-Scale Speech-Text Benchmark for Spoken Task-Oriented Dialogue Agents
par: Si, Shuzheng, et autres
Publié: (2023)
par: Si, Shuzheng, et autres
Publié: (2023)
A Simple "Motivation" Can Enhance Reinforcement Finetuning of Large Reasoning Models
par: Zhang, Junjie, et autres
Publié: (2025)
par: Zhang, Junjie, et autres
Publié: (2025)
A Comprehensive Evaluation on Event Reasoning of Large Language Models
par: Tao, Zhengwei, et autres
Publié: (2024)
par: Tao, Zhengwei, et autres
Publié: (2024)
Supervised Optimism Correction: Be Confident When LLMs Are Sure
par: Zhang, Junjie, et autres
Publié: (2025)
par: Zhang, Junjie, et autres
Publié: (2025)
A Survey on Knowledge Distillation of Large Language Models
par: Xu, Xiaohan, et autres
Publié: (2024)
par: Xu, Xiaohan, et autres
Publié: (2024)
EVIT: Event-Oriented Instruction Tuning for Event Reasoning
par: Tao, Zhengwei, et autres
Publié: (2024)
par: Tao, Zhengwei, et autres
Publié: (2024)
MMEvol: Empowering Multimodal Large Language Models with Evol-Instruct
par: Luo, Run, et autres
Publié: (2024)
par: Luo, Run, et autres
Publié: (2024)
OpenOmni: Advancing Open-Source Omnimodal Large Language Models with Progressive Multimodal Alignment and Real-Time Self-Aware Emotional Speech Synthesis
par: Luo, Run, et autres
Publié: (2025)
par: Luo, Run, et autres
Publié: (2025)
EIFBENCH: Extremely Complex Instruction Following Benchmark for Large Language Models
par: Zou, Tao, et autres
Publié: (2025)
par: Zou, Tao, et autres
Publié: (2025)
P-GenRM: Personalized Generative Reward Model with Test-time User-based Scaling
par: Zhang, Pinyi, et autres
Publié: (2026)
par: Zhang, Pinyi, et autres
Publié: (2026)
Improving Factual Consistency of News Summarization by Contrastive Preference Optimization
par: Feng, Huawen, et autres
Publié: (2023)
par: Feng, Huawen, et autres
Publié: (2023)
PROPHET: An Inferable Future Forecasting Benchmark with Causal Intervened Likelihood Estimation
par: Tao, Zhengwei, et autres
Publié: (2025)
par: Tao, Zhengwei, et autres
Publié: (2025)
MOA: Multi-Objective Alignment for Role-Playing Agents
par: Liao, Chonghua, et autres
Publié: (2025)
par: Liao, Chonghua, et autres
Publié: (2025)
Masked Thought: Simply Masking Partial Reasoning Steps Can Improve Mathematical Reasoning Learning of Language Models
par: Chen, Changyu, et autres
Publié: (2024)
par: Chen, Changyu, et autres
Publié: (2024)
Revisiting Catastrophic Forgetting in Large Language Model Tuning
par: Li, Hongyu, et autres
Publié: (2024)
par: Li, Hongyu, et autres
Publié: (2024)
Fine-Tuning Language Models with Reward Learning on Policy
par: Lang, Hao, et autres
Publié: (2024)
par: Lang, Hao, et autres
Publié: (2024)
Extend Model Merging from Fine-Tuned to Pre-Trained Large Language Models via Weight Disentanglement
par: Yu, Le, et autres
Publié: (2024)
par: Yu, Le, et autres
Publié: (2024)
MEEL: Multi-Modal Event Evolution Learning
par: Tao, Zhengwei, et autres
Publié: (2024)
par: Tao, Zhengwei, et autres
Publié: (2024)
CPO: Addressing Reward Ambiguity in Role-playing Dialogue via Comparative Policy Optimization
par: Ye, Xinge, et autres
Publié: (2025)
par: Ye, Xinge, et autres
Publié: (2025)
Agentic Reinforcement Learning with Implicit Step Rewards
par: Liu, Xiaoqian, et autres
Publié: (2025)
par: Liu, Xiaoqian, et autres
Publié: (2025)
Improving Large Language Models with Concept-Aware Fine-Tuning
par: Chen, Michael K., et autres
Publié: (2025)
par: Chen, Michael K., et autres
Publié: (2025)
OmniCharacter: Towards Immersive Role-Playing Agents with Seamless Speech-Language Personality Interaction
par: Zhang, Haonan, et autres
Publié: (2025)
par: Zhang, Haonan, et autres
Publié: (2025)
Large Language Models are Superpositions of All Characters: Attaining Arbitrary Role-play via Self-Alignment
par: Lu, Keming, et autres
Publié: (2024)
par: Lu, Keming, et autres
Publié: (2024)
A Survey on Agentic Multimodal Large Language Models
par: Yao, Huanjin, et autres
Publié: (2025)
par: Yao, Huanjin, et autres
Publié: (2025)
Reward Modeling from Natural Language Human Feedback
par: Wang, Zongqi, et autres
Publié: (2026)
par: Wang, Zongqi, et autres
Publié: (2026)
OOP: Object-Oriented Programming Evaluation Benchmark for Large Language Models
par: Wang, Shuai, et autres
Publié: (2024)
par: Wang, Shuai, et autres
Publié: (2024)
SeRL: Self-Play Reinforcement Learning for Large Language Models with Limited Data
par: Fang, Wenkai, et autres
Publié: (2025)
par: Fang, Wenkai, et autres
Publié: (2025)
Large Language Models as an Indirect Reasoner: Contrapositive and Contradiction for Automated Reasoning
par: Zhang, Yanfang, et autres
Publié: (2024)
par: Zhang, Yanfang, et autres
Publié: (2024)
FlowBench: Revisiting and Benchmarking Workflow-Guided Planning for LLM-based Agents
par: Xiao, Ruixuan, et autres
Publié: (2024)
par: Xiao, Ruixuan, et autres
Publié: (2024)
Better, Faster: Harnessing Self-Improvement in Large Reasoning Models
par: Zhong, Qihuang, et autres
Publié: (2026)
par: Zhong, Qihuang, et autres
Publié: (2026)
Predicting Rewards Alongside Tokens: Non-disruptive Parameter Insertion for Efficient Inference Intervention in Large Language Model
par: Yuan, Chenhan, et autres
Publié: (2024)
par: Yuan, Chenhan, et autres
Publié: (2024)
Self-Steering Optimization: Autonomous Preference Optimization for Large Language Models
par: Xiang, Hao, et autres
Publié: (2024)
par: Xiang, Hao, et autres
Publié: (2024)
Self-play with Execution Feedback: Improving Instruction-following Capabilities of Large Language Models
par: Dong, Guanting, et autres
Publié: (2024)
par: Dong, Guanting, et autres
Publié: (2024)
WisdomBot: Tuning Large Language Models with Artificial Intelligence Knowledge
par: Chen, Jingyuan, et autres
Publié: (2025)
par: Chen, Jingyuan, et autres
Publié: (2025)
Model Hemorrhage and the Robustness Limits of Large Language Models
par: Ma, Ziyang, et autres
Publié: (2025)
par: Ma, Ziyang, et autres
Publié: (2025)
Self-Retrieval: End-to-End Information Retrieval with One Large Language Model
par: Tang, Qiaoyu, et autres
Publié: (2024)
par: Tang, Qiaoyu, et autres
Publié: (2024)
Aligning Large Language Models from Self-Reference AI Feedback with one General Principle
par: Bao, Rong, et autres
Publié: (2024)
par: Bao, Rong, et autres
Publié: (2024)
Enhancing the General Agent Capabilities of Low-Parameter LLMs through Tuning and Multi-Branch Reasoning
par: Zhou, Qinhao, et autres
Publié: (2024)
par: Zhou, Qinhao, et autres
Publié: (2024)
Documents similaires
-
Reverse Preference Optimization for Complex Instruction Following
par: Huang, Xiang, et autres
Publié: (2025) -
Fortify the Shortest Stave in Attention: Enhancing Context Awareness of Large Language Models for Effective Tool Use
par: Chen, Yuhan, et autres
Publié: (2023) -
SpokenWOZ: A Large-Scale Speech-Text Benchmark for Spoken Task-Oriented Dialogue Agents
par: Si, Shuzheng, et autres
Publié: (2023) -
A Simple "Motivation" Can Enhance Reinforcement Finetuning of Large Reasoning Models
par: Zhang, Junjie, et autres
Publié: (2025) -
A Comprehensive Evaluation on Event Reasoning of Large Language Models
par: Tao, Zhengwei, et autres
Publié: (2024)