DIVE: Diversified Iterative Self-Improvement
Fuente:
arXiv
Salvato in:
| Autori principali: | Qin, Yiwei, Liu, Yixiu, Liu, Pengfei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Progress or Regress? Self-Improvement Reversal in Post-training
di: Wu, Ting, et al.
Pubblicazione: (2024)
di: Wu, Ting, et al.
Pubblicazione: (2024)
O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?
di: Huang, Zhen, et al.
Pubblicazione: (2024)
di: Huang, Zhen, et al.
Pubblicazione: (2024)
DIVE: Embedding Compression via Self-Limiting Gradient Updates
di: Zhao, Dongfang
Pubblicazione: (2026)
di: Zhao, Dongfang
Pubblicazione: (2026)
O1 Replication Journey: A Strategic Progress Report -- Part 1
di: Qin, Yiwei, et al.
Pubblicazione: (2024)
di: Qin, Yiwei, et al.
Pubblicazione: (2024)
Diversify and Conquer: Diversity-Centric Data Selection with Iterative Refinement
di: Yu, Simon, et al.
Pubblicazione: (2024)
di: Yu, Simon, et al.
Pubblicazione: (2024)
SAFETY-J: Evaluating Safety with Critique
di: Liu, Yixiu, et al.
Pubblicazione: (2024)
di: Liu, Yixiu, et al.
Pubblicazione: (2024)
Iterative Self-Improvement of Vision Language Models for Image Scoring and Self-Explanation
di: Tanji, Naoto, et al.
Pubblicazione: (2025)
di: Tanji, Naoto, et al.
Pubblicazione: (2025)
DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts
di: Feng, Yuchen, et al.
Pubblicazione: (2025)
di: Feng, Yuchen, et al.
Pubblicazione: (2025)
daVinci-LLM:Towards the Science of Pretraining
di: Qin, Yiwei, et al.
Pubblicazione: (2026)
di: Qin, Yiwei, et al.
Pubblicazione: (2026)
Are LLMs Stable Formal Logic Translators in Logical Reasoning Across Linguistically Diversified Texts?
di: Li, Qingchuan, et al.
Pubblicazione: (2025)
di: Li, Qingchuan, et al.
Pubblicazione: (2025)
Generative AI Act II: Test Time Scaling Drives Cognition Engineering
di: Xia, Shijie, et al.
Pubblicazione: (2025)
di: Xia, Shijie, et al.
Pubblicazione: (2025)
Self-Critique Guided Iterative Reasoning for Multi-hop Question Answering
di: Chu, Zheng, et al.
Pubblicazione: (2025)
di: Chu, Zheng, et al.
Pubblicazione: (2025)
KCS: Diversify Multi-hop Question Generation with Knowledge Composition Sampling
di: Wang, Yangfan, et al.
Pubblicazione: (2025)
di: Wang, Yangfan, et al.
Pubblicazione: (2025)
Benchmarking Large Language Models on Controllable Generation under Diversified Instructions
di: Chen, Yihan, et al.
Pubblicazione: (2024)
di: Chen, Yihan, et al.
Pubblicazione: (2024)
ISSR: Iterative Selection with Self-Review for Vocabulary Test Distractor Generation
di: Liu, Yu-Cheng, et al.
Pubblicazione: (2025)
di: Liu, Yu-Cheng, et al.
Pubblicazione: (2025)
Better, Faster: Harnessing Self-Improvement in Large Reasoning Models
di: Zhong, Qihuang, et al.
Pubblicazione: (2026)
di: Zhong, Qihuang, et al.
Pubblicazione: (2026)
SGIC: A Self-Guided Iterative Calibration Framework for RAG
di: Chen, Guanhua, et al.
Pubblicazione: (2025)
di: Chen, Guanhua, et al.
Pubblicazione: (2025)
Iterative Improvement of an Additively Regularized Topic Model
di: Gorbulev, Alex, et al.
Pubblicazione: (2024)
di: Gorbulev, Alex, et al.
Pubblicazione: (2024)
RAG-DIVE: A Dynamic Approach for Multi-Turn Dialogue Evaluation in Retrieval-Augmented Generation
di: Brehme, Lorenz, et al.
Pubblicazione: (2026)
di: Brehme, Lorenz, et al.
Pubblicazione: (2026)
Diversifying the Mixture-of-Experts Representation for Language Models with Orthogonal Optimizer
di: Liu, Boan, et al.
Pubblicazione: (2023)
di: Liu, Boan, et al.
Pubblicazione: (2023)
Diversifying the Expert Knowledge for Task-Agnostic Pruning in Sparse Mixture-of-Experts
di: Zhang, Zeliang, et al.
Pubblicazione: (2024)
di: Zhang, Zeliang, et al.
Pubblicazione: (2024)
Test-time Recursive Thinking: Self-Improvement without External Feedback
di: Zhuang, Yufan, et al.
Pubblicazione: (2026)
di: Zhuang, Yufan, et al.
Pubblicazione: (2026)
The Flip Side of RLHF: On-Policy Feedback for Reward Model Self-Supervised Improvement
di: Wang, Xiaobo, et al.
Pubblicazione: (2026)
di: Wang, Xiaobo, et al.
Pubblicazione: (2026)
Presenting a Paper is an Art: Self-Improvement Aesthetic Agents for Academic Presentations
di: Liu, Chengzhi, et al.
Pubblicazione: (2025)
di: Liu, Chengzhi, et al.
Pubblicazione: (2025)
Data Darwinism Part I: Unlocking the Value of Scientific Data for Pre-training
di: Qin, Yiwei, et al.
Pubblicazione: (2026)
di: Qin, Yiwei, et al.
Pubblicazione: (2026)
I-SHEEP: Self-Alignment of LLM from Scratch through an Iterative Self-Enhancement Paradigm
di: Liang, Yiming, et al.
Pubblicazione: (2024)
di: Liang, Yiming, et al.
Pubblicazione: (2024)
PopAlign: Diversifying Contrasting Patterns for a More Comprehensive Alignment
di: Wang, Zekun Moore, et al.
Pubblicazione: (2024)
di: Wang, Zekun Moore, et al.
Pubblicazione: (2024)
History-Guided Iterative Visual Reasoning with Self-Correction
di: Yang, Xinglong, et al.
Pubblicazione: (2026)
di: Yang, Xinglong, et al.
Pubblicazione: (2026)
Strength Lies in Differences! Improving Strategy Planning for Non-collaborative Dialogues via Diversified User Simulation
di: Zhang, Tong, et al.
Pubblicazione: (2024)
di: Zhang, Tong, et al.
Pubblicazione: (2024)
Synthetic Data Generation for Training Diversified Commonsense Reasoning Models
di: Zhang, Tianhui, et al.
Pubblicazione: (2026)
di: Zhang, Tianhui, et al.
Pubblicazione: (2026)
Not All Metrics Are Guilty: Improving NLG Evaluation by Diversifying References
di: Tang, Tianyi, et al.
Pubblicazione: (2023)
di: Tang, Tianyi, et al.
Pubblicazione: (2023)
Iterative Self-Tuning LLMs for Enhanced Jailbreaking Capabilities
di: Sun, Chung-En, et al.
Pubblicazione: (2024)
di: Sun, Chung-En, et al.
Pubblicazione: (2024)
ReMiT: RL-Guided Mid-Training for Iterative LLM Evolution
di: Huang, Junjie, et al.
Pubblicazione: (2026)
di: Huang, Junjie, et al.
Pubblicazione: (2026)
Contextual Experience Replay for Self-Improvement of Language Agents
di: Liu, Yitao, et al.
Pubblicazione: (2025)
di: Liu, Yitao, et al.
Pubblicazione: (2025)
Continuous Self-Improvement of Large Language Models by Test-time Training with Verifier-Driven Sample Selection
di: Moradi, Mohammad Mahdi, et al.
Pubblicazione: (2025)
di: Moradi, Mohammad Mahdi, et al.
Pubblicazione: (2025)
A Survey on LLM Inference-Time Self-Improvement
di: Dong, Xiangjue, et al.
Pubblicazione: (2024)
di: Dong, Xiangjue, et al.
Pubblicazione: (2024)
Enabling Language Models to Implicitly Learn Self-Improvement
di: Wang, Ziqi, et al.
Pubblicazione: (2023)
di: Wang, Ziqi, et al.
Pubblicazione: (2023)
InFoBench: Evaluating Instruction Following Ability in Large Language Models
di: Qin, Yiwei, et al.
Pubblicazione: (2024)
di: Qin, Yiwei, et al.
Pubblicazione: (2024)
TypedThinker: Diversify Large Language Model Reasoning with Typed Thinking
di: Wang, Danqing, et al.
Pubblicazione: (2024)
di: Wang, Danqing, et al.
Pubblicazione: (2024)
PLANNER: Generating Diversified Paragraph via Latent Language Diffusion Model
di: Zhang, Yizhe, et al.
Pubblicazione: (2023)
di: Zhang, Yizhe, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Progress or Regress? Self-Improvement Reversal in Post-training
di: Wu, Ting, et al.
Pubblicazione: (2024) -
O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?
di: Huang, Zhen, et al.
Pubblicazione: (2024) -
DIVE: Embedding Compression via Self-Limiting Gradient Updates
di: Zhao, Dongfang
Pubblicazione: (2026) -
O1 Replication Journey: A Strategic Progress Report -- Part 1
di: Qin, Yiwei, et al.
Pubblicazione: (2024) -
Diversify and Conquer: Diversity-Centric Data Selection with Iterative Refinement
di: Yu, Simon, et al.
Pubblicazione: (2024)