A Stitch in Time Saves Nine: Proactive Self-Refinement for Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Han, Jinyi, Wang, Xinyi, Zhao, Haiquan, li, Tingyun, Jiang, Zishang, Jiang, Sihang, Liang, Jiaqing, Lin, Xin, Zhou, Weikang, Sun, Zeye, Yu, Fei, Xiao, Yanghua |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
HINT: Helping Ineffective Rollouts Navigate Towards Effectiveness
di: Wang, Xinyi, et al.
Pubblicazione: (2025)
di: Wang, Xinyi, et al.
Pubblicazione: (2025)
Selective Expert Guidance for Effective and Diverse Exploration in Reinforcement Learning of LLMs
di: Jiang, Zishang, et al.
Pubblicazione: (2025)
di: Jiang, Zishang, et al.
Pubblicazione: (2025)
Your Models Have Thought Enough: Training Large Reasoning Models to Stop Overthinking
di: Han, Jinyi, et al.
Pubblicazione: (2025)
di: Han, Jinyi, et al.
Pubblicazione: (2025)
Structured Reasoning for Large Language Models
di: Han, Jinyi, et al.
Pubblicazione: (2026)
di: Han, Jinyi, et al.
Pubblicazione: (2026)
Order Doesn't Matter, But Reasoning Does: Training LLMs with Order-Centric Augmentation
di: He, Qianxi, et al.
Pubblicazione: (2025)
di: He, Qianxi, et al.
Pubblicazione: (2025)
Step-by-Step Mastery: Enhancing Soft Constraint Following Ability of Large Language Models
di: Ren, Qingyu, et al.
Pubblicazione: (2025)
di: Ren, Qingyu, et al.
Pubblicazione: (2025)
GenericAgent: A Token-Efficient Self-Evolving LLM Agent via Contextual Information Density Maximization (V1.0)
di: Liang, Jiaqing, et al.
Pubblicazione: (2026)
di: Liang, Jiaqing, et al.
Pubblicazione: (2026)
Beyond the Trade-off: Self-Supervised Reinforcement Learning for Reasoning Models' Instruction Following
di: Ren, Qingyu, et al.
Pubblicazione: (2025)
di: Ren, Qingyu, et al.
Pubblicazione: (2025)
SED: Self-Evaluation Decoding Enhances Large Language Models for Better Generation
di: Luo, Ziqin, et al.
Pubblicazione: (2024)
di: Luo, Ziqin, et al.
Pubblicazione: (2024)
Order Matters: Investigate the Position Bias in Multi-constraint Instruction Following
di: Zeng, Jie, et al.
Pubblicazione: (2025)
di: Zeng, Jie, et al.
Pubblicazione: (2025)
Enhancing Quantitative Reasoning Skills of Large Language Models through Dimension Perception
di: Huang, Yuncheng, et al.
Pubblicazione: (2023)
di: Huang, Yuncheng, et al.
Pubblicazione: (2023)
Mind the Generation Process: Fine-Grained Confidence Estimation During LLM Generation
di: Han, Jinyi, et al.
Pubblicazione: (2025)
di: Han, Jinyi, et al.
Pubblicazione: (2025)
Instructions are all you need: Self-supervised Reinforcement Learning for Instruction Following
di: Ren, Qingyu, et al.
Pubblicazione: (2025)
di: Ren, Qingyu, et al.
Pubblicazione: (2025)
Enhancing Confidence Expression in Large Language Models Through Learning from Past Experience
di: Han, Haixia, et al.
Pubblicazione: (2024)
di: Han, Haixia, et al.
Pubblicazione: (2024)
A Stitch in Time Saves Nine: Small VLM is a Precise Guidance for Accelerating Large VLMs
di: Zhao, Wangbo, et al.
Pubblicazione: (2024)
di: Zhao, Wangbo, et al.
Pubblicazione: (2024)
SEIF: Self-Evolving Reinforcement Learning for Instruction Following
di: Ren, Qingyu, et al.
Pubblicazione: (2026)
di: Ren, Qingyu, et al.
Pubblicazione: (2026)
Small Language Model Can Self-correct
di: Han, Haixia, et al.
Pubblicazione: (2024)
di: Han, Haixia, et al.
Pubblicazione: (2024)
CDS: Knowledge Component-Driven Data Synthesis Guided by Cognitive Diagnosis Theory
di: Zhao, Haokun, et al.
Pubblicazione: (2025)
di: Zhao, Haokun, et al.
Pubblicazione: (2025)
Do Large Language Models Truly Understand Cross-cultural Differences?
di: Guo, Shiwei, et al.
Pubblicazione: (2025)
di: Guo, Shiwei, et al.
Pubblicazione: (2025)
Think Thrice Before You Act: Progressive Thought Refinement in Large Language Models
di: Du, Chengyu, et al.
Pubblicazione: (2024)
di: Du, Chengyu, et al.
Pubblicazione: (2024)
LsrIF: Enhancing Logic-Structured Instruction Following of Large Language Models
di: Ren, Qingyu, et al.
Pubblicazione: (2026)
di: Ren, Qingyu, et al.
Pubblicazione: (2026)
Constrained Minimizers of the Fourth‐Order Schrödinger Equation With Saturable Nonlinearity
di: Zeye Han
Pubblicazione: (2025)
di: Zeye Han
Pubblicazione: (2025)
Ground Every Sentence: Improving Retrieval-Augmented LLMs with Interleaved Reference-Claim Generation
di: Xia, Sirui, et al.
Pubblicazione: (2024)
di: Xia, Sirui, et al.
Pubblicazione: (2024)
HybridStitch: Pixel and Timestep Level Model Stitching for Diffusion Acceleration
di: Sun, Desen, et al.
Pubblicazione: (2026)
di: Sun, Desen, et al.
Pubblicazione: (2026)
CEM: A Data-Efficient Method for Large Language Models to Continue Evolving From Mistakes
di: Zhao, Haokun, et al.
Pubblicazione: (2024)
di: Zhao, Haokun, et al.
Pubblicazione: (2024)
Reason from Fallacy: Enhancing Large Language Models' Logical Reasoning through Logical Fallacy Understanding
di: Li, Yanda, et al.
Pubblicazione: (2024)
di: Li, Yanda, et al.
Pubblicazione: (2024)
SEA-Eval: A Benchmark for Evaluating Self-Evolving Agents Beyond Episodic Assessment
di: Jiang, Sihang, et al.
Pubblicazione: (2026)
di: Jiang, Sihang, et al.
Pubblicazione: (2026)
Improving Recall of Large Language Models: A Model Collaboration Approach for Relational Triple Extraction
di: Ding, Zepeng, et al.
Pubblicazione: (2024)
di: Ding, Zepeng, et al.
Pubblicazione: (2024)
OVEL: Large Language Model as Memory Manager for Online Video Entity Linking
di: Zhao, Haiquan, et al.
Pubblicazione: (2024)
di: Zhao, Haiquan, et al.
Pubblicazione: (2024)
From Complex to Simple: Enhancing Multi-Constraint Complex Instruction Following Ability of Large Language Models
di: He, Qianyu, et al.
Pubblicazione: (2024)
di: He, Qianyu, et al.
Pubblicazione: (2024)
EDGE: Enhanced Grounded GUI Understanding with Enriched Multi-Granularity Synthetic Data
di: Chen, Xuetian, et al.
Pubblicazione: (2024)
di: Chen, Xuetian, et al.
Pubblicazione: (2024)
CultureScope: A Dimensional Lens for Probing Cultural Understanding in LLMs
di: Zhang, Jinghao, et al.
Pubblicazione: (2025)
di: Zhang, Jinghao, et al.
Pubblicazione: (2025)
Why Did Apple Fall: Evaluating Curiosity in Large Language Models
di: Wang, Haoyu, et al.
Pubblicazione: (2025)
di: Wang, Haoyu, et al.
Pubblicazione: (2025)
LUK: Empowering Log Understanding with Expert Knowledge from Large Language Models
di: Ma, Lipeng, et al.
Pubblicazione: (2024)
di: Ma, Lipeng, et al.
Pubblicazione: (2024)
AdaptiveLog: An Adaptive Log Analysis Framework with the Collaboration of Large and Small Language Model
di: Ma, Lipeng, et al.
Pubblicazione: (2025)
di: Ma, Lipeng, et al.
Pubblicazione: (2025)
Can Pre-trained Language Models Understand Chinese Humor?
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
ConcEPT: Concept-Enhanced Pre-Training for Language Models
di: Wang, Xintao, et al.
Pubblicazione: (2024)
di: Wang, Xintao, et al.
Pubblicazione: (2024)
VCEval: Rethinking What is a Good Educational Video and How to Automatically Evaluate It
di: Zhu, Xiaoxuan, et al.
Pubblicazione: (2024)
di: Zhu, Xiaoxuan, et al.
Pubblicazione: (2024)
LogReasoner: Empowering LLMs with Expert-like Coarse-to-Fine Reasoning for Automated Log Analysis
di: Ma, Lipeng, et al.
Pubblicazione: (2025)
di: Ma, Lipeng, et al.
Pubblicazione: (2025)
Look Ahead Text Understanding and LLM Stitching
di: Jiang, Junlin Julian, et al.
Pubblicazione: (2024)
di: Jiang, Junlin Julian, et al.
Pubblicazione: (2024)
Documenti analoghi
-
HINT: Helping Ineffective Rollouts Navigate Towards Effectiveness
di: Wang, Xinyi, et al.
Pubblicazione: (2025) -
Selective Expert Guidance for Effective and Diverse Exploration in Reinforcement Learning of LLMs
di: Jiang, Zishang, et al.
Pubblicazione: (2025) -
Your Models Have Thought Enough: Training Large Reasoning Models to Stop Overthinking
di: Han, Jinyi, et al.
Pubblicazione: (2025) -
Structured Reasoning for Large Language Models
di: Han, Jinyi, et al.
Pubblicazione: (2026) -
Order Doesn't Matter, But Reasoning Does: Training LLMs with Order-Centric Augmentation
di: He, Qianxi, et al.
Pubblicazione: (2025)