Self-Taught Self-Correction for Small Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Moskvoretskii, Viktor, Biemann, Chris, Nikishina, Irina |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Low-Resource Machine Translation through the Lens of Personalized Federated Learning
por: Moskvoretskii, Viktor, et al.
Publicado: (2024)
por: Moskvoretskii, Viktor, et al.
Publicado: (2024)
Do I look like a `cat.n.01` to you? A Taxonomy Image Generation Benchmark
por: Moskvoretskii, Viktor, et al.
Publicado: (2025)
por: Moskvoretskii, Viktor, et al.
Publicado: (2025)
Adaptive Retrieval Without Self-Knowledge? Bringing Uncertainty Back Home
por: Moskvoretskii, Viktor, et al.
Publicado: (2025)
por: Moskvoretskii, Viktor, et al.
Publicado: (2025)
Self-Calibrating Language Models via Test-Time Discriminative Distillation
por: Hedna, Mohamed Rissal, et al.
Publicado: (2026)
por: Hedna, Mohamed Rissal, et al.
Publicado: (2026)
TaxoLLaMA: WordNet-based Model for Solving Multiple Lexical Semantic Tasks
por: Moskvoretskii, Viktor, et al.
Publicado: (2024)
por: Moskvoretskii, Viktor, et al.
Publicado: (2024)
Multilingual Self-Taught Faithfulness Evaluators
por: Alfano, Carlo, et al.
Publicado: (2025)
por: Alfano, Carlo, et al.
Publicado: (2025)
Argument-Based Comparative Question Answering Evaluation Benchmark
por: Nikishina, Irina, et al.
Publicado: (2025)
por: Nikishina, Irina, et al.
Publicado: (2025)
Large Language Models Are Overparameterized Text Encoders
por: K, Thennal D, et al.
Publicado: (2024)
por: K, Thennal D, et al.
Publicado: (2024)
Self-Taught Optimizer (STOP): Recursively Self-Improving Code Generation
por: Zelikman, Eric, et al.
Publicado: (2023)
por: Zelikman, Eric, et al.
Publicado: (2023)
V-STaR: Training Verifiers for Self-Taught Reasoners
por: Hosseini, Arian, et al.
Publicado: (2024)
por: Hosseini, Arian, et al.
Publicado: (2024)
Self-AMPLIFY: Improving Small Language Models with Self Post Hoc Explanations
por: Bhan, Milan, et al.
Publicado: (2024)
por: Bhan, Milan, et al.
Publicado: (2024)
UnStar: Unlearning with Self-Taught Anti-Sample Reasoning for LLMs
por: Sinha, Yash, et al.
Publicado: (2024)
por: Sinha, Yash, et al.
Publicado: (2024)
On the Convergence of Moral Self-Correction in Large Language Models
por: Liu, Guangliang, et al.
Publicado: (2025)
por: Liu, Guangliang, et al.
Publicado: (2025)
AdaSTaR: Adaptive Data Sampling for Training Self-Taught Reasoners
por: Koh, Woosung, et al.
Publicado: (2025)
por: Koh, Woosung, et al.
Publicado: (2025)
B-STaR: Monitoring and Balancing Exploration and Exploitation in Self-Taught Reasoners
por: Zeng, Weihao, et al.
Publicado: (2024)
por: Zeng, Weihao, et al.
Publicado: (2024)
Self-Correction Bench: Uncovering and Addressing the Self-Correction Blind Spot in Large Language Models
por: Tsui, Ken
Publicado: (2025)
por: Tsui, Ken
Publicado: (2025)
Self-Taught Recognizer: Toward Unsupervised Adaptation for Speech Foundation Models
por: Hu, Yuchen, et al.
Publicado: (2024)
por: Hu, Yuchen, et al.
Publicado: (2024)
Large Language Models Must Be Taught to Know What They Don't Know
por: Kapoor, Sanyam, et al.
Publicado: (2024)
por: Kapoor, Sanyam, et al.
Publicado: (2024)
HS-STaR: Hierarchical Sampling for Self-Taught Reasoners via Difficulty Estimation and Budget Reallocation
por: Xiong, Feng, et al.
Publicado: (2025)
por: Xiong, Feng, et al.
Publicado: (2025)
Sherlock: Self-Correcting Reasoning in Vision-Language Models
por: Ding, Yi, et al.
Publicado: (2025)
por: Ding, Yi, et al.
Publicado: (2025)
ProgCo: Program Helps Self-Correction of Large Language Models
por: Song, Xiaoshuai, et al.
Publicado: (2025)
por: Song, Xiaoshuai, et al.
Publicado: (2025)
Self-Distilled Reasoner: On-Policy Self-Distillation for Large Language Models
por: Zhao, Siyan, et al.
Publicado: (2026)
por: Zhao, Siyan, et al.
Publicado: (2026)
Table-r1: Self-supervised and Reinforcement Learning for Program-based Table Reasoning in Small Language Models
por: Jin, Rihui, et al.
Publicado: (2025)
por: Jin, Rihui, et al.
Publicado: (2025)
Self-Evolved Preference Optimization for Enhancing Mathematical Reasoning in Small Language Models
por: Singh, Joykirat, et al.
Publicado: (2025)
por: Singh, Joykirat, et al.
Publicado: (2025)
Learning Self-Correction in Vision-Language Models via Rollout Augmentation
por: Ding, Yi, et al.
Publicado: (2026)
por: Ding, Yi, et al.
Publicado: (2026)
ReflexiCoder: Teaching Large Language Models to Self-Reflect on Generated Code and Self-Correct It via Reinforcement Learning
por: Jiang, Juyong, et al.
Publicado: (2026)
por: Jiang, Juyong, et al.
Publicado: (2026)
LLM-Independent Adaptive RAG: Let the Question Speak for Itself
por: Marina, Maria, et al.
Publicado: (2025)
por: Marina, Maria, et al.
Publicado: (2025)
Self-MoE: Towards Compositional Large Language Models with Self-Specialized Experts
por: Kang, Junmo, et al.
Publicado: (2024)
por: Kang, Junmo, et al.
Publicado: (2024)
IntroLM: Introspective Language Models via Prefilling-Time Self-Evaluation
por: Kasnavieh, Hossein Hosseini, et al.
Publicado: (2026)
por: Kasnavieh, Hossein Hosseini, et al.
Publicado: (2026)
Large Language Models Can Self-Improve At Web Agent Tasks
por: Patel, Ajay, et al.
Publicado: (2024)
por: Patel, Ajay, et al.
Publicado: (2024)
Self-Training Large Language Models with Confident Reasoning
por: Jang, Hyosoon, et al.
Publicado: (2025)
por: Jang, Hyosoon, et al.
Publicado: (2025)
Compute Where it Counts: Self Optimizing Language Models
por: Akhauri, Yash, et al.
Publicado: (2026)
por: Akhauri, Yash, et al.
Publicado: (2026)
CREAM: Consistency Regularized Self-Rewarding Language Models
por: Wang, Zhaoyang, et al.
Publicado: (2024)
por: Wang, Zhaoyang, et al.
Publicado: (2024)
A Confidence-based Acquisition Model for Self-supervised Active Learning and Label Correction
por: van Niekerk, Carel, et al.
Publicado: (2023)
por: van Niekerk, Carel, et al.
Publicado: (2023)
GLLM: Self-Corrective G-Code Generation using Large Language Models with User Feedback
por: Abdelaal, Mohamed, et al.
Publicado: (2025)
por: Abdelaal, Mohamed, et al.
Publicado: (2025)
SelfIE: Self-Interpretation of Large Language Model Embeddings
por: Chen, Haozhe, et al.
Publicado: (2024)
por: Chen, Haozhe, et al.
Publicado: (2024)
Self-Recognition in Language Models
por: Davidson, Tim R., et al.
Publicado: (2024)
por: Davidson, Tim R., et al.
Publicado: (2024)
CALM: Culturally Self-Aware Language Models
por: Shen, Lingzhi, et al.
Publicado: (2026)
por: Shen, Lingzhi, et al.
Publicado: (2026)
A Theoretical Understanding of Self-Correction through In-context Alignment
por: Wang, Yifei, et al.
Publicado: (2024)
por: Wang, Yifei, et al.
Publicado: (2024)
Self-Refining Language Model Anonymizers via Adversarial Distillation
por: Kim, Kyuyoung, et al.
Publicado: (2025)
por: Kim, Kyuyoung, et al.
Publicado: (2025)
Ejemplares similares
-
Low-Resource Machine Translation through the Lens of Personalized Federated Learning
por: Moskvoretskii, Viktor, et al.
Publicado: (2024) -
Do I look like a `cat.n.01` to you? A Taxonomy Image Generation Benchmark
por: Moskvoretskii, Viktor, et al.
Publicado: (2025) -
Adaptive Retrieval Without Self-Knowledge? Bringing Uncertainty Back Home
por: Moskvoretskii, Viktor, et al.
Publicado: (2025) -
Self-Calibrating Language Models via Test-Time Discriminative Distillation
por: Hedna, Mohamed Rissal, et al.
Publicado: (2026) -
TaxoLLaMA: WordNet-based Model for Solving Multiple Lexical Semantic Tasks
por: Moskvoretskii, Viktor, et al.
Publicado: (2024)