Self-Refine Instruction-Tuning for Aligning Reasoning in Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Ranaldi, Leonardo, Freitas, Andrè |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Empowering Cross-lingual Abilities of Instruction-tuned Large Language Models by Translation-following demonstrations
di: Ranaldi, Leonardo, et al.
Pubblicazione: (2023)
di: Ranaldi, Leonardo, et al.
Pubblicazione: (2023)
Eliciting Critical Reasoning in Retrieval-Augmented Language Models via Contrastive Explanations
di: Ranaldi, Leonardo, et al.
Pubblicazione: (2024)
di: Ranaldi, Leonardo, et al.
Pubblicazione: (2024)
Improving Chain-of-Thought Reasoning via Quasi-Symbolic Abstractions
di: Ranaldi, Leonardo, et al.
Pubblicazione: (2025)
di: Ranaldi, Leonardo, et al.
Pubblicazione: (2025)
Dissecting Clinical Reasoning in Language Models: A Comparative Study of Prompts and Model Adaptation Strategies
di: Jullien, Mael, et al.
Pubblicazione: (2025)
di: Jullien, Mael, et al.
Pubblicazione: (2025)
Improving Multilingual Retrieval-Augmented Language Models through Dialectic Reasoning Argumentations
di: Ranaldi, Leonardo, et al.
Pubblicazione: (2025)
di: Ranaldi, Leonardo, et al.
Pubblicazione: (2025)
When Large Language Models contradict humans? Large Language Models' Sycophantic Behaviour
di: Ranaldi, Leonardo, et al.
Pubblicazione: (2023)
di: Ranaldi, Leonardo, et al.
Pubblicazione: (2023)
Empowering Multi-step Reasoning across Languages via Tree-of-Thoughts
di: Ranaldi, Leonardo, et al.
Pubblicazione: (2023)
di: Ranaldi, Leonardo, et al.
Pubblicazione: (2023)
Instructive Decoding: Instruction-Tuned Large Language Models are Self-Refiner from Noisy Instructions
di: Kim, Taehyeon, et al.
Pubblicazione: (2023)
di: Kim, Taehyeon, et al.
Pubblicazione: (2023)
Abstract Activation Spaces for Content-Invariant Reasoning in Large Language Models
di: Maraia, Gabriele, et al.
Pubblicazione: (2026)
di: Maraia, Gabriele, et al.
Pubblicazione: (2026)
Animate, or Inanimate, That is the Question for Large Language Models
di: Ranaldi, Leonardo, et al.
Pubblicazione: (2024)
di: Ranaldi, Leonardo, et al.
Pubblicazione: (2024)
Protoknowledge Shapes Behaviour of LLMs in Downstream Tasks: Memorization and Generalization with Knowledge Graphs
di: Ranaldi, Federico, et al.
Pubblicazione: (2025)
di: Ranaldi, Federico, et al.
Pubblicazione: (2025)
PreCog: Exploring the Relation between Memorization and Performance in Pre-trained Language Models
di: Ranaldi, Leonardo, et al.
Pubblicazione: (2023)
di: Ranaldi, Leonardo, et al.
Pubblicazione: (2023)
Dual Instruction Tuning with Large Language Models for Mathematical Reasoning
di: Zhou, Yongwei, et al.
Pubblicazione: (2024)
di: Zhou, Yongwei, et al.
Pubblicazione: (2024)
Safe to Serve: Aligning Instruction-Tuned Models for Safety and Helpfulness
di: Amballa, Avinash, et al.
Pubblicazione: (2024)
di: Amballa, Avinash, et al.
Pubblicazione: (2024)
Exploring Linguistic Properties of Monolingual BERTs with Typological Classification among Languages
di: Ruzzetti, Elena Sofia, et al.
Pubblicazione: (2023)
di: Ruzzetti, Elena Sofia, et al.
Pubblicazione: (2023)
HANS, are you clever? Clever Hans Effect Analysis of Neural Systems
di: Ranaldi, Leonardo, et al.
Pubblicazione: (2023)
di: Ranaldi, Leonardo, et al.
Pubblicazione: (2023)
mCoT: Multilingual Instruction Tuning for Reasoning Consistency in Language Models
di: Lai, Huiyuan, et al.
Pubblicazione: (2024)
di: Lai, Huiyuan, et al.
Pubblicazione: (2024)
Investigating the Impact of Data Contamination of Large Language Models in Text-to-SQL Translation
di: Ranaldi, Federico, et al.
Pubblicazione: (2024)
di: Ranaldi, Federico, et al.
Pubblicazione: (2024)
X-Instruction: Aligning Language Model in Low-resource Languages with Self-curated Cross-lingual Instructions
di: Li, Chong, et al.
Pubblicazione: (2024)
di: Li, Chong, et al.
Pubblicazione: (2024)
OntoTune: Ontology-Driven Self-training for Aligning Large Language Models
di: Liu, Zhiqiang, et al.
Pubblicazione: (2025)
di: Liu, Zhiqiang, et al.
Pubblicazione: (2025)
A Trip Towards Fairness: Bias and De-Biasing in Large Language Models
di: Ranaldi, Leonardo, et al.
Pubblicazione: (2023)
di: Ranaldi, Leonardo, et al.
Pubblicazione: (2023)
Enhancing Ethical Explanations of Large Language Models through Iterative Symbolic Refinement
di: Quan, Xin, et al.
Pubblicazione: (2024)
di: Quan, Xin, et al.
Pubblicazione: (2024)
Multilingual Retrieval-Augmented Generation for Knowledge-Intensive Task
di: Ranaldi, Leonardo, et al.
Pubblicazione: (2025)
di: Ranaldi, Leonardo, et al.
Pubblicazione: (2025)
Reasoning with Natural Language Explanations
di: Valentino, Marco, et al.
Pubblicazione: (2024)
di: Valentino, Marco, et al.
Pubblicazione: (2024)
Chain-of-Instructions: Compositional Instruction Tuning on Large Language Models
di: Hayati, Shirley Anugrah, et al.
Pubblicazione: (2024)
di: Hayati, Shirley Anugrah, et al.
Pubblicazione: (2024)
SSR: Socratic Self-Refine for Large Language Model Reasoning
di: Shi, Haizhou, et al.
Pubblicazione: (2025)
di: Shi, Haizhou, et al.
Pubblicazione: (2025)
RICo: Refined In-Context Contribution for Automatic Instruction-Tuning Data Selection
di: Yang, Yixin, et al.
Pubblicazione: (2025)
di: Yang, Yixin, et al.
Pubblicazione: (2025)
Reasons to Reject? Aligning Language Models with Judgments
di: Xu, Weiwen, et al.
Pubblicazione: (2023)
di: Xu, Weiwen, et al.
Pubblicazione: (2023)
Controlling Equational Reasoning in Large Language Models with Prompt Interventions
di: Meadows, Jordan, et al.
Pubblicazione: (2023)
di: Meadows, Jordan, et al.
Pubblicazione: (2023)
Audited Reasoning Refinement: Fine-Tuning Language Models via LLM-Guided Step-Wise Evaluation and Correction
di: Bhattacharyya, Sumanta, et al.
Pubblicazione: (2025)
di: Bhattacharyya, Sumanta, et al.
Pubblicazione: (2025)
Monotonic Reference-Free Refinement for Autoformalization
di: Zhang, Lan, et al.
Pubblicazione: (2026)
di: Zhang, Lan, et al.
Pubblicazione: (2026)
Self-Polish: Enhance Reasoning in Large Language Models via Problem Refinement
di: Xi, Zhiheng, et al.
Pubblicazione: (2023)
di: Xi, Zhiheng, et al.
Pubblicazione: (2023)
Unveiling the Impact of Coding Data Instruction Fine-Tuning on Large Language Models Reasoning
di: Zhang, Xinlu, et al.
Pubblicazione: (2024)
di: Zhang, Xinlu, et al.
Pubblicazione: (2024)
Verification and Refinement of Natural Language Explanations through LLM-Symbolic Theorem Proving
di: Quan, Xin, et al.
Pubblicazione: (2024)
di: Quan, Xin, et al.
Pubblicazione: (2024)
Privacy-Preserving Instructions for Aligning Large Language Models
di: Yu, Da, et al.
Pubblicazione: (2024)
di: Yu, Da, et al.
Pubblicazione: (2024)
Mixture-of-Instructions: Aligning Large Language Models via Mixture Prompting
di: Xu, Bowen, et al.
Pubblicazione: (2024)
di: Xu, Bowen, et al.
Pubblicazione: (2024)
Efficient Response Generation Strategy Selection for Fine-Tuning Large Language Models Through Self-Aligned Perplexity
di: Ren, Xuan, et al.
Pubblicazione: (2025)
di: Ren, Xuan, et al.
Pubblicazione: (2025)
CLASS-IT: Conversational and Lecture-Aligned Small-Scale Instruction Tuning for BabyLMs
di: Capone, Luca, et al.
Pubblicazione: (2025)
di: Capone, Luca, et al.
Pubblicazione: (2025)
GIFT: Guided Fine-Tuning and Transfer for Enhancing Instruction-Tuned Language Models
di: Ruan, Zhiwen, et al.
Pubblicazione: (2026)
di: Ruan, Zhiwen, et al.
Pubblicazione: (2026)
From Templates to Natural Language: Generalization Challenges in Instruction-Tuned LLMs for Spatial Reasoning
di: Kranti, Chalamalasetti, et al.
Pubblicazione: (2025)
di: Kranti, Chalamalasetti, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Empowering Cross-lingual Abilities of Instruction-tuned Large Language Models by Translation-following demonstrations
di: Ranaldi, Leonardo, et al.
Pubblicazione: (2023) -
Eliciting Critical Reasoning in Retrieval-Augmented Language Models via Contrastive Explanations
di: Ranaldi, Leonardo, et al.
Pubblicazione: (2024) -
Improving Chain-of-Thought Reasoning via Quasi-Symbolic Abstractions
di: Ranaldi, Leonardo, et al.
Pubblicazione: (2025) -
Dissecting Clinical Reasoning in Language Models: A Comparative Study of Prompts and Model Adaptation Strategies
di: Jullien, Mael, et al.
Pubblicazione: (2025) -
Improving Multilingual Retrieval-Augmented Language Models through Dialectic Reasoning Argumentations
di: Ranaldi, Leonardo, et al.
Pubblicazione: (2025)