Reverse Training to Nurse the Reversal Curse
Fuente:
arXiv
Salvato in:
| Autori principali: | Golovneva, Olga, Allen-Zhu, Zeyuan, Weston, Jason, Sukhbaatar, Sainbayar |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Contextual Position Encoding: Learning to Count What's Important
di: Golovneva, Olga, et al.
Pubblicazione: (2024)
di: Golovneva, Olga, et al.
Pubblicazione: (2024)
StepWiser: Stepwise Generative Judges for Wiser Reasoning
di: Xiong, Wei, et al.
Pubblicazione: (2025)
di: Xiong, Wei, et al.
Pubblicazione: (2025)
Multi-Token Attention
di: Golovneva, Olga, et al.
Pubblicazione: (2025)
di: Golovneva, Olga, et al.
Pubblicazione: (2025)
R.I.P.: Better Models by Survival of the Fittest Prompts
di: Yu, Ping, et al.
Pubblicazione: (2025)
di: Yu, Ping, et al.
Pubblicazione: (2025)
Meta-Rewarding Language Models: Self-Improving Alignment with LLM-as-a-Meta-Judge
di: Wu, Tianhao, et al.
Pubblicazione: (2024)
di: Wu, Tianhao, et al.
Pubblicazione: (2024)
Some things are more CRINGE than others: Iterative Preference Optimization with the Pairwise Cringe Loss
di: Xu, Jing, et al.
Pubblicazione: (2023)
di: Xu, Jing, et al.
Pubblicazione: (2023)
CoT-Self-Instruct: Building high-quality synthetic prompts for reasoning and non-reasoning tasks
di: Yu, Ping, et al.
Pubblicazione: (2025)
di: Yu, Ping, et al.
Pubblicazione: (2025)
Self-Challenging Language Model Agents
di: Zhou, Yifei, et al.
Pubblicazione: (2025)
di: Zhou, Yifei, et al.
Pubblicazione: (2025)
Branch-Train-MiX: Mixing Expert LLMs into a Mixture-of-Experts LLM
di: Sukhbaatar, Sainbayar, et al.
Pubblicazione: (2024)
di: Sukhbaatar, Sainbayar, et al.
Pubblicazione: (2024)
Thinking LLMs: General Instruction Following with Thought Generation
di: Wu, Tianhao, et al.
Pubblicazione: (2024)
di: Wu, Tianhao, et al.
Pubblicazione: (2024)
Iterative Reasoning Preference Optimization
di: Pang, Richard Yuanzhe, et al.
Pubblicazione: (2024)
di: Pang, Richard Yuanzhe, et al.
Pubblicazione: (2024)
Self-Rewarding Language Models
di: Yuan, Weizhe, et al.
Pubblicazione: (2024)
di: Yuan, Weizhe, et al.
Pubblicazione: (2024)
Self-Improving Pretraining: using post-trained models to pretrain better models
di: Tan, Ellen Xiaoqing, et al.
Pubblicazione: (2026)
di: Tan, Ellen Xiaoqing, et al.
Pubblicazione: (2026)
An Analysis and Mitigation of the Reversal Curse
di: Lv, Ang, et al.
Pubblicazione: (2023)
di: Lv, Ang, et al.
Pubblicazione: (2023)
The Illusion of Latent Generalization: Bi-directionality and the Reversal Curse
di: Coda-Forno, Julian, et al.
Pubblicazione: (2026)
di: Coda-Forno, Julian, et al.
Pubblicazione: (2026)
The Factorization Curse: Which Tokens You Predict Underlie the Reversal Curse and More
di: Kitouni, Ouail, et al.
Pubblicazione: (2024)
di: Kitouni, Ouail, et al.
Pubblicazione: (2024)
Mitigating Reversal Curse in Large Language Models via Semantic-aware Permutation Training
di: Guo, Qingyan, et al.
Pubblicazione: (2024)
di: Guo, Qingyan, et al.
Pubblicazione: (2024)
A Theoretical Analysis of Why Masked Diffusion Models Mitigate the Reversal Curse
di: Jeon, Moongyu, et al.
Pubblicazione: (2026)
di: Jeon, Moongyu, et al.
Pubblicazione: (2026)
Self-Consistency Preference Optimization
di: Prasad, Archiki, et al.
Pubblicazione: (2024)
di: Prasad, Archiki, et al.
Pubblicazione: (2024)
The Reversal Curse: LLMs trained on "A is B" fail to learn "B is A"
di: Berglund, Lukas, et al.
Pubblicazione: (2023)
di: Berglund, Lukas, et al.
Pubblicazione: (2023)
The Era of Real-World Human Interaction: RL from User Conversations
di: Jin, Chuanyang, et al.
Pubblicazione: (2025)
di: Jin, Chuanyang, et al.
Pubblicazione: (2025)
Self-Taught Evaluators
di: Wang, Tianlu, et al.
Pubblicazione: (2024)
di: Wang, Tianlu, et al.
Pubblicazione: (2024)
Exploring the Reversal Curse and Other Deductive Logical Reasoning in BERT and GPT-Based Large Language Models
di: Wu, Da, et al.
Pubblicazione: (2023)
di: Wu, Da, et al.
Pubblicazione: (2023)
Training Large Language Models to Reason in a Continuous Latent Space
di: Hao, Shibo, et al.
Pubblicazione: (2024)
di: Hao, Shibo, et al.
Pubblicazione: (2024)
Reversing Large Language Models for Efficient Training and Fine-Tuning
di: Gal, Eshed, et al.
Pubblicazione: (2025)
di: Gal, Eshed, et al.
Pubblicazione: (2025)
Physics of Language Models: Part 3.3, Knowledge Capacity Scaling Laws
di: Allen-Zhu, Zeyuan, et al.
Pubblicazione: (2024)
di: Allen-Zhu, Zeyuan, et al.
Pubblicazione: (2024)
Physics of Language Models: Part 1, Learning Hierarchical Language Structures
di: Allen-Zhu, Zeyuan, et al.
Pubblicazione: (2023)
di: Allen-Zhu, Zeyuan, et al.
Pubblicazione: (2023)
Physics of Language Models: Part 3.1, Knowledge Storage and Extraction
di: Allen-Zhu, Zeyuan, et al.
Pubblicazione: (2023)
di: Allen-Zhu, Zeyuan, et al.
Pubblicazione: (2023)
Physics of Language Models: Part 3.2, Knowledge Manipulation
di: Allen-Zhu, Zeyuan, et al.
Pubblicazione: (2023)
di: Allen-Zhu, Zeyuan, et al.
Pubblicazione: (2023)
Crown, Frame, Reverse: Layer-Wise Scaling Variants for LLM Pre-Training
di: Baroian, Andrei, et al.
Pubblicazione: (2025)
di: Baroian, Andrei, et al.
Pubblicazione: (2025)
LEDOM: Reverse Language Model
di: Yin, Xunjian, et al.
Pubblicazione: (2025)
di: Yin, Xunjian, et al.
Pubblicazione: (2025)
Reversal of Thought: Enhancing Large Language Models with Preference-Guided Reverse Reasoning Warm-up
di: Yuan, Jiahao, et al.
Pubblicazione: (2024)
di: Yuan, Jiahao, et al.
Pubblicazione: (2024)
System-Level Natural Language Feedback
di: Yuan, Weizhe, et al.
Pubblicazione: (2023)
di: Yuan, Weizhe, et al.
Pubblicazione: (2023)
Following Length Constraints in Instructions
di: Yuan, Weizhe, et al.
Pubblicazione: (2024)
di: Yuan, Weizhe, et al.
Pubblicazione: (2024)
Adaptive Decoding via Latent Preference Optimization
di: Dhuliawala, Shehzaad, et al.
Pubblicazione: (2024)
di: Dhuliawala, Shehzaad, et al.
Pubblicazione: (2024)
Diverse Preference Optimization
di: Lanchantin, Jack, et al.
Pubblicazione: (2025)
di: Lanchantin, Jack, et al.
Pubblicazione: (2025)
R$^3$Mem: Bridging Memory Retention and Retrieval via Reversible Compression
di: Wang, Xiaoqiang, et al.
Pubblicazione: (2025)
di: Wang, Xiaoqiang, et al.
Pubblicazione: (2025)
Reasoning over mathematical objects: on-policy reward modeling and test time aggregation
di: Aggarwal, Pranjal, et al.
Pubblicazione: (2026)
di: Aggarwal, Pranjal, et al.
Pubblicazione: (2026)
Time-Reversal Provides Unsupervised Feedback to LLMs
di: Varun, Yerram, et al.
Pubblicazione: (2024)
di: Varun, Yerram, et al.
Pubblicazione: (2024)
Reversible Diffusion Decoding for Diffusion Language Models
di: Wang, Xinyun, et al.
Pubblicazione: (2026)
di: Wang, Xinyun, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Contextual Position Encoding: Learning to Count What's Important
di: Golovneva, Olga, et al.
Pubblicazione: (2024) -
StepWiser: Stepwise Generative Judges for Wiser Reasoning
di: Xiong, Wei, et al.
Pubblicazione: (2025) -
Multi-Token Attention
di: Golovneva, Olga, et al.
Pubblicazione: (2025) -
R.I.P.: Better Models by Survival of the Fittest Prompts
di: Yu, Ping, et al.
Pubblicazione: (2025) -
Meta-Rewarding Language Models: Self-Improving Alignment with LLM-as-a-Meta-Judge
di: Wu, Tianhao, et al.
Pubblicazione: (2024)