Mitigating Reversal Curse in Large Language Models via Semantic-aware Permutation Training
Fuente:
arXiv
Guardado en:
| Autores principales: | Guo, Qingyan, Wang, Rui, Guo, Junliang, Tan, Xu, Bian, Jiang, Yang, Yujiu |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
EvoPrompt: Connecting LLMs with Evolutionary Algorithms Yields Powerful Prompt Optimizers
por: Guo, Qingyan, et al.
Publicado: (2023)
por: Guo, Qingyan, et al.
Publicado: (2023)
An Analysis and Mitigation of the Reversal Curse
por: Lv, Ang, et al.
Publicado: (2023)
por: Lv, Ang, et al.
Publicado: (2023)
Empowering Diffusion Models on the Embedding Space for Text Generation
por: Gao, Zhujin, et al.
Publicado: (2022)
por: Gao, Zhujin, et al.
Publicado: (2022)
Exploring the Reversal Curse and Other Deductive Logical Reasoning in BERT and GPT-Based Large Language Models
por: Wu, Da, et al.
Publicado: (2023)
por: Wu, Da, et al.
Publicado: (2023)
Mitigating Selection Bias in Large Language Models via Permutation-Aware GRPO
por: Zheng, Jinquan, et al.
Publicado: (2026)
por: Zheng, Jinquan, et al.
Publicado: (2026)
Reverse Training to Nurse the Reversal Curse
por: Golovneva, Olga, et al.
Publicado: (2024)
por: Golovneva, Olga, et al.
Publicado: (2024)
Training Large Language Models for Reasoning through Reverse Curriculum Reinforcement Learning
por: Xi, Zhiheng, et al.
Publicado: (2024)
por: Xi, Zhiheng, et al.
Publicado: (2024)
The Factorization Curse: Which Tokens You Predict Underlie the Reversal Curse and More
por: Kitouni, Ouail, et al.
Publicado: (2024)
por: Kitouni, Ouail, et al.
Publicado: (2024)
A Theoretical Analysis of Why Masked Diffusion Models Mitigate the Reversal Curse
por: Jeon, Moongyu, et al.
Publicado: (2026)
por: Jeon, Moongyu, et al.
Publicado: (2026)
DIDS: Domain Impact-aware Data Sampling for Large Language Model Training
por: Shi, Weijie, et al.
Publicado: (2025)
por: Shi, Weijie, et al.
Publicado: (2025)
The Reversal Curse: LLMs trained on "A is B" fail to learn "B is A"
por: Berglund, Lukas, et al.
Publicado: (2023)
por: Berglund, Lukas, et al.
Publicado: (2023)
LLM-NEO: Parameter Efficient Knowledge Distillation for Large Language Models
por: Yang, Runming, et al.
Publicado: (2024)
por: Yang, Runming, et al.
Publicado: (2024)
APTQ: Attention-aware Post-Training Mixed-Precision Quantization for Large Language Models
por: Guan, Ziyi, et al.
Publicado: (2024)
por: Guan, Ziyi, et al.
Publicado: (2024)
Distributional Clarity: The Hidden Driver of RL-Friendliness in Large Language Models
por: Sun, Shaoning, et al.
Publicado: (2026)
por: Sun, Shaoning, et al.
Publicado: (2026)
Mitigating Hallucinations in Large Language Models via Causal Reasoning
por: Li, Yuangang, et al.
Publicado: (2025)
por: Li, Yuangang, et al.
Publicado: (2025)
Bridging the Semantic Gap for Categorical Data Clustering via Large Language Models
por: Yang, Zihua, et al.
Publicado: (2026)
por: Yang, Zihua, et al.
Publicado: (2026)
Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification
por: Liu, Chengwu, et al.
Publicado: (2025)
por: Liu, Chengwu, et al.
Publicado: (2025)
MAR: Efficient Large Language Models via Module-aware Architecture Refinement
por: Cai, Junhong, et al.
Publicado: (2026)
por: Cai, Junhong, et al.
Publicado: (2026)
On the Overscaling Curse of Parallel Thinking: System Efficacy Contradicts Sample Efficiency
por: Wang, Yiming, et al.
Publicado: (2026)
por: Wang, Yiming, et al.
Publicado: (2026)
Fast Large Language Model Collaborative Decoding via Speculation
por: Fu, Jiale, et al.
Publicado: (2025)
por: Fu, Jiale, et al.
Publicado: (2025)
Mitigating Over-Refusal in Aligned Large Language Models via Inference-Time Activation Energy
por: Jiang, Eric Hanchen, et al.
Publicado: (2025)
por: Jiang, Eric Hanchen, et al.
Publicado: (2025)
Regurgitative Training: The Value of Real Data in Training Large Language Models
por: Zhang, Jinghui, et al.
Publicado: (2024)
por: Zhang, Jinghui, et al.
Publicado: (2024)
Accelerating Diffusion Large Language Models with SlowFast Sampling: The Three Golden Principles
por: Wei, Qingyan, et al.
Publicado: (2025)
por: Wei, Qingyan, et al.
Publicado: (2025)
ChiEngMixBench: Evaluating Large Language Models on Spontaneous and Natural Chinese-English Code-Mixed Generation
por: Yang, Qingyan, et al.
Publicado: (2026)
por: Yang, Qingyan, et al.
Publicado: (2026)
The Curse of Depth in Large Language Models
por: Sun, Wenfang, et al.
Publicado: (2025)
por: Sun, Wenfang, et al.
Publicado: (2025)
LLM4Causal: Democratized Causal Tools for Everyone via Large Language Model
por: Jiang, Haitao, et al.
Publicado: (2023)
por: Jiang, Haitao, et al.
Publicado: (2023)
Improving Uncertainty Quantification in Large Language Models via Semantic Embeddings
por: Grewal, Yashvir S., et al.
Publicado: (2024)
por: Grewal, Yashvir S., et al.
Publicado: (2024)
Self-Hinting Language Models Enhance Reinforcement Learning
por: Liao, Baohao, et al.
Publicado: (2026)
por: Liao, Baohao, et al.
Publicado: (2026)
Induction Head Toxicity Mechanistically Explains Repetition Curse in Large Language Models
por: Wang, Shuxun, et al.
Publicado: (2025)
por: Wang, Shuxun, et al.
Publicado: (2025)
RE-Adapt: Reverse Engineered Adaptation of Large Language Models
por: Fleshman, William, et al.
Publicado: (2024)
por: Fleshman, William, et al.
Publicado: (2024)
CURE: Controlled Unlearning for Robust Embeddings -- Mitigating Conceptual Shortcuts in Pre-Trained Language Models
por: Kocak, Aysenur, et al.
Publicado: (2025)
por: Kocak, Aysenur, et al.
Publicado: (2025)
Emergent Representations of Program Semantics in Language Models Trained on Programs
por: Jin, Charles, et al.
Publicado: (2023)
por: Jin, Charles, et al.
Publicado: (2023)
Sliding Window Attention Training for Efficient Large Language Models
por: Fu, Zichuan, et al.
Publicado: (2025)
por: Fu, Zichuan, et al.
Publicado: (2025)
Training Language Models to Explain Their Own Computations
por: Li, Belinda Z., et al.
Publicado: (2025)
por: Li, Belinda Z., et al.
Publicado: (2025)
Sample-aware Adaptive Structured Pruning for Large Language Models
por: Kong, Jun, et al.
Publicado: (2025)
por: Kong, Jun, et al.
Publicado: (2025)
Detecting Training Data of Large Language Models via Expectation Maximization
por: Kim, Gyuwan, et al.
Publicado: (2024)
por: Kim, Gyuwan, et al.
Publicado: (2024)
Train Small, Infer Large: Memory-Efficient LoRA Training for Large Language Models
por: Zhang, Jun, et al.
Publicado: (2025)
por: Zhang, Jun, et al.
Publicado: (2025)
Syntactic and Semantic Control of Large Language Models via Sequential Monte Carlo
por: Loula, João, et al.
Publicado: (2025)
por: Loula, João, et al.
Publicado: (2025)
Probing the Robustness of Large Language Models Safety to Latent Perturbations
por: Gu, Tianle, et al.
Publicado: (2025)
por: Gu, Tianle, et al.
Publicado: (2025)
The Illusion of Latent Generalization: Bi-directionality and the Reversal Curse
por: Coda-Forno, Julian, et al.
Publicado: (2026)
por: Coda-Forno, Julian, et al.
Publicado: (2026)
Ejemplares similares
-
EvoPrompt: Connecting LLMs with Evolutionary Algorithms Yields Powerful Prompt Optimizers
por: Guo, Qingyan, et al.
Publicado: (2023) -
An Analysis and Mitigation of the Reversal Curse
por: Lv, Ang, et al.
Publicado: (2023) -
Empowering Diffusion Models on the Embedding Space for Text Generation
por: Gao, Zhujin, et al.
Publicado: (2022) -
Exploring the Reversal Curse and Other Deductive Logical Reasoning in BERT and GPT-Based Large Language Models
por: Wu, Da, et al.
Publicado: (2023) -
Mitigating Selection Bias in Large Language Models via Permutation-Aware GRPO
por: Zheng, Jinquan, et al.
Publicado: (2026)