Repetition Improves Language Model Embeddings
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Springer, Jacob Mitchell, Kotha, Suhas, Fried, Daniel, Neubig, Graham, Raghunathan, Aditi |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Understanding Catastrophic Forgetting in Language Models via Implicit Inference
par: Kotha, Suhas, et autres
Publié: (2023)
par: Kotha, Suhas, et autres
Publié: (2023)
Testing the Limits of Jailbreaking Defenses with the Purple Problem
par: Kim, Taeyoun, et autres
Publié: (2024)
par: Kim, Taeyoun, et autres
Publié: (2024)
Mitigating Bias in RAG: Controlling the Embedder
par: Kim, Taeyoun, et autres
Publié: (2025)
par: Kim, Taeyoun, et autres
Publié: (2025)
Sharpness-Aware Pretraining Mitigates Catastrophic Forgetting
par: Watts, Ishaan, et autres
Publié: (2026)
par: Watts, Ishaan, et autres
Publié: (2026)
Replaying pre-training data improves fine-tuning
par: Kotha, Suhas, et autres
Publié: (2026)
par: Kotha, Suhas, et autres
Publié: (2026)
Overtrained Language Models Are Harder to Fine-Tune
par: Springer, Jacob Mitchell, et autres
Publié: (2025)
par: Springer, Jacob Mitchell, et autres
Publié: (2025)
Watch the Weights: Unsupervised monitoring and control of fine-tuned LLMs
par: Zhong, Ziqian, et autres
Publié: (2025)
par: Zhong, Ziqian, et autres
Publié: (2025)
Sharpness-Aware Minimization Enhances Feature Quality via Balanced Learning
par: Springer, Jacob Mitchell, et autres
Publié: (2024)
par: Springer, Jacob Mitchell, et autres
Publié: (2024)
Understanding Finetuning for Factual Knowledge Extraction
par: Ghosal, Gaurav, et autres
Publié: (2024)
par: Ghosal, Gaurav, et autres
Publié: (2024)
ImpossibleBench: Measuring LLMs' Propensity of Exploiting Test Cases
par: Zhong, Ziqian, et autres
Publié: (2025)
par: Zhong, Ziqian, et autres
Publié: (2025)
Self-Trained Verification for Training- and Test-Time Self-Improvement
par: Wu, Chen Henry, et autres
Publié: (2026)
par: Wu, Chen Henry, et autres
Publié: (2026)
Early Data Exposure Improves Robustness to Subsequent Fine-Tuning
par: Feng, Lawrence, et autres
Publié: (2026)
par: Feng, Lawrence, et autres
Publié: (2026)
Dissecting Adversarial Robustness of Multimodal LM Agents
par: Wu, Chen Henry, et autres
Publié: (2024)
par: Wu, Chen Henry, et autres
Publié: (2024)
Retrieval Backward Attention without Additional Training: Enhance Embeddings of Large Language Models via Repetition
par: Duan, Yifei, et autres
Publié: (2025)
par: Duan, Yifei, et autres
Publié: (2025)
Context-Parametric Inversion: Why Instruction Finetuning Can Worsen Context Reliance
par: Goyal, Sachin, et autres
Publié: (2024)
par: Goyal, Sachin, et autres
Publié: (2024)
Mode-Conditioning Unlocks Superior Test-Time Scaling
par: Wu, Chen Henry, et autres
Publié: (2025)
par: Wu, Chen Henry, et autres
Publié: (2025)
Multitask Learning Can Improve Worst-Group Outcomes
par: Kulkarni, Atharva, et autres
Publié: (2023)
par: Kulkarni, Atharva, et autres
Publié: (2023)
T-MARS: Improving Visual Representations by Circumventing Text Feature Learning
par: Maini, Pratyush, et autres
Publié: (2023)
par: Maini, Pratyush, et autres
Publié: (2023)
Understanding the Influence of Synthetic Data for Text Embedders
par: Springer, Jacob Mitchell, et autres
Publié: (2025)
par: Springer, Jacob Mitchell, et autres
Publié: (2025)
SOTOPIA: Interactive Evaluation for Social Intelligence in Language Agents
par: Zhou, Xuhui, et autres
Publié: (2023)
par: Zhou, Xuhui, et autres
Publié: (2023)
From Decoding to Meta-Generation: Inference-time Algorithms for Large Language Models
par: Welleck, Sean, et autres
Publié: (2024)
par: Welleck, Sean, et autres
Publié: (2024)
Gained in Translation: Privileged Pairwise Judges Enhance Multilingual Reasoning
par: Sutawika, Lintang, et autres
Publié: (2026)
par: Sutawika, Lintang, et autres
Publié: (2026)
Roll the dice & look before you leap: Going beyond the creative limits of next-token prediction
par: Nagarajan, Vaishnavh, et autres
Publié: (2025)
par: Nagarajan, Vaishnavh, et autres
Publié: (2025)
Base Models Look Human To AI Detectors
par: Xu, Yixuan Even, et autres
Publié: (2026)
par: Xu, Yixuan Even, et autres
Publié: (2026)
Antislop: A Comprehensive Framework for Identifying and Eliminating Repetitive Patterns in Language Models
par: Paech, Samuel, et autres
Publié: (2025)
par: Paech, Samuel, et autres
Publié: (2025)
Divergences between Language Models and Human Brains
par: Zhou, Yuchen, et autres
Publié: (2023)
par: Zhou, Yuchen, et autres
Publié: (2023)
Hybrid-Gym: Training Coding Agents to Generalize Across Tasks
par: Xie, Yiqing, et autres
Publié: (2026)
par: Xie, Yiqing, et autres
Publié: (2026)
Prompt Repetition Improves Non-Reasoning LLMs
par: Leviathan, Yaniv, et autres
Publié: (2025)
par: Leviathan, Yaniv, et autres
Publié: (2025)
Demystifying Long Chain-of-Thought Reasoning in LLMs
par: Yeo, Edward, et autres
Publié: (2025)
par: Yeo, Edward, et autres
Publié: (2025)
Grounding Multilingual Multimodal LLMs With Cultural Knowledge
par: Nyandwi, Jean de Dieu, et autres
Publié: (2025)
par: Nyandwi, Jean de Dieu, et autres
Publié: (2025)
Tree Search for Language Model Agents
par: Koh, Jing Yu, et autres
Publié: (2024)
par: Koh, Jing Yu, et autres
Publié: (2024)
Mitigating the Language Mismatch and Repetition Issues in LLM-based Machine Translation via Model Editing
par: Wang, Weichuan, et autres
Publié: (2024)
par: Wang, Weichuan, et autres
Publié: (2024)
Do LLMs Understand Your Translations? Evaluating Paragraph-level MT with Question Answering
par: Fernandes, Patrick, et autres
Publié: (2025)
par: Fernandes, Patrick, et autres
Publié: (2025)
What Are Tools Anyway? A Survey from the Language Model Perspective
par: Wang, Zhiruo, et autres
Publié: (2024)
par: Wang, Zhiruo, et autres
Publié: (2024)
VisualWebArena: Evaluating Multimodal Agents on Realistic Visual Web Tasks
par: Koh, Jing Yu, et autres
Publié: (2024)
par: Koh, Jing Yu, et autres
Publié: (2024)
Reframing Data Value for Large Language Models Through the Lens of Plausibility
par: Rammal, Mohamad Rida, et autres
Publié: (2024)
par: Rammal, Mohamad Rida, et autres
Publié: (2024)
Everybody Prune Now: Structured Pruning of LLMs with only Forward Passes
par: Kolawole, Steven, et autres
Publié: (2024)
par: Kolawole, Steven, et autres
Publié: (2024)
Instruction-tuned Language Models are Better Knowledge Learners
par: Jiang, Zhengbao, et autres
Publié: (2024)
par: Jiang, Zhengbao, et autres
Publié: (2024)
An Incomplete Loop: Instruction Inference, Instruction Following, and In-context Learning in Language Models
par: Liu, Emmy, et autres
Publié: (2024)
par: Liu, Emmy, et autres
Publié: (2024)
WebArena: A Realistic Web Environment for Building Autonomous Agents
par: Zhou, Shuyan, et autres
Publié: (2023)
par: Zhou, Shuyan, et autres
Publié: (2023)
Documents similaires
-
Understanding Catastrophic Forgetting in Language Models via Implicit Inference
par: Kotha, Suhas, et autres
Publié: (2023) -
Testing the Limits of Jailbreaking Defenses with the Purple Problem
par: Kim, Taeyoun, et autres
Publié: (2024) -
Mitigating Bias in RAG: Controlling the Embedder
par: Kim, Taeyoun, et autres
Publié: (2025) -
Sharpness-Aware Pretraining Mitigates Catastrophic Forgetting
par: Watts, Ishaan, et autres
Publié: (2026) -
Replaying pre-training data improves fine-tuning
par: Kotha, Suhas, et autres
Publié: (2026)