Sequence Repetition Enhances Token Embeddings and Improves Sequence Labeling with Decoder-only Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Kukić, Matija Luka, Čuljak, Marko, Dukić, David, Tutek, Martin, Šnajder, Jan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Looking Right is Sometimes Right: Investigating the Capabilities of Decoder-only LLMs for Sequence Labeling
por: Dukić, David, et al.
Publicado: (2024)
por: Dukić, David, et al.
Publicado: (2024)
Supervised In-Context Fine-Tuning for Generative Sequence Labeling
por: Dukić, David, et al.
Publicado: (2025)
por: Dukić, David, et al.
Publicado: (2025)
Characterizing Linguistic Shifts in Croatian News via Diachronic Word Embeddings
por: Dukić, David, et al.
Publicado: (2025)
por: Dukić, David, et al.
Publicado: (2025)
Improving Transfer Learning for Sequence Labeling Tasks by Adapting Pre-trained Neural Language Models
por: Dukić, David
Publicado: (2025)
por: Dukić, David
Publicado: (2025)
Are ELECTRA's Sentence Embeddings Beyond Repair? The Case of Semantic Textual Similarity
por: Rep, Ivan, et al.
Publicado: (2024)
por: Rep, Ivan, et al.
Publicado: (2024)
Context Parametrization with Compositional Adapters
por: Jukić, Josip, et al.
Publicado: (2025)
por: Jukić, Josip, et al.
Publicado: (2025)
Leveraging Open Information Extraction for More Robust Domain Transfer of Event Trigger Detection
por: Dukić, David, et al.
Publicado: (2023)
por: Dukić, David, et al.
Publicado: (2023)
TakeLab Retriever: AI-Driven Search Engine for Articles from Croatian News Outlets
por: Dukić, David, et al.
Publicado: (2024)
por: Dukić, David, et al.
Publicado: (2024)
From Robustness to Improved Generalization and Calibration in Pre-trained Language Models
por: Jukić, Josip, et al.
Publicado: (2024)
por: Jukić, Josip, et al.
Publicado: (2024)
Out-of-Distribution Detection by Leveraging Between-Layer Transformation Smoothness
por: Jelenić, Fran, et al.
Publicado: (2023)
por: Jelenić, Fran, et al.
Publicado: (2023)
Repetition Improves Language Model Embeddings
por: Springer, Jacob Mitchell, et al.
Publicado: (2024)
por: Springer, Jacob Mitchell, et al.
Publicado: (2024)
Causal2Vec: Improving Decoder-only LLMs as Embedding Models through a Contextual Token
por: Lin, Ailiang, et al.
Publicado: (2025)
por: Lin, Ailiang, et al.
Publicado: (2025)
Compressing Sequences in the Latent Embedding Space: $K$-Token Merging for Large Language Models
por: Xu, Zihao, et al.
Publicado: (2026)
por: Xu, Zihao, et al.
Publicado: (2026)
Claim Check-Worthiness Detection: How Well do LLMs Grasp Annotation Guidelines?
por: Majer, Laura, et al.
Publicado: (2024)
por: Majer, Laura, et al.
Publicado: (2024)
CATfOOD: Counterfactual Augmented Training for Improving Out-of-Domain Performance and Calibration
por: Sachdeva, Rachneet, et al.
Publicado: (2023)
por: Sachdeva, Rachneet, et al.
Publicado: (2023)
Sequence to Sequence Reward Modeling: Improving RLHF by Language Feedback
por: Zhou, Jiayi, et al.
Publicado: (2024)
por: Zhou, Jiayi, et al.
Publicado: (2024)
Disentangling Latent Shifts of In-Context Learning with Weak Supervision
por: Jukić, Josip, et al.
Publicado: (2024)
por: Jukić, Josip, et al.
Publicado: (2024)
Dependency Graph Parsing as Sequence Labeling
por: Ezquerro, Ana, et al.
Publicado: (2024)
por: Ezquerro, Ana, et al.
Publicado: (2024)
Improving Low-Resource Sequence Labeling with Knowledge Fusion and Contextual Label Explanations
por: Lai, Peichao, et al.
Publicado: (2025)
por: Lai, Peichao, et al.
Publicado: (2025)
REVS: Unlearning Sensitive Information in Language Models via Rank Editing in the Vocabulary Space
por: Ashuach, Tomer, et al.
Publicado: (2024)
por: Ashuach, Tomer, et al.
Publicado: (2024)
ToPro: Token-Level Prompt Decomposition for Cross-Lingual Sequence Labeling Tasks
por: Ma, Bolei, et al.
Publicado: (2024)
por: Ma, Bolei, et al.
Publicado: (2024)
Bringing Emerging Architectures to Sequence Labeling in NLP
por: Ezquerro, Ana, et al.
Publicado: (2025)
por: Ezquerro, Ana, et al.
Publicado: (2025)
Temporal Tokenization Strategies for Event Sequence Modeling with Large Language Models
por: Liu, Zefang, et al.
Publicado: (2025)
por: Liu, Zefang, et al.
Publicado: (2025)
LLMs for Targeted Sentiment in News Headlines: Exploring the Descriptive-Prescriptive Dilemma
por: Juroš, Jana, et al.
Publicado: (2024)
por: Juroš, Jana, et al.
Publicado: (2024)
Advancing Cross-lingual Aspect-Based Sentiment Analysis with LLMs and Constrained Decoding for Sequence-to-Sequence Models
por: Šmíd, Jakub, et al.
Publicado: (2025)
por: Šmíd, Jakub, et al.
Publicado: (2025)
Chinese Sequence Labeling with Semi-Supervised Boundary-Aware Language Model Pre-training
por: Zhang, Longhui, et al.
Publicado: (2024)
por: Zhang, Longhui, et al.
Publicado: (2024)
E2S2: Encoding-Enhanced Sequence-to-Sequence Pretraining for Language Understanding and Generation
por: Zhong, Qihuang, et al.
Publicado: (2022)
por: Zhong, Qihuang, et al.
Publicado: (2022)
Improving Language Transfer Capability of Decoder-only Architecture in Multilingual Neural Machine Translation
por: Qu, Zhi, et al.
Publicado: (2024)
por: Qu, Zhi, et al.
Publicado: (2024)
A Global Context Mechanism for Sequence Labeling
por: Xu, Conglei, et al.
Publicado: (2023)
por: Xu, Conglei, et al.
Publicado: (2023)
Textless Dependency Parsing by Labeled Sequence Prediction
por: Kando, Shunsuke, et al.
Publicado: (2024)
por: Kando, Shunsuke, et al.
Publicado: (2024)
Semiparametric Token-Sequence Co-Supervision
por: Lee, Hyunji, et al.
Publicado: (2024)
por: Lee, Hyunji, et al.
Publicado: (2024)
Multi-word Tokenization for Sequence Compression
por: Gee, Leonidas, et al.
Publicado: (2024)
por: Gee, Leonidas, et al.
Publicado: (2024)
Repetition Neurons: How Do Language Models Produce Repetitions?
por: Hiraoka, Tatsuya, et al.
Publicado: (2024)
por: Hiraoka, Tatsuya, et al.
Publicado: (2024)
Retrieval Backward Attention without Additional Training: Enhance Embeddings of Large Language Models via Repetition
por: Duan, Yifei, et al.
Publicado: (2025)
por: Duan, Yifei, et al.
Publicado: (2025)
The Repetition Threshold for Rote Sequences
por: Ollinger, Nicolas, et al.
Publicado: (2024)
por: Ollinger, Nicolas, et al.
Publicado: (2024)
What Makes You CLIC: Detection of Croatian Clickbait Headlines
por: Anđelić, Marija, et al.
Publicado: (2025)
por: Anđelić, Marija, et al.
Publicado: (2025)
Training Language Models on Synthetic Edit Sequences Improves Code Synthesis
por: Piterbarg, Ulyana, et al.
Publicado: (2024)
por: Piterbarg, Ulyana, et al.
Publicado: (2024)
Sequence-to-Sequence Spanish Pre-trained Language Models
por: Araujo, Vladimir, et al.
Publicado: (2023)
por: Araujo, Vladimir, et al.
Publicado: (2023)
SciAnnotate: A Tool for Integrating Weak Labeling Sources for Sequence Labeling
por: Liu, Mengyang, et al.
Publicado: (2022)
por: Liu, Mengyang, et al.
Publicado: (2022)
Sequence-to-Sequence Language Models for Character and Emotion Detection in Dream Narratives
por: Cortal, Gustave
Publicado: (2024)
por: Cortal, Gustave
Publicado: (2024)
Ejemplares similares
-
Looking Right is Sometimes Right: Investigating the Capabilities of Decoder-only LLMs for Sequence Labeling
por: Dukić, David, et al.
Publicado: (2024) -
Supervised In-Context Fine-Tuning for Generative Sequence Labeling
por: Dukić, David, et al.
Publicado: (2025) -
Characterizing Linguistic Shifts in Croatian News via Diachronic Word Embeddings
por: Dukić, David, et al.
Publicado: (2025) -
Improving Transfer Learning for Sequence Labeling Tasks by Adapting Pre-trained Neural Language Models
por: Dukić, David
Publicado: (2025) -
Are ELECTRA's Sentence Embeddings Beyond Repair? The Case of Semantic Textual Similarity
por: Rep, Ivan, et al.
Publicado: (2024)