Chinese Sequence Labeling with Semi-Supervised Boundary-Aware Language Model Pre-training
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Longhui, Long, Dingkun, Zhang, Meishan, Zhang, Yanzhao, Xie, Pengjun, Zhang, Min |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Language Models are Universal Embedders
par: Zhang, Xin, et autres
Publié: (2023)
par: Zhang, Xin, et autres
Publié: (2023)
An End-to-End Model for Photo-Sharing Multi-modal Dialogue Generation
par: Guo, Peiming, et autres
Publié: (2024)
par: Guo, Peiming, et autres
Publié: (2024)
A Two-Stage Adaptation of Large Language Models for Text Ranking
par: Zhang, Longhui, et autres
Publié: (2023)
par: Zhang, Longhui, et autres
Publié: (2023)
Supervised Fine-Tuning or Contrastive Learning? Towards Better Multimodal LLM Reranking
par: Dai, Ziqi, et autres
Publié: (2025)
par: Dai, Ziqi, et autres
Publié: (2025)
Improving General Text Embedding Model: Tackling Task Conflict and Data Imbalance through Model Merging
par: Li, Mingxin, et autres
Publié: (2024)
par: Li, Mingxin, et autres
Publié: (2024)
ERank: Fusing Supervised Fine-Tuning and Reinforcement Learning for Effective and Efficient Text Reranking
par: Cai, Yuzheng, et autres
Publié: (2025)
par: Cai, Yuzheng, et autres
Publié: (2025)
GME: Improving Universal Multimodal Retrieval by Multimodal LLMs
par: Zhang, Xin, et autres
Publié: (2024)
par: Zhang, Xin, et autres
Publié: (2024)
Towards Text-Image Interleaved Retrieval
par: Zhang, Xin, et autres
Publié: (2025)
par: Zhang, Xin, et autres
Publié: (2025)
mGTE: Generalized Long-Context Text Representation and Reranking Models for Multilingual Text Retrieval
par: Zhang, Xin, et autres
Publié: (2024)
par: Zhang, Xin, et autres
Publié: (2024)
E2Rank: Your Text Embedding can Also be an Effective and Efficient Listwise Reranker
par: Liu, Qi, et autres
Publié: (2025)
par: Liu, Qi, et autres
Publié: (2025)
Towards Universal Video Retrieval: Generalizing Video Embedding via Synthesized Multimodal Pyramid Curriculum
par: Guo, Zhuoning, et autres
Publié: (2025)
par: Guo, Zhuoning, et autres
Publié: (2025)
LaSER: Internalizing Explicit Reasoning into Latent Space for Dense Retrieval
par: Jin, Jiajie, et autres
Publié: (2026)
par: Jin, Jiajie, et autres
Publié: (2026)
DiffuRank: Effective Document Reranking with Diffusion Language Models
par: Liu, Qi, et autres
Publié: (2026)
par: Liu, Qi, et autres
Publié: (2026)
Rethinking Composed Image Retrieval Evaluation: A Fine-Grained Benchmark from Image Editing
par: Song, Tingyu, et autres
Publié: (2026)
par: Song, Tingyu, et autres
Publié: (2026)
When Text Embedding Meets Large Language Model: A Comprehensive Survey
par: Nie, Zhijie, et autres
Publié: (2024)
par: Nie, Zhijie, et autres
Publié: (2024)
Qwen3 Embedding: Advancing Text Embedding and Reranking Through Foundation Models
par: Zhang, Yanzhao, et autres
Publié: (2025)
par: Zhang, Yanzhao, et autres
Publié: (2025)
A Systematic Survey of Semantic Role Labeling in the Era of Pretrained Language Models
par: Chen, Huiyao, et autres
Publié: (2025)
par: Chen, Huiyao, et autres
Publié: (2025)
Text2Token: Unsupervised Text Representation Learning with Token Target Prediction
par: An, Ruize, et autres
Publié: (2025)
par: An, Ruize, et autres
Publié: (2025)
Fine-tuning Pre-trained Language Models for Few-shot Intent Detection: Supervised Pre-training and Isotropization
par: Zhang, Haode, et autres
Publié: (2022)
par: Zhang, Haode, et autres
Publié: (2022)
LLMs Can Also Do Well! Breaking Barriers in Semantic Role Labeling via Large Language Models
par: Li, Xinxin, et autres
Publié: (2025)
par: Li, Xinxin, et autres
Publié: (2025)
The Efficiency of Pre-training with Objective Masking in Pseudo Labeling for Semi-Supervised Text Classification
par: Hatefi, Arezoo, et autres
Publié: (2025)
par: Hatefi, Arezoo, et autres
Publié: (2025)
On The Role of Pretrained Language Models in General-Purpose Text Embeddings: A Survey
par: Zhang, Meishan, et autres
Publié: (2025)
par: Zhang, Meishan, et autres
Publié: (2025)
Qwen3-VL-Embedding and Qwen3-VL-Reranker: A Unified Framework for State-of-the-Art Multimodal Retrieval and Ranking
par: Li, Mingxin, et autres
Publié: (2026)
par: Li, Mingxin, et autres
Publié: (2026)
Improving Transfer Learning for Sequence Labeling Tasks by Adapting Pre-trained Neural Language Models
par: Dukić, David
Publié: (2025)
par: Dukić, David
Publié: (2025)
Detecting Knowledge Boundary of Vision Large Language Models by Sampling-Based Inference
par: Chen, Zhuo, et autres
Publié: (2025)
par: Chen, Zhuo, et autres
Publié: (2025)
Pseudo-Prompt Generating in Pre-trained Vision-Language Models for Multi-Label Medical Image Classification
par: Ye, Yaoqin, et autres
Publié: (2024)
par: Ye, Yaoqin, et autres
Publié: (2024)
In-Context Learning for Few-Shot Nested Named Entity Recognition
par: Zhang, Meishan, et autres
Publié: (2024)
par: Zhang, Meishan, et autres
Publié: (2024)
ToolOmni: Enabling Open-World Tool Use via Agentic learning with Proactive Retrieval and Grounded Execution
par: Huang, Shouzheng, et autres
Publié: (2026)
par: Huang, Shouzheng, et autres
Publié: (2026)
Sequence-to-Sequence Spanish Pre-trained Language Models
par: Araujo, Vladimir, et autres
Publié: (2023)
par: Araujo, Vladimir, et autres
Publié: (2023)
KBM: Delineating Knowledge Boundary for Adaptive Retrieval in Large Language Models
par: Zhang, Zhen, et autres
Publié: (2024)
par: Zhang, Zhen, et autres
Publié: (2024)
QoSBERT: An Uncertainty-Aware Approach based on Pre-trained Language Models for Service Quality Prediction
par: Wang, Ziliang, et autres
Publié: (2025)
par: Wang, Ziliang, et autres
Publié: (2025)
Contrastive Learning on LLM Back Generation Treebank for Cross-domain Constituency Parsing
par: Guo, Peiming, et autres
Publié: (2025)
par: Guo, Peiming, et autres
Publié: (2025)
XNLP: An Interactive Demonstration System for Universal Structured NLP
par: Fei, Hao, et autres
Publié: (2023)
par: Fei, Hao, et autres
Publié: (2023)
Calibrating Pre-trained Language Classifiers on LLM-generated Noisy Labels via Iterative Refinement
par: Ye, Liqin, et autres
Publié: (2025)
par: Ye, Liqin, et autres
Publié: (2025)
Less Languages, Less Tokens: An Efficient Unified Logic Cross-lingual Chain-of-Thought Reasoning Framework
par: Zhang, Chenyuan, et autres
Publié: (2026)
par: Zhang, Chenyuan, et autres
Publié: (2026)
PrahokBART: A Pre-trained Sequence-to-Sequence Model for Khmer Natural Language Generation
par: Kaing, Hour, et autres
Publié: (2025)
par: Kaing, Hour, et autres
Publié: (2025)
ReHear: Iterative Pseudo-Label Refinement for Semi-Supervised Speech Recognition via Audio Large Language Models
par: Liu, Zefang, et autres
Publié: (2026)
par: Liu, Zefang, et autres
Publié: (2026)
System Report for CCL25-Eval Task 10: SRAG-MAV for Fine-Grained Chinese Hate Speech Recognition
par: Wang, Jiahao, et autres
Publié: (2025)
par: Wang, Jiahao, et autres
Publié: (2025)
Can Pre-trained Language Models Understand Chinese Humor?
par: Chen, Yuyan, et autres
Publié: (2024)
par: Chen, Yuyan, et autres
Publié: (2024)
Evaluating Discourse Cohesion in Pre-trained Language Models
par: He, Jie, et autres
Publié: (2025)
par: He, Jie, et autres
Publié: (2025)
Documents similaires
-
Language Models are Universal Embedders
par: Zhang, Xin, et autres
Publié: (2023) -
An End-to-End Model for Photo-Sharing Multi-modal Dialogue Generation
par: Guo, Peiming, et autres
Publié: (2024) -
A Two-Stage Adaptation of Large Language Models for Text Ranking
par: Zhang, Longhui, et autres
Publié: (2023) -
Supervised Fine-Tuning or Contrastive Learning? Towards Better Multimodal LLM Reranking
par: Dai, Ziqi, et autres
Publié: (2025) -
Improving General Text Embedding Model: Tackling Task Conflict and Data Imbalance through Model Merging
par: Li, Mingxin, et autres
Publié: (2024)