Taking a Deep Breath: Enhancing Language Modeling of Large Language Models with Sentinel Tokens
Fuente:
arXiv
Guardado en:
| Autores principales: | Luo, Weiyao, Zheng, Suncong, Xia, Heming, Wang, Weikang, Lei, Yan, Liu, Tianyu, Chen, Shuang, Sui, Zhifang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Can Large Multimodal Models Uncover Deep Semantics Behind Images?
por: Yang, Yixin, et al.
Publicado: (2024)
por: Yang, Yixin, et al.
Publicado: (2024)
Towards Harmonized Uncertainty Estimation for Large Language Models
por: Li, Rui, et al.
Publicado: (2025)
por: Li, Rui, et al.
Publicado: (2025)
Unlocking Efficiency in Large Language Model Inference: A Comprehensive Survey of Speculative Decoding
por: Xia, Heming, et al.
Publicado: (2024)
por: Xia, Heming, et al.
Publicado: (2024)
Large Language Models Struggle with Unreasonability in Math Problems
por: Ma, Jingyuan, et al.
Publicado: (2024)
por: Ma, Jingyuan, et al.
Publicado: (2024)
Can Large Language Models Always Solve Easy Problems if They Can Solve Harder Ones?
por: Yang, Zhe, et al.
Publicado: (2024)
por: Yang, Zhe, et al.
Publicado: (2024)
Language Models Encode the Value of Numbers Linearly
por: Zhu, Fangwei, et al.
Publicado: (2024)
por: Zhu, Fangwei, et al.
Publicado: (2024)
Enhancing Tool Retrieval with Iterative Feedback from Large Language Models
por: Xu, Qiancheng, et al.
Publicado: (2024)
por: Xu, Qiancheng, et al.
Publicado: (2024)
Exploring Activation Patterns of Parameters in Language Models
por: Wang, Yudong, et al.
Publicado: (2024)
por: Wang, Yudong, et al.
Publicado: (2024)
Self-Boosting Large Language Models with Synthetic Preference Data
por: Dong, Qingxiu, et al.
Publicado: (2024)
por: Dong, Qingxiu, et al.
Publicado: (2024)
HauntAttack: When Attack Follows Reasoning as a Shadow
por: Ma, Jingyuan, et al.
Publicado: (2025)
por: Ma, Jingyuan, et al.
Publicado: (2025)
SignLLM: Sign Language Production Large Language Models
por: Fang, Sen, et al.
Publicado: (2024)
por: Fang, Sen, et al.
Publicado: (2024)
Efficient Temporal Tokenization for Mobility Prediction with Large Language Models
por: He, Haoyu, et al.
Publicado: (2025)
por: He, Haoyu, et al.
Publicado: (2025)
How Far are LLMs from Being Our Digital Twins? A Benchmark for Persona-Based Behavior Chain Simulation
por: Li, Rui, et al.
Publicado: (2025)
por: Li, Rui, et al.
Publicado: (2025)
STShield: Single-Token Sentinel for Real-Time Jailbreak Detection in Large Language Models
por: Wang, Xunguang, et al.
Publicado: (2025)
por: Wang, Xunguang, et al.
Publicado: (2025)
Revealing the Learning Dynamics of Long-Context Continual Pre-training
por: Liang, Yupu, et al.
Publicado: (2026)
por: Liang, Yupu, et al.
Publicado: (2026)
Chain-of-Thought Tokens are Computer Program Variables
por: Zhu, Fangwei, et al.
Publicado: (2025)
por: Zhu, Fangwei, et al.
Publicado: (2025)
Stop Taking Tokenizers for Granted: They Are Core Design Decisions in Large Language Models
por: Alqahtani, Sawsan, et al.
Publicado: (2026)
por: Alqahtani, Sawsan, et al.
Publicado: (2026)
PEToolLLM: Towards Personalized Tool Learning in Large Language Models
por: Xu, Qiancheng, et al.
Publicado: (2025)
por: Xu, Qiancheng, et al.
Publicado: (2025)
Chip-Tuning: Classify Before Language Models Say
por: Zhu, Fangwei, et al.
Publicado: (2024)
por: Zhu, Fangwei, et al.
Publicado: (2024)
Don't Take Things Out of Context: Attention Intervention for Enhancing Chain-of-Thought Reasoning in Large Language Models
por: Yan, Shaotian, et al.
Publicado: (2025)
por: Yan, Shaotian, et al.
Publicado: (2025)
Beyond Single Frames: Can LMMs Comprehend Temporal and Contextual Narratives in Image Sequences?
por: Wang, Xiaochen, et al.
Publicado: (2025)
por: Wang, Xiaochen, et al.
Publicado: (2025)
DND: Boosting Large Language Models with Dynamic Nested Depth
por: Chen, Tieyuan, et al.
Publicado: (2025)
por: Chen, Tieyuan, et al.
Publicado: (2025)
Enhancing Large Language Models for Mobility Analytics with Semantic Location Tokenization
por: Chen, Yile, et al.
Publicado: (2025)
por: Chen, Yile, et al.
Publicado: (2025)
Enhancing Large Language Model Reasoning via Selective Critical Token Fine-Tuning
por: Ruan, Zhiwen, et al.
Publicado: (2025)
por: Ruan, Zhiwen, et al.
Publicado: (2025)
Empirical Study of Large Language Models as Automated Essay Scoring Tools in English Composition__Taking TOEFL Independent Writing Task for Example
por: Xia, Wei, et al.
Publicado: (2024)
por: Xia, Wei, et al.
Publicado: (2024)
Scalable Token-Level Hallucination Detection in Large Language Models
por: Min, Rui, et al.
Publicado: (2026)
por: Min, Rui, et al.
Publicado: (2026)
Flexibly Scaling Large Language Models Contexts Through Extensible Tokenization
por: Shao, Ninglu, et al.
Publicado: (2024)
por: Shao, Ninglu, et al.
Publicado: (2024)
AdaMMS: Model Merging for Heterogeneous Multimodal Large Language Models with Unsupervised Coefficient Optimization
por: Du, Yiyang, et al.
Publicado: (2025)
por: Du, Yiyang, et al.
Publicado: (2025)
Quite Good, but Not Enough: Nationality Bias in Large Language Models -- A Case Study of ChatGPT
por: Zhu, Shucheng, et al.
Publicado: (2024)
por: Zhu, Shucheng, et al.
Publicado: (2024)
From Token to Token Pair: Efficient Prompt Compression for Large Language Models in Clinical Prediction
por: Zhu, Mingcheng, et al.
Publicado: (2026)
por: Zhu, Mingcheng, et al.
Publicado: (2026)
ReTok: Replacing Tokenizer to Enhance Representation Efficiency in Large Language Model
por: Gu, Shuhao, et al.
Publicado: (2024)
por: Gu, Shuhao, et al.
Publicado: (2024)
Problematic Tokens: Tokenizer Bias in Large Language Models
por: Yang, Jin, et al.
Publicado: (2024)
por: Yang, Jin, et al.
Publicado: (2024)
AICoderEval: Improving AI Domain Code Generation of Large Language Models
por: Xia, Yinghui, et al.
Publicado: (2024)
por: Xia, Yinghui, et al.
Publicado: (2024)
PrefixQuant: Eliminating Outliers by Prefixed Tokens for Large Language Models Quantization
por: Chen, Mengzhao, et al.
Publicado: (2024)
por: Chen, Mengzhao, et al.
Publicado: (2024)
Tokenization Matters! Degrading Large Language Models through Challenging Their Tokenization
por: Wang, Dixuan, et al.
Publicado: (2024)
por: Wang, Dixuan, et al.
Publicado: (2024)
Addressing Tokenization Inconsistency in Steganography and Watermarking Based on Large Language Models
por: Yan, Ruiyi, et al.
Publicado: (2025)
por: Yan, Ruiyi, et al.
Publicado: (2025)
Rethinking Personalization in Large Language Models at the Token Level
por: Zhang, Chenheng, et al.
Publicado: (2026)
por: Zhang, Chenheng, et al.
Publicado: (2026)
Large Language Model Sentinel: LLM Agent for Adversarial Purification
por: Lin, Guang, et al.
Publicado: (2024)
por: Lin, Guang, et al.
Publicado: (2024)
Enhancing Knowledge Distillation of Large Language Models through Efficient Multi-Modal Distribution Alignment
por: Peng, Tianyu, et al.
Publicado: (2024)
por: Peng, Tianyu, et al.
Publicado: (2024)
Towards a Unified View of Preference Learning for Large Language Models: A Survey
por: Gao, Bofei, et al.
Publicado: (2024)
por: Gao, Bofei, et al.
Publicado: (2024)
Ejemplares similares
-
Can Large Multimodal Models Uncover Deep Semantics Behind Images?
por: Yang, Yixin, et al.
Publicado: (2024) -
Towards Harmonized Uncertainty Estimation for Large Language Models
por: Li, Rui, et al.
Publicado: (2025) -
Unlocking Efficiency in Large Language Model Inference: A Comprehensive Survey of Speculative Decoding
por: Xia, Heming, et al.
Publicado: (2024) -
Large Language Models Struggle with Unreasonability in Math Problems
por: Ma, Jingyuan, et al.
Publicado: (2024) -
Can Large Language Models Always Solve Easy Problems if They Can Solve Harder Ones?
por: Yang, Zhe, et al.
Publicado: (2024)