Distributed Specialization: Rare-Token Neurons in Large Language Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Liu, Jing, Wang, Haozheng, Li, Yueheng |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Emergent Specialization: Rare Token Neurons in Language Models
von: Liu, Jing, et al.
Veröffentlicht: (2025)
von: Liu, Jing, et al.
Veröffentlicht: (2025)
Conv-CoA: Improving Open-domain Question Answering in Large Language Models via Conversational Chain-of-Action
von: Pan, Zhenyu, et al.
Veröffentlicht: (2024)
von: Pan, Zhenyu, et al.
Veröffentlicht: (2024)
No Clustering, No Routing: How Transformers Actually Process Rare Tokens
von: Liu, Jing
Veröffentlicht: (2025)
von: Liu, Jing
Veröffentlicht: (2025)
Piculet: Specialized Models-Guided Hallucination Decrease for MultiModal Large Language Models
von: Wang, Kohou, et al.
Veröffentlicht: (2024)
von: Wang, Kohou, et al.
Veröffentlicht: (2024)
Reinforcement Learning with Promising Tokens for Large Language Models
von: Pang, Jing-Cheng, et al.
Veröffentlicht: (2026)
von: Pang, Jing-Cheng, et al.
Veröffentlicht: (2026)
RHYTHM: Reasoning with Hierarchical Temporal Tokenization for Human Mobility
von: He, Haoyu, et al.
Veröffentlicht: (2025)
von: He, Haoyu, et al.
Veröffentlicht: (2025)
Survey of Specialized Large Language Model
von: Yang, Chenghan, et al.
Veröffentlicht: (2025)
von: Yang, Chenghan, et al.
Veröffentlicht: (2025)
Tokenization Matters! Degrading Large Language Models through Challenging Their Tokenization
von: Wang, Dixuan, et al.
Veröffentlicht: (2024)
von: Wang, Dixuan, et al.
Veröffentlicht: (2024)
Token Signature: Predicting Chain-of-Thought Gains with Token Decoding Feature in Large Language Models
von: Liu, Peijie, et al.
Veröffentlicht: (2025)
von: Liu, Peijie, et al.
Veröffentlicht: (2025)
Neuron-based Multifractal Analysis of Neuron Interaction Dynamics in Large Models
von: Xiao, Xiongye, et al.
Veröffentlicht: (2024)
von: Xiao, Xiongye, et al.
Veröffentlicht: (2024)
Re-Initialization Token Learning for Tool-Augmented Large Language Models
von: Li, Chenghao, et al.
Veröffentlicht: (2025)
von: Li, Chenghao, et al.
Veröffentlicht: (2025)
Meta-Learning Based Few-Shot Graph-Level Anomaly Detection
von: Li, Liting, et al.
Veröffentlicht: (2025)
von: Li, Liting, et al.
Veröffentlicht: (2025)
CRANE: Causal Relevance Analysis of Language-Specific Neurons in Multilingual Large Language Models
von: Le, Yifan, et al.
Veröffentlicht: (2026)
von: Le, Yifan, et al.
Veröffentlicht: (2026)
Unveiling Factual Recall Behaviors of Large Language Models through Knowledge Neurons
von: Wang, Yifei, et al.
Veröffentlicht: (2024)
von: Wang, Yifei, et al.
Veröffentlicht: (2024)
Beyond Reproducibility: Token Probabilities Expose Large Language Model Nondeterminism
von: Fu, Tairan, et al.
Veröffentlicht: (2026)
von: Fu, Tairan, et al.
Veröffentlicht: (2026)
Visual Large Language Models for Generalized and Specialized Applications
von: Li, Yifan, et al.
Veröffentlicht: (2025)
von: Li, Yifan, et al.
Veröffentlicht: (2025)
Cracking Factual Knowledge: A Comprehensive Analysis of Degenerate Knowledge Neurons in Large Language Models
von: Chen, Yuheng, et al.
Veröffentlicht: (2024)
von: Chen, Yuheng, et al.
Veröffentlicht: (2024)
Membership Inference Attacks on Tokenizers of Large Language Models
von: Tong, Meng, et al.
Veröffentlicht: (2025)
von: Tong, Meng, et al.
Veröffentlicht: (2025)
Large Language Models Struggle in Token-Level Clinical Named Entity Recognition
von: Lu, Qiuhao, et al.
Veröffentlicht: (2024)
von: Lu, Qiuhao, et al.
Veröffentlicht: (2024)
GlitchProber: Advancing Effective Detection and Mitigation of Glitch Tokens in Large Language Models
von: Zhang, Zhibo, et al.
Veröffentlicht: (2024)
von: Zhang, Zhibo, et al.
Veröffentlicht: (2024)
Saliency-driven Dynamic Token Pruning for Large Language Models
von: Tao, Yao, et al.
Veröffentlicht: (2025)
von: Tao, Yao, et al.
Veröffentlicht: (2025)
Large Language Models Vote: Prompting for Rare Disease Identification
von: Oniani, David, et al.
Veröffentlicht: (2023)
von: Oniani, David, et al.
Veröffentlicht: (2023)
Probabilistic Token Alignment for Large Language Model Fusion
von: Zeng, Runjia, et al.
Veröffentlicht: (2025)
von: Zeng, Runjia, et al.
Veröffentlicht: (2025)
Full-ECE: A Metric For Token-level Calibration on Large Language Models
von: Liu, Han, et al.
Veröffentlicht: (2024)
von: Liu, Han, et al.
Veröffentlicht: (2024)
ZipVL: Efficient Large Vision-Language Models with Dynamic Token Sparsification
von: He, Yefei, et al.
Veröffentlicht: (2024)
von: He, Yefei, et al.
Veröffentlicht: (2024)
GlitchMiner: Mining Glitch Tokens in Large Language Models via Gradient-based Discrete Optimization
von: Wu, Zihui, et al.
Veröffentlicht: (2024)
von: Wu, Zihui, et al.
Veröffentlicht: (2024)
Leveraging Large Language Models for Rare Disease Named Entity Recognition
von: Xi, Nan Miles, et al.
Veröffentlicht: (2025)
von: Xi, Nan Miles, et al.
Veröffentlicht: (2025)
Token-Efficient Leverage Learning in Large Language Models
von: Zeng, Yuanhao, et al.
Veröffentlicht: (2024)
von: Zeng, Yuanhao, et al.
Veröffentlicht: (2024)
Question Classification with Deep Contextualized Transformer
von: Luo, Haozheng, et al.
Veröffentlicht: (2019)
von: Luo, Haozheng, et al.
Veröffentlicht: (2019)
Multi-Agent Guided Policy Optimization
von: Li, Yueheng, et al.
Veröffentlicht: (2025)
von: Li, Yueheng, et al.
Veröffentlicht: (2025)
SGM: Safety Glasses for Multimodal Large Language Models via Neuron-Level Detoxification
von: Wang, Hongbo, et al.
Veröffentlicht: (2025)
von: Wang, Hongbo, et al.
Veröffentlicht: (2025)
Rethinking Token Reduction for Large Vision-Language Models
von: Wang, Yi, et al.
Veröffentlicht: (2026)
von: Wang, Yi, et al.
Veröffentlicht: (2026)
Memory Retrieval and Consolidation in Large Language Models through Function Tokens
von: Zhang, Shaohua, et al.
Veröffentlicht: (2025)
von: Zhang, Shaohua, et al.
Veröffentlicht: (2025)
From Anchors to Answers: A Novel Node Tokenizer for Integrating Graph Structure into Large Language Models
von: Ji, Yanbiao, et al.
Veröffentlicht: (2024)
von: Ji, Yanbiao, et al.
Veröffentlicht: (2024)
Revisiting Large Language Model Pruning using Neuron Semantic Attribution
von: Ding, Yizhuo, et al.
Veröffentlicht: (2025)
von: Ding, Yizhuo, et al.
Veröffentlicht: (2025)
Large Language Models as Discounted Bayesian Filters
von: Zhang, Jensen, et al.
Veröffentlicht: (2025)
von: Zhang, Jensen, et al.
Veröffentlicht: (2025)
Scaling Capability in Token Space: An Analysis of Large Vision Language Model
von: Li, Tenghui, et al.
Veröffentlicht: (2024)
von: Li, Tenghui, et al.
Veröffentlicht: (2024)
Assessing and Enhancing Large Language Models in Rare Disease Question-answering
von: Wang, Guanchu, et al.
Veröffentlicht: (2024)
von: Wang, Guanchu, et al.
Veröffentlicht: (2024)
STAPO: Stabilizing Reinforcement Learning for LLMs by Silencing Rare Spurious Tokens
von: Liu, Shiqi, et al.
Veröffentlicht: (2026)
von: Liu, Shiqi, et al.
Veröffentlicht: (2026)
Cross-Modal Unlearning via Influential Neuron Path Editing in Multimodal Large Language Models
von: Li, Kunhao, et al.
Veröffentlicht: (2025)
von: Li, Kunhao, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Emergent Specialization: Rare Token Neurons in Language Models
von: Liu, Jing, et al.
Veröffentlicht: (2025) -
Conv-CoA: Improving Open-domain Question Answering in Large Language Models via Conversational Chain-of-Action
von: Pan, Zhenyu, et al.
Veröffentlicht: (2024) -
No Clustering, No Routing: How Transformers Actually Process Rare Tokens
von: Liu, Jing
Veröffentlicht: (2025) -
Piculet: Specialized Models-Guided Hallucination Decrease for MultiModal Large Language Models
von: Wang, Kohou, et al.
Veröffentlicht: (2024) -
Reinforcement Learning with Promising Tokens for Large Language Models
von: Pang, Jing-Cheng, et al.
Veröffentlicht: (2026)