Beyond the Next Token: Towards Prompt-Robust Zero-Shot Classification via Efficient Multi-Token Prediction
Fuente:
arXiv
Guardado en:
| Autores principales: | Qian, Junlang, Zhu, Zixiao, Zhou, Hanzhang, Feng, Zijian, Zhai, Zepeng, Mao, Kezhi |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Unveiling and Manipulating Prompt Influence in Large Language Models
por: Feng, Zijian, et al.
Publicado: (2024)
por: Feng, Zijian, et al.
Publicado: (2024)
UniBias: Unveiling and Mitigating LLM Bias through Internal Attention and FFN Manipulation
por: Zhou, Hanzhang, et al.
Publicado: (2024)
por: Zhou, Hanzhang, et al.
Publicado: (2024)
Logit Separability-Driven Samples and Multiple Class-Related Words Selection for Advancing In-Context Learning
por: Zixiao, Zhu, et al.
Publicado: (2024)
por: Zixiao, Zhu, et al.
Publicado: (2024)
LLMs Learn Task Heuristics from Demonstrations: A Heuristic-Driven Prompting Strategy for Document-Level Event Argument Extraction
por: Zhou, Hanzhang, et al.
Publicado: (2023)
por: Zhou, Hanzhang, et al.
Publicado: (2023)
FreeCtrl: Constructing Control Centers with Feedforward Layers for Learning-Free Controllable Text Generation
por: Feng, Zijian, et al.
Publicado: (2024)
por: Feng, Zijian, et al.
Publicado: (2024)
Domain Lexical Knowledge-based Word Embedding Learning for Text Classification under Small Data
por: Zhu, Zixiao, et al.
Publicado: (2025)
por: Zhu, Zixiao, et al.
Publicado: (2025)
Rethinking Prompt Optimizers: From Prompt Merits to Optimization
por: Zhu, Zixiao, et al.
Publicado: (2025)
por: Zhu, Zixiao, et al.
Publicado: (2025)
Fine-Grained Activation Steering: Steering Less, Achieving More
por: Feng, Zijian, et al.
Publicado: (2026)
por: Feng, Zijian, et al.
Publicado: (2026)
Restoring Pruned Large Language Models via Lost Component Compensation
por: Feng, Zijian, et al.
Publicado: (2025)
por: Feng, Zijian, et al.
Publicado: (2025)
Rewards as Labels: Revisiting RLVR from a Classification Perspective
por: Zhai, Zepeng, et al.
Publicado: (2026)
por: Zhai, Zepeng, et al.
Publicado: (2026)
Zero-Shot Video Translation via Token Warping
por: Zhu, Haiming, et al.
Publicado: (2024)
por: Zhu, Haiming, et al.
Publicado: (2024)
Just Pass Twice: Efficient Token Classification with LLMs for Zero-Shot NER
por: Ewais, Ahmed, et al.
Publicado: (2026)
por: Ewais, Ahmed, et al.
Publicado: (2026)
From Token to Token Pair: Efficient Prompt Compression for Large Language Models in Clinical Prediction
por: Zhu, Mingcheng, et al.
Publicado: (2026)
por: Zhu, Mingcheng, et al.
Publicado: (2026)
Beyond Next-Token: Next-X Prediction for Autoregressive Visual Generation
por: Ren, Sucheng, et al.
Publicado: (2025)
por: Ren, Sucheng, et al.
Publicado: (2025)
Zero-Shot Tokenizer Transfer
por: Minixhofer, Benjamin, et al.
Publicado: (2024)
por: Minixhofer, Benjamin, et al.
Publicado: (2024)
Zero-Shot Open-Vocabulary Human Motion Grounding with Test-Time Training
por: Zhou, Yunjiao, et al.
Publicado: (2025)
por: Zhou, Yunjiao, et al.
Publicado: (2025)
Beyond Next-Token Alignment: Distilling Multimodal Large Language Models via Token Interactions
por: Chen, Lin, et al.
Publicado: (2026)
por: Chen, Lin, et al.
Publicado: (2026)
GeoToken: Hierarchical Geolocalization of Images via Next Token Prediction
por: Ghasemi, Narges, et al.
Publicado: (2025)
por: Ghasemi, Narges, et al.
Publicado: (2025)
Beyond Next Token Prediction: Patch-Level Training for Large Language Models
por: Shao, Chenze, et al.
Publicado: (2024)
por: Shao, Chenze, et al.
Publicado: (2024)
Towards Understanding the Universality of Transformers for Next-Token Prediction
por: Sander, Michael E., et al.
Publicado: (2024)
por: Sander, Michael E., et al.
Publicado: (2024)
Beyond Training: Dynamic Token Merging for Zero-Shot Video Understanding
por: Zhang, Yiming, et al.
Publicado: (2024)
por: Zhang, Yiming, et al.
Publicado: (2024)
TokenCLIP: Token-wise Prompt Learning for Zero-shot Anomaly Detection
por: Zhou, Qihang, et al.
Publicado: (2025)
por: Zhou, Qihang, et al.
Publicado: (2025)
Training LLMs Beyond Next Token Prediction -- Filling the Mutual Information Gap
por: Yang, Chun-Hao, et al.
Publicado: (2025)
por: Yang, Chun-Hao, et al.
Publicado: (2025)
Cautious Next Token Prediction
por: Wang, Yizhou, et al.
Publicado: (2025)
por: Wang, Yizhou, et al.
Publicado: (2025)
ZSPAPrune: Zero-Shot Prompt-Aware Token Pruning for Vision-Language Models
por: Zhang, Pu, et al.
Publicado: (2025)
por: Zhang, Pu, et al.
Publicado: (2025)
Lossless Compression of Large Language Model-Generated Text via Next-Token Prediction
por: Mao, Yu, et al.
Publicado: (2025)
por: Mao, Yu, et al.
Publicado: (2025)
Compact Constraint Encoding for LLM Code Generation: An Empirical Study of Token Economics and Constraint Compliance
por: Tang, Hanzhang
Publicado: (2026)
por: Tang, Hanzhang
Publicado: (2026)
Token-Efficient Multimodal Reasoning via Image Prompt Packaging
por: Choi, Joong Ho, et al.
Publicado: (2026)
por: Choi, Joong Ho, et al.
Publicado: (2026)
In-Context Imitation Learning via Next-Token Prediction
por: Fu, Letian, et al.
Publicado: (2024)
por: Fu, Letian, et al.
Publicado: (2024)
Next-Token Prediction and Regret Minimization
por: Mohri, Mehryar, et al.
Publicado: (2026)
por: Mohri, Mehryar, et al.
Publicado: (2026)
Humanoid Locomotion as Next Token Prediction
por: Radosavovic, Ilija, et al.
Publicado: (2024)
por: Radosavovic, Ilija, et al.
Publicado: (2024)
Object Recognition as Next Token Prediction
por: Yue, Kaiyu, et al.
Publicado: (2023)
por: Yue, Kaiyu, et al.
Publicado: (2023)
Medical Referring Image Segmentation via Next-Token Mask Prediction
por: Chen, Xinyu, et al.
Publicado: (2025)
por: Chen, Xinyu, et al.
Publicado: (2025)
Toward Consistent World Models with Multi-Token Prediction and Latent Semantic Enhancement
por: Zhong, Qimin, et al.
Publicado: (2026)
por: Zhong, Qimin, et al.
Publicado: (2026)
Prot2Token: A Unified Framework for Protein Modeling via Next-Token Prediction
por: Pourmirzaei, Mahdi, et al.
Publicado: (2025)
por: Pourmirzaei, Mahdi, et al.
Publicado: (2025)
TONIC: Token-Centric Semantic Communication for Task-Oriented Wireless Systems
por: Liu, Sige, et al.
Publicado: (2026)
por: Liu, Sige, et al.
Publicado: (2026)
Moving Beyond Next-Token Prediction: Transformers are Context-Sensitive Language Generators
por: Rhee, Phill Kyu
Publicado: (2025)
por: Rhee, Phill Kyu
Publicado: (2025)
Next Token Prediction Towards Multimodal Intelligence: A Comprehensive Survey
por: Chen, Liang, et al.
Publicado: (2024)
por: Chen, Liang, et al.
Publicado: (2024)
Multi-scale Graph Autoregressive Modeling: Molecular Property Prediction via Next Token Prediction
por: Jiang, Zhuoyang, et al.
Publicado: (2026)
por: Jiang, Zhuoyang, et al.
Publicado: (2026)
TokenCom: Vision-Language Model for Multimodal and Multitask Token Communications
por: Jiang, Feibo, et al.
Publicado: (2026)
por: Jiang, Feibo, et al.
Publicado: (2026)
Ejemplares similares
-
Unveiling and Manipulating Prompt Influence in Large Language Models
por: Feng, Zijian, et al.
Publicado: (2024) -
UniBias: Unveiling and Mitigating LLM Bias through Internal Attention and FFN Manipulation
por: Zhou, Hanzhang, et al.
Publicado: (2024) -
Logit Separability-Driven Samples and Multiple Class-Related Words Selection for Advancing In-Context Learning
por: Zixiao, Zhu, et al.
Publicado: (2024) -
LLMs Learn Task Heuristics from Demonstrations: A Heuristic-Driven Prompting Strategy for Document-Level Event Argument Extraction
por: Zhou, Hanzhang, et al.
Publicado: (2023) -
FreeCtrl: Constructing Control Centers with Feedforward Layers for Learning-Free Controllable Text Generation
por: Feng, Zijian, et al.
Publicado: (2024)