YNTP-100: A Benchmark for Your Next Token Prediction with 100 People
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ding, Shiyao, Ito, Takayuki |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Diversity or Precision? A Deep Dive into Next Token Prediction
par: Wu, Haoyuan, et autres
Publié: (2025)
par: Wu, Haoyuan, et autres
Publié: (2025)
Cautious Next Token Prediction
par: Wang, Yizhou, et autres
Publié: (2025)
par: Wang, Yizhou, et autres
Publié: (2025)
$\infty$Bench: Extending Long Context Evaluation Beyond 100K Tokens
par: Zhang, Xinrong, et autres
Publié: (2024)
par: Zhang, Xinrong, et autres
Publié: (2024)
Reasoning Bias of Next Token Prediction Training
par: Lin, Pengxiao, et autres
Publié: (2025)
par: Lin, Pengxiao, et autres
Publié: (2025)
ENTP: Encoder-only Next Token Prediction
par: Ewer, Ethan, et autres
Publié: (2024)
par: Ewer, Ethan, et autres
Publié: (2024)
NITP: Next Implicit Token Prediction for LLM Pre-training
par: Zhang, Xiangdong, et autres
Publié: (2026)
par: Zhang, Xiangdong, et autres
Publié: (2026)
Alternatives To Next Token Prediction In Text Generation -- A Survey
par: Wyatt, Charlie, et autres
Publié: (2025)
par: Wyatt, Charlie, et autres
Publié: (2025)
Is Next Token Prediction Sufficient for GPT? Exploration on Code Logic Comprehension
par: Qi, Mengnan, et autres
Publié: (2024)
par: Qi, Mengnan, et autres
Publié: (2024)
PolySpeech-100: A Large-Scale Benchmark for Speech Understanding Across 100+ Languages and Dialects
par: Yang, Sicheng, et autres
Publié: (2026)
par: Yang, Sicheng, et autres
Publié: (2026)
Beyond the Next Token: Towards Prompt-Robust Zero-Shot Classification via Efficient Multi-Token Prediction
par: Qian, Junlang, et autres
Publié: (2025)
par: Qian, Junlang, et autres
Publié: (2025)
Fractal Patterns May Illuminate the Success of Next-Token Prediction
par: Alabdulmohsin, Ibrahim, et autres
Publié: (2024)
par: Alabdulmohsin, Ibrahim, et autres
Publié: (2024)
Implicit Optimization Bias of Next-Token Prediction in Linear Models
par: Thrampoulidis, Christos
Publié: (2024)
par: Thrampoulidis, Christos
Publié: (2024)
Preference Estimation via Opponent Modeling in Multi-Agent Negotiation
par: Konishi, Yuta, et autres
Publié: (2026)
par: Konishi, Yuta, et autres
Publié: (2026)
A Law of Next-Token Prediction in Large Language Models
par: He, Hangfeng, et autres
Publié: (2024)
par: He, Hangfeng, et autres
Publié: (2024)
Modeling Next-Token Prediction as Left-Nested Intuitionistic Implication
par: Tarau, Paul
Publié: (2026)
par: Tarau, Paul
Publié: (2026)
What Language is This? Ask Your Tokenizer
par: Meister, Clara, et autres
Publié: (2026)
par: Meister, Clara, et autres
Publié: (2026)
Geometry of Semantics in Next-Token Prediction: How Optimization Implicitly Organizes Linguistic Representations
par: Zhao, Yize, et autres
Publié: (2025)
par: Zhao, Yize, et autres
Publié: (2025)
Mechanics of Next Token Prediction with Self-Attention
par: Li, Yingcong, et autres
Publié: (2024)
par: Li, Yingcong, et autres
Publié: (2024)
The Hidden Strength of Disagreement: Unraveling the Consensus-Diversity Tradeoff in Adaptive Multi-Agent Systems
par: Wu, Zengqing, et autres
Publié: (2025)
par: Wu, Zengqing, et autres
Publié: (2025)
Improving Next Tokens via Second-to-Last Predictions with Generate and Refine
par: Schneider, Johannes
Publié: (2024)
par: Schneider, Johannes
Publié: (2024)
Differentially Private Next-Token Prediction of Large Language Models
par: Flemings, James, et autres
Publié: (2024)
par: Flemings, James, et autres
Publié: (2024)
Moving Beyond Next-Token Prediction: Transformers are Context-Sensitive Language Generators
par: Rhee, Phill Kyu
Publié: (2025)
par: Rhee, Phill Kyu
Publié: (2025)
Training LLMs Beyond Next Token Prediction -- Filling the Mutual Information Gap
par: Yang, Chun-Hao, et autres
Publié: (2025)
par: Yang, Chun-Hao, et autres
Publié: (2025)
Your LLM Knows the Future: Uncovering Its Multi-Token Prediction Potential
par: Samragh, Mohammad, et autres
Publié: (2025)
par: Samragh, Mohammad, et autres
Publié: (2025)
Low-Bit Quantization Favors Undertrained LLMs: Scaling Laws for Quantized LLMs with 100T Training Tokens
par: Ouyang, Xu, et autres
Publié: (2024)
par: Ouyang, Xu, et autres
Publié: (2024)
Broken Tokens? Your Language Model can Secretly Handle Non-Canonical Tokenizations
par: Zheng, Brian Siyuan, et autres
Publié: (2025)
par: Zheng, Brian Siyuan, et autres
Publié: (2025)
Advancing Pancreatic Cancer Prediction with a Next Visit Token Prediction Head on top of Med-BERT
par: He, Jianping, et autres
Publié: (2025)
par: He, Jianping, et autres
Publié: (2025)
LLMs are Not Just Next Token Predictors
par: Downes, Stephen M., et autres
Publié: (2024)
par: Downes, Stephen M., et autres
Publié: (2024)
Dynamics of Spontaneous Topic Changes in Next Token Prediction with Self-Attention
par: Jia, Mumin, et autres
Publié: (2025)
par: Jia, Mumin, et autres
Publié: (2025)
Towards Auto-Regressive Next-Token Prediction: In-Context Learning Emerges from Generalization
par: Gong, Zixuan, et autres
Publié: (2025)
par: Gong, Zixuan, et autres
Publié: (2025)
Lossless Compression of Large Language Model-Generated Text via Next-Token Prediction
par: Mao, Yu, et autres
Publié: (2025)
par: Mao, Yu, et autres
Publié: (2025)
On Next-Token Prediction in LLMs: How End Goals Determine the Consistency of Decoding Algorithms
par: Trauger, Jacob, et autres
Publié: (2025)
par: Trauger, Jacob, et autres
Publié: (2025)
LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation
par: Liu, Tianyu, et autres
Publié: (2025)
par: Liu, Tianyu, et autres
Publié: (2025)
$100K or 100 Days: Trade-offs when Pre-Training with Academic Resources
par: Khandelwal, Apoorv, et autres
Publié: (2024)
par: Khandelwal, Apoorv, et autres
Publié: (2024)
From Next-Token to Next-Block: A Principled Adaptation Path for Diffusion LLMs
par: Tian, Yuchuan, et autres
Publié: (2025)
par: Tian, Yuchuan, et autres
Publié: (2025)
Extending LLMs' Context Window with 100 Samples
par: Zhang, Yikai, et autres
Publié: (2024)
par: Zhang, Yikai, et autres
Publié: (2024)
Bigram Subnetworks: Mapping to Next Tokens in Transformer Language Models
par: Chang, Tyler A., et autres
Publié: (2025)
par: Chang, Tyler A., et autres
Publié: (2025)
Next-Token Prediction Task Assumes Optimal Data Ordering for LLM Training in Proof Generation
par: An, Chenyang, et autres
Publié: (2024)
par: An, Chenyang, et autres
Publié: (2024)
Roboflow100-VL: A Multi-Domain Object Detection Benchmark for Vision-Language Models
par: Robicheaux, Peter, et autres
Publié: (2025)
par: Robicheaux, Peter, et autres
Publié: (2025)
Probing Geometry of Next Token Prediction Using Cumulant Expansion of the Softmax Entropy
par: Viswanathan, Karthik, et autres
Publié: (2025)
par: Viswanathan, Karthik, et autres
Publié: (2025)
Documents similaires
-
Diversity or Precision? A Deep Dive into Next Token Prediction
par: Wu, Haoyuan, et autres
Publié: (2025) -
Cautious Next Token Prediction
par: Wang, Yizhou, et autres
Publié: (2025) -
$\infty$Bench: Extending Long Context Evaluation Beyond 100K Tokens
par: Zhang, Xinrong, et autres
Publié: (2024) -
Reasoning Bias of Next Token Prediction Training
par: Lin, Pengxiao, et autres
Publié: (2025) -
ENTP: Encoder-only Next Token Prediction
par: Ewer, Ethan, et autres
Publié: (2024)