Tokenization Multiplicity Leads to Arbitrary Price Variation in LLM-as-a-service
Fuente:
arXiv
Salvato in:
| Autori principali: | Chatzi, Ivi, Benz, Nina Corvelo, Tsirtsis, Stratis, Gomez-Rodriguez, Manuel |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Counterfactual Token Generation in Large Language Models
di: Chatzi, Ivi, et al.
Pubblicazione: (2024)
di: Chatzi, Ivi, et al.
Pubblicazione: (2024)
Evaluation of Large Language Models via Coupled Token Generation
di: Benz, Nina Corvelo, et al.
Pubblicazione: (2025)
di: Benz, Nina Corvelo, et al.
Pubblicazione: (2025)
Is Your LLM Overcharging You? Tokenization, Transparency, and Incentives
di: Velasco, Ander Artola, et al.
Pubblicazione: (2025)
di: Velasco, Ander Artola, et al.
Pubblicazione: (2025)
Prediction-Powered Ranking of Large Language Models
di: Chatzi, Ivi, et al.
Pubblicazione: (2024)
di: Chatzi, Ivi, et al.
Pubblicazione: (2024)
Learning to Decide with AI Assistance under Human-Alignment
di: Benz, Nina Corvelo, et al.
Pubblicazione: (2026)
di: Benz, Nina Corvelo, et al.
Pubblicazione: (2026)
Narrowing Action Choices with AI Improves Human Sequential Decisions
di: Straitouri, Eleni, et al.
Pubblicazione: (2025)
di: Straitouri, Eleni, et al.
Pubblicazione: (2025)
AI-Mediated Communication Can Steer Collective Opinion
di: Tsirtsis, Stratis, et al.
Pubblicazione: (2026)
di: Tsirtsis, Stratis, et al.
Pubblicazione: (2026)
Test-Time Compute Games
di: Velasco, Ander Artola, et al.
Pubblicazione: (2026)
di: Velasco, Ander Artola, et al.
Pubblicazione: (2026)
Auditing Pay-Per-Token in Large Language Models
di: Velasco, Ander Artola, et al.
Pubblicazione: (2025)
di: Velasco, Ander Artola, et al.
Pubblicazione: (2025)
Human-Aligned Calibration for AI-Assisted Decision Making
di: Benz, Nina L. Corvelo, et al.
Pubblicazione: (2023)
di: Benz, Nina L. Corvelo, et al.
Pubblicazione: (2023)
MANTRA: Synthesizing SMT-Validated Compliance Benchmarks for Tool-Using LLM Agents
di: Anand, Ashwani, et al.
Pubblicazione: (2026)
di: Anand, Ashwani, et al.
Pubblicazione: (2026)
Human-Alignment Influences the Utility of AI-assisted Decision Making
di: Benz, Nina L. Corvelo, et al.
Pubblicazione: (2025)
di: Benz, Nina L. Corvelo, et al.
Pubblicazione: (2025)
RSQ: Learning from Important Tokens Leads to Better Quantized LLMs
di: Sung, Yi-Lin, et al.
Pubblicazione: (2025)
di: Sung, Yi-Lin, et al.
Pubblicazione: (2025)
Efficient Joint Prediction of Multiple Future Tokens
di: Ahn, Kwangjun, et al.
Pubblicazione: (2025)
di: Ahn, Kwangjun, et al.
Pubblicazione: (2025)
Token-Budget-Aware LLM Reasoning
di: Han, Tingxu, et al.
Pubblicazione: (2024)
di: Han, Tingxu, et al.
Pubblicazione: (2024)
Critical Tokens Matter: Token-Level Contrastive Estimation Enhances LLM's Reasoning Capability
di: Lin, Zicheng, et al.
Pubblicazione: (2024)
di: Lin, Zicheng, et al.
Pubblicazione: (2024)
OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference
di: Shin, Seungjun, et al.
Pubblicazione: (2025)
di: Shin, Seungjun, et al.
Pubblicazione: (2025)
LazyLLM: Dynamic Token Pruning for Efficient Long Context LLM Inference
di: Fu, Qichen, et al.
Pubblicazione: (2024)
di: Fu, Qichen, et al.
Pubblicazione: (2024)
Token-Level LLM Collaboration via FusionRoute
di: Xiong, Nuoya, et al.
Pubblicazione: (2026)
di: Xiong, Nuoya, et al.
Pubblicazione: (2026)
Exploring LLM Reasoning Through Controlled Prompt Variations
di: Chatziveroglou, Giannis, et al.
Pubblicazione: (2025)
di: Chatziveroglou, Giannis, et al.
Pubblicazione: (2025)
TARo: Token-level Adaptive Routing for LLM Test-time Alignment
di: Rai, Arushi, et al.
Pubblicazione: (2026)
di: Rai, Arushi, et al.
Pubblicazione: (2026)
Adaptive Layer Selection for Layer-Wise Token Pruning in LLM Inference
di: Taniguchi, Rei, et al.
Pubblicazione: (2026)
di: Taniguchi, Rei, et al.
Pubblicazione: (2026)
Rep2Text: Decoding Full Text from a Single LLM Token Representation
di: Zhao, Haiyan, et al.
Pubblicazione: (2025)
di: Zhao, Haiyan, et al.
Pubblicazione: (2025)
MoBiQuant: Mixture-of-Bits Quantization for Token-Adaptive Any-Precision LLM
di: Wang, Dongwei, et al.
Pubblicazione: (2026)
di: Wang, Dongwei, et al.
Pubblicazione: (2026)
LLMs as Zero-shot Graph Learners: Alignment of GNN Representations with LLM Token Embeddings
di: Wang, Duo, et al.
Pubblicazione: (2024)
di: Wang, Duo, et al.
Pubblicazione: (2024)
TokenButler: Token Importance is Predictable
di: Akhauri, Yash, et al.
Pubblicazione: (2025)
di: Akhauri, Yash, et al.
Pubblicazione: (2025)
Dynamics of Spontaneous Topic Changes in Next Token Prediction with Self-Attention
di: Jia, Mumin, et al.
Pubblicazione: (2025)
di: Jia, Mumin, et al.
Pubblicazione: (2025)
CharPoet: A Chinese Classical Poetry Generation System Based on Token-free LLM
di: Yu, Chengyue, et al.
Pubblicazione: (2024)
di: Yu, Chengyue, et al.
Pubblicazione: (2024)
Matchings, Predictions and Counterfactual Harm in Refugee Resettlement Processes
di: Lee, Seungeon, et al.
Pubblicazione: (2024)
di: Lee, Seungeon, et al.
Pubblicazione: (2024)
Optimizing Social Utility in Sequential Experiments
di: Velasco, Ander Artola, et al.
Pubblicazione: (2026)
di: Velasco, Ander Artola, et al.
Pubblicazione: (2026)
Editing Arbitrary Propositions in LLMs without Subject Labels
di: Feigenbaum, Itai, et al.
Pubblicazione: (2024)
di: Feigenbaum, Itai, et al.
Pubblicazione: (2024)
Rethinking Parameter Sharing for LLM Fine-Tuning with Multiple LoRAs
di: Ban, Hao, et al.
Pubblicazione: (2025)
di: Ban, Hao, et al.
Pubblicazione: (2025)
Lossless Token Sequence Compression via Meta-Tokens
di: Harvill, John, et al.
Pubblicazione: (2025)
di: Harvill, John, et al.
Pubblicazione: (2025)
Generalized Stock Price Prediction for Multiple Stocks Combined with News Fusion
di: Liao, Pei-Jun, et al.
Pubblicazione: (2026)
di: Liao, Pei-Jun, et al.
Pubblicazione: (2026)
Adversarial Tokenization
di: Geh, Renato Lui, et al.
Pubblicazione: (2025)
di: Geh, Renato Lui, et al.
Pubblicazione: (2025)
Beyond the 80/20 Rule: High-Entropy Minority Tokens Drive Effective Reinforcement Learning for LLM Reasoning
di: Wang, Shenzhi, et al.
Pubblicazione: (2025)
di: Wang, Shenzhi, et al.
Pubblicazione: (2025)
Sentiment Analysis of Airbnb Reviews: Exploring Their Impact on Acceptance Rates and Pricing Across Multiple U.S. Regions
di: Safari, Ali
Pubblicazione: (2025)
di: Safari, Ali
Pubblicazione: (2025)
T-FREE: Subword Tokenizer-Free Generative LLMs via Sparse Representations for Memory-Efficient Embeddings
di: Deiseroth, Björn, et al.
Pubblicazione: (2024)
di: Deiseroth, Björn, et al.
Pubblicazione: (2024)
Tokenization Matters: Navigating Data-Scarce Tokenization for Gender Inclusive Language Technologies
di: Ovalle, Anaelia, et al.
Pubblicazione: (2023)
di: Ovalle, Anaelia, et al.
Pubblicazione: (2023)
The Price of Format: Diversity Collapse in LLMs
di: Yun, Longfei, et al.
Pubblicazione: (2025)
di: Yun, Longfei, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Counterfactual Token Generation in Large Language Models
di: Chatzi, Ivi, et al.
Pubblicazione: (2024) -
Evaluation of Large Language Models via Coupled Token Generation
di: Benz, Nina Corvelo, et al.
Pubblicazione: (2025) -
Is Your LLM Overcharging You? Tokenization, Transparency, and Incentives
di: Velasco, Ander Artola, et al.
Pubblicazione: (2025) -
Prediction-Powered Ranking of Large Language Models
di: Chatzi, Ivi, et al.
Pubblicazione: (2024) -
Learning to Decide with AI Assistance under Human-Alignment
di: Benz, Nina Corvelo, et al.
Pubblicazione: (2026)