Tao, W., Zhang, B., Qu, X., Wan, J., & Wang, J. (2025). Cocktail: Chunk-Adaptive Mixed-Precision Quantization for Long-Context LLM Inference.
Style de citation Chicago (17e éd.)Tao, Wei, Bin Zhang, Xiaoyang Qu, Jiguang Wan, et Jianzong Wang. Cocktail: Chunk-Adaptive Mixed-Precision Quantization for Long-Context LLM Inference. 2025.
Style de citation MLA (9e éd.)Tao, Wei, et al. Cocktail: Chunk-Adaptive Mixed-Precision Quantization for Long-Context LLM Inference. 2025.
Attention : ces citations peuvent ne pas être correctes à 100%.