Yang, C., Cheng, N., Akbari, A., Tan, Q., Zhu, Q., Zhang, C., Yang, C., Wang, Y., Niu, W., Wang, J., Lu, J., & Yuan, G. (2026). BitNest: Bit-Nested Speculative Decoding for Memory-Efficient LLM Inference Acceleration. https://omanscience.com/ar/articles/bitnest-bit-nested-speculative-decoding-for-memory-efficient-llm-inference-acceleration