Li, Y., Garg, A., Chaudhuri, S., Zhao, R., & Kessler, G. (2026). Perceptio: Perception Enhanced Vision Language Models via Spatial Token Generation.
Chicago Style (17th ed.) CitationLi, Yuchen, Amanmeet Garg, Shalini Chaudhuri, Rui Zhao, and Garin Kessler. Perceptio: Perception Enhanced Vision Language Models via Spatial Token Generation. 2026.
MLA (9th ed.) CitationLi, Yuchen, et al. Perceptio: Perception Enhanced Vision Language Models via Spatial Token Generation. 2026.
Warning: These citations may not always be 100% accurate.