Wang, H., Lin, T., Kong, L., Li, C., Jiang, H., & Tambe, M. (2026). Reward Shaping for Inference-Time Alignment: A Stackelberg Game Perspective.
Chicago Style (17th ed.) CitationWang, Haichuan, Tao Lin, Lingkai Kong, Ce Li, Hezi Jiang, and Milind Tambe. Reward Shaping for Inference-Time Alignment: A Stackelberg Game Perspective. 2026.
MLA (9th ed.) CitationWang, Haichuan, et al. Reward Shaping for Inference-Time Alignment: A Stackelberg Game Perspective. 2026.
Warning: These citations may not always be 100% accurate.