Meng, H. (2026). CUJBench: Benchmarking LLM-Agent on Cross-Modal Failure Diagnosis from Browser to Backend.
Chicago Style (17th ed.) CitationMeng, Haoming. CUJBench: Benchmarking LLM-Agent on Cross-Modal Failure Diagnosis from Browser to Backend. 2026.
MLA (9th ed.) CitationMeng, Haoming. CUJBench: Benchmarking LLM-Agent on Cross-Modal Failure Diagnosis from Browser to Backend. 2026.
Warning: These citations may not always be 100% accurate.