@misc{indiciae776a21e79474, title = {CirrusBench: Evaluating LLM-based Agents Beyond Correctness in Real-World Cloud Service Environments}, author = {Yi Yu and Guangquan Hu and Chenghuang Shen and Xingyan Liu and Jing Gu and Hangyi Sun and Junzhuo Ma and Weiting Liu and Jianfeng Liu and Mingyue Pu and Yu Wang and Zhengdong Xiao and Rui Xie and Longjiu Luo and Qianrong Wang and Gurong Cui and Honglin Qiao and Wenlian Lu}, year = {2026}, url = {https://arxiv.org/abs/2603.28569}, note = {Source identifier: 2603.28569} }