TY - RPRT TI - PPTC-R benchmark: Towards Evaluating the Robustness of Large Language Models for PowerPoint Task Completion AU - Zekai Zhang AU - Yiduo Guo AU - Yaobo Liang AU - Dongyan Zhao AU - Nan Duan PY - 2024 UR - https://arxiv.org/abs/2403.03788 ID - 2403.03788 ER -