TY - RPRT TI - SafeClawBench: Separating Semantic, Audit-Evidence, and Sandbox Harm in Tool-Using LLM Agents AU - Yuchuan Tian AU - Mengyu Zheng AU - Haocheng Mei AU - Ye Yuan AU - Chao Xu AU - Xinghao Chen AU - Hanting Chen AU - Yu Wang PY - 2026 UR - https://arxiv.org/abs/2606.18356 ID - 2606.18356 ER -