TY - RPRT TI - Reliable Evaluations for Natural Language Inference based on a Unified Cross-dataset Benchmark AU - Guanhua Zhang AU - Bing Bai AU - Jian Liang AU - Kun Bai AU - Conghui Zhu AU - Tiejun Zhao PY - 2020 UR - https://arxiv.org/abs/2010.07676 ID - 2010.07676 ER -