@misc{indiciae95ca6de09822, title = {Missing Information, Unresponsive Authors, Experimental Flaws: The Impossibility of Assessing the Reproducibility of Previous Human Evaluations in NLP}, author = {Anya Belz and Craig Thomson and Ehud Reiter and Gavin Abercrombie and Jose M. Alonso-Moral and Mohammad Arvan and Anouck Braggaar and Mark Cieliebak and Elizabeth Clark and Kees van Deemter and Tanvi Dinkar and Ondřej Dušek and Steffen Eger and Qixiang Fang and Mingqi Gao and Albert Gatt and Dimitra Gkatzia and Javier González-Corbelle and Dirk Hovy and Manuela Hürlimann and Takumi Ito and John D. Kelleher and Filip Klubicka and Emiel Krahmer and Huiyuan Lai and Chris van der Lee and Yiru Li and Saad Mahamood and Margot Mieskes and Emiel van Miltenburg and Pablo Mosteiro and Malvina Nissim and Natalie Parde and Ondřej Plátek and Verena Rieser and Jie Ruan and Joel Tetreault and Antonio Toral and Xiaojun Wan and Leo Wanner and Lewis Watson and Diyi Yang}, year = {2023}, url = {https://arxiv.org/abs/2305.01633}, note = {Source identifier: 2305.01633} }