TY - RPRT TI - Factually Consistent Summarization via Reinforcement Learning with Textual Entailment Feedback AU - Paul Roit AU - Johan Ferret AU - Lior Shani AU - Roee Aharoni AU - Geoffrey Cideron AU - Robert Dadashi AU - Matthieu Geist AU - Sertan Girgin AU - Léonard Hussenot AU - Orgad Keller AU - Nikola Momchev AU - Sabela Ramos AU - Piotr Stanczyk AU - Nino Vieillard AU - Olivier Bachem AU - Gal Elidan AU - Avinatan Hassidim AU - Olivier Pietquin AU - Idan Szpektor PY - 2023 UR - https://arxiv.org/abs/2306.00186 ID - 2306.00186 ER -