TY - RPRT TI - LLM-based Rewriting of Inappropriate Argumentation using Reinforcement Learning from Machine Feedback AU - Timon Ziegenbein AU - Gabriella Skitalinskaya AU - Alireza Bayat Makou AU - Henning Wachsmuth PY - 2024 UR - https://arxiv.org/abs/2406.03363 ID - 2406.03363 ER -