TY - RPRT TI - Deep Q-Learning versus Proximal Policy Optimization: Performance Comparison in a Material Sorting Task AU - Reuf Kozlica AU - Stefan Wegenkittl AU - Simon Hirländer PY - 2023 UR - https://arxiv.org/abs/2306.01451 ID - 2306.01451 ER -