TY - RPRT TI - Model-free Reinforcement Learning of Semantic Communication by Stochastic Policy Gradient AU - Edgar Beck AU - Carsten Bockelmann AU - Armin Dekorsy PY - 2024 DO - 10.1109/icmlcn59089.2024.10625190 UR - https://arxiv.org/abs/2305.03571 ID - 2305.03571 ER -