@misc{indiciae3608aff3dd78, title = {SOAP-RL: Sequential Option Advantage Propagation for Reinforcement Learning in POMDP Environments}, author = {Shu Ishida and João F. Henriques}, year = {2024}, url = {https://arxiv.org/abs/2407.18913}, note = {Source identifier: 2407.18913} }