TY - RPRT TI - Online Learning for Multi-Layer Hierarchical Inference under Partial and Policy-Dependent Feedback AU - Haoran Zhang AU - Seohyeon Cha AU - Hasan Burhan Beytur AU - Kevin S Chan AU - Gustavo de Veciana AU - Haris Vikalo PY - 2026 UR - https://arxiv.org/abs/2603.04247 ID - 2603.04247 ER -