@misc{indiciae1d2c9139eadc, title = {Bayesian Conservative Policy Optimization (BCPO): A Novel Uncertainty-Calibrated Offline Reinforcement Learning with Credible Lower Bounds}, author = {Debashis Chatterjee}, year = {2026}, url = {https://arxiv.org/abs/2603.12284}, note = {Source identifier: 2603.12284} }