TY - RPRT TI - One4Many-StablePacker: An Efficient Deep Reinforcement Learning Framework for the 3D Bin Packing Problem AU - Lei Gao AU - Shihong Huang AU - Shengjie Wang AU - Hong Ma AU - Feng Zhang AU - Hengda Bao AU - Qichang Chen AU - Weihua Zhou PY - 2026 UR - https://arxiv.org/abs/2510.10057 ID - 2510.10057 ER -