@misc{indiciae6725f682e3dd, title = {Scaling LLM Inference with Optimized Sample Compute Allocation}, author = {Kexun Zhang and Shang Zhou and Danqing Wang and William Yang Wang and Lei Li}, year = {2024}, url = {https://arxiv.org/abs/2410.22480}, note = {Source identifier: 2410.22480} }