TY - RPRT TI - Training and inference of large language models using 8-bit floating point AU - Sergio P. Perez AU - Yan Zhang AU - James Briggs AU - Charlie Blake AU - Josh Levy-Kramer AU - Paul Balanca AU - Carlo Luschi AU - Stephen Barlow AU - Andrew William Fitzgibbon PY - 2023 UR - https://arxiv.org/abs/2309.17224 ID - 2309.17224 ER -