@misc{indiciae06ec6eb8892f, title = {70\% Size, 100\% Accuracy: Lossless LLM Compression for Efficient GPU Inference via Dynamic-Length Float (DFloat11)}, author = {Tianyi Zhang and Mohsen Hariri and Shaochen Zhong and Vipin Chaudhary and Yang Sui and Xia Hu and Anshumali Shrivastava}, year = {2026}, url = {https://arxiv.org/abs/2504.11651}, note = {Source identifier: 2504.11651} }