跳到正文
原文
TensorFlow Blog· TensorFlow Blog·· 2023-11-30AI 评分58

TensorFlow Lite XNNPack 启用半精度推理,FP16 性能翻倍

Half-precision Inference Doubles On-Device Inference Performance

AI 导读

TensorFlow Blog 宣布 TensorFlow Lite 的 XNNPack 后端支持半精度(FP16)推理,在 ARM CPU 上使浮点模型推理速度较 FP32 提升近 2 倍。

来源:TensorFlow Blog · blog.tensorflow.org