刚到手, 简单测了一下 pytorch 1.x + clip, 跑的是 ViT-L/14@336px 模型, MPS 的 backend, 每张图跑到 32batch, 每张图推理时间 M1 Max 大概是 0.2x 秒, M2 Max 大概是 0.11 秒, 性能翻倍很明显, 参考一下 1080ti 的对应性能是 0.06 秒左右
也就是说 M2 Max 的 MPS 性能有可能达到 1080Ti 的百分之 60 左右了
再强调一下, 用的是 MPS 直接跑的推理, 不是转 onnx 以后用 npu 跑的