NPU 算力测试

免费测试当前电脑在浏览器中可用的 NPU AI 算力,查看有效 TOPS、速度、延迟和 WebNN 支持情况,并可对照 GPU 或 CPU。

所属分类

开发工具

使用说明

  1. 选择 NPU 专用后端、算力工作负载和测算时长
  2. 点击“开始测算”构建 WebNN 图并执行预热批次
  3. 查看实测 NPU TOPS、峰值 TOPS、持续 TOPS、平均延迟和迭代次数
  4. NPU 专用模式不会回退 GPU 或 CPU;如果 NPU 上下文创建失败,则不会给出 NPU 算力

示例

  • NPU 专用算力测算

    输入: 后端: NPU 专用 | 工作负载: 算力 | 时长: 20s

    输出: 实测 NPU 算力 8.42 TOPS | 峰值 9.10 TOPS | 持续 8.01 TOPS

  • CPU/GPU 对照

    输入: 后端: CPU 或 GPU 对照 | 工作负载: 均衡 | 时长: 10s

    输出: 用于和 NPU 专用模式比较浏览器调度差异

常见问题

这个 TOPS 是厂商标称 NPU 峰值吗?
不是。这里的 TOPS 是 WebNN 图在浏览器中可实际调用的端到端有效算力,包含浏览器、驱动、调度和少量同步开销。
如何确保测的是 NPU?
NPU 专用模式只请求 deviceType=npu,并且不再回退 GPU/CPU。如果浏览器不能创建 NPU 上下文,工具会报错而不是显示其它后端结果。
为什么使用矩阵乘工作负载?
密集矩阵乘是神经网络常见算子,也适合 AI 加速器执行。工具按 2 × batch × hidden × hidden × 层数计算每次推理操作量,再除以实测耗时得到 TOPS。

相关工具