NPU 算力测试
免费测试当前电脑在浏览器中可用的 NPU AI 算力,查看有效 TOPS、速度、延迟和 WebNN 支持情况,并可对照 GPU 或 CPU。
所属分类
使用说明
- 选择 NPU 专用后端、算力工作负载和测算时长
- 点击“开始测算”构建 WebNN 图并执行预热批次
- 查看实测 NPU TOPS、峰值 TOPS、持续 TOPS、平均延迟和迭代次数
- NPU 专用模式不会回退 GPU 或 CPU;如果 NPU 上下文创建失败,则不会给出 NPU 算力
示例
-
NPU 专用算力测算
输入:
后端: NPU 专用 | 工作负载: 算力 | 时长: 20s输出:
实测 NPU 算力 8.42 TOPS | 峰值 9.10 TOPS | 持续 8.01 TOPS -
CPU/GPU 对照
输入:
后端: CPU 或 GPU 对照 | 工作负载: 均衡 | 时长: 10s输出:
用于和 NPU 专用模式比较浏览器调度差异
常见问题
- 这个 TOPS 是厂商标称 NPU 峰值吗?
- 不是。这里的 TOPS 是 WebNN 图在浏览器中可实际调用的端到端有效算力,包含浏览器、驱动、调度和少量同步开销。
- 如何确保测的是 NPU?
- NPU 专用模式只请求 deviceType=npu,并且不再回退 GPU/CPU。如果浏览器不能创建 NPU 上下文,工具会报错而不是显示其它后端结果。
- 为什么使用矩阵乘工作负载?
- 密集矩阵乘是神经网络常见算子,也适合 AI 加速器执行。工具按 2 × batch × hidden × hidden × 层数计算每次推理操作量,再除以实测耗时得到 TOPS。
相关工具
- ONNX 模型运行器
上传 ONNX 模型或填写下载地址,在你的浏览器中测试本地推理、速度和 WebNN NPU/GPU 兼容性。