ONNX 模型运行器

免费在浏览器中测试 ONNX 模型。上传模型或填写下载地址后,可查看本地推理速度、延迟和 WebNN NPU/GPU 兼容性。

所属分类

开发工具

使用说明

  1. 上传 ONNX 模型或填写可下载模型地址
  2. 选择优先后端,例如 WebNN NPU、WebNN GPU 或 WASM
  3. 配置输入张量、数据类型和推理参数
  4. 运行后检查延迟、输出张量和后端回退提示

示例

  • 测试小型分类模型

    输入: 上传 model.onnx | 输入张量 1x3x224x224

    输出: 显示推理耗时和输出张量摘要

  • 验证 NPU 可用性

    输入: 选择 WebNN NPU 优先

    输出: 若浏览器无法创建 NPU 上下文,会显示回退或错误信息

常见问题

模型和输入会上传服务器吗?
不会。模型加载和推理在浏览器中进行;远程模型地址只由浏览器下载到当前页面环境。
所有 ONNX 模型都能运行吗?
不能。是否可运行取决于算子支持、模型大小、输入格式、浏览器内存和后端能力。
适合生产部署吗?
该工具适合原型验证和兼容性测试。正式部署前需要固定模型、输入校验、错误处理和性能基线。

相关工具