应用介绍
把 YOLO 模型部署到生产或边缘设备,Python 环境又大又慢。Ultralytics Inference 是官方推出的用 Rust 编写的高性能 YOLO 推理引擎。
它基于 ONNX Runtime,支持 CUDA、CoreML 等 GPU 后端,还能编译成 WebGPU/WASM 在浏览器里跑,附带命令行工具。
Rust 推理:快且省。
多后端:CUDA 与 CoreML。
浏览器运行:WebGPU 与 WASM。
多任务:检测、分类、深度。
它基于 ONNX Runtime,支持 CUDA、CoreML 等 GPU 后端,还能编译成 WebGPU/WASM 在浏览器里跑,附带命令行工具。
软件功能
Rust 推理:快且省。
多后端:CUDA 与 CoreML。
浏览器运行:WebGPU 与 WASM。
多任务:检测、分类、深度。

