OpenVINO

部署方式Intel

Intel 官方推理优化工具包,把模型优化部署到 Intel CPU / GPU / NPU,本地 LLM 在 Intel 平台上的官方路线。

类型
推理框架 / 服务引擎
支持
Intel CPU / iGPU / Arc GPU / NPU · LLM 推理(OpenVINO GenAI) · 模型优化与量化 · 多后端统一 API
上手难点
绑定 Intel 平台;LLM 侧生态薄于 vLLM / llama.cpp
许可
Apache-2.0
发布
2018-10-15
收录
2026-10-03

它解决什么

Intel 机器上跑模型,官方答案就是 OpenVINO:它把模型优化(算子融合、 量化)成 Intel 硬件友好的形态,统一覆盖 CPU、核显、Arc 独显和 NPU。 LLM 场景有专门的 OpenVINO GenAI 组件,仓库 topics 明确带 llm-inference。

什么时候用它

  • 全是 Intel 硬件的本地部署(笔记本、工作站、带 NPU 的机型)→ 官方路线。
  • 要 NPU 参与推理 → 主流开源引擎里支持 Intel NPU 的基本只有它。
  • 已有 OpenVINO 技术栈(视觉模型在用)想扩展 LLM → 统一 API 省事。

上手难点

  • 平台锁定 Intel,混用 NVIDIA 环境要两套。
  • LLM 支持的模型范围与吞吐不及 vLLM / llama.cpp 主线。
  • 文档按“Intel 生态”组织,纯 LLM 用户上手曲线偏陡。