MLX
Apple 官方的 Apple Silicon 数组计算框架,Mac 上本地跑 LLM 的主流底层(LM Studio 的 MLX 引擎、MLX-LM 都基于它)。
- 类型
- 支撑性生态
- 支持
- Apple Silicon 统一内存 · 懒求值计算图 · 与 NumPy / PyTorch 互操作 · 训练 + 推理
- 上手难点
- 只支持 Apple Silicon(和少量其他后端),NVIDIA 环境用不上
- 许可
- MIT
- 发布
- 2023-11-28
- 收录
- 2026-10-03
它解决什么
在 Mac 上跑本地 LLM,瓶颈不是算力而是内存管理。MLX 是 Apple 官方的 数组计算框架,专门为 Apple Silicon 的统一内存设计:模型权重和 KV cache 共享同一块物理内存,避免 CPU/GPU 之间来回拷贝。基于它的上层项目 (MLX-LM、LM Studio 的 mlx-engine)让 Mac 本地推理接近消费级 NVIDIA 卡的体验。
什么时候用它
- 在 Apple Silicon 上做本地 LLM 推理或微调 → 这是官方推荐路线。
- 要写自己的模型加载 / 推理代码,不想被引擎框架绑死 → 直接用它。
- 生态选型:LLM 运行时看 MLX-LM,桌面一键体验看 LM Studio。
上手难点
- 平台锁定 Apple Silicon,团队环境混用 NVIDIA 时两边要维护两套。
- 它是计算框架不是推理服务:并发、OpenAI 兼容接口要靠上层项目补齐。
- 新模型支持跟着社区走,刚发布的模型可能要等适配。