MLX-LM
基于 Apple MLX 框架的 LLM 运行工具包:命令行聊天、微调、LoRA 训练、量化转换一条龙,Apple Silicon 本地玩法的核心入口。
- 项目形态
- 本地推理 / 微调工具包(MLX)
- 许可
- MIT
- 发布
- 2025-03-11
- 收录
- 2026-10-03
它解决什么
在 Mac 上用 LLM 之前,社区散落在 HF 镜像、mlx-examples、各种量化脚本里。 MLX-LM 把「下载 → 量化 → 聊天 → LoRA 微调」收进同一套命令行工具, 模型直接消费 HuggingFace 上的权重,统一量化格式让不同模型可以互换。
什么时候用它
- 想在 MacBook / Mac Studio 上快速验证开源模型 → 一条命令起服务或进 REPL。
- 本地做小规模 LoRA 微调,不想租 GPU → 统一内存架构下 8B~70B 都可行。
- 起常驻服务的需求交给 omlx 或 vllm-mlx,这里偏开发侧。
上手难点
- 只跑 Apple Silicon;跨平台需求看 llama.cpp 生态。
- 微调路径的超参文档偏薄,复现论文配置要自己读源码。