oMLX 集成中心实战:如何一键接入 OpenClaw、OpenCode、Codex 与 Copilot
如果你正在 Mac 上使用 Codex、OpenCode、OpenClaw 或 Copilot CLI,却一直为"让 AI 编码工具用上本地大模型"而手动改配置文件,那么 oMLX 值得你花 5 分钟了解一下。oMLX 是一款运行在 Apple Silicon 上的 LLM 推理服务器,支持连续批处理(continuous batching)与 SSD 缓存,并通过 macOS 菜单栏原生应用管理。它内置的**集成中心(Integrations)**让你一键把 OpenClaw、OpenCode、Codex、Copilot CLI 等 8 款外部 AI 工具指向本地模型——自动写配置、自动备份、自动选模型,全程零手动编辑。
oMLX 是什么:Apple Silicon 原生 LLM 推理服务器
在动手接入之前,先 30 秒认识 oMLX:
- 🚀 为 Apple Silicon 而生:基于 MLX 框架,充分利用 Apple 芯片的统一内存与 GPU,无需 CUDA;
- 📊 连续批处理:多个请求可同时推理,多工具共用一台服务器也不卡顿;
- 💾 SSD 缓存:冷模型可卸载到磁盘,按需换入,长上下文不再吃满内存;
- 🖥️ 菜单栏管理:原生 Swift 菜单栏应用,启动、停止、监控服务器不用开终端。
任何 OpenAI 兼容客户端都能连接 http://localhost:8000/v1,这也是集成中心能"即插即用"的原因——它只是把各工具的 provider 地址填成 oMLX 而已。
准备就绪:先加载一个模型
接入工具前,请确保 oMLX 服务已启动、且至少加载了一个模型:
- 打开 oMLX,从管理面板(
http://localhost:8000/admin)进入模型下载器,直接在 HuggingFace 搜索并一键下载 MLX 模型; - 加载模型后,可先在内置 Chat 页面(
/admin/chat)验证输出是否正常。
一键接入步骤:打开集成中心
进入管理面板的 Integrations(集成) 页面,你会看到 8 个开箱即用的集成:OpenClaw、OpenCode、Codex、Codex App、Copilot CLI、Claude Code、Hermes Agent 和 Pi。点击对应工具,oMLX 会:
- ✅ 检测该工具是否已安装(未安装会给出安装提示);
- 📦 自动备份现有配置文件,再写入 oMLX 的 provider 设置;
- 🔍 弹出全屏幕模型选择器(方向键操作),已加载模型置顶显示,并标注上下文窗口大小;
- 🚀 配置完成后直接启动该工具。
所有集成逻辑集中在 omlx/integrations/init.py,每个工具一个模块,新增工具无需改主流程。
四大热门工具实战
OpenClaw 本地模型接入:自动完成引导配置
OpenClaw 是玩法最多的一个。oMLX 会向 ~/.openclaw/openclaw.json 写入名为 omlx 的 provider(OpenAI 兼容接口),并把所选模型设为默认;若检测到 OpenClaw 尚未完成引导,还会自动执行非交互式 onboarding、按需重启 gateway 守护进程。实现见 omlx/integrations/openclaw.py。
选模型时,视觉模型(VLM)会自动声明 image 输入能力,推理模型会开启 reasoning 开关——这些细节全部自动处理。
OpenCode 连接 oMLX 推理服务
OpenCode 走的是配置文件路线:oMLX 向 ~/.config/opencode/opencode.json 注入一个基于 @ai-sdk/openai-compatible 的 provider,模型 ID 以 omlx/模型名 形式成为默认模型。如果你选的是 VLM,配置里会自动附带图片模态与 attachment 标记。实现见 omlx/integrations/opencode.py。
Codex 切换本地 LLM 后端:不改你的全局配置
Codex 集成最"克制":oMLX 不修改你的 ~/.codex/config.toml,而是通过进程级 -c 参数临时覆盖 provider、模型和推理力度——退出 Codex 后你的原始配置原封不动。而且当模型名包含 thinking / o1 / o3 / r1 时,会自动把 reasoning effort 设为 high。实现见 omlx/integrations/codex.py。
Copilot CLI 接入本地模型(BYOK)
Copilot CLI 采用 Bring-Your-Own-Key 模式:oMLX 通过 COPILOT_PROVIDER_BASE_URL、COPILOT_PROVIDER_TYPE=openai 等环境变量把请求指到本地,并自动设置上下文与输出 token 上限。注意官方实现特意选用 responses 协议而非 completions,以规避已知兼容性问题。实现见 omlx/integrations/copilot.py。
终端快速启动:omlx launch 一行命令
除了面板,CLI 同样支持一行接入,命令解析与模型选择逻辑见 omlx/cli.py:
omlx launch list # 查看所有集成及安装状态
omlx launch openclaw --model qwen3-8b # 指定模型直接启动
omlx launch codex # 不带 --model 时弹出交互式模型选择器
执行前 oMLX 会先请求 /health 确认服务在线,再拉取 /v1/models/status 获取每个模型的上下文窗口等元信息,最后才交给底层集成模块启动工具——服务器没起、模型没装都会被提前拦截并给出提示。
为什么可以放心一键?
集成基类 omlx/integrations/base.py 里藏着几个贴心设计:
- 🛟 配置写前必备份:任何 JSON 配置在修改前都会生成带时间戳的
.bak文件; - 🐍 环境净化:启动外部工具前自动清除 oMLX 自带的 PYTHONHOME/PYTHONPATH,避免子进程 Python 崩溃;
- 🎯 智能模型选择:已加载模型(●)排在前、磁盘可用模型(○)排在后,禁用的模型附原因说明;
- 🌐 OpenAI + Anthropic 双协议:oMLX 同时兼容两套 API(
/v1/chat/completions与/v1/messages),所以 Claude Code 这类 Anthropic 系工具也能接入。
总结
oMLX 把"本地大模型 × AI 编码工具"这条最常被手动折腾的链路彻底简化了:面板一键配置、终端一行启动、配置自动备份、协议自动适配。在 Apple Silicon 上,你完全可以让 Codex、OpenCode、OpenClaw、Copilot 全部跑在免费、私密、低延迟的本地模型上——从下载模型到接入工具,全程不超过 10 分钟。🚀
更多功能(工具调用、结构化输出、MCP 集成等)可参考项目根目录的 README.md,集成模块源码位于 omlx/integrations/ 目录。
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考






