oMLX 集成中心实战:如何一键接入 OpenClaw、OpenCode、Codex 与 Copilot

oMLX 集成中心实战:如何一键接入 OpenClaw、OpenCode、Codex 与 Copilot

如果你正在 Mac 上使用 Codex、OpenCode、OpenClaw 或 Copilot CLI,却一直为"让 AI 编码工具用上本地大模型"而手动改配置文件,那么 oMLX 值得你花 5 分钟了解一下。oMLX 是一款运行在 Apple Silicon 上的 LLM 推理服务器,支持连续批处理(continuous batching)与 SSD 缓存,并通过 macOS 菜单栏原生应用管理。它内置的**集成中心(Integrations)**让你一键把 OpenClaw、OpenCode、Codex、Copilot CLI 等 8 款外部 AI 工具指向本地模型——自动写配置、自动备份、自动选模型,全程零手动编辑。

oMLX 集成中心:一键接入 OpenClaw、OpenCode、Codex、Copilot 等 AI 编码工具

oMLX 是什么:Apple Silicon 原生 LLM 推理服务器

在动手接入之前,先 30 秒认识 oMLX:

  • 🚀 为 Apple Silicon 而生:基于 MLX 框架,充分利用 Apple 芯片的统一内存与 GPU,无需 CUDA;
  • 📊 连续批处理:多个请求可同时推理,多工具共用一台服务器也不卡顿;
  • 💾 SSD 缓存:冷模型可卸载到磁盘,按需换入,长上下文不再吃满内存;
  • 🖥️ 菜单栏管理:原生 Swift 菜单栏应用,启动、停止、监控服务器不用开终端。

![oMLX 菜单栏状态:监控本地 LLM 推理服务器](https://raw.gitcode.com/GitHub_Trending/om/omlx/raw/4a082f4bb883cdae1de3f444d4a5ae050d39d213/docs/images/Screenshot 2026-02-10 at 00.51.54.png?utm_source=gitcode_repo_files)

任何 OpenAI 兼容客户端都能连接 http://localhost:8000/v1,这也是集成中心能"即插即用"的原因——它只是把各工具的 provider 地址填成 oMLX 而已。

准备就绪:先加载一个模型

接入工具前,请确保 oMLX 服务已启动、且至少加载了一个模型:

  1. 打开 oMLX,从管理面板(http://localhost:8000/admin)进入模型下载器,直接在 HuggingFace 搜索并一键下载 MLX 模型;
  2. 加载模型后,可先在内置 Chat 页面(/admin/chat)验证输出是否正常。

oMLX 模型下载器:搜索并一键下载 MLX 本地模型

一键接入步骤:打开集成中心

进入管理面板的 Integrations(集成) 页面,你会看到 8 个开箱即用的集成:OpenClaw、OpenCode、Codex、Codex App、Copilot CLI、Claude Code、Hermes Agent 和 Pi。点击对应工具,oMLX 会:

  1. ✅ 检测该工具是否已安装(未安装会给出安装提示);
  2. 📦 自动备份现有配置文件,再写入 oMLX 的 provider 设置;
  3. 🔍 弹出全屏幕模型选择器(方向键操作),已加载模型置顶显示,并标注上下文窗口大小;
  4. 🚀 配置完成后直接启动该工具。

所有集成逻辑集中在 omlx/integrations/init.py,每个工具一个模块,新增工具无需改主流程。

四大热门工具实战

OpenClaw 本地模型接入:自动完成引导配置

OpenClaw 是玩法最多的一个。oMLX 会向 ~/.openclaw/openclaw.json 写入名为 omlx 的 provider(OpenAI 兼容接口),并把所选模型设为默认;若检测到 OpenClaw 尚未完成引导,还会自动执行非交互式 onboarding、按需重启 gateway 守护进程。实现见 omlx/integrations/openclaw.py

选模型时,视觉模型(VLM)会自动声明 image 输入能力,推理模型会开启 reasoning 开关——这些细节全部自动处理。

OpenCode 连接 oMLX 推理服务

OpenCode 走的是配置文件路线:oMLX 向 ~/.config/opencode/opencode.json 注入一个基于 @ai-sdk/openai-compatible 的 provider,模型 ID 以 omlx/模型名 形式成为默认模型。如果你选的是 VLM,配置里会自动附带图片模态与 attachment 标记。实现见 omlx/integrations/opencode.py

Codex 切换本地 LLM 后端:不改你的全局配置

Codex 集成最"克制":oMLX 不修改你的 ~/.codex/config.toml,而是通过进程级 -c 参数临时覆盖 provider、模型和推理力度——退出 Codex 后你的原始配置原封不动。而且当模型名包含 thinking / o1 / o3 / r1 时,会自动把 reasoning effort 设为 high。实现见 omlx/integrations/codex.py

Copilot CLI 接入本地模型(BYOK)

Copilot CLI 采用 Bring-Your-Own-Key 模式:oMLX 通过 COPILOT_PROVIDER_BASE_URLCOPILOT_PROVIDER_TYPE=openai 等环境变量把请求指到本地,并自动设置上下文与输出 token 上限。注意官方实现特意选用 responses 协议而非 completions,以规避已知兼容性问题。实现见 omlx/integrations/copilot.py

终端快速启动:omlx launch 一行命令

除了面板,CLI 同样支持一行接入,命令解析与模型选择逻辑见 omlx/cli.py

omlx launch list                      # 查看所有集成及安装状态
omlx launch openclaw --model qwen3-8b  # 指定模型直接启动
omlx launch codex                      # 不带 --model 时弹出交互式模型选择器

执行前 oMLX 会先请求 /health 确认服务在线,再拉取 /v1/models/status 获取每个模型的上下文窗口等元信息,最后才交给底层集成模块启动工具——服务器没起、模型没装都会被提前拦截并给出提示。

oMLX 内置 Chat 页面:验证本地模型输出

为什么可以放心一键?

集成基类 omlx/integrations/base.py 里藏着几个贴心设计:

  • 🛟 配置写前必备份:任何 JSON 配置在修改前都会生成带时间戳的 .bak 文件;
  • 🐍 环境净化:启动外部工具前自动清除 oMLX 自带的 PYTHONHOME/PYTHONPATH,避免子进程 Python 崩溃;
  • 🎯 智能模型选择:已加载模型(●)排在前、磁盘可用模型(○)排在后,禁用的模型附原因说明;
  • 🌐 OpenAI + Anthropic 双协议:oMLX 同时兼容两套 API(/v1/chat/completions/v1/messages),所以 Claude Code 这类 Anthropic 系工具也能接入。

总结

oMLX 把"本地大模型 × AI 编码工具"这条最常被手动折腾的链路彻底简化了:面板一键配置、终端一行启动、配置自动备份、协议自动适配。在 Apple Silicon 上,你完全可以让 Codex、OpenCode、OpenClaw、Copilot 全部跑在免费、私密、低延迟的本地模型上——从下载模型到接入工具,全程不超过 10 分钟。🚀

更多功能(工具调用、结构化输出、MCP 集成等)可参考项目根目录的 README.md,集成模块源码位于 omlx/integrations/ 目录。

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值