WorkBuddy 对接 DeepSeek 模型省钱全攻略:自带 Key、缓存、错峰,成本直降 5~10 倍
用 WorkBuddy 干活是真的爽,但积分掉得也是真的快——写长文档、多轮推理、跑复杂任务,一天几百积分说没就没。其实 WorkBuddy 官方早就支持「自定义模型」:把 DeepSeek 官方 API 接进来,调用走你自己的账户按量计费,同样的活,成本大概只有积分计费的 1/10~1/5。
下面围绕「自带 API Key 绕开积分」这条主线,讲清 DeepSeek API 侧的上下文缓存、错峰使用、选对模型,再到 WorkBuddy 自身的积分使用习惯,全程照做即可,不需要懂代码。
一、为什么是 DeepSeek?先算一笔账
1.1 WorkBuddy 的积分制:掉得比想象中快
WorkBuddy 内置了混元、DeepSeek、GLM、Kimi 等一堆模型,默认走「积分」计费。从实际使用来看:
| 模型档位 | 单次对话大致消耗 |
|---|---|
| 轻量模型 | 约 10~20 积分 |
| 中等模型 | 约 30~60 积分 |
| 高级模型 | 约 100~200 积分 |
高频使用的话,几千积分一周就能见底。而换成「自定义模型 + DeepSeek 官方 API」之后,同一个任务的成本大约只有积分计费的 1/10~1/5——平台给你工具和流程,动脑子的钱自己出,反而更省。
1.2 DeepSeek API 到底有多便宜
DeepSeek API 按「百万 tokens」计费,单价低到可以直接忽略。V4 系列当前价格如下(单位:元 / 百万 tokens):
| 计费项 | deepseek-v4-flash | deepseek-v4-pro | deepseek-v4-flash-vision-exp |
|---|---|---|---|
| 输入(缓存命中,空闲/高峰) | 0.05 / 0.10 | 0.15 / 0.30 | 0.05 / 0.10 |
| 输入(缓存未命中,空闲/高峰) | 1.5 / 3.0 | 4.5 / 9.0 | 1.5 / 3.0 |
| 输出(空闲/高峰) | 4.5 / 9.0 | 13.5 / 27.0 | 4.5 / 9.0 |
| 并发上限 | 2500 | 500 | 2500 |
几个关键信息:
- 上下文长度 1M,单次最大输出 384K,处理超长文档毫无压力;
- 空闲时段价格 = 高峰时段的一半。高峰时段为北京时间周一至周五 9:00–12:00、14:00–18:00,其余均为空闲时段;
- 三个模型都支持 JSON Output、Tool Calls、思考模式等能力,Agent 场景完全够用。
记住下面三个「省钱数字」,后面会反复用到:
| 数字 | 含义 |
|---|---|
| 30 倍 | 输入 token「缓存命中」比「缓存未命中」便宜 30 倍 |
| 2 倍 | 「空闲时段」比「高峰时段」便宜一半 |
| 3 倍 | Flash 比 Pro 便宜 3 倍(输入/输出都是) |
二、准备工作:注册 + 拿 Key(约 3 分钟)
无论用哪种配置方式,第一步都是去 DeepSeek 开放平台拿一把「钥匙」。
- 打开 DeepSeek 官网 https://www.deepseek.com,点击「API 开放平台」入口(不是「开始对话」)。
- 用手机号验证码或微信扫码登录,没有账号会自动注册。
- 进入控制台后,左侧菜单点「用量信息」看看余额。DeepSeek 按量计费,新用户通常有赠送额度;余额不足可以先充值(支持支付宝/微信,¥10 起充)。
- 左侧菜单点「API keys」→ 右上角「创建 API key」。
- 复制生成的密钥(以
sk-开头),立即保存到安全的地方——密钥只在创建那一刻完整显示一次,关掉弹窗后就再也看不到了。
⚠️ 安全提醒:API Key 就是你的钱包钥匙,不要截图、不要发群里、不要提交到公开仓库。怀疑泄露就回平台删除重建,旧的作废。
三、方式一:图形界面配置(新手推荐,5 分钟搞定)
WorkBuddy 内置了「自定义模型」入口,不需要手写任何配置文件。
-
打开 WorkBuddy,点输入框右下角的模型选择器(显示当前模型名的地方,默认可能是「Auto」)。
-
弹出模型列表后,拉到最底部,点「配置自定义模型」。
-
进入模型设置页,点右上角「+ 添加模型」,弹出「添加模型」窗口(标题写着「仅支持 OpenAI 兼容协议 API」——DeepSeek 完全兼容)。
-
只需要填三个字段:
- 提供商:下拉选择「深度求索 / DeepSeek」(选完接口地址会自动填好,不用手填网址);
- API Key:粘贴第 2 节复制的
sk-xxx; - 模型名称:下拉选择,有
DeepSeek-V4 Pro、DeepSeek-V4 Flash等,按需选。
-
点「保存」,配置完成。
回到对话界面,再次点开模型选择器,就能在「自定义模型」区域看到刚添加的 DeepSeek。选中它之后,你发的消息就通过你自己的 DeepSeek API Key 调用,不再扣 WorkBuddy 积分。
四、方式二:本地 models.json 配置文件(进阶,官方推荐)
DeepSeek 官方文档也给出了配置文件方式,适合想一次配好多个模型、或需要精细控制参数的场景。
4.1 写入配置文件
创建或编辑用户级配置文件:
C:\Users\<你的用户名>\.codebuddy\models.json
如果只想对某个项目生效,也可以创建项目级配置文件:
<你的项目>\.codebuddy\models.json
先将 API Key 设置为环境变量(PowerShell):
setx DEEPSEEK_API_KEY "<your DeepSeek API Key>"
然后写入以下配置:
{
"models": [
{
"id": "deepseek-v4-pro",
"name": "DeepSeek V4 Pro",
"vendor": "DeepSeek",
"url": "https://api.deepseek.com/v1/chat/completions",
"apiKey": "${DEEPSEEK_API_KEY}",
"maxInputTokens": 128000,
"maxOutputTokens": 8192,
"supportsToolCall": true,
"supportsImages": false,
"relatedModels": {
"lite": "deepseek-v4-flash",
"reasoning": "deepseek-v4-pro"
}
},
{
"id": "deepseek-v4-flash",
"name": "DeepSeek V4 Flash",
"vendor": "DeepSeek",
"url": "https://api.deepseek.com/v1/chat/completions",
"apiKey": "${DEEPSEEK_API_KEY}",
"maxInputTokens": 128000,
"maxOutputTokens": 8192,
"supportsToolCall": true,
"supportsImages": false
}
],
"availableModels": [
"deepseek-v4-pro",
"deepseek-v4-flash"
]
}
关键细节:请把
models.json保存为 UTF-8 无 BOM。部分桌面版本读取带 UTF-8 BOM 文件头的 JSON 时,可能会读取本地模型配置失败。
4.2 重启并选择模型
完全退出 WorkBuddy 后重新打开,在模型选择器中选择 DeepSeek V4 Pro 或 DeepSeek V4 Flash 即可。
4.3 可选:验证 API Key
Windows 用户可以在 PowerShell 里先验证 Key 是否可用:
$env:DEEPSEEK_API_KEY="<your DeepSeek API Key>"
curl https://api.deepseek.com/v1/chat/completions `
-H "Content-Type: application/json" `
-H "Authorization: Bearer $env:DEEPSEEK_API_KEY" `
-d '{"model":"deepseek-v4-flash","messages":[{"role":"user","content":"hi"}],"stream":false}'
能正常返回内容,说明 Key 和模型名都可用。
五、验证是否配置成功:一眼识别
配置好之后,最容易踩的坑是选错模型——内置 DeepSeek 和自定义 DeepSeek 长得几乎一样,但计费完全不同:
- 上半部分内置的 DeepSeek:扣 WorkBuddy 积分;
- 底部带「自定义」标识的 DeepSeek:走你自己的账户。
验证方法:随便发一条消息,然后看左下角的积分余额——
- 积分掉了 → 选成了内置模型,切换重选;
- 积分没变 → 成功!走的是你自己的 Key。
注意:配好后日常对话不再扣积分,但联网搜索等附加功能仍可能扣少量积分(搜索结果汇总会用到内置模型),属正常现象。
六、省钱大招一:上下文缓存,命中比未命中便宜 30 倍
这是 DeepSeek API 侧最狠的一个省钱点。
DeepSeek 会自动对请求里的公共前缀做缓存——包括系统提示词(System Prompt)和前面几轮的对话历史。这些重复发送的内容,命中的部分按「缓存命中价」计费,没命中的才按全价:
| 模型 | 输入·缓存未命中(高峰) | 输入·缓存命中(高峰) | 差距 |
|---|---|---|---|
| deepseek-v4-flash | 3.0 元 | 0.10 元 | 30 倍 |
| deepseek-v4-pro | 9.0 元 | 0.30 元 | 30 倍 |
对 WorkBuddy 这类 Agent 场景尤其友好:每一轮请求都会带上相同的系统提示词 + 工具定义 + 历史消息,这部分天然就是「命中缓存」的大头。也就是说,对话越长,缓存命中带来的节省越明显——前提是尽量在一个会话里保持前缀不变、不要频繁大改系统提示。
6.1 怎么吃满缓存收益
- 别轻易重启新会话:多轮追问同一个任务,历史前缀稳定,命中率高;
- 把稳定的说明写进系统提示(或 WorkBuddy 的自定义指令里),而不是每轮消息里重复贴一遍;
- 工具/技能定义保持稳定:不要在对话中途反复增删技能,否则前缀变动会导致缓存失效重算。
七、省钱大招二:错峰使用,空闲时段直接半价
DeepSeek 的「峰谷定价」简单粗暴:
- 高峰时段:北京时间周一至周五 9:00–12:00、14:00–18:00;
- 空闲时段:其余所有时间,价格打五折。
同样是 deepseek-v4-pro 的输出,高峰 27 元/百万 tokens,空闲只要 13.5 元。
落地建议:把「批量跑、不着急」的活留到晚上、中午 12:00–14:00 或周末——比如让 WorkBuddy 批量生成周报、整理报表、清洗数据、翻译长文档。这些任务对时延不敏感,错峰跑等于白捡一半折扣。
八、省钱大招三:选对模型,Flash 干 Pro 的活用 1/3 的钱
很多人一上来就选最贵的 Pro,其实大部分日常办公任务 Flash 完全够用:
| 场景 | 推荐模型 |
|---|---|
| 日常问答、翻译、摘要、润色 | DeepSeek V4 Flash |
| 数据整理、表格处理、轻量代码 | DeepSeek V4 Flash |
| 深度推理、复杂分析、写长文 | DeepSeek V4 Pro |
| 看图、读截图、图文理解 | DeepSeek V4 Flash Vision Exp |
Flash 的输入/输出价格都是 Pro 的 1/3(输入 1.5 vs 4.5,输出 4.5 vs 13.5),日常任务用 Flash,遇到搞不定的再手动切 Pro,是性价比最高的用法。
小技巧:在方式二的
models.json里,relatedModels.lite已经指向deepseek-v4-flash,可以让 Agent 在简单环节自动降级到 Flash,进一步省钱。
九、省钱大招四:控制上下文长度,别让历史吃掉预算
很多人的钱不是「用」掉的,是「喂」掉的。每轮请求都会把全部历史重新发给模型,对话到第 20 轮时,单次消耗可能是第 1 轮的十几倍。
对应到 API 账单就是:输入 token 随轮次线性膨胀。所以:
- 一个任务一个对话窗口:做完就关,别混着聊;
- 新话题开新窗口:避免无关历史拖累每一轮成本;
- 一次把需求说清楚:别「挤牙膏」式来回改,每多一轮都是钱;
- 必要时手动截断:长对话里如果前面的结论已经用不上了,开新窗口把结论复制过去继续。
十、进阶省钱:多模型矩阵 / 中转聚合 / 本地模型
除了「自带 DeepSeek Key」这条主线,还有几个进阶玩法,按需取用:
10.1 中转聚合平台(一个 Key 走天下)
一些第三方平台(例如七牛云 AI Token Plan 之类)提供「一个 API Key + 一个 baseUrl」聚合多家模型的服务,在 WorkBuddy 里只需改一个提供商就能切换 DeepSeek / GLM / Kimi 等,适合不想在多个平台分别充值、又想要多模型兜底的用户。
⚠️ 请认准正规渠道,不要使用来路不明的「免费 Key」,避免隐私和资费风险。
10.2 本地模型(Ollama 完全免费)
电脑配置够(建议 16G 内存以上)的话,可以在本地跑开源模型(Ollama / LM Studio),完全不扣积分、不走网络、数据不出本机,适合对隐私敏感、不想持续充值的场景。代价是效果和在线大模型有差距,适合简单任务。
10.3 企业内网自部署
公司内部已经部署了 DeepSeek 模型服务(形如 http://10.x.x.x:1025 的内网地址),同样可以作为「OpenAI 兼容」自定义模型接进 WorkBuddy,减少网络延迟、保障数据不出企业内网。
十一、WorkBuddy 积分使用习惯(7 招省积分)
如果暂时不想折腾 API,单靠「改习惯」也能省下一大截积分。下面这七招,招招都冲着积分消耗的源头去:
| # | 习惯 | 做法 |
|---|---|---|
| 1 | 按任务复杂度选模型 | 简单任务用轻量模型,复杂任务再上高配,别「大炮打蚊子」 |
| 2 | 分清 Ask / Plan / Craft | 查资料、问概念用 Ask;要生成文件、操作数据才用 Craft |
| 3 | 一次把需求说清楚 | 首条消息写清「要什么 / 用什么 / 什么格式 / 什么要求」四要素 |
| 4 | 一个任务一个窗口 | 做完就关,避免历史堆积导致单次消耗暴涨 |
| 5 | 手动控制技能调用 | 简单任务加一句「直接回答,不用调用额外技能」 |
| 6 | 优先用快过期积分 | 定期看积分明细,快过期的用来跑消耗大的任务 |
| 7 | 当月免费额度用完 | 月底前把当月额度花掉,别浪费 |
十二、避坑指南
- 内置 vs 自定义分不清:选模型务必看有没有「自定义」标识,长得一样但计费天差地别。
models.json保存成带 BOM:务必 UTF-8 无 BOM,否则读取失败。- 模型 id 写错:必须严格写成
deepseek-v4-pro/deepseek-v4-flash,多一个空格都是 404。 - UI 直接显示
${DEEPSEEK_API_KEY}:说明环境变量没展开,从已设置该变量的终端重启 WorkBuddy,或在配置里直接填真实 Key。 - 配好才发现没余额:自定义模型能不能调通取决于账户余额,先充值再配。
- 把接口 URL 填到 API Key 字段:401 报错的常见原因,API Key 和地址是两个东西。
十三、总结
把上面所有方法串起来,就是一条清晰的省钱链路:
- 主线:注册 DeepSeek 开放平台 → 拿 Key → 在 WorkBuddy 里配「自定义模型」→ 选底部带「自定义」标识的模型,成本直接降到积分计费的 1/10~1/5;
- API 侧:吃满上下文缓存(30 倍)+ 错峰(半价)+ 选 Flash(1/3 价)+ 控制上下文长度;
- 习惯侧:一个任务一个窗口、一次说清需求、按复杂度选模型。
核心思路一句话:把 WorkBuddy 积分留给「只有它才能干」的高级能力(专家中心、技能、连接器、自动化),那些通用对话、简单代码这类「哪儿都能干」的活,交给 DeepSeek 按量计费,反而更划算。

119

被折叠的 条评论
为什么被折叠?



