WorkBuddy 对接火山引擎豆包大模型省钱全攻略:按量计费 + 自动缓存,积分成本直降 5~10 倍
上一篇我们聊了 WorkBuddy 接 DeepSeek 官方 API 省钱,很多读者问:火山引擎的豆包模型能不能接?效果怎么样?更省钱吗?
答案是:能接,而且同样走「自定义模型 + 按量计费」这条路,把 WorkBuddy 里的通用对话、文档处理、简单代码这些「哪儿都能干」的活,交给豆包按 token 计费,积分只留给 WorkBuddy 独有的高级能力。配合豆包自带的上下文缓存和 Turbo/Pro 两档选型,同样的工作量,成本大概只有积分计费的 1/10~1/5。
下面围绕「自带 API Key 绕开积分」这条主线,讲清火山方舟 API 侧的注册、开通、缓存、选型,再到 WorkBuddy 的配置与使用习惯,全程照做即可,不需要懂代码。
一、为什么是火山方舟?先算一笔账
1.1 WorkBuddy 的积分,掉得比想象中快
WorkBuddy 内置了混元、DeepSeek、GLM、Kimi 等一堆模型,默认走「积分」计费。从实际使用来看:
| 模型档位 | 单次对话大致消耗 |
|---|---|
| 轻量模型 | 约 10~20 积分 |
| 中等模型 | 约 30~60 积分 |
| 高级模型 | 约 100~200 积分 |
高频使用的话,几千积分一周就能见底。而换成「自定义模型 + 火山方舟豆包 API」之后,同一个任务的成本大约只有积分计费的 1/10~1/5——平台给你工具和流程,动脑子的钱自己出,反而更省。
1.2 豆包 API 到底有多便宜
豆包模型通过**火山方舟(Volcano Engine Ark)**平台对外提供 OpenAI 兼容 API。当前主力是豆包大模型 2.1 系列,按「百万 tokens」计费(单位:元 / 百万 tokens):
| 计费项 | Doubao-Seed-2.1-pro | Doubao-Seed-2.1-turbo |
|---|---|---|
| 输入(缓存未命中) | 6 | 3 |
| 输入(缓存命中) | 1.2 | 0.6 |
| 输出 | 30 | 15 |
| 缓存存储 | 0.017 元/百万 tokens/小时 | 0.017 元/百万 tokens/小时 |
几个关键信息:
- 上下文长度 256K,处理超长文档、整份代码库提问都没压力;
- 上下文缓存是自动的:不用手动配置,命中部分的输入 token 直接按「命中价」计费;
- 两个模型都支持 Tool Calls、思考模式、JSON 输出等能力,Agent 场景完全够用;
- 新用户开通模型通常有免费赠送额度(各模型不同,一般在几十万 tokens 量级),可以先白嫖测通,再决定要不要充值。
记住下面三个「省钱数字」,后面会反复用到:
| 数字 | 含义 |
|---|---|
| 5 倍 | 输入 token「缓存命中」比「缓存未命中」便宜 5 倍 |
| 2 倍 | Turbo 比 Pro 便宜一半(输入、输出都是) |
| ≈0 | 缓存存储费 0.017 元/百万 tokens/小时,几乎可以忽略 |
1.3 和 DeepSeek 横向比一下
有人问:那豆包和 DeepSeek 谁更便宜?简单横向对比(单位:元 / 百万 tokens):
| 模型 | 输入(未命中) | 输入(缓存命中) | 输出 |
|---|---|---|---|
| DeepSeek V4 Flash | 1.5 | 0.05 | 4.5 |
| DeepSeek V4 Pro | 4.5 | 0.15 | 13.5 |
| 豆包 2.1 Turbo | 3 | 0.6 | 15 |
| 豆包 2.1 Pro | 6 | 1.2 | 30 |
单看单价,DeepSeek 确实更便宜。但豆包的账要这么算:免费赠送额度 + 自动缓存 + 中文语境顺手,前期基本零成本;而且豆包模型对中文长文、报告、摘要这类办公场景的体验很稳。结论是:两个都值得接,哪个顺手用哪个;追求极致便宜选 DeepSeek,看重中文体验和免费额度选豆包。 本文解决的是「豆包这条线怎么接、怎么省」。
二、准备工作:注册 + 开通模型 + 拿 Key(约 5 分钟)
火山方舟比 DeepSeek 多一步「开通模型」,其余流程类似:
- 打开火山方舟官网 https://www.volcengine.com/product/ark,或直接进控制台 https://console.volcengine.com/ark。
- 用手机号注册/登录火山引擎账号(没有会自动注册),按提示完成实名认证(个人或企业均可)。
- 进入方舟控制台后,左侧找「模型广场」,搜索或找到 Doubao-Seed-2.1-pro / Doubao-Seed-2.1-turbo,点「开通服务」(或「立即使用」),计费方式选按量付费(后付费)。这一步开通后,模型才真的能调。
- 左侧菜单点「API Key 管理」→「创建 API Key」,复制生成的密钥(以
ark-或类似前缀开头,形如一串 UUID)。 - 立即保存到安全的地方——密钥只在创建那一刻完整显示一次,关掉弹窗后就再也看不到了。
⚠️ 安全提醒:API Key 就是你的钱包钥匙,不要截图、不要发群里、不要提交到公开仓库。怀疑泄露就回平台删除重建,旧的作废。
💡 模型 ID 说明:火山方舟新版模型既可以直接用「模型 ID」调用(如
doubao-seed-2-1-pro,有时带日期版本号如doubao-seed-2-1-pro-260628),也可以通过「推理接入点」调用(见第 9 节)。日常用模型 ID 最简单。
三、方式一:图形界面配置(新手推荐,5 分钟搞定)
WorkBuddy 内置了「自定义模型」入口,不需要手写任何配置文件。
-
打开 WorkBuddy,点输入框右下角的模型选择器(显示当前模型名的地方,默认可能是「Auto」)。
-
弹出模型列表后,拉到最底部,点「配置自定义模型」。
-
进入模型设置页,点右上角「+ 添加模型」,弹出「添加模型」窗口(标题写着「仅支持 OpenAI 兼容协议 API」——火山方舟的 v3 接口完全兼容)。
-
填写三个核心字段:
- 提供商:下拉里若没有「火山方舟 / Volcengine」,选「OpenAI 兼容」或「自定义」,手动填接口地址(见下方 Base URL);
- API Key:粘贴第 2 节复制的密钥;
- 模型名称:填
doubao-seed-2-1-pro或doubao-seed-2-1-turbo。
火山方舟的 Base URL 是:
https://ark.cn-beijing.volces.com/api/v3 -
点「保存」,配置完成。
回到对话界面,再次点开模型选择器,就能在「自定义模型」区域看到刚添加的豆包。选中它之后,你发的消息就通过你自己的火山方舟 API Key 调用,不再扣 WorkBuddy 积分。
四、方式二:本地 models.json 配置文件(进阶)
适合想一次配好多个模型、或需要精细控制参数的场景。
4.1 写入配置文件
创建或编辑用户级配置文件:
C:\Users\<你的用户名>\.codebuddy\models.json
如果只想对某个项目生效,也可以创建项目级配置文件:
<你的项目>\.codebuddy\models.json
先将 API Key 设置为环境变量(PowerShell):
setx ARK_API_KEY "<你的火山方舟 API Key>"
然后写入以下配置:
{
"models": [
{
"id": "doubao-seed-2-1-pro",
"name": "豆包 2.1 Pro",
"vendor": "Volcengine",
"url": "https://ark.cn-beijing.volces.com/api/v3/chat/completions",
"apiKey": "${ARK_API_KEY}",
"maxInputTokens": 128000,
"maxOutputTokens": 8192,
"supportsToolCall": true,
"supportsImages": false,
"relatedModels": {
"lite": "doubao-seed-2-1-turbo",
"reasoning": "doubao-seed-2-1-pro"
}
},
{
"id": "doubao-seed-2-1-turbo",
"name": "豆包 2.1 Turbo",
"vendor": "Volcengine",
"url": "https://ark.cn-beijing.volces.com/api/v3/chat/completions",
"apiKey": "${ARK_API_KEY}",
"maxInputTokens": 128000,
"maxOutputTokens": 8192,
"supportsToolCall": true,
"supportsImages": false
}
],
"availableModels": [
"doubao-seed-2-1-pro",
"doubao-seed-2-1-turbo"
]
}
关键细节:请把
models.json保存为 UTF-8 无 BOM。部分桌面版本读取带 UTF-8 BOM 文件头的 JSON 时,可能会读取本地模型配置失败。
4.2 重启并选择模型
完全退出 WorkBuddy 后重新打开,在模型选择器中选择 豆包 2.1 Pro 或 豆包 2.1 Turbo 即可。
4.3 可选:验证 API Key
Windows 用户可以在 PowerShell 里先验证 Key 是否可用:
$env:ARK_API_KEY="<你的火山方舟 API Key>"
curl https://ark.cn-beijing.volces.com/api/v3/chat/completions `
-H "Content-Type: application/json" `
-H "Authorization: Bearer $env:ARK_API_KEY" `
-d '{"model":"doubao-seed-2-1-turbo","messages":[{"role":"user","content":"hi"}]}'
能正常返回内容,说明 Key 和模型 ID 都可用。如果报「模型未开通」或「model not found」,多半是第 2 节忘了「开通服务」这一步。
五、验证是否配置成功:一眼识别
配置好之后,最容易踩的坑是选错模型——内置模型和自定义模型长得可能很像,但计费完全不同:
- 上半部分内置的模型:扣 WorkBuddy 积分;
- 底部带「自定义」标识的模型:走你自己的账户。
验证方法:随便发一条消息,然后看左下角的积分余额——
- 积分掉了 → 选成了内置模型,切换重选;
- 积分没变 → 成功!走的是你自己的 Key。
注意:配好后日常对话不再扣积分,但联网搜索等附加功能仍可能扣少量积分(搜索结果汇总会用到内置模型),属正常现象。
六、省钱大招一:上下文缓存,命中比未命中便宜 5 倍
这是火山方舟 API 侧最省心也最实在的一个省钱点:缓存是自动的,你什么都不用做。
豆包会自动对请求里的公共前缀做缓存——包括系统提示词(System Prompt)和前面几轮的对话历史。这些重复发送的内容,命中的部分按「缓存命中价」计费,没命中的才按全价:
| 模型 | 输入·缓存未命中 | 输入·缓存命中 | 差距 |
|---|---|---|---|
| Doubao-Seed-2.1-pro | 6.0 元 | 1.2 元 | 5 倍 |
| Doubao-Seed-2.1-turbo | 3.0 元 | 0.6 元 | 5 倍 |
对 WorkBuddy 这类 Agent 场景尤其友好:每一轮请求都会带上相同的系统提示词 + 工具定义 + 历史消息,这部分天然就是「命中缓存」的大头。也就是说,对话越长,缓存命中带来的节省越明显——前提是尽量在一个会话里保持前缀不变、不要频繁大改系统提示。
顺带说一句:缓存确实有存储费(0.017 元/百万 tokens/小时),但低到可以忽略——按 1 万 token 的前缀缓存 24 小时算,一天也就零点几厘钱。
6.1 怎么吃满缓存收益
- 别轻易重启新会话:多轮追问同一个任务,历史前缀稳定,命中率高;
- 把稳定的说明写进系统提示(或 WorkBuddy 的自定义指令里),而不是每轮消息里重复贴一遍;
- 工具/技能定义保持稳定:不要在对话中途反复增删技能,否则前缀变动会导致缓存失效重算。
七、省钱大招二:选对模型,Turbo 干 Pro 的活用一半的钱
很多人一上来就选 Pro,其实大部分日常办公任务 Turbo 完全够用:
| 场景 | 推荐模型 |
|---|---|
| 日常问答、翻译、摘要、润色 | 豆包 2.1 Turbo |
| 数据整理、表格处理、轻量代码 | 豆包 2.1 Turbo |
| 深度推理、复杂分析、写长文 | 豆包 2.1 Pro |
Turbo 的输入/输出价格都是 Pro 的 1/2(输入 3 vs 6,输出 15 vs 30),日常任务用 Turbo,遇到搞不定的再手动切 Pro,是性价比最高的用法。
小技巧:在方式二的
models.json里,relatedModels.lite已经指向doubao-seed-2-1-turbo,可以让 Agent 在简单环节自动降级到 Turbo,进一步省钱。
八、省钱大招三:控制上下文长度,别让历史吃掉预算
很多人的钱不是「用」掉的,是「喂」掉的。每轮请求都会把全部历史重新发给模型,对话到第 20 轮时,单次消耗可能是第 1 轮的十几倍。
对应到 API 账单就是:输入 token 随轮次线性膨胀。所以:
- 一个任务一个对话窗口:做完就关,别混着聊;
- 新话题开新窗口:避免无关历史拖累每一轮成本;
- 一次把需求说清楚:别「挤牙膏」式来回改,每多一轮都是钱;
- 必要时手动截断:长对话里如果前面的结论已经用不上了,开新窗口把结论复制过去继续。
九、进阶省钱:Coding Plan / 推理接入点 / 节省计划
除了「按量计费 + 缓存」这条主线,火山方舟还有几个进阶玩法,按需取用:
9.1 推理接入点(Endpoint)
推理接入点是火山方舟的一个特色概念:把一个「模型 + 版本」绑定成一个接入点(形如 ep-2025xxxxxx),调用时 model 字段填接入点 ID 而不是模型 ID。好处是:
- 版本锁定:模型升级不会影响你,稳定性更好;
- 独立限流与监控:可以对不同用途(如对话、批处理)建不同接入点,分别看用量。
对 WorkBuddy 用户来说,日常用模型 ID 就够了;如果某个高频任务想锁定版本、单独控预算,再考虑建接入点。
9.2 Coding Plan / Agent Plan(订阅制)
火山方舟还提供面向编程场景的订阅套餐(Coding Plan 配豆包编程模型,Agent Plan 面向 Agent 任务),按月付费,适合重度使用 Claude Code、Cursor 等编程工具的用户。
对 WorkBuddy 这种「通用对话 + 文档处理」为主的场景,按量付费通常更灵活、更省——用量不大时订阅反而贵。建议先用按量跑一个月,看真实账单再决定要不要上订阅。
9.3 节省计划(预付费折扣)
如果用量稳定且较大,可以看看方舟的「节省计划」——预付一定额度换取折扣,类似「充值返利」。适合用量确定的企业/重度用户,个人轻度使用不必折腾。
9.4 本地模型(Ollama 完全免费)
电脑配置够(建议 16G 内存以上)的话,可以在本地跑开源模型(Ollama / LM Studio),完全不扣积分、不走网络、数据不出本机。代价是效果和在线大模型有差距,适合简单任务。
十、WorkBuddy 积分使用习惯(7 招省积分)
如果暂时不想折腾 API,单靠「改习惯」也能省下一大截积分。下面这七招,招招都冲着积分消耗的源头去:
| # | 习惯 | 做法 |
|---|---|---|
| 1 | 按任务复杂度选模型 | 简单任务用轻量模型,复杂任务再上高配,别「大炮打蚊子」 |
| 2 | 分清 Ask / Plan / Craft | 查资料、问概念用 Ask;要生成文件、操作数据才用 Craft |
| 3 | 一次把需求说清楚 | 首条消息写清「要什么 / 用什么 / 什么格式 / 什么要求」四要素 |
| 4 | 一个任务一个窗口 | 做完就关,避免历史堆积导致单次消耗暴涨 |
| 5 | 手动控制技能调用 | 简单任务加一句「直接回答,不用调用额外技能」 |
| 6 | 优先用快过期积分 | 定期看积分明细,快过期的用来跑消耗大的任务 |
| 7 | 当月免费额度用完 | 月底前把当月额度花掉,别浪费 |
十一、避坑指南
- 内置 vs 自定义分不清:选模型务必看有没有「自定义」标识,长得一样但计费天差地别。
- 忘了「开通服务」这一步:火山方舟必须先开通模型才能调,报「模型未开通 / not found」多半是这里。
models.json保存成带 BOM:务必 UTF-8 无 BOM,否则读取失败。- 模型 ID 写错:注意是
doubao-seed-2-1-pro(2-1中间是连字符不是点),多一个空格、写错字符都是 404。 - UI 直接显示
${ARK_API_KEY}:说明环境变量没展开,从已设置该变量的终端重启 WorkBuddy,或在配置里直接填真实 Key。 - 把接口地址填到 API Key 字段:401 报错的常见原因,API Key 和 Base URL 是两个东西。
- 触发限流(429):火山方舟对免费额度/低等级账号有 RPM(每分钟请求数)限流,批量跑任务时如果频繁 429,先调低并发、错开时间,或提升账号等级。
十二、总结
把上面所有方法串起来,就是一条清晰的省钱链路:
- 主线:注册火山引擎 → 实名 → 开通豆包模型 → 拿 API Key → 在 WorkBuddy 里配「自定义模型」→ 选底部带「自定义」标识的模型,成本直接降到积分计费的 1/10~1/5;
- API 侧:吃满上下文缓存(自动,命中便宜 5 倍)+ 选 Turbo(半价)+ 控制上下文长度;
- 习惯侧:一个任务一个窗口、一次说清需求、按复杂度选模型。
核心思路一句话:把 WorkBuddy 积分留给「只有它才能干」的高级能力(专家中心、技能、连接器、自动化),那些通用对话、文档处理、简单代码这类「哪儿都能干」的活,交给豆包按量计费,反而更划算。

183

被折叠的 条评论
为什么被折叠?



