WorkBuddy 对接 DeepSeek 模型省钱全攻略:自带 Key、缓存、错峰,成本直降 5~10 倍

WorkBuddy 对接 DeepSeek 模型省钱全攻略:自带 Key、缓存、错峰,成本直降 5~10 倍

用 WorkBuddy 干活是真的爽,但积分掉得也是真的快——写长文档、多轮推理、跑复杂任务,一天几百积分说没就没。其实 WorkBuddy 官方早就支持「自定义模型」:把 DeepSeek 官方 API 接进来,调用走你自己的账户按量计费,同样的活,成本大概只有积分计费的 1/10~1/5

下面围绕「自带 API Key 绕开积分」这条主线,讲清 DeepSeek API 侧的上下文缓存、错峰使用、选对模型,再到 WorkBuddy 自身的积分使用习惯,全程照做即可,不需要懂代码。


一、为什么是 DeepSeek?先算一笔账

1.1 WorkBuddy 的积分制:掉得比想象中快

WorkBuddy 内置了混元、DeepSeek、GLM、Kimi 等一堆模型,默认走「积分」计费。从实际使用来看:

模型档位单次对话大致消耗
轻量模型约 10~20 积分
中等模型约 30~60 积分
高级模型约 100~200 积分

高频使用的话,几千积分一周就能见底。而换成「自定义模型 + DeepSeek 官方 API」之后,同一个任务的成本大约只有积分计费的 1/10~1/5——平台给你工具和流程,动脑子的钱自己出,反而更省。

1.2 DeepSeek API 到底有多便宜

DeepSeek API 按「百万 tokens」计费,单价低到可以直接忽略。V4 系列当前价格如下(单位:元 / 百万 tokens):

计费项deepseek-v4-flashdeepseek-v4-prodeepseek-v4-flash-vision-exp
输入(缓存命中,空闲/高峰)0.05 / 0.100.15 / 0.300.05 / 0.10
输入(缓存未命中,空闲/高峰)1.5 / 3.04.5 / 9.01.5 / 3.0
输出(空闲/高峰)4.5 / 9.013.5 / 27.04.5 / 9.0
并发上限25005002500

几个关键信息:

  • 上下文长度 1M,单次最大输出 384K,处理超长文档毫无压力;
  • 空闲时段价格 = 高峰时段的一半。高峰时段为北京时间周一至周五 9:00–12:00、14:00–18:00,其余均为空闲时段;
  • 三个模型都支持 JSON Output、Tool Calls、思考模式等能力,Agent 场景完全够用。

记住下面三个「省钱数字」,后面会反复用到:

数字含义
30 倍输入 token「缓存命中」比「缓存未命中」便宜 30 倍
2 倍「空闲时段」比「高峰时段」便宜一半
3 倍Flash 比 Pro 便宜 3 倍(输入/输出都是)

二、准备工作:注册 + 拿 Key(约 3 分钟)

无论用哪种配置方式,第一步都是去 DeepSeek 开放平台拿一把「钥匙」。

  1. 打开 DeepSeek 官网 https://www.deepseek.com,点击「API 开放平台」入口(不是「开始对话」)。
  2. 手机号验证码微信扫码登录,没有账号会自动注册。
  3. 进入控制台后,左侧菜单点「用量信息」看看余额。DeepSeek 按量计费,新用户通常有赠送额度;余额不足可以先充值(支持支付宝/微信,¥10 起充)。
  4. 左侧菜单点「API keys」→ 右上角「创建 API key」。
  5. 复制生成的密钥(以 sk- 开头),立即保存到安全的地方——密钥只在创建那一刻完整显示一次,关掉弹窗后就再也看不到了。

⚠️ 安全提醒:API Key 就是你的钱包钥匙,不要截图、不要发群里、不要提交到公开仓库。怀疑泄露就回平台删除重建,旧的作废。


三、方式一:图形界面配置(新手推荐,5 分钟搞定)

WorkBuddy 内置了「自定义模型」入口,不需要手写任何配置文件。

  1. 打开 WorkBuddy,点输入框右下角的模型选择器(显示当前模型名的地方,默认可能是「Auto」)。

  2. 弹出模型列表后,拉到最底部,点「配置自定义模型」。

  3. 进入模型设置页,点右上角「+ 添加模型」,弹出「添加模型」窗口(标题写着「仅支持 OpenAI 兼容协议 API」——DeepSeek 完全兼容)。

  4. 只需要填三个字段:

    • 提供商:下拉选择「深度求索 / DeepSeek」(选完接口地址会自动填好,不用手填网址);
    • API Key:粘贴第 2 节复制的 sk-xxx
    • 模型名称:下拉选择,有 DeepSeek-V4 ProDeepSeek-V4 Flash 等,按需选。
  5. 点「保存」,配置完成。

回到对话界面,再次点开模型选择器,就能在「自定义模型」区域看到刚添加的 DeepSeek。选中它之后,你发的消息就通过你自己的 DeepSeek API Key 调用,不再扣 WorkBuddy 积分。


四、方式二:本地 models.json 配置文件(进阶,官方推荐)

DeepSeek 官方文档也给出了配置文件方式,适合想一次配好多个模型、或需要精细控制参数的场景。

4.1 写入配置文件

创建或编辑用户级配置文件:

C:\Users\<你的用户名>\.codebuddy\models.json

如果只想对某个项目生效,也可以创建项目级配置文件:

<你的项目>\.codebuddy\models.json

先将 API Key 设置为环境变量(PowerShell):

setx DEEPSEEK_API_KEY "<your DeepSeek API Key>"

然后写入以下配置:

{
  "models": [
    {
      "id": "deepseek-v4-pro",
      "name": "DeepSeek V4 Pro",
      "vendor": "DeepSeek",
      "url": "https://api.deepseek.com/v1/chat/completions",
      "apiKey": "${DEEPSEEK_API_KEY}",
      "maxInputTokens": 128000,
      "maxOutputTokens": 8192,
      "supportsToolCall": true,
      "supportsImages": false,
      "relatedModels": {
        "lite": "deepseek-v4-flash",
        "reasoning": "deepseek-v4-pro"
      }
    },
    {
      "id": "deepseek-v4-flash",
      "name": "DeepSeek V4 Flash",
      "vendor": "DeepSeek",
      "url": "https://api.deepseek.com/v1/chat/completions",
      "apiKey": "${DEEPSEEK_API_KEY}",
      "maxInputTokens": 128000,
      "maxOutputTokens": 8192,
      "supportsToolCall": true,
      "supportsImages": false
    }
  ],
  "availableModels": [
    "deepseek-v4-pro",
    "deepseek-v4-flash"
  ]
}

关键细节:请把 models.json 保存为 UTF-8 无 BOM。部分桌面版本读取带 UTF-8 BOM 文件头的 JSON 时,可能会读取本地模型配置失败。

4.2 重启并选择模型

完全退出 WorkBuddy 后重新打开,在模型选择器中选择 DeepSeek V4 ProDeepSeek V4 Flash 即可。

4.3 可选:验证 API Key

Windows 用户可以在 PowerShell 里先验证 Key 是否可用:

$env:DEEPSEEK_API_KEY="<your DeepSeek API Key>"
curl https://api.deepseek.com/v1/chat/completions `
  -H "Content-Type: application/json" `
  -H "Authorization: Bearer $env:DEEPSEEK_API_KEY" `
  -d '{"model":"deepseek-v4-flash","messages":[{"role":"user","content":"hi"}],"stream":false}'

能正常返回内容,说明 Key 和模型名都可用。


五、验证是否配置成功:一眼识别

配置好之后,最容易踩的坑是选错模型——内置 DeepSeek 和自定义 DeepSeek 长得几乎一样,但计费完全不同:

  • 上半部分内置的 DeepSeek:扣 WorkBuddy 积分;
  • 底部带「自定义」标识的 DeepSeek:走你自己的账户。

验证方法:随便发一条消息,然后看左下角的积分余额——

  • 积分掉了 → 选成了内置模型,切换重选;
  • 积分没变 → 成功!走的是你自己的 Key。

注意:配好后日常对话不再扣积分,但联网搜索等附加功能仍可能扣少量积分(搜索结果汇总会用到内置模型),属正常现象。


六、省钱大招一:上下文缓存,命中比未命中便宜 30 倍

这是 DeepSeek API 侧最狠的一个省钱点

DeepSeek 会自动对请求里的公共前缀做缓存——包括系统提示词(System Prompt)和前面几轮的对话历史。这些重复发送的内容,命中的部分按「缓存命中价」计费,没命中的才按全价:

模型输入·缓存未命中(高峰)输入·缓存命中(高峰)差距
deepseek-v4-flash3.0 元0.10 元30 倍
deepseek-v4-pro9.0 元0.30 元30 倍

对 WorkBuddy 这类 Agent 场景尤其友好:每一轮请求都会带上相同的系统提示词 + 工具定义 + 历史消息,这部分天然就是「命中缓存」的大头。也就是说,对话越长,缓存命中带来的节省越明显——前提是尽量在一个会话里保持前缀不变、不要频繁大改系统提示。

6.1 怎么吃满缓存收益

  1. 别轻易重启新会话:多轮追问同一个任务,历史前缀稳定,命中率高;
  2. 把稳定的说明写进系统提示(或 WorkBuddy 的自定义指令里),而不是每轮消息里重复贴一遍;
  3. 工具/技能定义保持稳定:不要在对话中途反复增删技能,否则前缀变动会导致缓存失效重算。

七、省钱大招二:错峰使用,空闲时段直接半价

DeepSeek 的「峰谷定价」简单粗暴:

  • 高峰时段:北京时间周一至周五 9:00–12:00、14:00–18:00
  • 空闲时段:其余所有时间,价格打五折

同样是 deepseek-v4-pro 的输出,高峰 27 元/百万 tokens,空闲只要 13.5 元。

落地建议:把「批量跑、不着急」的活留到晚上、中午 12:00–14:00 或周末——比如让 WorkBuddy 批量生成周报、整理报表、清洗数据、翻译长文档。这些任务对时延不敏感,错峰跑等于白捡一半折扣。


八、省钱大招三:选对模型,Flash 干 Pro 的活用 1/3 的钱

很多人一上来就选最贵的 Pro,其实大部分日常办公任务 Flash 完全够用:

场景推荐模型
日常问答、翻译、摘要、润色DeepSeek V4 Flash
数据整理、表格处理、轻量代码DeepSeek V4 Flash
深度推理、复杂分析、写长文DeepSeek V4 Pro
看图、读截图、图文理解DeepSeek V4 Flash Vision Exp

Flash 的输入/输出价格都是 Pro 的 1/3(输入 1.5 vs 4.5,输出 4.5 vs 13.5),日常任务用 Flash,遇到搞不定的再手动切 Pro,是性价比最高的用法。

小技巧:在方式二的 models.json 里,relatedModels.lite 已经指向 deepseek-v4-flash,可以让 Agent 在简单环节自动降级到 Flash,进一步省钱。


九、省钱大招四:控制上下文长度,别让历史吃掉预算

很多人的钱不是「用」掉的,是「喂」掉的。每轮请求都会把全部历史重新发给模型,对话到第 20 轮时,单次消耗可能是第 1 轮的十几倍。

对应到 API 账单就是:输入 token 随轮次线性膨胀。所以:

  1. 一个任务一个对话窗口:做完就关,别混着聊;
  2. 新话题开新窗口:避免无关历史拖累每一轮成本;
  3. 一次把需求说清楚:别「挤牙膏」式来回改,每多一轮都是钱;
  4. 必要时手动截断:长对话里如果前面的结论已经用不上了,开新窗口把结论复制过去继续。

十、进阶省钱:多模型矩阵 / 中转聚合 / 本地模型

除了「自带 DeepSeek Key」这条主线,还有几个进阶玩法,按需取用:

10.1 中转聚合平台(一个 Key 走天下)

一些第三方平台(例如七牛云 AI Token Plan 之类)提供「一个 API Key + 一个 baseUrl」聚合多家模型的服务,在 WorkBuddy 里只需改一个提供商就能切换 DeepSeek / GLM / Kimi 等,适合不想在多个平台分别充值、又想要多模型兜底的用户。

⚠️ 请认准正规渠道,不要使用来路不明的「免费 Key」,避免隐私和资费风险。

10.2 本地模型(Ollama 完全免费)

电脑配置够(建议 16G 内存以上)的话,可以在本地跑开源模型(Ollama / LM Studio),完全不扣积分、不走网络、数据不出本机,适合对隐私敏感、不想持续充值的场景。代价是效果和在线大模型有差距,适合简单任务。

10.3 企业内网自部署

公司内部已经部署了 DeepSeek 模型服务(形如 http://10.x.x.x:1025 的内网地址),同样可以作为「OpenAI 兼容」自定义模型接进 WorkBuddy,减少网络延迟、保障数据不出企业内网。


十一、WorkBuddy 积分使用习惯(7 招省积分)

如果暂时不想折腾 API,单靠「改习惯」也能省下一大截积分。下面这七招,招招都冲着积分消耗的源头去:

#习惯做法
1按任务复杂度选模型简单任务用轻量模型,复杂任务再上高配,别「大炮打蚊子」
2分清 Ask / Plan / Craft查资料、问概念用 Ask;要生成文件、操作数据才用 Craft
3一次把需求说清楚首条消息写清「要什么 / 用什么 / 什么格式 / 什么要求」四要素
4一个任务一个窗口做完就关,避免历史堆积导致单次消耗暴涨
5手动控制技能调用简单任务加一句「直接回答,不用调用额外技能」
6优先用快过期积分定期看积分明细,快过期的用来跑消耗大的任务
7当月免费额度用完月底前把当月额度花掉,别浪费

十二、避坑指南

  1. 内置 vs 自定义分不清:选模型务必看有没有「自定义」标识,长得一样但计费天差地别。
  2. models.json 保存成带 BOM:务必 UTF-8 无 BOM,否则读取失败。
  3. 模型 id 写错:必须严格写成 deepseek-v4-pro / deepseek-v4-flash,多一个空格都是 404。
  4. UI 直接显示 ${DEEPSEEK_API_KEY}:说明环境变量没展开,从已设置该变量的终端重启 WorkBuddy,或在配置里直接填真实 Key。
  5. 配好才发现没余额:自定义模型能不能调通取决于账户余额,先充值再配。
  6. 把接口 URL 填到 API Key 字段:401 报错的常见原因,API Key 和地址是两个东西。

十三、总结

把上面所有方法串起来,就是一条清晰的省钱链路:

自定义模型

WorkBuddy

DeepSeek 官方 API

Flash 模型
价格是 Pro 的 1/3

上下文缓存
命中便宜 30 倍

错峰使用
空闲半价

积分习惯
单窗口 + 一次说清

  • 主线:注册 DeepSeek 开放平台 → 拿 Key → 在 WorkBuddy 里配「自定义模型」→ 选底部带「自定义」标识的模型,成本直接降到积分计费的 1/10~1/5
  • API 侧:吃满上下文缓存(30 倍)+ 错峰(半价)+ 选 Flash(1/3 价)+ 控制上下文长度
  • 习惯侧:一个任务一个窗口、一次说清需求、按复杂度选模型。

核心思路一句话:把 WorkBuddy 积分留给「只有它才能干」的高级能力(专家中心、技能、连接器、自动化),那些通用对话、简单代码这类「哪儿都能干」的活,交给 DeepSeek 按量计费,反而更划算。

打开链接下载源码: https://pan.quark.cn/s/e18529987bb9 ### ETS中文教程:KNX施耐德智能家居 #### 知识点:ETS软件概述与启动 ETS(Engineering Tool Software)是由施耐德电气研发的款专业设计工具,其核心功能在于构建配置基于KNX标准的智能家居及楼宇自动化系统。KNX代表种国际公认的开放式标准,该标准在楼宇自动化领域得到广泛应用,其目的是实现不同品牌设备之间的互联互通。 **软件启动方法**:ETS软件可以通过双击其图标来启动,或者从开始菜单中选择“File”->“New Project”,亦或接使用Ctrl+N快捷键来启动该软件。 #### 知识点二:工程项目创建 在启动新的工程项目时,需要遵循以下流程: 1. **项目命名**:推荐使用数字与字母的组合来命名项目,例如“Officebuildings”,这样的命名方式有助于日后的管理识别。 2. **构建建筑物模型**:在“Buildings/Functions”部分添加建筑物,自定义其名称(例如“mg”),并确认创建操作。 3. **添加房间**:针对每个建筑物,可以进步添加房间,同样地,为房间自定义名称(如“1F”),以此来构建完整的建筑模型。 #### 知识点三:设备加载与配置 设备加载是ETS软件中的核心环节,其作用在于将实际的智能设备(包括开关、传感器等)整合到项目中: 1. **设备加载过程**:在目标房间处进行右键点击,选择“Add Devices”,随后通过“Product Finder”对话框选择合适的制造商产品系列,以此来加载所需的设备类型。 2. **地址分配**:在设备加载完成后,应手动为其分配独...
代码下载链接: https://pan.quark.cn/s/a4b39357ea24 在客户端编程中,有时我们需要对用户上传的Excel文件内容进行管理,并将其转化为JSON格式以便进行后续操作或与服务器端进行数据交换。这过程通常包含文件读取、数据解析以及格式转换等步骤。以下是些关于如何运用JavaScript达成这功能的核心要点: 1. **File API**:在当前版本的浏览器中,我们可以借助File API来获取用户上传的文件。`FileReader`对象提供了异步获取文件内容的方法,例如`readAsArrayBuffer()`,用于读取文件内容。 2. **XLSX库**:由于浏览器自带的API不接支持Excel文件的解析,我们需要借助第三方库。其中,`xlsx`库是个广受欢迎的选择,它能解析多种Excel文件格式(如XLS、XLSX、CSV等)并提供便捷的数据操作接口。 3. **获取Excel文件**:借助`xlsx`库,我们首先需要将File API获取到的`ArrayBuffer`转换为可解析的格式。例如,可以调用`XLSX.read(arrayBuffer, {type: buffer})`进行格式转换。 4. **解析工作表内容**:`xlsx`库解析完成后,会返回个对象,其中包含了所有工作表的信息。我们可以通过`XLSX.utils.sheet_to_json(worksheet)`方法将单个工作表转换为二维数组,这类似于Excel中的表格数据。 5. **转化为JSON对象**:二维数组可以很方便地转化为JSON对象。遍历数组,每行数据作为JSON对象的个属性,属性名为单元格的列名,属性值为单元格的值。可以使用`Arr...
源码下载地址: https://pan.quark.cn/s/de26074cf420 CadLib4.0被定位为个功能丰富的.NET CAD类库,它为开发人员提供了在C#或其它.NET编程语言环境中嵌入CAD功能的可能性,从而简化了DWGDXF文件的构建与修改过程。这个压缩文件内含了必要的DLL组件以及个基于WinForms的应用实例,该实例清晰展示了在Visual Studio 2010开发环境中如何进行CAD文件的读取处理,特别是对于AutoCAD 2014所支持的最新文件格式具备良好的兼容性。 1. **CadLib**:CadLib作为核心的类库,为与AutoCAD的DWGDXF文件进行交互提供了接口实现机制。它通过封装CAD数据结构相关操作,让开发人员无需深入探究底层CAD格式细节,即可便捷地完成CAD文件的输入输出操作。 2. **WW.Cad.dll**:此DLL文件被视为CadLib的核心构成部分,其中汇集了所有与CAD操作接关联的类函数。例如,开发人员可借助此库来初始化新的图纸,向其中添加各类几何元素(比如线、圆形、多段线等),或是提取已有图纸中的数据信息。 3. **WW.dll**:该DLL可能扮演着CadLib的辅助角色,里面存放了通用的工具函数类,它们为CadLib各项功能的实现提供了支持。这些功能可能涵盖数据转换、异常管理或图形的视觉呈现等方面。 4. **WW.Pdf.dll**:此文件或许具备将CAD图纸内容转换为PDF文档的能力。开发者可利用这特性,将设计成果导出为PDF格式,方便进行打印或在线传播,而无需借助AutoCAD软件。 5. **WW.GL.dll**:从其命名推断,该文...
打开链接下载源码: https://pan.quark.cn/s/a619258fc89d CAS(Central Authentication Service)是种基于Java的开源身份验证架构,其目的是达成单登录(Single Sign-On,简称SSO)的功能。单登录机制使得用户在完成次身份验证后,便能够访问多个不同的应用系统,而无需反复输入用户名与密码。这种机制对于规模较大的企业或组织而言,能够优化用户体验,并有助于简化安全管理体系。 Cas实现单点登录的运作机制主要包括以下环节: 1. 用户尝试进入个由CAS进行安全控制的应用系统。 2. 应用服务端将用户重定向至CAS服务器以进行身份验证。 3. 用户在CAS服务器上提交认证信息(例如用户名密码)。 4. CAS服务器对提交的认证信息进行核实,若核实无误,则生成个服务票据(Service Ticket)并传递给用户。 5. 用户将服务票据递送回最初请求的应用服务端。 6. 应用服务端向CAS服务器对服务票据进行验证,若验证结果为通过,则允许用户访问应用。 通过QQ登录第三方服务的接口,通常需要遵循以下步骤: 1. 在QQ开放平台完成开发者注册,领取AppIDAppKey。 2. 下载QQ登录的SDK,并将其集成到项目中。 3. 依照官方指南设置应用相关参数,包括设定回调URL等。 4. 在应用中运用SDK所提供的登录功能,引导用户进行授权。 5. 用户完成授权后,SDK会反馈个授权码(Access Token)及其他相关数据。 6. 利用该授权码通过API查询用户的OpenID,进而获取用户的基础资料。 7. 将OpenID与内部用户管理系统进行关联,从而完成登录操作。 针对腾讯开放平台...
代码转载自:https://pan.quark.cn/s/836345b7e100 在信息技术行业,特别是在软件编程算法构建方面,"列出集合的所有子集"是个普遍存在的问题,它不仅测试了开发者对数据结构的掌握程度,还关联到了递归、位操作等多元技术的运用。依据提供的文档资料,我们能够详细研究两种实现策略:递归策略(SubSet函数)位操作策略(SubSet2函数),并从中汲取广泛的IT专业知识。 ### 1. 递归策略(SubSet函数) 递归策略是观且简单明了的解题途径,它通过函数自我调用来逐步解决问题。在此情境中,递归策略被用于生成集合的全部子集。具体来说: - **核心概念**:递归策略基于二叉树的逻辑,对于集合中的每个对象,都有选择纳入或不纳入两种可能性。因此,递归函数会探索所有可能的选择路径,从而获取所有可能的子集。 - **执行细节**:函数`SubSet`接收四个变量,分别是集合元素数组`arr`、当前处理的元素位置`num`、集合中的元素总数`n`以及个布尔数组`include`,用于记录当前子集包含哪些元素。递归结束的条件是`num`等于`n`,此时显示当前的子集;在递归过程中,分别尝试将当前元素纳入不纳入子集中,然后继续对下个元素执行相同的操作。 ### 2. 位操作策略(SubSet2函数) 位操作策略借助了二进制数的特性,创造性地解决了生成所有子集的难题。这种策略的关键在于使用二进制数的每位来标识集合中的每个元素是否被选中。 - **核心概念**:对于个含有`n`个元素的集合,其所有子集的总数为2^n。因此,可以利用`n`位的二进制数来展示所有可能的子集搭配,其中每位代表是否选择集合中的对应元素。 - **执行细...
评论
成就一亿技术人!
拼手气红包6.0元
还能输入1000个字符
 
 条评论被折叠 查看
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

phpgolife

谢谢您的支持,您是我最大的动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值