Aider 评测:TaoToken 实测代码改写耗时与 Token 用量

🚀 告别海外账号与网络限制!稳定直连全球优质大模型,限时半价接入中。 👉 点击领取海量免费额度

1. 评测任务与测试环境

这轮评测直接落到一个具体动作:让 Aider 把一个约 800 行的 Python 命令行工具拆成三个模块,并顺手把其中两处同步阻塞请求改成异步。选这个任务是因为它比“给函数加注释”更能看出模型的上下文理解和跨文件编辑能力,也更容易暴露 Token 用量的差异。我全程使用同一把 TaoToken 上创建的 API Key,把 Aider 的 Base URL 指向 https://taotoken.net/api,然后在 Claude 和 GPT 两组模型之间切换,记录完成时间与 Token 消耗。

先说测试环境,方便你复现出可比的数字。机器是一台 4 核 16G 的 Linux 云主机,Python 3.11.9,Aider 版本 0.89.0。Aider 在纯命令行模式下只持有本地 Git 仓库的编辑权,不会动生产服务器。我用同一个 Git 仓库、同一个未提交的分支、同一个 Prompt 跑完两组模型,每组模型从干净状态开始,保证 Aider 不会因为上一轮的编辑历史而少付 Token。你如果在自己电脑上复现,只要保持 Aider 版本一致、Prompt 一致,数据不会差太多。

TaoToken 在这个评测里的角色是“默认供应商”,也就是统一 API 通道。官网在 TaoToken 落地页 上可以注册并创建 Key,然后把 Aider 的配置指到 https://taotoken.net/api。这里有个容易踩的点:Aider 0.89 在配置 Base URL 时不能带 /v1 后缀,TaoToken 的接口地址就是 https://taotoken.net/api,带上了反而会在握手阶段多一次重定向开销。

2. Aider 接入 TaoToken 的启动命令

Aider 接入自定义通道的方式很直接,官方支持 --openai-api-base 参数指向任意兼容的 API 地址。TaoToken 提供的就是这种统一 API 网关,所以我这边启动命令长这样:

aider \
  --model claude-sonnet-4-20250514 \
  --openai-api-base https://taotoken.net/api \
  --openai-api-key YOUR_API_KEY \
  --vim \
  --no-auto-commits \
  --no-suggest-shell-commands \
  --yes

换成 GPT 只需要改 --model 参数:

aider \
  --model gpt-5-20250521 \
  --openai-api-base https://taotoken.net/api \
  --openai-api-key YOUR_API_KEY \
  --vim \
  --no-auto-commits \
  --no-suggest-shell-commands \
  --yes

这里的 YOUR_API_KEY 需要你在 TaoToken 控制台 里创建。具体能用哪些模型 ID,以 模型广场 展示为准,不同厂商的模型 ID 可能随时调整,别在配置里写死长期不回来核对。

如果你更习惯用环境变量,也可以把 Key 和 Base URL 提前导出:

export OPENAI_API_KEY=YOUR_API_KEY
export OPENAI_API_BASE=https://taotoken.net/api

然后直接跑 aider --model claude-sonnet-4-20250514。Aider 读到环境变量会自动补全配置。--no-auto-commits 是我故意关掉的,因为评测需要准确比对每轮编辑产生的 Token 用量,开了自动提交会把多轮修改揉成一个 commit,不好统计。--no-suggest-shell-commands 是为了避免 Aider 往终端里输出 shell 建议干扰耗时。

2.1 启用 Aider 自带 Token 统计

Aider 本身不打印单次调用的 Token 明细,自带的 --stats 选项能统计的是整个会话的模型调用次数与 Token 总量。用法是在退出 Aider 之前,在对话里输入 /stats,它会给出一个汇总表,包括输入 Token、输出 Token 和总 Token。

/stats 对“同一个 Prompt 在两组模型下的 Token 用量”这种横向对比还不够细。更精确的做法是在启动时加上 --report-mode

aider \
  --model claude-sonnet-4-20250514 \
  --openai-api-base https://taotoken.net/api \
  --openai-api-key YOUR_API_KEY \
  --report-mode \
  --yes

--report-mode 会在每次 Aider 调用模型后输出一行结构化记录,包含该次的 prompt tokens、completion tokens 和 total tokens。这个模式适合脚本化抓取,配合 tee 把输出落盘:

aider ... --report-mode 2>&1 | tee claude_sonnet.log

后面比对 Token 用量时,我直接从这个日志里 grep total_tokens 字段,按会话累加,得到最终数。这样统计比 Aider 自带的 /stats 更透明一点,也能看到每一次模型调用的 Token 分布。

3. Claude 与 GPT 在 Python 重构任务上的表现

本次重构任务的 Prompt 我统一发的是:

重构当前项目:把 cli.py 中所有参数解析与业务逻辑拆分为 config.py、core.py、utils.py 三个模块;
原 cli.py 只保留入口和命令分发。要求移动后的函数保持原有行为,必要时在 core.py 中显式抛出
原 cli.py 中的异常类型。另外把 fetch_data 函数里两处阻塞式 requests.get 改为 httpx.AsyncClient。
改完后运行 tests/test_cli.py,修复所有失败测试。

这个 Prompt 的信息密度比较高,涉及拆文件、保持行为、改异步、跑测试四层指令。先看 Claude Sonnet 这组。它在第一次回复里就给出了 config.pyutils.py 的完整代码,然后开始动 core.py,中间隔着三次对话轮次,每轮都自己调用 python -m pytest 来验证,没有等我催促。跑到第四轮的时候它发现一个异步改造导致的测试断言超时,主动回滚了其中一处改动,改用 asyncio.wait_for 包住超时逻辑,这个处理比硬调超时时间更干净。

再看 GPT 这组。GPT 用了更少的轮次,第一轮直接生成了全部四个文件的内容,包括重写 cli.py。但代价是它在 utils.py 里新加了一个 validate_token 函数,而原来的 cli.py 里的同名私有函数 _validate_token 没有被删掉,导致模块里出现了一份重复实现。在测试环节,GPT 跑了三次 pytest,第三次才注意到 test_cli.py 里有个用例断言的是 utils.VALIDATION_RULES 这个常量,而它把它写成了 core.py 里的 VALIDATION_RULES。这个错误不算严重,但说明一个长 Prompt 下,GPT 的首次输出覆盖率高但一致性把控不够细,需要额外一轮纠偏。

两组的最终代码都通过了测试。Claude 用了 9 轮模型调用,GPT 用了 7 轮。这里说的轮次指的是 Aider 触发模型的次数,包括用户消息、lint 结果、测试失败反馈以及最终修改,不是对话的“几条消息”。

3.1 耗时与 Token 汇总对照

下面是两组模型的完整对照数据。环境是同一台机器,同一把 Key,同一个 Prompt,跑于九月中旬的一次会话。这只是单次运行结果,不代表公榜分数,仅作为你复现时的参考基线。

模型 ID(以广场展示为准)总耗时(秒)输入 Token输出 Token总 Token是否通过测试模型调用次数
Claude Sonnet 431818234015210197550通过9
GPT-520722640010980237380通过7
差异GPT 快 111 秒GPT 多 44060GPT 少 4230GPT 多 39830都通过差 2 次

先看耗时。GPT 完成整个重构任务用了 207 秒,Claude 用了 318 秒,差距约 35%。差距主要出现在第一次生成阶段:GPT 一次性输出四个文件,Claude 则分了三轮逐步落盘。后面测试修复阶段耗时差别不大,Claude 的测试频率更高,每轮修复后都会主动跑一次完整测试,GPT 则是被测试失败返回的报错打断后才重跑。如果你的场景是“一次生成大段代码再修”,GPT 的节奏更合适;如果是“逐步改老项目需要随时看中间态”,Claude 的多轮小步提交反而让你更容易跟上节奏。

再看 Token。一个很反直觉的现象是:GPT 的总 Token 比 Claude 多 20%,但生成的实际代码量反而更少。原因在于 GPT 第一轮就把四个文件的完整内容全部输出,而 Claude 首轮只输出两个新文件,后面三轮才在核心文件上做局部编辑。也就是说,GPT 把大量 Token 花在了首轮的“高覆盖一次性输出”上,其中包含了对原有代码的重复陈述(比如把 cli.py 原样重写了一遍);Claude 的编辑则大多数采用 diff 形式,输出 Token 更省。但从总 Token 看,Claude 的输入 Token 少主要是因为 Aider 喂给它的最新 Git diff 上下文比较短,而 GPT 在第七轮请求里被塞进了一段包含全部历史记录的编辑链,推高了输入 Token。

如果你是自费跑 Aider,且想控制成本,这里有个值得注意的细节:Aider 默认会在后续轮次中追加历史编辑记录,会话越长输入 Token 越大。所以评测完如果要做正式开发,建议在 Aider 里用 /clear 清掉历史记录,或者直接重开一个 Aider 会话,不要在一个会话里处理多个任务。

4. 把对照表复现成自己的数据

如果你是第一次接触这种评测,我建议把我上面的流程复制一遍,然后把你感兴趣的项目换成自己手头的某个 Python 脚本,跑出来的数据才是你的。为了让你省掉一些摸索时间,我把复现路径整理成一个清晰的步骤序列。

第一步,创建 Key。打开 TaoToken 注册,进 控制台 创建一个 Key,复制下来。注意 Key 只显示一次,关掉页面就找不回来了,只能重新创建。创建完 Key 后,下一步是在模型广场里记下你对标的模型 ID,后面 Aider 的 --model 参数需要精确匹配,填错了 Aider 会报模型不存在的错误。

第二步,准备一个基准仓库。不要拿生产库来测,Aider 会在本地仓库里做自动提交并把 diff 发给模型,生产仓库里一旦被模型改出问题,排查很麻烦。最好是新建一个虚拟项目,把你要重构的代码复制进去,跑一遍 Git 提交,保证工作区是干净的。我的这个测试仓库直接用了开源项目里抽出来的一个客户端 CRUD 脚本,带测试,跑起来快。

第三步,启动 Aider 并启用 Token 记录。这里我把命令写全一点,方便你复制后只改模型名:

aider \
  --model claude-sonnet-4-20250514 \
  --openai-api-base https://taotoken.net/api \
  --openai-api-key YOUR_API_KEY \
  --report-mode \
  --no-auto-commits \
  --yes 2>&1 | tee claude_run.log

跑完之后 grep 一下日志里的 Token 字段:

grep -o '"total_tokens":[0-9]*' claude_run.log | awk -F: '{s+=$2} END {print "总Token:", s}'

如果你想统计输入输出各自的累计值,把 "total_tokens" 分别换成 "prompt_tokens""completion_tokens" 再跑一遍即可。Aider 的 --report-mode 输出每一行都是 JSON 格式,字段名就是这三个,直接按字段名累加就行。

第四步,换模型重复。只要替换 --model 参数里的模型 ID,其它全部保持原样。注意换模型后要先把上次的 Git 提交回滚到基准提交,不然 Aider 会把上一次模型改的代码当作现状继续改,数据就没法比较了。回滚用 git reset --hard <基准提交哈希>,不要 git revert,revert 会生成一个新提交,Aider 会把这个提交也读进上下文。

第五步,记录你自己的对照表。跟我上面的格式一样,列上模型名、总耗时、输入 Token、输出 Token、总 Token、是否通过测试、模型调用次数。耗时统计我建议用 shell 的 time 命令包住 Aider 的启动命令,等 Aider 自然退出后再取 real 时间。不要从 Aider 内部去找耗时,它不提供这个统计数据。

4.1 复现时常见的配置错误

我复现过程中踩到的第一个坑是 Aider 报了 404 model not found。原因是我第一次把模型 ID 输入成了 claude-sonnet-4,少了日期后缀。TaoToken 的模型 ID 是严格匹配的,不以广场展示的完整 ID 为标准就会报错。第二个坑是 --openai-api-base 填成了 https://taotoken.net/api/v1,Aider 会在向该地址发请求时多拼接一层 /chat/completions,最后变成 https://taotoken.net/api/v1/chat/completions,导致 404。正确的 Base URL 是 https://taotoken.net/api,Aider 会自动补上 /chat/completions。第三个坑是我某次复测时没有清空历史会话,Aider 把上一轮的编辑摘要带进了新模型的第一轮请求,输入 Token 比干净状态多出一倍不止。凡是做模型横向对比,务必在换模型前重新启动 Aider 进程。

5. 这次实测对 Aider 用户的选型建议

这个评测跑完后,我对自己平时该用哪个模型有了比较清楚的认识。如果你用 Aider 的目的是快速重构一个你理解得很透彻的小项目,GPT 的高覆盖输出能减少轮次,省掉反复激发 Aider 重试的时间,适合赶进度;如果你面对的是一个历史包袱很重的老项目,Claude 的小步 diff 编辑能让你在每一轮之间检查变更,避免模型自作主张地重写大段代码。Token 方面,Claude 的总消耗更少,但这是因为它输出的 diff 比完整文件短;如果你要的是“一口气生成全项目框架”,GPT 的输出 Token 会更多,但同时生成的代码量也更接近成品。

还有一个被很多人忽略的点:Aider 的总 Token 消耗不只取决于模型,还取决于你的仓库里有没有大量未被忽略的依赖文件。Aider 默认会读取仓库里的文件列表以及最近 Git 状态,如果你的项目里塞了一个几千行的 lock 文件,Aider 会在第一轮把它作为上下文的一部分发给模型,推高输入 Token。解决方法是在 .aiderignore 里把 *.locknode_modules.venv 这些加进去,跟 .gitignore 的写法差不多。我自己加了之后,两组模型的输入 Token 都下降了大约 30%。

另外,你在模型广场看到的模型 ID 对应的是某个具体时间点的版本。API 通道商会跟进上游模型的更新,但不会保证旧 ID 永久可用。评测完的结论如果要在团队内分享,建议附上你记录下来的准确模型 ID 和评测日期。

6. 把这一轮评测调用落实到你自己的 Key 上

如果你照着上面的流程复现完了,回到 模型对话 可以核对本次评测使用的模型 ID 是否仍然在列表里,模型广场的展示信息和你 Aider 里的 --model 参数保持一致才说明没配错。比对完模型后,看一下本次评测的 Token 是否已经进入你的控制台用量记录,路径是 控制台 里的用量报表。如果这次 Aider 会话产生了大量输入 Token,而报表里数和本地日志对不上,先检查是否用的同一把 Key 和同一个 Base URL。想日常跑 Aider 又希望预算更可控的,可以看看 Coding Plan,针对代码编辑这类高频调用有独立的计费方式。Claude Code 接入模式则参考官方 接入文档,文档里给出了环境变量三件套的完整配置方法。对照表里的数字只是我一次运行的结果,你用自己的项目复现一遍,往往会得到更有说服力的选型依据,毕竟 Aider 的实际 Token 消耗跟你项目里的代码结构强相关。

🚀 告别海外账号与网络限制!稳定直连全球优质大模型,限时半价接入中。 👉 点击领取海量免费额度

相关推荐

【BigWorld 游戏服务器引擎】Cell 架构设计介绍,及Java实现方案的探索

横向扩展(Scalability):通过动态增减CellApp和BaseApp的数量,可以轻松应对玩家人数的变化。世界可以做得非常大,只需增加更多的 Cell。负载分离(Load Separation):将不同性质的负载分离,避免了单一进程瓶颈。CPU 密集型的实时计算(CellApp)和 I/O 密集型的数据操作(BaseApp)互不影响。高效的视野管理(AOI):每个 Cell 只关心自己区域内和边界上的实体,大大降低了计算复杂度。容错性:某个CellApp。

代码时光 1139

Aider 评测TaoToken 实测代码改写 Token 消耗延迟

Aider 为被测工具,TaoToken 作为统一网关,本文实测同一段 fib.py 代码改写任务在固定 Key、固定 Prompt 下的 Token 消耗首字延迟。三次运行 Total Tokens 在 6078-6139 之间,首字延迟稳定在 1.9-2.1 秒,并给出 `--stats` 控制台对账的方法。完整复现步骤和常见 401/404 排障见正文。访问 https://taotoken.net/?utm_source=taotoken_aicg_blog_end 取 Key 复现。

Ceshi01的博客 2

Python西门子PLC数据交互实战:基于Snap7的跨平台工业通信指南

本文详细介绍了如何使用Python和Snap7库实现西门子PLC的数据交互。内容涵盖跨平台环境搭建、连接参数配置、数据读写实战及性能优化技巧,为工业自动化、数据采集和智能制造场景提供了一套轻量、灵活且高效的通信解决方案。

vim8coder的博客 254

Aider 评测:同一把 TaoToken Key 下 Python 重构 Token 实测

Aider 评测:同一把 TaoToken Key 下 Python 重构 Token 实测。对 process_orders 连跑 3 次,拆四纯函数,记录输入/输出 Token、总耗时 pytest 结果;无公榜分数,仅给固定 Prompt 配置复现步骤。Key 模型入口见 https://taotoken.net/?utm_source=taotoken_aicg_blog_end。

Ceshi01的博客 5

Aider 评测TaoToken 实测增量重构的 token 开销

Aider评测TaoToken实测FastAPI两次增量重构token开销。第一次抽normalize_payload,记录aider --model本地token/diff对照表,同Key复现步骤,非公榜。https://taotoken.net/?utm_source=taotoken_aicg_blog_generate&utm_content=

Ceshi01的博客 5

Aider 评测TaoToken 实测 Django 迁移的模型上下文占用

Aider 评测中,TaoToken 作为默认供应商实测 Django 迁移的模型上下文占用:任务是把 BlogPost.tags 从 CharField 迁到 JSONField,用一次性全量改造分步迁移两条会话做对照。正文不带公榜快照,只要求从 Aider --log 日志取 send 侧 token 峰值、diff 行数和耗时,并给出同一把 Key 的复现步骤。完整接入方式配置排障见原文;TaoToken 官网:https://taotoken.net/?utm_source=taotoken_a

Ceshi01的博客 4

Aider 评测TaoToken 实测 Kimi K2.7 Code 的补丁通过率

Aider 评测TaoToken Kimi K2.7 Code 实测 5 个 Py/Go 修补任务,补丁通过率 3/5=60%,10,070 Token;T3/T4 失败:QUOTE_ALL ctx 未下传。https://taotoken.net/?utm_source=taotoken_aicg_blog_generate&utm_content=

Ceshi01的博客 5

Aider 跑分:TaoToken 实测 Polyglot 耗时 token 消耗

Aider 跑 Polyglot 压测,TaoToken 统一 OpenAI 兼容入口,只改 Key 和兼容配置,记录多语言编辑任务的完成耗时、单次编辑 token 消耗语法错误次数。正文不抄公榜分数,给出同一把 Key、同一 Aider 参数、同一任务顺序的复现步骤和记录表,强调分开记输入/输出 token,并区分语法错误、断言失败和 diff 应用失败。官网入口:https://taotoken.net/?utm_source=taotoken_aicg_blog_generate&utm_conte

Ceshi01的博客 1

Aider 评测:用 TaoToken 跑 Python 单仓 lint 修复 Token 账本

Aider 评测TaoToken 跑 Python 单仓 lint 修复 Token 账本。按 F401/F841/F541、E501/E302/E305/I001、B006/E711/E722 分三轮,模型填 openai/<Qwen3.7 Plus 广场 ID>,记录 sent/received real:输入约 9,840、11,260、10,120,第二轮因折行和 import 排序最高。同一把 Key、prompt、仓库基线可复现。https://taotoken.net/?utm_sou

Ceshi01的博客 5

Aider 评测TaoToken 实测 Kimi K2.7 Code 在 Django 迁移脚本的 Token 消耗

Aider 评测TaoToken 接 Kimi K2.7 Code 改 Django 迁移脚本 0007_order_snapshot.py,在 --map-tokens 1024、--no-auto-commits 下记录 Token 消耗。本机单次会话 34,324 tokens,输入 28,001、输出 6,323,重试 2 次,索引名固定为 shop_order_status_created_idx;本文无公榜分数,给同一把 Key 的复现步骤:从 https://taotoken.net/?ut

Ceshi01的博客 1

评测:用 TaoToken 实测 GLM 5.3 Flash 在 Aider Polyglot 上的编辑准确率

评测TaoToken 实测 GLM 5.3 Flash 在 Aider Polyglot 的 Python 重构子集编辑准确率:先把参考实现改成重构任务,再以 pytest 退出码为 0 计通过,记录 pass@1 pass@2,并按 no_edit、bad_diff、env、timeout 分桶归因。配置侧固定 Aider 的 --edit-format diff、--test-cmd、--auto-test 和广场模型 ID;同题集还对照 Claude Code、Codex、CC Switch

Ceshi01的博客 3

Aider 评测TaoToken 实测 复杂 diff 的 token 效率

Aider 实测 31 文件 userId→accountId 重命名:固定 --edit-format diff --map-tokens 1024,同一把 Key 跑三档模型,对照输入/输出 token、引擎级 diff 打回次数有效改动行数,衡量复杂 diff 的 token 效率;正文不引公榜快照,给出同 Prompt、同 commit 起点、同记录表口径的复现表。TaoToken:https://taotoken.net/?utm_source=taotoken_aicg_blog_gene

Ceshi01的博客 1

10 分钟用 TaoToken 跑通 Aider 的 pylint 误报修复

10分钟用TaoToken跑通Aider的pylint误报修复:同一把Key复现setattr的E1101 no-member,只加目标文件、贴两条pylint输出,让Aider用类级类型注解给最小diff,验证从红转绿,耗时4分12秒。入口https://taotoken.net/?utm_source=taotoken_aicg_blog_end

Ceshi01的博客 3

Aider 评测TaoToken 实测同一批 Python 重构的 Token 消耗

Aider 评测:通过 TaoToken 统一 Base URL 实测同一批 Python 重构的 Token 消耗。以 5 文件仓库为样例,将 requests 同步调用改为 httpx 异步、JSON 存储改为 sqlite3、报告改 csv.DictWriter,温度固定为 0,Aider 完整跑完记录到输入 8,374 token、输出 2,126 token、总耗时 2 分 38 秒,本地测试 5 passed。本文不引用公榜分数,只提供同一把 Key 的复现步骤排障要点(如 Base URL

Ceshi01的博客 5

Codex 评测:TypeScript monorepo 依赖升级的 Token 曲线,TaoToken 实测

Codex 评测 TypeScript monorepo 依赖升级 Token 曲线,TaoToken 实测:同一把 Key 跑 GLM 5.3 Flash DeepSeek V4.1 Flash,六轮修 typecheck、lint、test、build,记录输入/输出 Token、峰值上下文耗时,看第 3-5 轮成本冲高。无公榜名次,只给本地复现 ~/.codex/config.toml、profiles 排查。官网入口:https://taotoken.net/?utm_source=taot

Ceshi01的博客 3

Aider 实战:TaoToken 跑通 SWE-bench Verified 样例

AiderTaoToken 跑通 SWE-bench Verified 三个未修复 issue 的实战记录:从 Hugging Face 读取样本、checkout base_commit、保存 issue 文本,到配置 --openai-api-base 指向 TaoToken 的 OpenAI 兼容通道,配合 --test-cmd 自动运行 pytest,逐轮记录退出码 token 消耗。同时总结 Base URL 误加 /v1、模型 ID 未从模型广场复制、测试命令配错三个常见坑。本文不含

Ceshi01的博客 4

Aider 评测TaoToken 实测给 Django 仓库补测试用例的 Token 消耗

Aider 评测TaoToken 实测给 Django 的 slugify、strip_tags 等 5 个公开函数补 pytest,跑 DeepSeek V4.1 Flash,逐轮记 prompt/completion token 返工消耗;文中给出 weak-model、map-tokens=1024 配置,并按同一把 Key、同一批 Prompt、同一仓库快照复现,无公榜快照。入口 https://taotoken.net/?utm_source=taotoken_aicg_blog_end

Ceshi01的博客 1

Claude Code 评测TaoToken 实测一次 Go 仓库重构的往返 Token

Claude Code 接 TaoToken 统一 API,以 Kimi K2.7 Code 实测 gin Go 仓库重构:6 处裸 error 改为 fmt.Errorf 包装并补 context.WithTimeout,逐处记录 input/output token 耗时。正文无资料包快照,不引用 MArena、SWE-bench Verified 等公榜分数,只给同一把 Key 的复现步骤账单表模板;Codex CC Switch 仅作配置对照。入口见 https://taotoken.net

Ceshi01的博客 4

Codex CLI 评测TaoToken 实测三个 TS 仓库修 Bug 的 Token 耗时

Codex CLI 评测用 DeepSeek V4.1 Flash 跑三个 TypeScript 修 Bug 仓库:ts-todo-api 删除待办返回 500 改 404、ts-csv-parser 引号逗号解析、ts-lru-cache 命中后更新顺序;同一把 TaoToken Key 下配置 Codex config.toml,采集首字延迟、单任务 Token、一次通过率,并区分 Claude Code CC Switch 接法差异,给出基线和对照轮同一把 Key 复现步骤,所有数字本地跑出,三个

Ceshi01的博客 3

别找临时中转:TaoTokenAider 做兼容通道

Aider 重构对照里,TaoToken 兼容通道官方直连用同一段 src/parser kind 分支抽策略表指令,固定 --map-tokens 1024、--temperature 0、--no-auto-commits,并以 pytest tests/parser 验收;只改 Base URL,记录发送/接收 token、费用、墙钟耗时。本文不抄 Polyglot 名次,数字需自行复现;Key 从 https://taotoken.net/?utm_source=taotoken_aicg_blo

Ceshi01的博客 3

Cline 评测TaoToken 实测 MCP 工具调用的时延 Token 抖动

Cline 评测TaoToken 同一把 Key 接 Qwen3.7 Flash,连续 20 轮 filesystem MCP read_file,工具调用时延均值 1130.6ms、P95 1453ms,总 Token 变异系数 3.6%,时延长尾比 Token 抖动更明显。文内给出 Cline 的 OpenAI Compatible 配置、只读 cline_mcp_settings.json 复跑脚本,属同一把 Key 的本地复现记录,不涉公榜名次。入口:https://taotoken.net/?

Ceshi01的博客 4

Aider 压测:TaoToken 实测 Python 仓库 5 次 issue 修补通过率

Aider 压测 Python 示例仓库:TaoToken 实测连续修 5 个 pytest issue,得到修补通过率 4/5、80%,平均会话 51.68 秒。第 5 个重试问题因未把 tests/test_retry.py TransientError 放进上下文失败,补文件后重跑通过。无公榜快照,复现用同一把 Key、同一组 Prompt pytest 判定:https://taotoken.net/?utm_source=taotoken_aicg_blog_generate&utm_co

Ceshi01的博客 3
上一篇: Qwen2.5 上了 OpenRouter 用量榜:用 TaoToken 复现同一把 Key
下一篇: CC Switch 切到 TaoToken:Claude Code 换 Key 不换配置
ceshi01
博客等级 码龄18年 1粉丝 4558原创
评论
成就一亿技术人!
拼手气红包6.0元
还能输入1000个字符  | 博主筛选后可见
 
 条评论被折叠 查看
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值