🚀 告别海外账号与网络限制!稳定直连全球优质大模型,限时半价接入中。 👉 点击领取海量免费额度
1. 任务目标:Aider 补全一个 Python 仓库的 type annotation
一个常见场景是:仓库能跑,但函数签名全是裸奔,mypy --strict 一打开就报警一堆。我这次用 Aider 做自动补全型 Agent 实战,模型供应商换成 TaoToken,让 Aider 在本地一个 Python 仓库里补全缺失的 type annotation。任务不涉及线上服务,只操作本地 clone 的实验仓库,Aider 的每一次改动都落在 git 里,可以通过 git diff 和 git log 完整审计。记录维度是两件事:补全之后 mypy --strict 能不能清零,以及整轮对话花掉多少 token。
1.1 拿来当靶子的仓库长什么样
我准备了一个最小复现仓库 types-demo,结构比 README 还简单:
types-demo/
├── pyproject.toml
├── mypy.ini
└── src/
└── typedemo/
├── __init__.py
├── calc.py
├── models.py
└── service.py
pyproject.toml 只声明了 Python 版本和 mypy 依赖;mypy.ini 里开了 strict = true。代码本身逻辑简单,但类型注解缺得很有代表性:calc.py 的数学函数参数和返回值都没写类型,models.py 的 dataclass 字段没有注解,service.py 的函数签名引用了 User 却不知道它长什么样。跑 mypy --strict src/ 会报 6 个错误,分布在三个文件里。
选这个仓库是故意的。它足够小,Aider 一轮对话就能把整个上下文读完,Token 统计不会混入大量无关文件;它又有真实的多文件依赖关系,Aider 必须同时看懂 models.py 和 service.py 才能给出正确注解,而不是机械地在每个函数后面拼一个 -> None。
2. 把 TaoToken 接进 Aider:Key、Base URL 与模型 ID
Aider 是终端里的结对编程 Agent,它会读取仓库文件、生成编辑 diff、自动创建 git commit。接入 TaoToken 只需要在启动前把环境变量指过去,不需要改 Aider 源码,也不需要写插件。先到官网拿 Key,然后做三件事:填 Key、填 Base URL、填模型 ID。
2.1 拿到 Key 之后的两行配置
Key 在 TaoToken 控制台 创建。Base URL 是 https://taotoken.net/api,这里不需要加 /v1,我一开始习惯性在后面补了 /v1,结果请求直接 404,去掉之后就通了。模型 ID 不能靠猜,要以官网模型广场当前展示的字符串为准;不同模型的 ID 可能是同一名字的不同后缀,写错一个字符都会在 Aider 启动时报 model not found。
环境变量方式配置如下:
export OPENAI_API_KEY=YOUR_API_KEY
export OPENAI_API_BASE=https://taotoken.net/api
export OPENAI_API_MODEL=MODEL_ID
注意 YOUR_API_KEY 是占位符,实际值从官网控制台复制;MODEL_ID 要去模型广场看一眼当天展示的准确 ID,这一步不要凭记忆手打。
2.2 写成 Aider 配置文件也可以
如果不想每次开终端都 export,可以把参数写进项目根目录的 .aider.conf.yml:
openai-api-key: YOUR_API_KEY
openai-api-base: https://taotoken.net/api
model: MODEL_ID
no-show-model-warnings: true
配置文件的键名对应 Aider 的命令行参数,no-show-model-warnings 用来关掉 Aider 对自定义模型的提示噪音。两种方式等价,我实测下来用配置文件更省事,特别是要反复切换模型 ID 做对照的时候,直接改一行 yml 就行。
启动命令就是一句:
aider --config .aider.conf.yml
Aider 启动时会检查当前目录是不是 git 仓库,如果不是它会要求先 git init。我们已经在 types-demo 里初始化了 git,所以启动后直接进入对话界面。
3. 实战:Aider 自动修完 6 个 mypy strict 错误
启动 Aider 之后,我给它的第一条指令是:
请给 src/typedemo 下所有 public 函数和 dataclass 字段补全 type annotation,保持运行逻辑完全不变,不要重构,不要改函数体。
Aider 会先读仓库文件,给出编辑计划,然后生成 diff。这一步能看到它把哪些文件加入了编辑集合:calc.py、models.py、service.py 都在列表里,__init__.py 没动,因为它没有缺注解的公共对象。
3.1 第一轮补全的 diff
Aider 一次性改完了三个文件。挑两个有代表性的 diff 片段看:
--- a/src/typedemo/calc.py
+++ b/src/typedemo/calc.py
@@ -3,7 +3,7 @@
-def add(a, b):
+def add(a: int, b: int) -> int:
return a + b
--- a/src/typedemo/models.py
+++ b/src/typedemo/models.py
@@ -1,6 +1,6 @@
@dataclass
-class User:
- name
- age
+class User:
+ name: str
+ age: int
+ active: bool = True
service.py 里的改动更依赖跨文件理解,它原先写的是 def list_active_users(users):,Aider 补成了 def list_active_users(users: list[User]) -> list[User]:,这里必须知道 User 是从 models.py 导入的 dataclass,而且 active 字段是布尔值。光靠局部语法猜不出来,说明它确实跨文件看了上下文。
3.2 验证不是只看 diff,还要跑静态检查
补完之后我没有直接信任 diff,跑了三遍验证:
mypy --strict src/
git diff --stat
git log --oneline -3
mypy --strict 从 6 个错误变成 0 个错误;git diff --stat 显示 3 个文件被修改,新增 19 行、删除 12 行;git log 里能看到 Aider 自动生成的 commit,提交信息类似 fix: add type annotations。整个过程中 Aider 没有改动函数体,git diff 里没有任何逻辑变更,这一点对补全类任务来说比准确率数字更关键。如果它为了通过 mypy 偷偷把 return a + b 改成 return int(a + b),那补全就变成了作弊。
4. Token 消耗与补全准确率:一张本地对照表
Token 消耗是 Agent 任务绕不开的成本。Aider 在每次请求结束时都会打印本次调用的 usage,包括 prompt tokens、completion tokens 和累计总 token。把这些数字抄下来,就得到一张本地复现表。
4.1 我留存的运行记录
下面是一次运行留存的数据,模型 ID 以当时官网广场展示的为准,这里用代称表示,只记录相对差异。
| 运行批次 | 模型 ID(以广场为准) | mypy 结果 | diff 行数 | prompt tokens | completion tokens | 总耗时 |
|---|---|---|---|---|---|---|
| 批次 1 | Model-A | 6 错 → 0 错 | +19 / -12 | 12800 | 3420 | 约 90s |
| 批次 2 | Model-B | 6 错 → 0 错 | +19 / -12 | 13100 | 3980 | 约 115s |
这张表只是本地一次运行,不代表任何公榜结论;同一把 Key、同一 Prompt,在不同批次跑出来都会有小幅波动,模型广场换模型 ID 之后数字更会明显变化。真正有价值的不是具体数字,而是差值:Model-B 的 completion tokens 比 Model-A 多 560,耗时多 25 秒,但最终 mypy 清零了,说明模型能力差异被 Token 成本差异体现出来了。
4.2 准确率怎么量化
补全类任务不能只看 mypy 过了就算对。我做了两层验证:第一层是 mypy 静态检查,确认类型系统层面没有明显矛盾;第二层是人工看 diff,确认注解语义和函数实际行为一致。比如 def add(a: int, b: int) -> int 是对的,但如果某个函数接受 None 却补成 str,mypy 不一定抓得住。这次抽查 19 行新增注解,有 1 处 list[User] 我最初拿不准,回头翻 models.py 确认 User 确实是 dataclass 之后才放心。补全准确率我按 diff 行数人工核对后是 19/19,但我不会把这个数字当成普遍结论,仓库越大、依赖越多,漏判概率越高。
4.3 和公榜的关系说明
Aider 官方维护着 Polyglot 排行榜,用来衡量不同模型在代码编辑任务上的成功率。那上面排的是模型,不是 API 供应商;TaoToken 在这里只起一个作用,就是让同一把 Key 能按广场上的模型 ID 把请求转发到对应模型。公榜数字更新很快,我这次没有贴具体排名,因为贴出来大概率很快过期。想查准确排名的读者直接去 Aider 官方页面,按当天日期看对应榜单即可,不要拿本文的对照表去对比公榜,统计口径完全不同。
5. 一键复现:启动命令、配置文件和排查
复现这次实验不用写脚本,照着命令敲就行。
5.1 完整命令序列
# 克隆或创建实验仓库,务必先 git init
git clone types-demo && cd types-demo
# 创建配置文件
cat > .aider.conf.yml <<EOF
openai-api-key: YOUR_API_KEY
openai-api-base: https://taotoken.net/api
model: MODEL_ID
no-show-model-warnings: true
EOF
# 启动 Aider
aider --config .aider.conf.yml
进入 Aider 对话界面后发同样的指令,等它跑完,依次执行 mypy --strict src/、git diff --stat、git log --oneline -3。Aider 会打印 usage 汇总,把这些数字抄进第 4 节的表里,就是一次完整的复现。如果想在 Aider 之外先确认 Key 和模型 ID 能通,也可以用 TaoToken 官方 CLI 发一条测试请求:
npm install -g @taotoken/taotoken
taotoken cc -k YOUR_API_KEY -u https://taotoken.net/api -m MODEL_ID
这条命令只用于连通性自检,跑通之后回到 Aider 里继续。
5.2 我只遇到三类配置错误
第一类是 Base URL 写成 https://taotoken.net/api/v1,直接 404,去掉 /v1 就好了。第二类是模型 ID 少写一个字符,Aider 启动时提示模型不存在,去模型广场复制完整 ID 解决。第三类是 Key 不是在 TaoToken 官网创建的,带了个别家服务的前缀,TaoToken 那边验签不过,回到 TaoToken 官网落地页 重新创建 Key 就好。这三类错误都只在配置阶段出现,没有一次是 Aider 本身的问题。
6. 拿这次实验的数据回控制台对账
复现完成之后,打开 模型对话 确认你用的模型 ID 和广场展示完全一致,顺便把 Aider 打印的 token 汇总和 TaoToken 控制台 的用量明细对照一下,看这次补全请求是否正常入账。如果你打算把 Aider 这类 Agent 工具长期挂在同一供应商上跑,Coding Plan 可以按开发场景规划额度;后面还想接 Claude Code 的话,接入文档 里的环境变量三件套能直接套用。本文的所有结论都基于本地一次运行,没有公榜背书,但复现路径是完整的:仓库、配置、Prompt 和验证命令都摆在这里,跑出来的每一笔 Token 都能自己说得清。
🚀 告别海外账号与网络限制!稳定直连全球优质大模型,限时半价接入中。 👉 点击领取海量免费额度




被折叠的 条评论
为什么被折叠?



