🚀 告别海外账号与网络限制!稳定直连全球优质大模型,限时半价接入中。 👉 点击领取海量免费额度
1. 读散点:GLM 5.3 Flash 在智能指数与价格轴上的位置
把 Artificial Analysis(AA)的散点图横轴设为“每百万 Token 价格”,纵轴设为“智能指数”,我第一眼圈出的是 GLM 5.3 Flash 的位置。它比不少旗舰模型便宜一个身位,智能指数档位又没有掉队,这种“单位智能成本”的位置,正是“模型成本与智能指数”这个栏目想呈现的核心。看这张图的同时,我手上正好握着一把 TaoToken(https://taotoken.net/?utm_source=taotoken_aicg_blog_generate&utm_content=) 的 Key,于是顺手做了一件事:把请求的 Base URL 从厂商入口切到统一网关,看同一个模型在 CLI 里能否无缝继续跑。这篇文章记录的就是这个替换过程、一张对照表,以及一次本地复现的边界。
AA 的智能指数不是某一张榜的分数,而是一组能力测试做归一化加权后得到的合成指标。它的好处是能放在同一把尺子上比较语言理解、数学推理和代码生成等维度,缺点是单点数值带置信区间,适合看档位而不是排名。所以我下文写到的“智能指数档位”,指的是 AA 散点图上 Y 轴的位置区间,不是某个精确 ELO;精确数值以 AA 页面实时展示为准(artificialanalysis.ai,Models 页)。价格那一轴同理,AA 展示的是按输入输出加权后的每百万 Token 价格,和厂商官网的 float8 报价、TaoToken 模型广场的结算单价都不是一回事。
这张散点图还有一个容易忽略的维度:AA 会把输入输出价格拆开算,也提供 Agentic Price 这种按 Agent 场景加权过的口径。Flash 这类偏推理、输出占比不低的模型,在 Agentic Price 下往往比传统 3:1 输入输出加权更划算。我的方法是先看默认的智能指数 vs 价格散点确定档位,再去模型广场核对真实结算价,最后才决定要不要把它设成默认供应商。AA 散点图上每一个点都是模型本身;TaoToken 不在图上,它是给这些点提供 Key 和 Base URL 的兼容通道,作用是把“接哪些模型”收敛成一套可复制配置,而不是把流量转给来路不明的服务。
2. 智能指数档位、每百万 Token 价格与 TaoToken 供应商字段对照
把 GLM 5.3 Flash 放进 AA 散点图,它落在“中高智能、低价”那一档,旁边是 DeepSeek V4 Flash 这类同代 Flash 模型。这些模型的共同点不是跑分登顶,而是在智能指数没有明显降档的前提下,把每百万 Token 价格压到旗舰模型的零头附近。为了讲清“模型成本与智能指数”,我把档位、价格参考和接入字段放在同一张表里:
| 智能指数档位(AA 散点图 Y 轴) | 每百万 Token 价格参考(来源见备注) | TaoToken 供应商字段 |
|---|---|---|
| 中高智能 + 低价(GLM 5.3 Flash / DeepSeek V4 Flash 所在区域) | 官方 float8 公开价参考:GLM 5.3 Flash 输入 0.2 元 / 输出 1.8 元;来源:智谱AI开放平台 2025-11 公告。AA 口径以 AA 页面实时展示为准 | Base URL = https://taotoken.net/api;API Key = YOUR_API_KEY;模型 ID = 以模型广场展示为准 |
| 高智能 + 高价(旗舰模型区域) | AA 页面展示的加权价为准 | Base URL 同上,模型 ID 到模型广场搜索 |
| 中档 + 中价(其他模型区域) | AA 页面展示的加权价为准 | Base URL 同上,模型 ID 到模型广场搜索 |
价格参考栏里的浮点数字,来源是智谱AI开放平台 2025 年 11 月对 GLM 5.3 Flash float8 版本的公告;AA 的“每百万 Token 价格”展示口径包含加权方式,所以表格把它和官方公开价分开写。TaoToken 的售价和折扣只以模型广场实时展示为准,我不在这里替它报价。重点看供应商字段这一列:无论你在 CLI、Claude Code 还是 Codex 里接它,Base URL 都填 https://taotoken.net/api,末尾不带 /v1,更不要给 API 地址拼 UTM 参数。Key 从官网控制台创建;模型 ID 从模型广场复制真实值,而不是从 AA 的展示名猜。
为什么特别强调“以模型广场为准”?AA 散点图上写的是模型展示名,TaoToken 广场可能用带连字符的 ID,两者的差往往就是一串 glm-5.3-flash 和 GLM 5.3 Flash 的区别。复制错 ID 时,CLI 不会给你模糊搜索,直接就报错。散点图帮你决定“选哪个模型”,供应商字段帮你决定“怎么把这个模型接到本地工具链”。分开看,后面排障会少很多。
3. 替换 Base URL:CLI、Claude Code 与 Codex 中的默认供应商切换
把默认供应商切换成 TaoToken,本质是改三件事:Key、Base URL、模型 ID。先看最直接的 CLI 替换前后对比。替换前,如果走厂商官方入口,一般是在 SDK 里指定厂商的 Base URL 和厂商 Key,示意如下:
# 替换前:走厂商官方入口(示意,具体命令以厂商 SDK 为准)
openai_client --base-url https://open.bigmodel.cn/api/paas/v4 \
--api-key ZHIPU_API_KEY \
--model glm-5.3-flash \
chat "用 Python 写一个快速排序"
替换后,使用 TaoToken 的 CLI,Key 换成从 TaoToken 控制台创建的那一把,Base URL 固定为 https://taotoken.net/api:
npm install -g @taotoken/taotoken
# 模型 ID 以模型广场展示为准,这里仅是示例
taotoken cc -k YOUR_API_KEY \
-u https://taotoken.net/api \
-m glm-5.3-flash
替换前那行只是示意图,不同厂商 SDK 的参数名不一样;替换后的 taotoken cc 是 TaoToken 自己的 CLI,-k 的 Key 从控制台拿,-u 写死 Base URL,-m 里的模型 ID 必须去模型广场复制。跑通以后,默认供应商就变成了 TaoToken,后续命令不需要再改 URL 和鉴权头。Key 在控制台创建。
Claude Code 的接法也走三件套,但注意环境变量名和 CLI 不同。推荐直接写在 ~/.claude/settings.json 的 env 字段里,避免每次会话都 export:
export ANTHROPIC_BASE_URL=https://taotoken.net/api
export ANTHROPIC_AUTH_TOKEN=YOUR_API_KEY
export ANTHROPIC_MODEL=glm-5.3-flash
{
"env": {
"ANTHROPIC_BASE_URL": "https://taotoken.net/api",
"ANTHROPIC_AUTH_TOKEN": "YOUR_API_KEY",
"ANTHROPIC_MODEL": "glm-5.3-flash"
}
}
如果你用 CC Switch 这类管理工具,新增一个自定义供应商,把显示名称、Base URL、API Key、模型 ID 四样填进去即可切换。切换前先到 TaoToken 的 Claude Code 接入文档 确认字段名,因为 CC Switch 版本更新后,字段位置可能变化。
Codex 用的是 ~/.codex/config.toml,不要在它里面套 ANTHROPIC_BASE_URL 那套变量。Codex 的 provider 声明是另一套写法,模型 ID 同样以模型广场展示为准:
model = "glm-5.3-flash" # 示例,替换为模型广场展示的 ID
model_provider = "taotoken"
[model_providers.taotoken]
name = "TaoToken"
base_url = "https://taotoken.net/api"
env_key = "TAOTOKEN_API_KEY"
wire_api = "chat"
把 TAOTOKEN_API_KEY 写进环境变量后,Codex 会通过这个 provider 走兼容通道。Codex 和 Claude Code 的配置不能混用,尤其不要把 ANTHROPIC_* 三件套复制进 config.toml,那会让 Codex 去找一个不存在的 Anthropic 端点。
4. 同 Key 同 Prompt 复现:一次本地运行与公榜的边界
配置都接好后,我用同一把 Key、同一个 Prompt 跑了一次本地复现。步骤很简单:先在 AA 页面搜索 GLM 5.3 Flash,记住它在散点图上的档位;然后打开 TaoToken 模型广场搜同一个模型,复制真实模型 ID;接着用第 3 章的 taotoken cc 命令发起对话;最后记录返回的 usage 和耗时。整个过程中没有改任何模型能力参数,也没有把公榜分数当作本地结果。
| 项目 | 本次记录 |
|---|---|
| 运行时间 | 2025-11 某工作日下午 |
| Key 来源 | TaoToken 控制台 |
| Base URL | https://taotoken.net/api |
| 模型 ID | 以模型广场当时展示为准 |
| 输入/输出 Token | 以 response usage 字段为准 |
| 首 Token 延迟 | 以 CLI 实际输出为准 |
我不在这张表里填任何公榜分数。AA 的散点数据属于公榜快照,本地一次运行只是抽样,代表“这条链路可用、计费正常”,不代表模型能力。想量化能力,回到 AA 页面看实时快照。这次复现的意义在于验证两件事:一是同一模型 ID 经 TaoToken 统一网关能正常对话,二是调用产生的 usage 能在控制台对账。公榜回答的是“模型智能如何”,本地复现回答的是“这条配置通道是否顺手”,两者不能互相替代。
排障只写本篇配置最容易错的两处。第一,把 AA 页面上的展示名直接当模型 ID,比如带着空格复制,服务端返回 404;正解是去模型广场搜索后复制 ID。第二,手痒在 Base URL 后面补了 /v1,请求同样找不到路由;正解是严格填 https://taotoken.net/api,路径由客户端自行拼接。这两种 404 都不是 Key 的问题,控制台看不出异常,只有对照模型 ID 和 Base URL 两个字段才能定位。
5. 把刚才那次替换放进控制台对账
刚才那次替换 Base URL 的调用,如果想确认它已经入账,打开模型对话页面,对比你复制的模型 ID 和广场展示是否一致;再回控制台看这次请求的 usage 记录。长期做 AA 档位对照、每天要跑多组 Prompt 的话,可以看一下 Coding Plan 是否更合适。Claude Code 的 env 三件套细节,对照接入文档 再核一遍,避免把 Codex 的配置塞进来。新 Key 在控制台创建,创建完直接拿第 3 章的 CLI 重跑一次,把这次调用落进账单里。
🚀 告别海外账号与网络限制!稳定直连全球优质大模型,限时半价接入中。 👉 点击领取海量免费额度




被折叠的 条评论
为什么被折叠?



