🚀 告别海外账号与网络限制!稳定直连全球优质大模型,限时半价接入中。 👉 点击领取海量免费额度
1. Artificial Analysis 上的 GLM 5.3 Flash:公榜速览先看什么
TaoToken 的落地页在 https://taotoken.net/?utm_source=taotoken_aicg_blog_generate&utm_content= ,从这里创建 Key 后,Base URL 填 https://taotoken.net/api。GLM 5.3 Flash 出现在 Artificial Analysis 的模型列表里,这件事对做评测的人有个直接用途:你可以在本地用同一把 Key 向 /chat/completions 发一道 MATH 题,看返回的模型名、推理过程和 usage,而不是只转述公榜截图。先说明,这篇不含排行分数,也不伪造快照日;Artificial Analysis 上的智能指数、名次、价格轴,需要你打开页面时自己记录榜名、查阅日期、数值和页面来源。公榜上的是模型,统一 API 通道只是你拿 Key、切模型、复现请求的地方。
公榜速览最容易犯的错,是把页面上的一个总分当成全部结论。Artificial Analysis 的入口通常会把模型名、智能指数、价格、延迟或吞吐放在散点图里,GLM 5.3 Flash 只是其中一个点。你要做的是先确认三件事:页面上的模型名是否就是 GLM 5.3 Flash,版本后缀是否有区别,页面顶部的日期或更新时间是什么。没有这些,复现出来的 model 字段就算和公榜同名,也不能直接说“复现了公榜”。公榜记录的是模型在特定评测集、特定采样、特定版本下的表现;你在本地发一道 MATH 题,得到的是一次具体请求的返回,两者不是同一种证据。
如果你只是看到别人转发“GLM 5.3 Flash 上了 Artificial Analysis”,建议按下面的顺序处理。第一步,打开 Artificial Analysis 页面,把整个图表区域截下来,别只截分数。图表里通常还有横轴或纵轴的含义,比如智能指数与价格的关系,或者不同模型之间的相对位置。第二步,把页面地址和查阅日期记到笔记里,格式可以写成:榜名 Artificial Analysis;查阅日期填你打开页面的那天;模型名 GLM 5.3 Flash;分数与名次按页面原样抄;页面来源填当前 URL。第三步,再回到统一 API 通道,用同一道 MATH 题发一次请求,把返回的 model、choices[0].message.content、usage 和 HTTP 状态保存下来。这样你手里有两类材料:公榜页面快照,以及本地一次请求记录,二者不要混在一张表里。
这里要特别提醒价格轴。Artificial Analysis 页面上的价格通常来自它自己的统计口径,可能是 API 标价或某个供应商的报价,不是你在 TaoToken 控制台看到的实际扣费。你可以在文章里讨论 GLM 5.3 Flash 在智能指数与价格散点图上的位置,但不能把 AA 标价写成 TaoToken 售价。真正要下单或充值时,以 https://taotoken.net/?utm_source=taotoken_aicg_blog_generate&utm_content= 展示为准,控制台用量页才是对账入口。公榜看的是模型能力快照,通道看的是调用是否稳定、账单是否可查、Key 是否能复用,这两件事不要互相替代。
还有一条纪律:公榜表和本地复现表必须分开。公榜表里可以放榜名、查阅日期、模型名、分数或名次、页面来源;本地复现表里放运行日期、Base URL、模型 ID、Prompt、temperature、HTTP 状态、usage、是否完成。不要把 Arena ELO、SWE-bench 百分比、Hugging Face likes、OpenRouter 用量拼成一张“综合实力表”,也不要把 GLM 5.3 Flash 在 Artificial Analysis 上的位置说成统一 API 通道的成绩。通道不是参赛方,也不主办榜单;它只负责把请求送到你选定的模型。你真正能复现的,是一条具体的 curl、一个具体的返回 JSON,以及一张带时间戳的截图。

上面这行只是提醒,实际截图建议保存为 aa-glm53flash-snapshot.png,文件里至少能看到 Artificial Analysis 的标题、图表、模型名和页面地址。本文不含排行分数,所以不会给你一个“智能指数多少”或“排第几”的数字。如果你需要数字,请以你查阅当天的页面为准,并在引用时写清榜名、查阅日期、名次或分数、页面来源。这个习惯比抄一个分数重要,因为公榜会更新,模型版本也会变化,今天看到的 GLM 5.3 Flash 配置和明天不一定完全相同。
2. 用 TaoToken 拿 Key 与切模型:Base URL 和模型广场 ID
在本地复现之前,先把入口理清。打开 TaoToken,在控制台创建 Key,占位符用 YOUR_API_KEY。Base URL 固定写 https://taotoken.net/api,末尾不带 /v1。这一点在 curl 里尤其容易写错:有人习惯把 Base URL 写成 https://taotoken.net/api/v1,然后请求 https://taotoken.net/api/v1/chat/completions,结果收到 404。正确做法是 Base URL 归 Base URL,路径归路径:Base URL 用 https://taotoken.net/api,聊天补全路径拼成 /chat/completions,最终 URL 是 https://taotoken.net/api/chat/completions。不要在 Base URL、curl、CLI 的 -u 或环境变量里加 UTM,UTM 只用于落地页归因。
Key 创建之后,下一步是选模型。GLM 5.3 Flash 在模型广场里可能以某个模型 ID 出现,这个 ID 必须以模型广场为准,不要凭记忆写一个“看起来像”的字符串。你可以在控制台或模型广场搜索 GLM 5.3 Flash,复制展示出来的模型 ID,填到 curl 的 "model" 字段。如果广场里同时有多个相似名称,比如不同上下文长度、不同供应商标签或不同版本,建议先只选一个,跑通一次请求,再考虑做对照。模型 ID 写错时,常见返回是 400 或 404,而不是模型回答错误,所以排障时要先看 HTTP 状态和错误信息,不要急着怀疑数学题太难。
如果你打算在命令行里复用,可以用 CLI 把 Key、Base URL、模型 ID 一次性带上:
npm install -g @taotoken/taotoken
taotoken cc -k YOUR_API_KEY -u https://taotoken.net/api -m YOUR_MODEL_ID
这里的 -u 是 Base URL,不带 UTM;-m 是模型 ID,仍然以模型广场为准。CLI 适合把配置写进 Claude Code 之类的环境,但本篇的主角是 curl 向 /chat/completions 发 MATH 题,所以 CLI 只作为复用入口提一下。真正要截图的复现命令还是用 curl,因为它把请求体、响应体和状态码都暴露在终端里,方便你保存原始记录。
准备阶段还需要确认两件小事。第一,Key 有没有多余空格。复制 YOUR_API_KEY 时,前后如果带空格,Authorization 头会变成 Bearer YOUR_API_KEY ,服务端可能直接返回 401。第二,Content-Type 必须是 application/json,否则请求体可能无法被解析。curl 默认不会自动加这个头,所以命令里要显式写 -H "Content-Type: application/json"。这两点在本地排障里占很大比例,和模型能力无关,却会让你误以为 GLM 5.3 Flash 接不进来。
模型广场里还有一个容易忽略的字段:模型 ID 和展示名不是一回事。展示名可以写“GLM 5.3 Flash”,但请求里的 model 必须填广场给出的 ID。你在返回 JSON 里会看到 model 字段,它应该和你请求时填的 ID 一致或至少对应同一模型。截图时把请求命令和返回的 model 字段放在同一张图里,后续做对照表时就不容易混淆。若你同时测多个模型,建议给每次运行单独建一个 JSON 文件,例如 glm53flash-math-run1.json,文件名里带模型名和序号,避免几天后分不清哪份结果对应哪次请求。
3. 一条 curl 向 /chat/completions 发 MATH 题:完整命令与截图位
下面这条命令就是本篇要复现的核心。它把 Base URL 设为 https://taotoken.net/api,向 /chat/completions 发一道 MATH 题,要求模型分步推理并给出最终答案。temperature 设为 0,stream 设为 false,方便一次性拿到完整 JSON 并截图。tee 会把响应同时输出到终端和文件,你可以把文件留作原始证据。
curl -sS -w "\nHTTP_STATUS:%{http_code}\n" https://taotoken.net/api/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "YOUR_MODEL_ID",
"messages": [
{
"role": "system",
"content": "你是一个数学推理助手。请分步推理,最后单独给出一行最终答案。"
},
{
"role": "user",
"content": "设 x 和 y 为正整数,且 2x + 3y = 47。求 x + y 的最大值。请分步推理,并在最后一行输出最终答案。"
}
],
"temperature": 0,
"stream": false
}' | tee glm53flash-math.json
命令拆开看,-sS 让 curl 安静但不隐藏错误;-w 在响应末尾追加 HTTP 状态码,截图时你能同时看到 200 或 401;-H "Authorization: Bearer YOUR_API_KEY" 带 Key;-H "Content-Type: application/json" 声明请求体格式;-d 后面是 JSON 请求体。请求体里最重要的三个字段是 model、messages、temperature。model 填模型广场里 GLM 5.3 Flash 对应的 ID,messages 里 system 负责约束输出格式,user 放题目。temperature: 0 是为了降低随机性,让同一道题在多次运行中更容易比较;这不保证每次逐字相同,但比默认温度更适合做复现记录。
这道 MATH 题本身很简单:x 和 y 是正整数,2x + 3y = 47,求 x + y 的最大值。你可以先不用模型,自己算一遍:要让 x + y 最大,x 要尽量大,y 要尽量小;y 为正整数,且 47 - 3y 必须是非负偶数,所以 y 从 1 开始试,y=1 时 2x=44,x=22,x+y=23。模型返回时可能会写出方程变形、奇偶性讨论或枚举过程,你要看的是它有没有在最后一行给出明确答案,以及中间推理是否自洽。注意,这里只是本地一次请求的题目,不是 Artificial Analysis 的评测题;不要拿这一次返回去声称复现了公榜分数。
返回 JSON 的结构可以按下面这些字段截图。不同模型或通道可能在字段顺序上略有差异,但核心字段通常包括 id、model、choices、usage。choices[0].message.content 是模型回答正文,finish_reason 表示结束原因,usage 里能看到 prompt tokens、completion tokens、total tokens。截图时不要只截最后一行答案,要把命令、HTTP 状态、model 字段和 usage 一起框进去。你可以在终端里把窗口拉宽,或者用 python -m json.tool glm53flash-math.json 格式化后再截,但建议保留原始输出,因为原始输出能证明这条请求确实来自 curl。
{
"model": "<响应里的模型 ID>",
"choices": [
{
"message": {
"role": "assistant",
"content": "<模型返回的推理与最终答案>"
},
"finish_reason": "stop"
}
],
"usage": {
"prompt_tokens": "<从响应中抄>",
"completion_tokens": "<从响应中抄>",
"total_tokens": "<从响应中抄>"
}
}
上面的 JSON 只是字段示意,不是某次真实运行结果。你跑完命令后,glm53flash-math.json 里会有真实内容。建议再截一张图,包含文件名、修改时间和文件大小,证明这份 JSON 是本次产生的。若你需要把结果贴到文章或报告里,优先贴原始 JSON 的片段,并写清运行日期、模型 ID、Prompt、temperature 和 HTTP 状态。不要只贴模型答案,那样无法复现;也不要贴未标来源的分数,那样容易把一次运行说成公榜结论。
截图完成后,可以再做一次不带 tee 的快速请求,只发同一道题,看返回是否在同一模型 ID 下保持稳定。如果两次答案不同,先检查 temperature 是否真的为 0,再检查模型 ID 是否被切换。若你在模型广场里选了多个相似模型,务必在文件名和截图里写清楚是哪一个 ID。公榜速览栏目最怕把不同模型的结果混在一起,所以本文把“公榜页面记录”和“本地 curl 记录”分成两张表,下一节就讲怎么填。
4. 本地复现表怎么填:GLM 5.3 Flash 数学推理一次运行
复现表不是为了好看,而是为了让你在三天后还能解释清楚:当时用的是哪把 Key、哪个 Base URL、哪个模型 ID、哪道题、什么温度、返回了多少 token、HTTP 状态是多少。下面这张表只记录本地一次运行,不记录 Artificial Analysis 的分数。你可以把它复制到 Markdown 笔记里,每次跑完填一行。注意,表格里留空比编造好;没有来源的数字不要写,没有截图的记录不要当成证据。
| 字段 | 你填什么 | 说明 |
|---|---|---|
| 运行日期 | 你执行 curl 的日期和时间 | 精确到分钟更好,便于和账单对账 |
| 通道 | 统一 API 基线 | 不把通道写成参赛方 |
| Base URL | https://taotoken.net/api | 不带 UTM,不带 /v1 |
| 请求路径 | /chat/completions | 最终 URL 是 Base URL + 路径 |
| 模型 ID | 模型广场展示的 GLM 5.3 Flash ID | 以模型广场为准,不要凭记忆写 |
| Prompt | 2x + 3y = 47 求 x + y 最大值 | 全文用同一道题,便于对照 |
| temperature | 0 | 降低随机性,不保证逐字相同 |
| HTTP 状态 | 从 HTTP_STATUS 抄 | 200 表示请求成功 |
| usage | 从返回 JSON 抄 | prompt、completion、total 分开记 |
| 是否完成 | 是或否 | 只看这次请求是否返回完整答案 |
| 截图文件 | glm53flash-math.png | 包含命令、状态码、model、usage |
| 原始 JSON | glm53flash-math.json | 保留原始响应,便于复查 |
这张表里没有 Artificial Analysis 的智能指数,也没有名次。公榜信息另建一张表,只记录你从页面上看到的内容:榜名、查阅日期、模型名、分数或名次、页面来源。两张表不要合并。合并之后最容易出现的情况是,读者以为你的本地 curl 跑出了公榜分数,或者以为通道参与了榜单排名。实际上,公榜上的是 GLM 5.3 Flash 这个模型;你本地跑的是一次具体请求,统一 API 基线只负责把请求送到模型并返回结果。
如果你要做多次运行,可以在表下面追加“运行 2”“运行 3”,每次只改运行日期和返回的 usage,其他字段保持一致。这样你能观察到同一模型 ID、同一 Prompt、同一温度下的返回差异。若你要换 temperature,建议另起一张表,写清 temperature 值,不要把不同温度的运行混在同一列。若你要换模型,比如从 GLM 5.3 Flash 换到另一个 Flash 模型,也要新建表。公榜速览文章最容易犯的错是把不同模型、不同温度、不同 Prompt 的记录拼成一张“综合表”,然后得出一个没有来源的结论。本文明确不这么做。
一次运行不代表公榜。这句话建议写在你的记录表标题下面,避免以后自己忘记。Artificial Analysis 上的分数有它自己的评测方法、采样设置和版本快照;你的 curl 只发了一道题,只能说明这次请求是否成功、模型是否给出答案、返回用了多少 token。即使模型这次答对了,也不能说它在 MATH 类评测上达到某个分数。反过来,即使模型这次答错,也不能说它在公榜上的位置是假的。公榜和本地复现是两种证据,前者看页面来源,后者看运行记录。
如果你想把记录做得更完整,可以给 glm53flash-math.json 算一个哈希,写进表格备注。这样以后把 JSON 发给别人时,对方能确认文件没有中途被改。哈希命令可以用 shasum -a 256 glm53flash-math.json,把输出抄到备注里。截图方面,建议截三样:终端命令与状态码、格式化后的 JSON 片段、以及模型广场里模型 ID 的页面。三张图放在同一文件夹,文件名带日期。这样一套材料下来,你既有本地复现产出,又不会把它伪装成公榜分数。
5. 排障与复用:401、404、Claude Code、Codex、CC Switch
复现时最常见的错误是 401。看到 401 先检查 Authorization 头是不是 Bearer YOUR_API_KEY,Key 前后有没有空格,Key 是不是从带 UTM 的落地页控制台创建。不要把 Key 写进公开仓库,也不要在截图里露出完整 Key;截图前可以用占位符替换,或者只露前几位。401 还可能是 Key 被删除、被禁用或复制错了环境。控制台里重新创建一把专用 Key,命名成 glm53flash-math,再跑一次 curl。若换成新 Key 后 200,说明问题在旧 Key,不在模型。
404 通常和 URL 有关。检查 Base URL 是不是 https://taotoken.net/api,请求 URL 是不是 https://taotoken.net/api/chat/completions。不要写成 /api/v1/chat/completions,也不要把 UTM 参数拼到 Base URL 后面。若你把 https://taotoken.net/?utm_source=taotoken_aicg_blog_generate&utm_content= 直接当 Base URL,请求就会打到落地页而不是 API 端点,结果可能是 404 或 HTML 返回。正确做法是:落地页用来创建 Key、看模型广场、看用量;Base URL 只写 https://taotoken.net/api;curl 的路径单独拼 /chat/completions。这三者分工清楚,排障会快很多。
400 多半是模型 ID 或请求体格式问题。先确认 "model" 的值来自模型广场,而不是手写猜测;再确认 JSON 引号、逗号、括号没有写错。若你从网页复制了带智能引号的文本, curl 的 -d 里可能出现非法字符。可以用 jq . 先校验请求体,或者把请求体保存为 request.json,用 curl -d @request.json 发送。400 的错误信息通常会提示哪个字段无效;截图时把错误信息也带上,不要只截“请求失败”。429 表示请求频率或配额限制,先降低并发,检查控制台用量,再决定是否调整 Key 或计划。
如果你要把同一把 Key 复用到 Claude Code,环境变量写法是:
export ANTHROPIC_BASE_URL=https://taotoken.net/api
export ANTHROPIC_AUTH_TOKEN=YOUR_API_KEY
export ANTHROPIC_MODEL=YOUR_MODEL_ID
ANTHROPIC_MODEL 填模型广场里的 ID,不要凭记忆编造。也可以写进 ~/.claude/settings.json 的 env:
{
"env": {
"ANTHROPIC_BASE_URL": "https://taotoken.net/api",
"ANTHROPIC_AUTH_TOKEN": "YOUR_API_KEY",
"ANTHROPIC_MODEL": "YOUR_MODEL_ID"
}
}
这里同样不要把 UTM 加到 ANTHROPIC_BASE_URL 上。Claude Code 接入相关细节可以对照 接入文档。如果你用的是 Codex,配置文件在 ~/.codex/config.toml,不要把 ANTHROPIC_* 环境变量套到 Codex 上,两者配置体系不同。Codex 可以这样写:
model = "YOUR_MODEL_ID"
model_provider = "custom"
[model_providers.custom]
name = "custom"
base_url = "https://taotoken.net/api"
env_key = "OPENAI_API_KEY"
模型 ID 仍以模型广场为准。CC Switch 的思路更简单:新增自定义供应商,Base URL 填 https://taotoken.net/api,Key 填 YOUR_API_KEY,模型 ID 填模型广场展示的 GLM 5.3 Flash 对应 ID。切换后先发一条最小请求验证,不要一上来就跑长上下文。若切换后 401,回到 Key;若 404,回到 Base URL 和路径;若模型答非所问,回到模型 ID 和系统提示。排障只围绕本篇配置,不要引入无关的代理或绕过手段。
6. 把这次 curl 结果带回模型对话与创建 Key 复现对照表
跑完上面的 curl,你已经拿到三样东西:一条可复制的命令、一份 glm53flash-math.json、一张包含 HTTP 状态和 usage 的截图。接下来做两件事。第一,回到 模型对话 确认 GLM 5.3 Flash 的模型 ID 与广场一致,顺便看这次调用是否入账。模型对话页适合发一条轻量请求,验证同一模型 ID 在交互界面里是否可用,但不要把对话页的结果当成公榜分数。第二,如果你准备把 MATH 题跑成一套对照表,在 创建 Key 建一把专用 Key,命名成能识别的项目名,后续每次运行都写清日期、模型 ID、Prompt、temperature 和 usage。
长期复用同一套配置时,再看 Coding Plan。Claude Code、Codex、CC Switch 这类工具的重点不是一次性跑通,而是 Key、Base URL、模型 ID 三件套稳定,切换模型时只改模型 ID,不改通道地址。如果你在 Claude Code 里已经把 ANTHROPIC_BASE_URL 写成 https://taotoken.net/api,在 Codex 里把 base_url 写成同一个地址,在 CC Switch 里也填同一个 Base URL,那么排障时就能用同一套判断:401 看 Key,404 看路径,400 看模型 ID。不要把不同工具的配置混写,也不要把 UTM 参数带进环境变量。
这次复现的最终产出可以整理成一个文件夹:glm53flash-math.json、glm53flash-math.png、aa-glm53flash-snapshot.png、run-log.md。run-log.md 里先写一句“本文不含排行分数”,然后贴公榜登记表和本地复现表。公榜表只放 Artificial Analysis 的页面信息,本地表只放本次 curl 的字段。若你之后要在团队里分享,优先发原始 JSON 和截图,而不是只发一句“GLM 5.3 Flash 数学推理不错”。有来源的数字才可引用;没有来源的结论,宁可留空。
如果你还打算把同一道题发给其他模型做对照,保持 Prompt、temperature、Base URL 不变,只改模型 ID,并给每个模型单独建表。对照表可以写成:模型 ID、运行日期、HTTP 状态、usage、是否给出最终答案、截图文件。注意,这张表仍然不是公榜,只是本地一次运行记录。公榜速览的正确姿势是:公榜看页面,复现看命令,通道看账单。用 TaoToken 创建 Key、切模型,把 GLM 5.3 Flash 的 MATH 题复现一次,然后把结果和公榜页面分开保存。这样你既能在 Artificial Analysis 看到模型位置,也能在本地留下可复查的请求记录。
🚀 告别海外账号与网络限制!稳定直连全球优质大模型,限时半价接入中。 👉 点击领取海量免费额度




被折叠的 条评论
为什么被折叠?



