🚀 告别海外账号与网络限制!稳定直连全球优质大模型,限时半价接入中。 👉 点击领取海量免费额度
GLM 5.3 Flash 出现在 Artificial Analysis 的智能指数页面后,我想先确认一件事:用同一把 TaoToken Key,能不能把它写进请求体并复现页面标注的采样参数。本文默认入口是 TaoToken。对做 AI 工具评测、跑 Agent、接插件的人来说,榜单页最怕两件事:一是只看名次不看价格散点,二是把公榜数字直接当成自己环境的实测结果。GLM 5.3 Flash 这类 Flash 型号更适合放在“智能指数 vs 价格”的坐标里看,而不是只背一个排名。下面我会把 Artificial Analysis 页面要抄的字段、TaoToken 兼容通道的 Base URL、curl 请求体、采样参数复现方式、上下文窗口和输出 token 上限的核对表都拆开写清楚。需要提前说明:本文输入没有提供公榜快照,所以正文不写 Artificial Analysis 的具体名次、智能指数分数、价格数字、上下文窗口数字和最大输出数字,只写可复现的记录方法。你查阅当天页面看到什么,就按页面来源和日期填进表里。
1. 在 Artificial Analysis 找到 GLM 5.3 Flash 的智能指数与价格散点
Artificial Analysis 的页面不是“看一眼排名”就结束。对 GLM 5.3 Flash 这种 Flash 型号,散点图上的横轴和纵轴通常对应价格与智能指数,读者要做的第一件事是记录榜名、查阅日期、页面来源、模型展示名、字段值。因为本文没有公榜快照,我不会凭记忆写“某月某日第几名”或“智能指数多少”,这类数字必须由你在查阅当天从页面复制。公榜记录表和本地复现表一定要分开:前者写 Artificial Analysis 页面上的模型字段,后者写你用同一把 Key 发请求后拿到的 HTTP 状态、usage、finish_reason 和错误码。把两张表混在一起,很容易把 AA 标价误写成通道售价,也容易把一次本地调用说成公榜复现。
1.1 打开页面后先记录哪四个字段
在 Artificial Analysis 找到 GLM 5.3 Flash 的条目后,先别急着截图转发。你至少要记录四个字段:智能指数、价格散点对应字段、上下文窗口、输出 token 上限。有些页面会把价格写成每百万 token 的输入价与输出价,有些页面会把它画在散点图的价格轴上;有些页面会把上下文窗口放在模型详情里,有些会放在 API 参数说明附近。记录时写清楚字段原名,不要自己翻译成“能力分”“便宜度”“记忆长度”这类模糊词。模型展示名也要原样抄,因为 GLM 5.3 Flash 在页面上可能写作带空格、带版本号或带厂商前缀的形式,而请求体里的 model 字段不一定接受展示名。查阅日期和页面 URL 同样要记,后续同事问你数据来源时,这三项比一个孤立数字有用得多。
如果页面还标了采样参数,比如 temperature、top_p、max_tokens、seed、stop 之类,把这些参数单独放进“官方标注采样参数”小节。不要默认所有模型都用 temperature=0;也不要因为某个评测常用 greedy 就替 Artificial Analysis 改写参数。本文不预设官方采样值,原因很简单:没有资料包,也没有搜索快照,任何具体数字都可能是记忆污染。正确做法是在页面标注处抄下字段名和值,再原样写进请求体。若页面只给了一部分参数,就只复现那一部分,剩余参数在请求体里保持你所用客户端默认值,并在记录里注明“页面未标注,未强行指定”。这样得到的本地结果才和公榜口径有可比边界。
1.2 价格散点看的是性价比,不是 TaoToken 售价
Artificial Analysis 的“智能指数 vs 价格”散点图,对 GLM 5.3 Flash 这类 Flash 型号很有参考价值:横轴越靠左、纵轴越高,通常意味着单位价格下的智能指数表现越值得看。但这里有一个常见误读:AA 页面的标价是公榜口径下的价格标注,不是你在 TaoToken 或任何 API 兼容通道里的最终售价。售价、折扣、套餐、Coding Plan 额度,只以 TaoToken 展示为准。你可以把 AA 价格散点当作“公开价格维度的参照”,把控制台用量和发票当作“自己实际消耗的参照”。两者混写,会让评测文章失去可信度。
还有一点,公榜上的是模型,TaoToken 是 API 兼容通道,不是榜单参赛方,也不是评测主办方。读者用同一把 Key 和 Base URL 接上同一个 GLM 5.3 Flash 模型,做的是“请求侧复现”,不是“给榜单重新打分”。所以散点图里的位置、智能指数、价格标注,来源都应写 Artificial Analysis 页面;本地请求得到的只是状态码、延迟、usage、finish_reason、是否被限流、是否因窗口超限报错。把这两类信息放在同一张“综合实力表”里,既不严谨,也不利于排查问题。文章后续的对照表会把公榜字段和本地字段并排,但不会把 Arena ELO、SWE-bench 百分比、Hugging Face likes、OpenRouter 用量拼成一张混合分数表。
1.3 本文不含排行分数,先搭复现骨架
本文既然没有公榜快照,就不写 GLM 5.3 Flash 在第几名、智能指数多少、每百万 token 多少钱、上下文窗口多大、最大输出多少。可写的是复现骨架:榜单页查哪些字段,模型广场复制哪个 ID,Base URL 写什么,curl 请求体怎么把模型名写进 model 字段,采样参数如何从 AA 页面抄进 JSON,上下文窗口和输出上限如何用响应 usage 与错误码核对。读完后你得到的是一套可重复流程,而不是一篇转发型榜单快讯。若你需要可对外引用的公榜数字,自己打开 Artificial Analysis,记录榜名、查阅日期、名次或分数、页面来源,再把这一行贴进你的表格。
这样做还有一个好处:GLM 5.3 Flash 的页面字段可能会更新,模型 ID 也可能随着模型广场调整。如果你把某天的 AA 数字写死在文章里,过两天页面改版,读者就不知道该信旧数字还是新页面。把“查阅日期”和“页面来源”作为必填列,数字才有上下文。本文后续所有涉及本地实测的地方,也会明确写“一次运行,不代表公榜”。你可以重复运行,把多次结果放在自己的表里,但不要用一次 curl 的返回去覆盖 Artificial Analysis 的公开评测。
2. 用同一把 TaoToken Key 把 GLM 5.3 Flash 写进请求体
这一章只做接入与请求体。先去 TaoToken 创建 Key,Base URL 统一写 https://taotoken.net/api,注意末尾不带 /v1。模型 ID 以模型广场为准:在模型广场搜索 GLM 5.3 Flash,找到对应条目后复制模型 ID,不要把页面展示名直接手打进请求体。展示名可能带空格、大小写差异或厂商前缀,而 API 请求通常要求精确 ID。拿到 Key 后,先不要急着跑长上下文,先用一条短请求验证鉴权、模型 ID、Base URL 和采样参数是否能被服务端接受。这个顺序能帮你把 401、404、400 分开定位,而不是一上来就怀疑模型窗口。
2.1 创建 Key、确认模型广场 ID 与 Base URL
打开带 UTM 的官网落地页,进入控制台创建 Key。Key 占位符统一写成 YOUR_API_KEY,不要把它提交到公开仓库,也不要写进前端代码。然后打开模型广场,找到 GLM 5.3 Flash 对应行,复制模型 ID。模型 ID 可能和展示名不完全一致,以广场显示为准。Base URL 写 https://taotoken.net/api,这个地址不要附加 UTM 参数,也不要写成带 /v1 的落地页链接。Claude Code、Codex、CC Switch 或自定义 OpenAI 兼容客户端里,如果要求填 Base URL,同样填这个地址;如果某个客户端要求完整 endpoint,再按它的文档拼接,但不要改 Base URL 的 UTM 口径。
注册、看模型广场、看用量都在带 UTM 的官网完成。这样做的好处是渠道来源可追踪,但 API 请求本身不应该带营销参数。Base URL 是给程序用的,UTM 是给落地页归因用的,两者混在一起容易造成 404 或鉴权异常。本文后面的 curl 会访问 https://taotoken.net/api/v1/chat/completions 这类兼容路径,但你在配置项里看到的 Base URL 仍然是 https://taotoken.net/api。这个区别要分清:Base URL 是根,完整路径是客户端或 curl 自己拼的。
2.2 curl 请求体:把 GLM 5.3 Flash 的模型 ID 写进 model
下面这段 curl 可以用同一把 Key 发起一次最小请求。先替换变量:YOUR_API_KEY 换成控制台创建的 Key,MODEL_ID 换成模型广场里 GLM 5.3 Flash 对应的 ID,AA_TEMPERATURE、AA_TOP_P、AA_MAX_TOKENS 换成你在 Artificial Analysis 页面抄到的官方标注采样参数。若页面没有标注某项,就不要 export 那一项,或者按你的客户端默认值处理,并在记录里注明“AA 页面未标注”。请求体里的 model 字段就是“把模型名写进请求体”的位置,但这里写的是广场 ID,不是展示名。
export YOUR_API_KEY="YOUR_API_KEY"
export MODEL_ID="以模型广场为准的 GLM 5.3 Flash 模型 ID"
export AA_TEMPERATURE="从 Artificial Analysis 页面抄"
export AA_TOP_P="从 Artificial Analysis 页面抄"
export AA_MAX_TOKENS="从 Artificial Analysis 页面抄"
curl https://taotoken.net/api/v1/chat/completions \
-H "Authorization: Bearer $YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d "{
\"model\": \"$MODEL_ID\",
\"messages\": [
{\"role\": \"user\", \"content\": \"请用三句话说明你收到的模型标识和采样参数。\"}
],
\"temperature\": $AA_TEMPERATURE,
\"top_p\": $AA_TOP_P,
\"max_tokens\": $AA_MAX_TOKENS,
\"stream\": false
}"
请求成功后,把完整响应另存为 JSON 文件,至少记录 HTTP 状态码、响应里的 model、usage.prompt_tokens、usage.completion_tokens、usage.total_tokens、finish_reason。若返回 401,先查 Key 和 Authorization 头;若返回 404,先查 Base URL 与模型 ID;若返回 400,先查采样参数类型,比如温度是否被写成字符串、max_tokens 是否超过服务端允许值。不要一看到错误就换模型,也不要凭记忆猜一个模型 ID。模型广场的 ID 才是可复制配置。
2.3 复现 Artificial Analysis 标注的采样参数
Artificial Analysis 页面上如果有采样参数说明,通常会在模型详情、评测方法或 API 参数附近。你抄的时候不要只抄值,也要抄字段名和上下文。例如页面写的是 max_output_tokens 还是 max_tokens,是 temperature 还是 top_p,是默认值还是评测固定值。JSON 请求体对字段名敏感,写错字段可能被忽略,也可能直接报 400。复现时建议建一个小节:参数名、AA 页面值、本地请求体值、响应是否观察到差异。没有页面标注的参数不要补脑,比如页面没写 seed,你就不需要为了“更像官方”硬塞一个 seed;页面没写 stop,也不要自己加。
如果页面标注了多个采样参数,而你的客户端只支持其中一部分,就在记录里写清楚“客户端不支持项”。本地复现的目标不是篡改公榜,而是验证同一模型 ID 在相同请求体字段下能否被通道正常转发。你还可以把同一条 prompt 在 temperature 为页面值和默认值下各发一次,观察回答长度、finish_reason 和 usage 的差别。但要注意,一次运行不代表公榜,也不代表模型真实能力分布。评测里常说的“可复现”更多指请求参数、模型 ID、Base URL、日期和响应记录可追溯,不是指每次生成文本完全一样。
2.4 Claude Code、Codex、CC Switch 的配置差异
如果你从 curl 扩展到 Claude Code,记住三件套:ANTHROPIC_BASE_URL、ANTHROPIC_AUTH_TOKEN、ANTHROPIC_MODEL。Base URL 写 https://taotoken.net/api,AUTH_TOKEN 写你的 Key,MODEL 写模型广场里 GLM 5.3 Flash 对应的 ID。也可以放进 ~/.claude/settings.json 的 env 字段。Codex 不要套 ANTHROPIC_*,它走 ~/.codex/config.toml,里面配置模型供应商、base_url、env_key 和模型 ID。CC Switch 则用自定义供应商:填 Base URL、Key、模型 ID,保存后切换生效。三者的共同点只有 Base URL 和 Key,字段名并不通用。
# ~/.codex/config.toml 示例,字段以你的 Codex 版本为准
model = "以模型广场为准的 GLM 5.3 Flash 模型 ID"
model_provider = "taotoken"
[model_providers.taotoken]
name = "taotoken"
base_url = "https://taotoken.net/api"
env_key = "TAOTOKEN_API_KEY"
wire_api = "chat"
上面的 Codex 示例里,TAOTOKEN_API_KEY 是你本地环境变量名,值仍然是 YOUR_API_KEY。不要把 ANTHROPIC_BASE_URL 写进 Codex 配置,也不要给 Base URL 加 UTM。CC Switch 的自定义供应商也是同理:Base URL 纯地址,Key 纯密钥,模型 ID 从模型广场复制。配置完成后先用一条短对话验证,再跑采样对照。
3. 核对上下文窗口与输出 token 上限:AA 值 vs 本地实测对照表
上下文窗口和输出 token 上限是最容易被口口相传搞混的两个字段。Artificial Analysis 页面可能写 Context Window,也可能写 Max Output Tokens;模型广场也可能有类似字段。你要做的是把 AA 页面值、模型广场值、本地请求观察值分开写。本文没有公榜快照,所以不填具体数字,只给表格骨架。你查阅当天看到什么,就填什么,并在表头写清楚查阅日期和页面来源。本地实测则写请求时间、请求体、HTTP 状态、usage、finish_reason 和错误信息。两边不要混成一列,否则后面排查 400 时没有依据。
3.1 上下文窗口怎么核对
上下文窗口通常指一次请求里输入与输出 token 的总预算上限,但不同服务端对“窗口”和“max_tokens”的关系定义不完全一样。有的要求 prompt_tokens + max_tokens 不超过窗口,有的把 max_tokens 算在窗口内,有的在超出时返回 400,有的会截断输入。核对时先看 Artificial Analysis 页面的 Context Window 字段,再看模型广场写的是模型上下文窗口还是接口可用窗口。然后发一条短请求,读取 usage.prompt_tokens,确认基础链路能通。接着逐步增加输入长度,观察响应里 prompt_tokens 的变化、是否出现截断、是否返回窗口超限错误。不要拿生产数据去测窗口,也不要把密钥和隐私内容放进长 prompt。
如果你要更严谨,可以准备几档测试输入:很短、中等、接近页面标注窗口、明显超过页面标注窗口。每一档只记录现象,不写“模型能力如何”。比如接近窗口时是否成功、超过窗口时返回什么错误码、错误信息里是否提到 token 数。Artificial Analysis 的窗口字段是公榜模型页信息,本地窗口测试是你这条通道和这个模型 ID 的请求行为,两者可以互相对照,但不能互相替代。一次运行不代表公榜,也不代表所有账号、所有区域、所有时间都一样。
3.2 输出 token 上限怎么核对
输出上限通常对应请求体里的 max_tokens 或 max_output_tokens。核对时不要把 max_tokens 直接设成一个很大的数去撞上限,这样既浪费额度,也可能触发服务端保护。更稳的做法是先从较小值开始,比如 16、64、128,观察 finish_reason 是否变成 length;再把它调到页面标注值附近,确认服务端是否接受。如果页面标注 Max Output Tokens 为某个字段,而请求体 max_tokens 超过该字段仍返回 200,就要检查服务端是否自动截断、是否忽略了该参数、是否把错误藏在响应体里。反之,如果 400 错误提到 max_tokens,就把它降下来,并记录实际允许值。
注意,AA 页面标注的输出上限是模型页信息,本地请求能跑通的上限是你这次请求、这个通道、这个账号下的观察值。两者不一致时,不要立刻断言谁错,先检查字段名、模型 ID、请求路径、参数类型和账号配额。本文不写具体上限数字,因为你应当以查阅当天页面和模型广场为准。你可以在对照表里写“AA 页面值”“模型广场值”“本地请求值”“差异原因”四列,差异原因可以是“页面未标注”“参数名不同”“服务端截断”“超过窗口总预算”等。
3.3 Artificial Analysis 值与本地实测对照表
下面这张表就是本文要求的对照表骨架。Artificial Analysis 侧填你查阅当天页面上的值,并写清楚查阅日期和页面来源;本地实测侧填同一把 Key、同一模型 ID、同一请求体下的响应记录。本文不预填公榜数字,也不预填本地分数,避免把记忆当数据。表里的“智能指数”和“价格散点”只做字段搬运,不做自评分。价格散点对应 AA 页面标注,不是通道售价。
| 项目 | Artificial Analysis 页面字段与值(查阅日期:____,来源:页面 URL) | 本地通过同一把 Key 请求得到的值(运行时间:____) | 备注 |
|---|---|---|---|
| 模型展示名 | GLM 5.3 Flash,按页面原样抄 | 请求体 model 填模型广场 ID | 展示名不等于模型 ID |
| 智能指数 | 页面字段:____,值:以查阅当天页面为准 | 不做本地自评分 | 公榜数字必须带榜名、日期、来源 |
| 价格散点 | 页面字段:____,值:以查阅当天页面为准 | 以落地页展示为准 | AA 标价不是通道售价 |
| 上下文窗口 | 页面字段:____,值:以查阅当天页面为准 | 用 usage.prompt_tokens 与错误码核对 | 不凭记忆写数字 |
| 输出 token 上限 | 页面字段:____,值:以查阅当天页面为准 | 用 max_tokens 与 finish_reason 核对 | 不要一次拉满 |
| 官方采样参数 | temperature:,top_p:,max_tokens:____ | 请求体字段:,是否接受: | 页面没标注就不强塞 |
| 请求状态 | 不适用 | HTTP 状态码:____ | 401/404/400 分开查 |
| 用量记录 | 不适用 | prompt_tokens:,completion_tokens: | 响应 usage 原样记录 |
| 结束原因 | 不适用 | finish_reason:____ | stop 或 length 都要记 |
表格填完后,把 Artificial Analysis 页面截图或页面 URL 与本地响应 JSON 放在同一个实验记录目录。公榜表只保留一个榜名,不要在同一张表里混入 Arena ELO、SWE-bench 百分比或 Hugging Face likes。本文不含排行分数,也不把本地一次运行写成公榜结果。若你要对外引用,写清楚“Artificial Analysis 页面查阅日期”和“本地运行时间”,并声明本地结果不代表公榜。
4. GLM 5.3 Flash 采样复现排障:401、404、400 与窗口边界
排障时最容易犯的错,是把所有错误都归因到模型或通道。实际上,401、404、400 对应的位置完全不同。401 多数是 Key 或 Authorization 头问题;404 多数是 Base URL、路径或模型 ID 问题;400 多数是请求体字段、参数类型或 token 预算问题。你只要按顺序验证,就能把问题缩小到一处。下面只写本篇配置相关的错误,不展开无关的历史模型或客户端问题。每修一项,都重新发一次最小请求,不要同时改 Key、Base URL、模型 ID 和采样参数。
4.1 401 与 Key 问题
401 出现时,先看 Authorization 头是不是 Bearer YOUR_API_KEY,再看 Key 是否从带 UTM 的官网控制台创建,是否复制完整,前后有没有多空格。有人把 Key 写进 URL 参数,有人把 Authorization 写成 AuthToken,有人把 ANTHROPIC_AUTH_TOKEN 和 OpenAI 兼容的 Bearer 混用。curl 示例里用的是 Authorization: Bearer $YOUR_API_KEY,这是 OpenAI 兼容路径的常见写法。Claude Code 走 ANTHROPIC_AUTH_TOKEN,字段名不同,不要互相套。修正后先跑最小请求,不要先跑长上下文。
如果 Key 正确但仍然 401,检查环境变量有没有被引号截断,检查 shell 里是否 export 成功。不要把 Key 提交到公开仓库,也不要在截图里露出完整 Key。对账时只看控制台用量,不需要把 Key 贴给任何人。若你用的是 Codex,确认它读的是它自己的 env_key,而不是 ANTHROPIC_* 变量。若你用的是 CC Switch,确认自定义供应商保存后真的切换到了该供应商。401 的排查原则是:只动鉴权,不动模型参数。
4.2 404 与 Base URL、模型 ID
404 常见于三种情况:Base URL 写成了带 /v1 的地址、完整路径拼错、模型 ID 不是模型广场里 GLM 5.3 Flash 对应的那一行。Base URL 应写 https://taotoken.net/api,末尾不带 /v1;完整请求路径由客户端或 curl 拼接。若你把 Base URL 写成落地页地址并带上 UTM,接口服务当然找不到。模型 ID 方面,展示名 GLM 5.3 Flash 可能可以直接写在某些客户端里,但更稳的是从模型广场复制 ID。不要凭记忆写 gpt-5 之类不存在的正式配置,也不要拿旧模型 ID 硬套新条目。
排查顺序是:先用最小 curl 访问 https://taotoken.net/api/v1/chat/completions,Authorization 和 Content-Type 都带上,model 用刚复制的 ID。若仍然 404,把模型 ID 换成模型广场里另一个可用条目做连通性测试,确认是 ID 问题还是路径问题。确认后再切回 GLM 5.3 Flash。不要同时改五个变量,否则你不知道哪个修复生效。
4.3 400 与采样参数类型
400 通常来自请求体 JSON 不合法、参数类型错误或超过允许范围。JSON 里 temperature 应该是数字,不是字符串;top_p 应该是数字;max_tokens 应该是整数。若你用 shell 变量拼 JSON,注意变量里不要带引号或换行。AA 页面抄来的采样参数如果是文本描述,例如“默认”或“未指定”,不要直接塞进 JSON。页面没有数字就省略该字段,或者用客户端默认值。服务端拒绝某个参数时,错误信息里通常会出现字段名,按字段名修比盲猜快。
还有一个坑:有些接口用 max_output_tokens,有些用 max_tokens。你抄 AA 页面字段时,要把它映射到当前请求体支持的字段名。映射关系以模型广场或接口文档为准,不要自行发明字段。修改后重新发送最小请求。若 400 消失,再逐步加采样参数,每加一个记录一次响应。这样你能知道是哪个字段导致失败。
4.4 上下文窗口与 max_tokens 的边界
上下文窗口和 max_tokens 的边界问题,经常表现为“短请求正常,长 prompt 400”或“输出被截断”。先确认 prompt_tokens 与 max_tokens 之和是否可能超过页面标注的 Context Window。若超过,就减少输入或降低 max_tokens。若没有超过但 finish_reason 仍为 length,说明输出被 max_tokens 截断,或服务端有更低的输出上限。记录时写清楚 finish_reason、usage 和请求体,而不是只写“模型没答完”。若错误信息提到 context length,就把输入长度和页面字段贴在一起,方便后续对照。
本文不写具体窗口数字和输出上限数字,因为这些以你查阅当天 Artificial Analysis 页面和模型广场为准。你可以用同一把 Key 做小步测试,但不要把一次失败直接写成模型缺陷。公榜页面上的窗口是模型信息,本地请求的上限是通道与账号下的观察值,两者都要标注来源和时间。
4.5 对账、发票与临时通道对比
如果你在对比临时 API 聚合页和正规兼容通道,真正影响长期评测的不是某次请求快了几百毫秒,而是配额是否稳定、失败是否可追踪、用量是否能对账、发票是否能开。临时通道经常今天能调 GLM 5.3 Flash,明天模型 ID 变了,后天价格口径又变了,评测记录无法复现。统一网关至少能让你在控制台看到调用记录,把“这次评测调用是否入账”和“本地响应 usage 是否一致”对上。这里不教任何绕过封禁的做法,也不建议把业务密钥交给不可审计的页面。
对账时记录三件事:请求时间、模型 ID、usage 总量。控制台用量和本地响应可能因为缓存、重试或流式统计存在差异,出现差异先查是否重试、是否流式中断、是否多个 Key 共用。发票和套餐问题只以带 UTM 的官网展示为准。临时通道的不稳定和无法开票,是选择长期通道时要考虑的因素,但不要把“别找临时中转”当成本文第一条建议。评测的核心仍是可复现请求和可追溯记录。
5. 把这次 GLM 5.3 Flash 复现变成可重复流程
把 Artificial Analysis 查阅、模型广场 ID、Base URL、curl 请求体、采样参数、上下文窗口核对、输出上限核对、错误码记录串成一个固定流程,下次换模型时只需要改模型 ID 和页面字段。建议你建一个实验目录,里面放四类文件:公榜页面记录、请求体 JSON、响应 JSON、对照表。公榜页面记录写榜名 Artificial Analysis、查阅日期、页面来源、模型展示名和字段值;请求体写 Base URL https://taotoken.net/api、完整路径、model 字段、messages、采样参数;响应 JSON 保留 usage 和 finish_reason;对照表把 AA 值和本地观察值分开。这样别人复现时不会把公榜数字和本地一次运行混在一起。
如果你用 Claude Code,把三件套写进环境变量或 ~/.claude/settings.json 的 env;如果用 Codex,只改 ~/.codex/config.toml,不要把 ANTHROPIC_* 塞进去;如果用 CC Switch,自定义供应商里填 Base URL、Key、模型 ID。所有配置里的 Base URL 都是 https://taotoken.net/api,末尾不带 /v1,也不带 UTM。模型 ID 以模型广场为准,采样参数以 Artificial Analysis 页面标注为准,窗口与输出上限以查阅当天页面和本地错误码共同核对。本文不含排行分数,只给复现方法。
跑完这次 GLM 5.3 Flash 请求后,可以去 模型对话 再发一条同模型 ID 的短对话,确认模型广场展示与请求体一致;如果准备长期跑采样对照,可以看 Coding Plan。还没有 Key 的话,在 创建 Key 建一个,再回到上面的 curl 复现对照表。Claude Code 三件套和 CC Switch 配置可以对照 接入文档。最后在控制台看这次评测调用是否入账,把控制台用量和本地响应 usage 对一遍,确保你的 GLM 5.3 Flash 采样复现记录能按日期、模型 ID、请求体和响应结果完整追溯。
🚀 告别海外账号与网络限制!稳定直连全球优质大模型,限时半价接入中。 👉 点击领取海量免费额度




被折叠的 条评论
为什么被折叠?



