2026-10-02 更新:Sonnet 已升级为 Claude Sonnet 5.5,上游与 API 模型 ID 为 claude-sonnet-5-5。每百万 token 的输入 / 输出牌价仍为 $2 / $10,共享池 $1 / $5,官方线 $1.8 / $9;缓存读牌价 $0.20,5 分钟 / 1 小时缓存写牌价 $2.50 / $4。下方其他模型的报价与目录描述保留 2026-09-12 历史快照,不能当作当前报价。当前模型、路由与价格见 模型与价格页;Sonnet 来源见 Anthropic 模型文档。
2026-09-30 更新:文中的 claude-fable-5、claude-opus-5、gpt-5.6-sol 和 grok-4.6 从 9 月 24 日起停用,接替它们的是 claude-fable-5-1、claude-opus-5-5、gpt-6.1-sol 和 grok-4.7。9 月 28 日这里写的 gpt-6-sol 也在 9 月 30 日停用了。下面的算式用的是 9 月 12 日的价格,算法不变,代入数字请用 ai.topxea.com/pricing 上的现价。
$99。一个写代码的 agent 挂在 claude-sonnet-5-5 的共享池上,22 个工作日下来的账单。用量是假设的:每天 300 万 token 输入,30 万 token 输出。Sonnet 5.5 单价于 2026-10-02 按 Anthropic 模型页核验,TopxAI 共享池按牌价的 50%、官方线按 90% 计费。下文其他模型的比较仍保留 2026-09-12 的历史快照。
算式一行写完:66 × $1 + 6.6 × $5 = $66 + $33。66 是 6,600 万输入按百万计的数,6.6 是 660 万输出,$1 和 $5 是共享池的输入价和输出价。这种用法下,输入占了账单三分之二。
同一份用量按供应商牌价算是 $198,走 TopxAI 的官方线是 $178.2。共享池比牌价省一半,是 $99 对 $198;在 TopxAI 两条路由之间选,最多省 44%,是 $99 对 $178.2。官方线的 $178.2 比 $99 多出 $79.2,是专线没开通就选官方线的代价。
300 万输入的来历:60 次请求,平均每次带 5 万 token 的仓库上下文
七个文本模型的牌价单位都是「美元 / 百万 token」。一百万 token 约 75 万英文词,或者 50 万到 100 万汉字;按开头的假设,一个写代码的 agent 一天就用掉 300 万。
原因在多轮对话的计费方式。每一轮请求都把之前的整段历史重新发一遍,模型上一轮的回答,这一轮全算输入。每天 300 万输入,可以是 60 次请求,平均每次带 5 万 token 的仓库上下文;30 万输出,是这 60 次里每次写了 5,000 token 的代码和解释。上下文越长、轮数越多,账单的大头越往输入那边挪。想省钱,先砍上下文;让模型少说话,省不了多少。
自己的真实用量不用猜。每次回包的 usage 字段里有本次的 token 数,Anthropic 风格是 input_tokens / output_tokens,OpenAI 风格是 prompt_tokens / completion_tokens。控制台的用量日志一次请求一行,记着模型、token 数和费用,还有延迟和实际走的分组,不记内容。
牌价是三家供应商自己定的,TopxAI 只在上面乘一个系数
接口里每个模型带一个 reference_price 字段,就是供应商公布的价格,出处也写在接口里:Anthropic 的定价页,OpenAI 的 gpt-5.6-sol 与 gpt-6-astra 模型页,xAI 的定价页,原接口标的核验日是 2026-09-09。Sonnet 一行已于 2026-10-02 按 Sonnet 5.5 模型页重新核验:输入 $2,输出 $10,缓存读 $0.2。
官方线乘 0.9,共享池乘 0.5,输入、输出和缓存读三项用同一个系数,原文在 2026-09-12 对七个文本模型逐个核过;Sonnet 5.5 已于 2026-10-02 重新核验。Sonnet 5.5 共享池的输入是 $2 × 0.5 = $1,输出是 $10 × 0.5 = $5,代回 $99 的算式,正好是 $66 加 $33。
模型与价格页直接从这个接口取数,改价 5 分钟内跟上,下面表格除 Sonnet 5.5 一行(2026-10-02)外,其余数字只对 2026-09-12 负责;当前目录、长上下文档和价格以实时页面为准。
官方线九折,共享池五折,一把 key 只能走一条
接口里路由说明的原文是「Claude · Official key · 90% of list price」和「Claude · Shared pool · 50% of list price」,OpenAI 和 Grok 同理,本站叫官方线和共享池。建 key 的时候选一条,一把 key 不能两边跑,两条都要就开两把。下表是原文七个文本模型的历史比较,Sonnet 一行更新为 5.5;单位 USD / 百万 token,每格按「输入 / 输出 / 缓存读」写。
| 模型 | 牌价 | 官方线(90%) | 共享池(50%) |
|---|---|---|---|
| claude-fable-5-1 | 10 / 50 / 0.25 | 9 / 45 / 0.225 | 5 / 25 / 0.125 |
| claude-fable-5 | 10 / 50 / 1 | 9 / 45 / 0.9 | 5 / 25 / 0.5 |
| claude-opus-5 | 5 / 25 / 0.5 | 4.5 / 22.5 / 0.45 | 2.5 / 12.5 / 0.25 |
| claude-sonnet-5-5 (2026-10-02) | 2 / 10 / 0.2 | 1.8 / 9 / 0.18 | 1 / 5 / 0.1 |
| gpt-6-astra | 10 / 50 / 1 | 9 / 45 / 0.9 | 5 / 25 / 0.5 |
| gpt-5.6-sol | 4 / 20 / 0.4 | 3.6 / 18 / 0.36 | 2 / 10 / 0.2 |
| grok-4.6 | 2 / 6 / 0.5 | 1.8 / 5.4 / 0.45 | 1 / 3 / 0.25 |
把 $99 那份用量在表里横着走一遍。
牌价 66 × 2 + 6.6 × 10 = 132 + 66 = $198
官方线 66 × 1.8 + 6.6 × 9 = 118.8 + 59.4 = $178.2
共享池 66 × 1 + 6.6 × 5 = 66 + 33 = $99
共享池是官方线的 5/9,便宜 44%;比牌价便宜一半。当时的 gpt-image-2 不在表里,按次计且只有一条路由,$0.05 / 次,参考价 $0.10。该模型现已下架,当前出图模型按尺寸计费,不能沿用这个旧价。
官方线背后是一条按账户开通的专线,要先发邮件到 support@topxea.com 申请。key 倒是随时能建。表单上写着,专线没配好时,官方线的请求回退到共享池。回退的请求扣费仍按官方线单价,用量日志会标出实际走的分组。没发过那封邮件就选官方线,等于同一份共享池流量多付 $79.2,按 $1.8 的价走 $1 的路,这就是开头说的那 $79.2。所以顺序别反:先发邮件,专线开了再建官方线的 key;key 建好先发一条请求,看日志那行标的分组是不是官方线,再放 agent 上去跑。
共享池的请求可能经过中间 API 服务商,隐私政策原话是「may include an intermediary API provider」,内容按那家的条款处理,TopxAI 管不到。TopxAI 这边不留:提示和回复只转发不存储,用量日志只有计数和标识。数据不能经第三方过手的,先发邮件把专线的路径问清楚,再看价格。两条线上游模型相同,都来自官方上游 API,没有蒸馏副本,也没有第三方镜像。延迟和成功率没有公布数据,本文不估;日志里每行有延迟,跑几天自己看。
缓存命中一半,账单少三成,不是少一半
价格表里每个文本模型还有一栏缓存读。多轮对话里前缀相同的那段,供应商能从缓存里读,按这栏计价。除 claude-fable-5-1 是输入价的 2.5%($0.25 对 $10)外,Claude 和 OpenAI 的模型缓存读都是输入价的 10%,grok-4.6 是 25%。sonnet 共享池的缓存读是 $0.1。
算式改一项,把输入拆成两半:费用 = 输入 × (1 - 命中率) × 输入单价 + 输入 × 命中率 × 缓存读单价 + 输出 × 输出单价。假设命中率 50%,$99 变成 33 × 1 + 33 × 0.1 + 6.6 × 5 = 33 + 3.3 + 33 = $69.3。少了 30%,不是 50%,因为输出那 $33 一分没动,输入里没命中的一半也还是原价。官方线在同一命中率下是 $124.74,也是少 30%。
命中率是假设,实际能命中多少看每轮请求的前缀是不是和上一轮相同,规则以各家 API 文档为准。system 提示开头放时间戳或随机 ID,每轮前缀都变,写进缓存的那段没人读得到。
Claude 四个模型写缓存也收钱,接口里有写价,比直接输入贵 25%:sonnet 共享池写一次 $1.25,直接输入 $1,保 1 小时的那档 $2;官方线对应 $2.25 和 $3.6。写一次加读一次是 1.25 + 0.1 = $1.35,比直接发两遍的 $2 低,命中一次就回本;只有一轮的请求写完没人读,那 25% 白付。1 小时那档得命中两次才划算,短对话别开。OpenAI 和 xAI 的模型,这篇只算缓存读。
同样的用量换成 gpt-5.6-sol 是 $198,换成 claude-opus-5 是 $247.5
路由定了,账单剩下的变量是模型名。还是 6,600 万输入加 660 万输出,全走共享池。gpt-5.6-sol:66 × 2 + 6.6 × 10 = $198,正好是 sonnet 的两倍,和 sonnet 按牌价一个价。claude-opus-5:66 × 2.5 + 6.6 × 12.5 = $247.5。grok-4.6:66 × 1 + 6.6 × 3 = $85.8,比 sonnet 少的 $13.2 全在输出价上,两家共享池的输入都是 $1。
偶尔调一下的轻用量,一个月 100 万输入加 20 万输出,sonnet 共享池是 1 × 1 + 0.2 × 5 = $2,官方线 $3.6,牌价 $4。这个量级下路由怎么选都无所谓,差的是一两美元。
不算缓存读,同一个「一百万 token」从 sonnet 或 grok 共享池的输入 $1,到两个 fable 或 gpt-6-astra 牌价的输出 $50,差 50 倍。谁报价不带模型名,也不说是输入还是输出,那个数字不值得记。
自己写代码走共享池,对请求路径有要求的先发邮件开专线
两条线的差别,公开页面上写明的是价格,以及共享池可能经过中间 API 服务商。自己挂 Claude Code 写代码,或者本地批量跑自己的数据,用共享池,$99 那张账单就是这么来的。客户文档或合规材料对请求路径有要求的,先给 support@topxea.com 发邮件,把专线配好、路径问清楚,再建官方线 key,比牌价省 10%。
两种用途都有的,看差价决定要不要分两把 key。轻用量两条线一个月差 $1.6,一把官方线 key 全包省事;到了 $79.2 的差价,值得分开,对路径有要求的那部分走官方线,其余走共享池。base URL 和环境变量怎么填,在接入篇。
建 key 时能设这把 key 最多花多少美元。给 CI 或同事的 key,额度设成一个月的预算,共享池的 sonnet 就填 $99 上下,跑飞了也就亏那么多。余额提醒只有 webhook 一种,余额低于设定阈值时向填好的 URL 发一次 POST,默认阈值 $5,不发邮件。共享池一天 $4.5,$5 只剩一天的余量,调到五个工作日的量,$22.5 上下。
这篇的 300 万和 30 万都是假设。余额是预付的美元,充值不退,经核实的重复扣款除外,所以第一笔别充多。开一把共享池的 key,让自己的 agent 跑一周,用量日志里这一周的费用加总,折成一个月,账就出来了;要换模型或换路由再估,把回包 usage 里的输入和输出 token 各自加总,代进上面的算式,得到的那个数才是自己的账单。