博客

10 美元的 OpenCode Go 能用多少 Qwen3.8 Max?最多 810 次,标价之外要看三个数

OpenCode Go 标价 10 美元/月,Qwen3.8 Max 在套餐里只折算 15 美元额度:官方典型请求 810 次,缓存全不命中 112 次。附同样 10 美元直连(分地区)、走 router、买套餐的对照表与可改参数脚本。

Leo Kaka约 13 分钟
同样 10 美元买 Qwen3.8 Max 的四种方式对比条形图:直连阿里云新加坡价 539 次、直连北京或 Global 地区价 654 次、走 router 不超过直连、OpenCode Go 套餐 810 次(按 Go 文档的典型请求模式)

先回答标题。10 美元的 OpenCode Go,换成 Qwen3.8 Max 是每月 15 美元的折算额度——按 官方文档给出的典型请求模式(每次 420 个新输入、66,000 个缓存读、200 个输出 token;「缓存读」是上一轮已经发过、这一轮原样再发一遍的上下文,厂商按输入价的八分之一收),是 810 次请求;全花在一种 token 上,是 750 万新输入,或 250 万输出,或 6,000 万缓存读。同一个 15 美元, 如果你的请求一个缓存都不命中,只剩 112 次。标价是 $10,真正决定你能用多少的是三个数。前两个是 OpenCode 定的:5 小时 / 每周 / 每月三层滚动限额,和每个模型各自的折算额度——都写在文档里,首页只给了 每个模型 5 小时能发多少次的柱状图。第三个是你自己的:缓存命中率,任何厂商都不可能替你写在标签上。

写这篇的起因是掘金上一篇介绍 OpenCode Go 的帖子(作者神奇小汤圆, 8 月 19 日),里面提到一位读者的账单:单次请求带 15.6 万到 19 万输入 token,费用只有 0.0006 到 0.0014 美元。 那篇帖子写的是怎么接入,本文只做一件它没做的事:把套餐的额度算清楚。所有数字以官方页面为准,核对日期 2026-08-25;掘金帖里的数字一个都不直接采用。

10 美元套餐里,Qwen3.8 Max 只分到 15 美元

OpenCode 是一个开源的编程 agent,官方另卖两种模型服务:Zen 按 token 计费,Go 按月订阅。Go 的 文档把话说得很直接:

With Go, you pay $10/month and we aim to give you 6x that in usage.

6 倍,也就是每月 60 美元的用量。但这是上限,不是每个模型的数。同一份文档的价目表最后一列叫 Usage, 写的是每个模型各自每月能用的折算金额:

模型Go 内计价(新输入 / 输出 / 缓存读,USD 每百万 token)每月折算额度相对 $10 的倍数
GLM-5.2$1.40 / $4.40 / $0.26$606x
DeepSeek V4 Flash谷时 $0.22 / $0.66 / $0.007,峰时翻倍$303x
Qwen3.8 Max$2.00 / $6.00 / $0.25$151.5x
Kimi K3$3.00 / $15.00 / $0.30$151.5x
GPT 5.6 Luna$0.20 / $1.20 / $0.02(≤272K 上下文)$151.5x
OpenCode Go 官方文档价目表节选:GLM-5.2、Kimi K3、Qwen3.8 Max、DeepSeek V4 Flash 峰谷两行的输入、输出、缓存读写价与每月 Usage 额度
图 1 — Go 文档价目表节选(完整表 32 行,这里只取正文用到的 5 行)。最后一列 Usage 才是每个模型真正的月额度,从 $15 到 $60 分三档。来源:OpenCode Go 文档

文档自己解释了为什么有的模型倍数低:大多数模型靠批量折扣和预留 GPU 拿到低价,再以 6 倍的形式让出来; 有些模型太新、或公开价本来就已经打过折,没谈到折扣,「you still get a little more than if you paid the model providers directly」(比直接找厂商买略多一点)。哪个模型属于哪一种,文档没点名;Qwen3.8 Max 是 Go 列表里最新的模型之一(阿里云的模型页更新于 8 月 3 日),归第一种最合理,但这是我的推断。所以掘金帖里 那句「Qwen3.8 Max 每月折算额度只有 15 美元」是准确的,出处是官方表。Go 表里 DeepSeek 已经按峰谷双价 列了两行,那次调价的来龙去脉 zh 刊 8 月 18 日写过,这里不重复。

三条滚动限额怎么叠在一起

文档 Usage limits 一节只有三行:

  • 5 小时限额——12 美元用量
  • 每周限额——30 美元用量
  • 每月限额——60 美元用量

后面跟着一句关键的话:Limits are defined in dollar value——限额按美元算,不按次数算。所以「能发多少请求」 这个问题,官方也只能给估算。窗口是固定时段重置还是从第一次请求起滑动,文档没写。

这三个数怎么和上一节的每模型额度叠?文档没有明说,但这一节下面还有一张按模型估算请求数的表,三列对应 5 小时 / 每周 / 每月,算术藏在里面。Qwen3.8 Max 三列是 160 / 400 / 810;GLM-5.2 是 880 / 2,150 / 4,300; MiMo-V2.5 是 30,100 / 75,200 / 150,400。三组数的比例都接近 1 : 2.5 : 5——5 小时列约等于每月列除以 5, 每周列约等于每月列除以 2。对 $60 的模型,这就是 $12 / $30 / $60;对 $15 的 Qwen3.8 Max,按同样的比例反推, 5 小时窗口是 3 美元、每周是 7.5 美元。这是从表格反推的,不是文档写明的规则;大多数行验得上,请求数小的行 (Kimi K3 110 / 250 / 490)取整误差有一成,别拿它验。

叠加的结果是:能卡住你的永远是最先到顶的那一层。跑一个长任务,Qwen3.8 Max 五小时里发 160 次左右 就到顶;换 DeepSeek V4 Flash,同样五小时是 7,600 次。反过来看每周那一层:GLM-5.2 一周能用 $30, 但一个月只有 $60,连续两周满负荷之后,后半个月的额度就是零——周限额不是月限额除以四,而是除以二, 这一点对按周排任务的人比 5 小时那层更要紧。到顶之后有两种结局:默认阻断(免费模型仍可用); 或者你在控制台开了 Use balance,请求回落到 Zen 的按量余额继续扣钱。第二种结局的账单不再是 10 美元。

还有一个本文算不了的场景:混用多个模型。三层窗口写的是账户级的总额,Usage 列写的是每模型的上限, 两者在切换模型时怎么合并——共享一个 $60 月池、每模型再各有上限,还是别的算法——文档没写,我不替它猜。 下文全部按单模型满负荷算。

清单卡:标价之外要看的三个数——两条是厂商的滚动窗口与按模型折算,一条是用户自己的缓存命中率
图 2 — 前两个数在 Go 文档里,第三个数在你自己的日志里。

另外一条影响你能不能买的:文档写它「designed primarily for international users」(主要面向国际用户), 具体是付款方式还是地区限制,只有这一句,付款前自己验证。

把额度换算回 token 和请求

换算本身只有一个乘法:单次成本 = 新输入 token × 输入价 + 缓存读 token × 缓存读价 + 输出 token × 输出价; 请求数 = 月额度 ÷ 单次成本。难点从来不是公式,是你有没有一组真实的 token 配比。Go 文档给了它观测到的 典型模式,我用它的价目和它的模式,复现它的请求数表:

# Prices: USD per 1M tokens (input, output, cached read); usage: monthly USD allowance.
# Patterns: typical tokens per request (input, cached read, output), both from
# https://opencode.ai/docs/go/ as of 2026-08-25.
models = {
    "Qwen3.8 Max":        ((2.00, 6.00, 0.25),   15, (420, 66_000, 200)),
    "Kimi K3":            ((3.00, 15.00, 0.30),  15, (1_050, 76_500, 300)),
    "GLM-5.2":            ((1.40, 4.40, 0.26),   60, (700, 52_000, 150)),
    "DeepSeek V4 Flash":  ((0.22, 0.66, 0.007),  30, (410, 71_300, 310)),  # off-peak
}
for name, ((p_in, p_out, p_cache), usage, (t_in, t_cache, t_out)) in models.items():
    cost = (t_in * p_in + t_cache * p_cache + t_out * p_out) / 1e6
    print(f"{name:18} ${cost:.5f}/req  {usage / cost:8.0f} req/month")

输出:Qwen3.8 Max $0.01854 一次、809 次;Kimi K3 $0.03060、490 次;DeepSeek V4 Flash $0.00079、37,788 次; GLM-5.2 $0.01516、3,958 次。对照官方表的 810 / 490 / 37,800 / 4,300:前三个误差在 1% 以内,GLM-5.2 差了 8%。 文档给了典型模式的模型一共 22 个,我全跑了一遍(分档计价的 GPT 5.6 Luna 与 Qwen3.7 / 3.6 Plus 取低档价, DeepSeek 取谷时价):18 个在 1% 以内,GLM-5.3 / 5.2 / 5.1 三个版本都差 8%,Kimi K2.7 Code 差 26%。 官方页没解释这四行为什么不同,我也不替它猜。另一个值得记下的细节:DeepSeek V4 Flash 那行官方用的是 谷时价,按峰时价算只有 18,894 次,正好一半。对中国读者这不是脚注:峰时段换成北京时间是工作日 9 点到 12 点、14 点到 18 点,如果你的请求都发在上班时间,套餐里那 30 美元的 DeepSeek 额度按次数算 就只剩一半,而这个折半在 Go 的估算表上看不到。

这些换算的前提,是 Go 表里的价和各家官方价一致。逐家核过(都是 2026-08-25 读到的页面):

模型官方价目页新输入 / 输出 / 缓存读(USD 每百万)地区与备注与 Go 表一致
Qwen3.8 MaxAlibaba Cloud Model Studio$2 / $6 / 隐式缓存 $0.25(显式缓存创建 $2.5、读 $0.17)新加坡(International),Go 用的是这一档。同页另外五个地区——北京,以及 Scope 为 Global 的法兰克福 / 弗吉尼亚 / 东京 / 香港——都是 $1.65 / $4.951 / $0.206;北京对应 CN 站 CNY 12 / 36
DeepSeek V4 FlashDeepSeek 价目页谷时 $0.22 / $0.66 / $0.007,峰时 $0.44 / $1.32 / $0.014峰时 01:00–04:00 与 06:00–10:00 UTC,周一至周五
Kimi K3Kimi 开放平台$3 / $15 / $0.30不含税
GLM-5.2Z.ai 价目页$1.4 / $4.4 / $0.26缓存存储限时免费
阿里云 Model Studio 上 Qwen3.8-Max 新加坡地区的官方价目表:输入 2、输出 6、隐式缓存 0.25、显式缓存创建 2.5、显式缓存读 0.17 美元每百万 token
图 3 — Qwen3.8-Max 官方价目(新加坡 / International),六个地区里唯一的 $2 / $6 档;页面注明是不含限时促销的原价。来源:Alibaba Cloud Model Studio

四家全部对上。这意味着 Go 没有在价上做手脚,它卖的就是那个倍数:Qwen3.8 Max 1.5 倍、DeepSeek 3 倍、 GLM-5.2 6 倍。一个 Zen 侧的事实:Zen 的按量价目表上有 Qwen3.7 Max,没有 Qwen3.8 Max——想在 OpenCode 里按量买这个模型,目前买不到,得去官方或第三方。

缓存命中率决定你拿到的是 810 次还是 112 次

上面所有的「810 次」都建立在一个假设上:每次请求送进去的 66,420 个 token 里,66,000 个命中缓存。这是编程 agent 的常态——系统提示和代码库上下文每轮都带,只有增量是新的——但它不是你的常态,除非你量过。 把命中率当变量,其他不动:

缓存命中率单次成本(新加坡价)Go 的 $15 能发$10 直连(新加坡价)$10 直连(北京 / Global 价)
99.4%(官方模式)$0.0185809 次539 次654 次
90%$0.0294510 次340 次412 次
50%$0.0759198 次132 次160 次
0%$0.1340112 次75 次90 次

同一个额度,7 倍的差距。原因是 Qwen3.8 Max 的缓存读价只有输入价的八分之一,而这个模式里送进去的 token 99% 以上是缓存读。把缓存打掉,进项这一头从 $0.0173(420 个全价 + 66,000 个缓存价)涨到 $0.1328 (66,420 个全价),输出那 200 个 token 的 $0.0012 几乎可以忽略。

掘金帖那位读者 15.6 万 token 一次只花 $0.0014,按 DeepSeek 谷时价加几乎全命中缓存能对上: 410 × $0.22 + 156,000 × $0.007 + 300 × $0.66,除以一百万,$0.0014;同一个请求落在北京上班时段是 $0.0028。 帖里另一端的 $0.0006 按现行价算不出来——156,000 个缓存读单独一项就是 $0.0011,多半是 8 月 16 日调价前的 账单。帖里写的缓存读价「每百万 0.0028 美元」也对不上现行页,那是 Go 表里 MiMo V2.5 那一行的缓存价。 价目页会变,转述不会跟着变,这是本文每个数都回官方页核一遍的原因。命中率是 账单看不见的四处之外的第五处,区别是它不是厂商藏的,是你自己不量就不知道的。

同样 10 美元的四种买法

把前面的数放进一张表。前提写在最后一列,因为没有前提的对比表只是广告。

买法Qwen3.8 Max 每月请求数DeepSeek V4 Flash 每月请求数限额与席位前提
直连官方 API(阿里云新加坡)539 次谷时 12,596 次 / 峰时 6,298 次无窗口,用完为止;余额可跨月;多人共用一个池官方新加坡价;DeepSeek 按你的请求落在哪个时段
直连官方 API(阿里云北京或 Global 地区)654 次同上同上$1.65 / $4.951 / $0.206;北京地区按 CNY 12 / 36 结算
走 router 按量(以 OpenRouter 为例)≤539 次≤ 直连同直连,外加平台的充值手续费OpenRouter 的 FAQ 原话:no markup on inference pricing,但充值收费;比例以各平台当前页面为准;其模型页只列了阿里云国际站一个供应商
OpenCode Go 套餐810 次(折算 $15)37,800 次(折算 $30,谷时价)5 小时 / 每周 / 每月三层滚动;到顶阻断或回落按量;每 workspace 一人官方典型模式;额度「may change」

Qwen3.8 Max 上,套餐比直连多 1.5 倍(对新加坡价)或 1.24 倍(对北京价),也就是多 271 次或 156 次; DeepSeek V4 Flash 上是 3 倍——倍数是按模型谈的,不是按套餐谈的。换成日常量纲:810 次按 22 个工作日 是每天 37 次;一次请求就是 agent 的一轮工具调用,人在环里对话够用,自治循环一个下午就能碰到 5 小时那层 的 160 次。命中率打不中,四行一起缩水,倍数不变。

利益申报:我们在做跨供应商的 LLM 路由,属于第三行的形态;删掉这句,表里的数一个都不变。

如果是团队买

文档写「Only one member per workspace can subscribe to OpenCode Go」,团队就是按人头买。8 个人是 8 份、$80/月,每人各自 810 次、各自三层窗口,额度不能在成员间挪;同样 $80 直连是一个池——新加坡价 4,315 次、北京价 5,236 次,无窗口,余额跨月。总次数上套餐仍然多(8 × 810 = 6,480),但那要 8 个人都把 自己的 810 次用满;只要有两个人一个月要发 2,000 次、其余人用不到一半,套餐里那两个人卡在 810,直连的 池子还有余量。判据一句话:成员用量越不均匀,直连池化越占优;人人满负荷,套餐占优。前提同上表。

回到「值不值」,用文章里的数就能答:只用 Qwen3.8 Max 或 Kimi K3,套餐比直连多 24% 到 50%,代价是 三层窗口和一人一份;主力是 DeepSeek V4 Flash 或 GLM-5.2,3 到 6 倍,明显划算;命中率低于 50%、或者 DeepSeek 主要跑在北京上班时段,先拿上面的脚本按自己的数重算,再决定。

自己算之前的两件事

脚本改三个数就能用:你的新输入、你的缓存读、你的输出 token。改之前做两件事。

第一,核对日期和地区。本文所有价目核对于 2026-08-25;Qwen3.8 Max 六个地区两档价,DeepSeek 一天内 两个价,Go 的额度文档自己写着 may change。复核频率该由各家的调价通知条款决定, 两天前那篇把四家的条款并排放过,DeepSeek 不承诺任何通知期。

第二,先量命中率,再算次数。从现有日志的 usage 字段里把 cached token 和总输入 token 的比值算出来, 一条查询的事。没有这个数,810 和 112 之间的任何数字都可能是你的。

订阅制不是坏东西——对很多人来说,一个固定的数比一堆变量好管。只是这个固定的数是 10 美元, 而你买到的是每月 15 到 60 美元之间的一个折算额度,乘上你的命中率,再切成 5 小时和每周两层窗口。 把它算出来,比信标价那个数便宜。