# 10 美元的 OpenCode Go 能用多少 Qwen3.8 Max？最多 810 次，标价之外要看三个数

> OpenCode Go 标价 10 美元/月，Qwen3.8 Max 在套餐里只折算 15 美元额度：官方典型请求 810 次，缓存全不命中 112 次。附同样 10 美元直连（分地区）、走 router、买套餐的对照表与可改参数脚本。

- Published: 2026年8月25日
- Author: Leo Kaka, Engineering
- Tags: pricing, cost, coding-agents
- Canonical: https://pirouter.ai/zh/blog/subscription-bundle-quota-math

---
先回答标题。**10 美元的 OpenCode Go，换成 Qwen3.8 Max 是每月 15 美元的折算额度**——按
[官方文档](https://opencode.ai/docs/go/)给出的典型请求模式（每次 420 个新输入、66,000 个缓存读、200 个输出
token；「缓存读」是上一轮已经发过、这一轮原样再发一遍的上下文，厂商按输入价的八分之一收），是
**810 次请求**；全花在一种 token 上，是 750 万新输入，或 250 万输出，或 6,000 万缓存读。同一个 15 美元，
如果你的请求一个缓存都不命中，只剩 **112 次**。标价是 $10，真正决定你能用多少的是三个数。前两个是
OpenCode 定的：5 小时 / 每周 / 每月三层滚动限额，和每个模型各自的折算额度——都写在文档里，首页只给了
每个模型 5 小时能发多少次的柱状图。第三个是你自己的：缓存命中率，任何厂商都不可能替你写在标签上。

写这篇的起因是掘金上一篇[介绍 OpenCode Go 的帖子](https://juejin.cn/post/7675412802417639462)（作者神奇小汤圆，
8 月 19 日），里面提到一位读者的账单：单次请求带 15.6 万到 19 万输入 token，费用只有 0.0006 到 0.0014 美元。
那篇帖子写的是怎么接入，本文只做一件它没做的事：把套餐的额度算清楚。所有数字以官方页面为准，核对日期
2026-08-25；掘金帖里的数字一个都不直接采用。

## 10 美元套餐里，Qwen3.8 Max 只分到 15 美元

OpenCode 是一个开源的编程 agent，官方另卖两种模型服务：Zen 按 token 计费，Go 按月订阅。Go 的
[文档](https://opencode.ai/docs/go/)把话说得很直接：

> With Go, you pay $10/month and we aim to give you 6x that in usage.

6 倍，也就是每月 60 美元的用量。但这是上限，不是每个模型的数。同一份文档的价目表最后一列叫 Usage，
写的是每个模型各自每月能用的折算金额：

| 模型 | Go 内计价（新输入 / 输出 / 缓存读，USD 每百万 token） | 每月折算额度 | 相对 $10 的倍数 |
|---|---|---|---|
| GLM-5.2 | $1.40 / $4.40 / $0.26 | $60 | 6x |
| DeepSeek V4 Flash | 谷时 $0.22 / $0.66 / $0.007，峰时翻倍 | $30 | 3x |
| Qwen3.8 Max | $2.00 / $6.00 / $0.25 | $15 | 1.5x |
| Kimi K3 | $3.00 / $15.00 / $0.30 | $15 | 1.5x |
| GPT 5.6 Luna | $0.20 / $1.20 / $0.02（≤272K 上下文） | $15 | 1.5x |

![OpenCode Go 官方文档价目表节选：GLM-5.2、Kimi K3、Qwen3.8 Max、DeepSeek V4 Flash 峰谷两行的输入、输出、缓存读写价与每月 Usage 额度](/blog/images/opencode-go-price-usage-table.png "图 1 — Go 文档价目表节选（完整表 32 行，这里只取正文用到的 5 行）。最后一列 Usage 才是每个模型真正的月额度，从 $15 到 $60 分三档。来源：[OpenCode Go 文档](https://opencode.ai/docs/go/)。")

文档自己解释了为什么有的模型倍数低：大多数模型靠批量折扣和预留 GPU 拿到低价，再以 6 倍的形式让出来；
有些模型太新、或公开价本来就已经打过折，没谈到折扣，「you still get a little more than if you paid the
model providers directly」（比直接找厂商买略多一点）。哪个模型属于哪一种，文档没点名；Qwen3.8 Max 是
Go 列表里最新的模型之一（阿里云的模型页更新于 8 月 3 日），归第一种最合理，但这是我的推断。所以掘金帖里
那句「Qwen3.8 Max 每月折算额度只有 15 美元」是准确的，出处是官方表。Go 表里 DeepSeek 已经按峰谷双价
列了两行，那次调价的来龙去脉 [zh 刊 8 月 18 日写过](/zh/blog/deepseek-harness-guancha)，这里不重复。

## 三条滚动限额怎么叠在一起

文档 Usage limits 一节只有三行：

- 5 小时限额——12 美元用量
- 每周限额——30 美元用量
- 每月限额——60 美元用量

后面跟着一句关键的话：Limits are defined in dollar value——限额按美元算，不按次数算。所以「能发多少请求」
这个问题，官方也只能给估算。窗口是固定时段重置还是从第一次请求起滑动，文档没写。

这三个数怎么和上一节的每模型额度叠？文档没有明说，但这一节下面还有一张按模型估算请求数的表，三列对应
5 小时 / 每周 / 每月，算术藏在里面。Qwen3.8 Max 三列是 160 / 400 / 810；GLM-5.2 是 880 / 2,150 / 4,300；
MiMo-V2.5 是 30,100 / 75,200 / 150,400。三组数的比例都接近 **1 : 2.5 : 5**——5 小时列约等于每月列除以 5，
每周列约等于每月列除以 2。对 $60 的模型，这就是 $12 / $30 / $60；对 $15 的 Qwen3.8 Max，按同样的比例反推，
5 小时窗口是 3 美元、每周是 7.5 美元。这是从表格反推的，不是文档写明的规则；大多数行验得上，请求数小的行
（Kimi K3 110 / 250 / 490）取整误差有一成，别拿它验。

叠加的结果是：**能卡住你的永远是最先到顶的那一层**。跑一个长任务，Qwen3.8 Max 五小时里发 160 次左右
就到顶；换 DeepSeek V4 Flash，同样五小时是 7,600 次。反过来看每周那一层：GLM-5.2 一周能用 $30，
但一个月只有 $60，连续两周满负荷之后，后半个月的额度就是零——周限额不是月限额除以四，而是除以二，
这一点对按周排任务的人比 5 小时那层更要紧。到顶之后有两种结局：默认阻断（免费模型仍可用）；
或者你在控制台开了 Use balance，请求回落到 Zen 的按量余额继续扣钱。第二种结局的账单不再是 10 美元。

还有一个本文算不了的场景：混用多个模型。三层窗口写的是账户级的总额，Usage 列写的是每模型的上限，
两者在切换模型时怎么合并——共享一个 $60 月池、每模型再各有上限，还是别的算法——文档没写，我不替它猜。
**下文全部按单模型满负荷算。**

![清单卡：标价之外要看的三个数——两条是厂商的滚动窗口与按模型折算，一条是用户自己的缓存命中率](/blog/images/subscription-bundle-quota-math-three-constraints.png "图 2 — 前两个数在 Go 文档里，第三个数在你自己的日志里。")

另外一条影响你能不能买的：文档写它「designed primarily for international users」（主要面向国际用户），
具体是付款方式还是地区限制，只有这一句，付款前自己验证。

## 把额度换算回 token 和请求

换算本身只有一个乘法：单次成本 = 新输入 token × 输入价 + 缓存读 token × 缓存读价 + 输出 token × 输出价；
请求数 = 月额度 ÷ 单次成本。难点从来不是公式，是你有没有一组真实的 token 配比。Go 文档给了它观测到的
典型模式，我用它的价目和它的模式，复现它的请求数表：

```python
# Prices: USD per 1M tokens (input, output, cached read); usage: monthly USD allowance.
# Patterns: typical tokens per request (input, cached read, output), both from
# https://opencode.ai/docs/go/ as of 2026-08-25.
models = {
    "Qwen3.8 Max":        ((2.00, 6.00, 0.25),   15, (420, 66_000, 200)),
    "Kimi K3":            ((3.00, 15.00, 0.30),  15, (1_050, 76_500, 300)),
    "GLM-5.2":            ((1.40, 4.40, 0.26),   60, (700, 52_000, 150)),
    "DeepSeek V4 Flash":  ((0.22, 0.66, 0.007),  30, (410, 71_300, 310)),  # off-peak
}
for name, ((p_in, p_out, p_cache), usage, (t_in, t_cache, t_out)) in models.items():
    cost = (t_in * p_in + t_cache * p_cache + t_out * p_out) / 1e6
    print(f"{name:18} ${cost:.5f}/req  {usage / cost:8.0f} req/month")
```

输出：Qwen3.8 Max $0.01854 一次、809 次；Kimi K3 $0.03060、490 次；DeepSeek V4 Flash $0.00079、37,788 次；
GLM-5.2 $0.01516、3,958 次。对照官方表的 810 / 490 / 37,800 / 4,300：前三个误差在 1% 以内，GLM-5.2 差了 8%。
文档给了典型模式的模型一共 22 个，我全跑了一遍（分档计价的 GPT 5.6 Luna 与 Qwen3.7 / 3.6 Plus 取低档价，
DeepSeek 取谷时价）：18 个在 1% 以内，GLM-5.3 / 5.2 / 5.1 三个版本都差 8%，Kimi K2.7 Code 差 26%。
官方页没解释这四行为什么不同，我也不替它猜。另一个值得记下的细节：DeepSeek V4 Flash 那行官方用的是
谷时价，按峰时价算只有 18,894 次，正好一半。对中国读者这不是脚注：峰时段换成北京时间是工作日
9 点到 12 点、14 点到 18 点，如果你的请求都发在上班时间，套餐里那 30 美元的 DeepSeek 额度按次数算
就只剩一半，而这个折半在 Go 的估算表上看不到。

这些换算的前提，是 Go 表里的价和各家官方价一致。逐家核过（都是 2026-08-25 读到的页面）：

| 模型 | 官方价目页 | 新输入 / 输出 / 缓存读（USD 每百万） | 地区与备注 | 与 Go 表一致 |
|---|---|---|---|---|
| Qwen3.8 Max | [Alibaba Cloud Model Studio](https://www.alibabacloud.com/help/en/model-studio/qwen3-8-max) | $2 / $6 / 隐式缓存 $0.25（显式缓存创建 $2.5、读 $0.17） | 新加坡（International），Go 用的是这一档。同页另外五个地区——北京，以及 Scope 为 Global 的法兰克福 / 弗吉尼亚 / 东京 / 香港——都是 $1.65 / $4.951 / $0.206；北京对应 CN 站 [CNY 12 / 36](https://help.aliyun.com/en/model-studio/model-pricing) | ✓ |
| DeepSeek V4 Flash | [DeepSeek 价目页](https://api-docs.deepseek.com/quick_start/pricing) | 谷时 $0.22 / $0.66 / $0.007，峰时 $0.44 / $1.32 / $0.014 | 峰时 01:00–04:00 与 06:00–10:00 UTC，周一至周五 | ✓ |
| Kimi K3 | [Kimi 开放平台](https://platform.kimi.ai/docs/pricing/chat-k3) | $3 / $15 / $0.30 | 不含税 | ✓ |
| GLM-5.2 | [Z.ai 价目页](https://docs.z.ai/guides/overview/pricing) | $1.4 / $4.4 / $0.26 | 缓存存储限时免费 | ✓ |

![阿里云 Model Studio 上 Qwen3.8-Max 新加坡地区的官方价目表：输入 2、输出 6、隐式缓存 0.25、显式缓存创建 2.5、显式缓存读 0.17 美元每百万 token](/blog/images/qwen38max-pricing-singapore.png "图 3 — Qwen3.8-Max 官方价目（新加坡 / International），六个地区里唯一的 $2 / $6 档；页面注明是不含限时促销的原价。来源：[Alibaba Cloud Model Studio](https://www.alibabacloud.com/help/en/model-studio/qwen3-8-max)。")

四家全部对上。这意味着 Go 没有在价上做手脚，它卖的就是那个倍数：Qwen3.8 Max 1.5 倍、DeepSeek 3 倍、
GLM-5.2 6 倍。一个 Zen 侧的事实：Zen 的按量价目表上有 Qwen3.7 Max，没有 Qwen3.8 Max——想在 OpenCode
里按量买这个模型，目前买不到，得去官方或第三方。

## 缓存命中率决定你拿到的是 810 次还是 112 次

上面所有的「810 次」都建立在一个假设上：每次请求送进去的 66,420 个 token 里，66,000 个命中缓存。这是编程
agent 的常态——系统提示和代码库上下文每轮都带，只有增量是新的——但它不是你的常态，除非你量过。
把命中率当变量，其他不动：

| 缓存命中率 | 单次成本（新加坡价） | Go 的 $15 能发 | $10 直连（新加坡价） | $10 直连（北京 / Global 价） |
|---|---|---|---|---|
| 99.4%（官方模式） | $0.0185 | 809 次 | 539 次 | 654 次 |
| 90% | $0.0294 | 510 次 | 340 次 | 412 次 |
| 50% | $0.0759 | 198 次 | 132 次 | 160 次 |
| 0% | $0.1340 | 112 次 | 75 次 | 90 次 |

同一个额度，7 倍的差距。原因是 Qwen3.8 Max 的缓存读价只有输入价的八分之一，而这个模式里送进去的 token
99% 以上是缓存读。把缓存打掉，进项这一头从 $0.0173（420 个全价 + 66,000 个缓存价）涨到 $0.1328
（66,420 个全价），输出那 200 个 token 的 $0.0012 几乎可以忽略。

掘金帖那位读者 15.6 万 token 一次只花 $0.0014，按 DeepSeek 谷时价加几乎全命中缓存能对上：
410 × $0.22 + 156,000 × $0.007 + 300 × $0.66，除以一百万，$0.0014；同一个请求落在北京上班时段是 $0.0028。
帖里另一端的 $0.0006 按现行价算不出来——156,000 个缓存读单独一项就是 $0.0011，多半是 8 月 16 日调价前的
账单。帖里写的缓存读价「每百万 0.0028 美元」也对不上现行页，那是 Go 表里 MiMo V2.5 那一行的缓存价。
价目页会变，转述不会跟着变，这是本文每个数都回官方页核一遍的原因。命中率是
[账单看不见的四处](/zh/blog/invisible-llm-bill)之外的第五处，区别是它不是厂商藏的，是你自己不量就不知道的。

## 同样 10 美元的四种买法

把前面的数放进一张表。前提写在最后一列，因为没有前提的对比表只是广告。

| 买法 | Qwen3.8 Max 每月请求数 | DeepSeek V4 Flash 每月请求数 | 限额与席位 | 前提 |
|---|---|---|---|---|
| 直连官方 API（阿里云新加坡） | 539 次 | 谷时 12,596 次 / 峰时 6,298 次 | 无窗口，用完为止；余额可跨月；多人共用一个池 | 官方新加坡价；DeepSeek 按你的请求落在哪个时段 |
| 直连官方 API（阿里云北京或 Global 地区） | 654 次 | 同上 | 同上 | $1.65 / $4.951 / $0.206；北京地区按 CNY 12 / 36 结算 |
| 走 router 按量（以 OpenRouter 为例） | ≤539 次 | ≤ 直连 | 同直连，外加平台的充值手续费 | [OpenRouter 的 FAQ 原话](https://openrouter.ai/docs/faq)：no markup on inference pricing，但充值收费；比例以各平台当前页面为准；其模型页只列了阿里云国际站一个供应商 |
| OpenCode Go 套餐 | 810 次（折算 $15） | 37,800 次（折算 $30，谷时价） | 5 小时 / 每周 / 每月三层滚动；到顶阻断或回落按量；每 workspace 一人 | 官方典型模式；额度「may change」 |

Qwen3.8 Max 上，套餐比直连多 1.5 倍（对新加坡价）或 1.24 倍（对北京价），也就是多 271 次或 156 次；
DeepSeek V4 Flash 上是 3 倍——倍数是按模型谈的，不是按套餐谈的。换成日常量纲：810 次按 22 个工作日
是每天 37 次；一次请求就是 agent 的一轮工具调用，人在环里对话够用，自治循环一个下午就能碰到 5 小时那层
的 160 次。命中率打不中，四行一起缩水，倍数不变。

利益申报：我们在做跨供应商的 LLM 路由，属于第三行的形态；删掉这句，表里的数一个都不变。

### 如果是团队买

文档写「Only one member per workspace can subscribe to OpenCode Go」，团队就是按人头买。8 个人是
8 份、$80/月，每人各自 810 次、各自三层窗口，额度不能在成员间挪；同样 $80 直连是一个池——新加坡价
4,315 次、北京价 5,236 次，无窗口，余额跨月。总次数上套餐仍然多（8 × 810 = 6,480），但那要 8 个人都把
自己的 810 次用满；只要有两个人一个月要发 2,000 次、其余人用不到一半，套餐里那两个人卡在 810，直连的
池子还有余量。判据一句话：成员用量越不均匀，直连池化越占优；人人满负荷，套餐占优。前提同上表。

回到「值不值」，用文章里的数就能答：只用 Qwen3.8 Max 或 Kimi K3，套餐比直连多 24% 到 50%，代价是
三层窗口和一人一份；主力是 DeepSeek V4 Flash 或 GLM-5.2，3 到 6 倍，明显划算；命中率低于 50%、或者
DeepSeek 主要跑在北京上班时段，先拿上面的脚本按自己的数重算，再决定。

## 自己算之前的两件事

脚本改三个数就能用：你的新输入、你的缓存读、你的输出 token。改之前做两件事。

第一，**核对日期和地区**。本文所有价目核对于 2026-08-25；Qwen3.8 Max 六个地区两档价，DeepSeek 一天内
两个价，Go 的额度文档自己写着 may change。复核频率该由各家的调价通知条款决定，
[两天前那篇](/zh/blog/price-notice-is-a-contract-clause)把四家的条款并排放过，DeepSeek 不承诺任何通知期。

第二，**先量命中率，再算次数**。从现有日志的 usage 字段里把 cached token 和总输入 token 的比值算出来，
一条查询的事。没有这个数，810 和 112 之间的任何数字都可能是你的。

订阅制不是坏东西——对很多人来说，一个固定的数比一堆变量好管。只是这个固定的数是 10 美元，
而你买到的是每月 15 到 60 美元之间的一个折算额度，乘上你的命中率，再切成 5 小时和每周两层窗口。
把它算出来，比信标价那个数便宜。

---

## Sources

### opencode.ai

- [官方文档](https://opencode.ai/docs/go/)

### juejin.cn

- [介绍 OpenCode Go 的帖子](https://juejin.cn/post/7675412802417639462)

### alibabacloud.com

- [Alibaba Cloud Model Studio](https://www.alibabacloud.com/help/en/model-studio/qwen3-8-max)

### help.aliyun.com

- [CNY 12 / 36](https://help.aliyun.com/en/model-studio/model-pricing)

### api-docs.deepseek.com

- [DeepSeek 价目页](https://api-docs.deepseek.com/quick_start/pricing)

### platform.kimi.ai

- [Kimi 开放平台](https://platform.kimi.ai/docs/pricing/chat-k3)

### docs.z.ai

- [Z.ai 价目页](https://docs.z.ai/guides/overview/pricing)

### openrouter.ai

- [OpenRouter 的 FAQ 原话](https://openrouter.ai/docs/faq)
