烦恼

上周我想给手上的 agent 换个模型试试,折腾了半个晚上。

先去智谱的平台注册,再去 Kimi 那边充值,翻出 OpenAI 的 Key 想看看 GPT 5.6,发现余额只剩两美元。最后模型没换成,Key 倒多了一把。

这种事我忍很久了。

开源模型现在确实能打,GLM-5.3、Kimi K3、DeepSeek V4.1 挨个都不是吃素的,价格也不贵。烦的地方从来不在模型身上,在它们各自散在各自的平台上。注册一轮,充值一轮,管一堆 Key,想换一个就回去改配置。运气差的时候还得排查线路。

后来我订了 OpenCode Go,这个问题算是被正面回答了。

它是什么,便宜在哪

OpenCode Go 是 OpenCode 团队做的一项订阅服务,每月 10 美元。订完给你一个 API Key,用这个 Key 就能调他们筛过的一批开源编程模型。

它跟 OpenCode 这个工具本身是分开的。配在 OpenCode 里能用,配在别的 agent 里也能用,直接当个普通模型端点来调也行。

OpenCode Go 官网首页,顶部挂着 DeepSeek V4.1 Flash 限时 4 倍用量的活动

价格上,官方给的目标是让你拿到相当于 6 倍订阅费的用量。FAQ 里的原话是,用量大致相当于每 5 小时 12 美元、每周 30 美元、每月 60 美元的基础额度,具体因模型而异。

这个 6 倍不是拍脑袋来的。他们跟模型方谈批量折扣、预留 GPU 容量,把谈下来的成本用 6 倍乘数回馈给订阅者。有些模型他们还没谈下折扣,或者公开价本身就已经是折扣价了,这类给的使用额度会低一些,可能只有订阅费的 1.5 倍或者 3 倍。下面那张全表里能直接看出来。

27 个模型,每个月能跑多少

阵容现在一共 27 个。海外那边有 Grok 4.6、GPT 5.6 Luna、Muse Spark 1.3 Contributor。

国内基本把能打的都放进来了。GLM 从 5.3-Flash 到 5.1 一串,Kimi 有 K3、K2.7 Code、K2.6,DeepSeek 有 V4.1 Flash、V4 Pro、V4 Flash 和 V4 Flash Vision Exp,Qwen 从 3.8 Max 一路排到 3.6 Plus,MiniMax 有 M3 和 M2.7,另外还有 MiMo-V2.5 系列、LongCat-2.0、Hy4 preview、Hy3。

一个订阅把这些全包了,想试哪个切哪个,不用为单个模型再开一个账号。

每个月到底能跑多少次,官方给了完整一张表。我按每 5 小时的请求数从少到多整理如下。

模型

每 5 小时

每周

每月

每月使用额度

相当于订阅费

Kimi K3

110

250

490

$15

1.5 倍

Qwen3.8 Max

160

400

810

$15

1.5 倍

Grok 4.6

169

423

845

$15

1.5 倍

Qwen3.7 Max

170

420

840

$30

3 倍

GLM-5.3

220

540

1,080

$15

1.5 倍

GLM-5.2

880

2,150

4,300

$60

6 倍

GLM-5.1

880

2,150

4,300

$60

6 倍

DeepSeek V4 Pro

1,050

2,600

5,200

$15

1.5 倍

Kimi K2.6

1,150

2,880

5,750

$60

6 倍

Kimi K2.7 Code

1,350

3,380

6,750

$60

6 倍

Hy4 preview

1,350

3,380

6,770

$30

3 倍

GPT 5.6 Luna

2,050

5,100

10,250

$15

1.5 倍

MiniMax M3

3,200

8,000

16,000

$60

6 倍

MiMo-V2.5-Pro

3,250

8,150

16,300

$15

1.5 倍

Qwen3.6 Plus

3,300

8,200

16,300

$60

6 倍

MiniMax M2.7

3,400

8,500

17,000

$60

6 倍

Qwen3.7 Plus

4,300

10,800

21,600

$60

6 倍

Hy3

4,300

10,750

21,500

$60

6 倍

Qwen3.8 Flash

5,400

13,500

27,000

$30

3 倍

GLM-5.3-Flash

6,320

15,790

31,580

$60

6 倍

DeepSeek V4 Flash Vision Exp

6,500

16,250

32,500

$15

1.5 倍

DeepSeek V4.1 Flash

6,500

16,250

32,500

$15

限时 4 倍

DeepSeek V4.1 Flash(活动生效中)

26,000

65,000

130,000

$60

6 倍

LongCat-2.0

11,400

28,600

57,200

$60

6 倍

DeepSeek V4 Flash

13,000

32,500

65,000

$30

3 倍

MiMo-V2.5

30,100

75,200

150,400

$60

6 倍

Muse Spark 1.3 Contributor

45,300

113,300

226,600

$60

6 倍

Muse Spark 1.2 Contributor

45,300

113,300

226,600

$60

6 倍

OpenCode Go 官方文档里的预估请求数表

便宜的那几档数字挺唬人。MiMo-V2.5 一个月 15 万次,Muse Spark Contributor 22 万次,日常补全、改 bug 这种活根本用不完。

贵的就难看了。Kimi K3 每月只有 490 次,Grok 4.6 八百多次,GLM-5.3 一千次出头。拿这几个当主力,肯定不够。我一开始没细看这列,把 K3 配上跑了一下午,第二天发现额度见底了。

现在正好有活动

DeepSeek V4.1 Flash 在搞 4 倍用量,每 5 小时从 6,500 提到 26,000,月额度从 15 美元提到 60 美元,直接进 6 倍档。

Go 官网的模型额度表,DeepSeek V4.1 Flash 那行标着限时 4 倍

活动官方标了结束时间,9 月 20 日,也就剩这几天。想薅得抓紧。

怎么接进去

三步。官网注册账号、订阅、拿 Key。

然后填端点。OpenAI 兼容协议就填 https://opencode.ai/zen/go/v1,模型名填模型 ID,比如 deepseek-v4-flash 或者 kimi-k2.7-code。用 Anthropic 协议的换成 https://opencode.ai/zen/go/v1/messages。想核对模型名单和元数据,直接请求 https://opencode.ai/zen/go/v1/models

协议

端点

OpenAI 兼容

https://opencode.ai/zen/go/v1/chat/completions

Anthropic 兼容

https://opencode.ai/zen/go/v1/messages

OpenAI Responses

https://opencode.ai/zen/go/v1/responses

Claude Code 能接,Codex 能接,各家支持自定义 OpenAI 端点的工具都能接。一个 Key 打通,不用为每个模型单独折腾一遍。

我是怎么分配模型的

日常补全、改 bug、写脚本这类活,我用 6 倍档里最便宜的那几个,MiMo-V2.5 或者 LongCat-2.0。这个量级一个月几万到十几万次,根本用不完。

要动脑子的活,比如重构、理逻辑、写方案,切 Kimi K2.7 Code 或者 GLM-5.2。同样在 6 倍档,额度够用。

Kimi K3、GLM-5.3 这两个我只在真卡住的时候才用,原因前面说过,额度太紧。

还有个省额度的小技巧。同一段长上下文反复用的话,缓存读取价和标准输入价能差十倍以上。把稳定不变的部分(系统提示、工具定义、往前翻的对话)放在提示词靠前的位置,缓存命中率会明显高一些。

我踩过的坑,和几个得提前知道的

第一个坑是请求头。 我把 Go 接进自己的 agent 时,死活报 400,错误信息是 MissingSessionID。查了半天才明白,OpenCode Go 要求每个请求带一个 x-opencode-session 头,不带就直接拒。官方的现成客户端会自己带上,自己接的就得手动加。加完立刻就通了。

顺带说一句,有些 agent 的辅助任务链路(比如自动生成会话标题)不走主配置,读不到自定义请求头,那类任务也会报同样的 400。我最后是把自动标题关掉了,影响很小。

限流是三层叠加的。 5 小时、每周、每月三个滚动窗口同时生效,任何一层打满都会被拦。月额度还剩很多,不代表你能随便冲。

额度按美元价值算,不按请求数。 官方说得很明白,实际请求数取决于你用哪个模型。上面那张表的数字是官方预估值,实际会有出入。

打满限额后有兜底。 控制台里能打开「使用余额」开关,开了之后额度用尽会自动回退到你的 Zen 余额,请求不会被拦,跑了一半的任务也不会断。不开就是被拦,但免费模型还能接着用。

免费档和 Go 不是一回事。 免费模型包含 Big Pickle 和当时可用的促销模型,每天 200 次请求配额。Go 是在这基础上给精选阵容加更高的滚动窗口。

退款有条件。 扣款在过去 14 天内,并且这个计费周期里一次 Go 额度都没用过,才可能符合条件。用过了就别想了。取消随时可以。

一个工作空间只能有一个人订阅。 团队想一起用,买一份分着用是行不通的。

数据和隐私

官方把每个模型的训练使用和数据留存都列出来了,这点比不少平台坦荡。

OpenCode Go 官方文档的隐私保护表

大部分模型是不用于训练加零天留存。GLM 全家、Kimi 全家、DeepSeek 全家、Qwen 全家、MiniMax、MiMo、Hy3 都是这个待遇。零天留存,也就是走零数据保留协议。

有三个例外得知道。Grok 4.6 和 GPT 5.6 Luna 是零留存,但滥用监控日志保留 30 天。Muse Spark 1.2 和 1.3 Contributor 是拿你的提示词和补全结果去训练未来的 Meta 模型,换的是大幅打折的 token 价格。这两个要不要用,自己权衡。另外 DeepSeek V4 Flash 的零数据保留协议是按月续签的,当前协议有效期到 9 月 30 日。

关于邀请链接

说个实打实的东西。OpenCode 有推荐机制,你走别人的邀请链接订阅 Go,双方各得 5 美元使用额度。

下面这个是我的链接。

https://opencode.ai/go?ref=A6G4TBFW1M

走这个链接订阅,你多拿 5 美元额度,我也多拿 5 美元额度。

这 5 美元是使用额度,用来扩大你的用量上限,不能拿来抵扣订阅费。按 DeepSeek V4 Flash 这种便宜档的单价算,5 美元能多跑不少请求。白给的,不要白不要。

如果你本来就在考虑订,走链接对双方都划算,你一分钱损失没有,价格一样,就是多 5 美元可用量。要是完全没这需求,直接去 opencode.ai/go 也一样,该说的我上面都说了。

坑和例外我全写在这篇里了,没挑好听的说。值不值,你拿自己的用量对一下那张表就知道。

到底适合谁

适合的几种情况。你同时在用或者想试好几家的开源模型,又不想为每家都开账号。你希望一个 Key 接进所有编程工具。你对数据留存有要求,看重零留存这类条款。你的用量集中在便宜档位的模型上。

不太适合的也说清楚。你只用一个模型而且用量很大,那直接向模型方按量付费通常更便宜。你需要 Kimi K3、GLM-5.3 这类贵模型当主力,Go 给的额度撑不住。你在国内且对线路有硬性要求,官方说这项服务主要面向国际用户、提供的是全球访问。

写在最后

我用它的时间还不算长,具体每月能跑多少活,我自己也还在摸。有一件事倒是已经确认了,就是那个反复切工具、反复配 Key 的烦躁感没了。

需求来了直接切模型,这个手感比省下的钱更让我舒服。

订之前建议先按自己常用的那两三个模型,对着表算一遍。算下来够用再订,不够就老老实实按量付费。链接在上面,想试的自己点,有问题评论区聊。


参考来源

  • OpenCode Go 官方文档(Go 介绍、使用限制、预估请求数、API 端点、隐私保护)

  • OpenCode Go 官网首页与模型额度表(数据截至 2026-09-15,官方会调整,下单前请以官网为准)

  • OpenCode 官方 X 账号关于推荐奖励的公告

  • OpenCode Go 控制台推荐页面说明