跳转到内容

Go

低成本的开源编程模型订阅服务。

OpenCode Go 是一项低成本的订阅服务 —— 首月 5 美元,之后 每月 10 美元 —— 让你能够稳定地访问流行的开源编程模型。

Go 的工作方式与 OpenCode 中的任何其他提供商(provider)一样。订阅 OpenCode Go 后你将获得 API 密钥。它是 完全可选 的,并非使用 OpenCode 所必需的条件。

它主要面向国际用户,并提供稳定的全球访问。


背景

开源模型现在变得非常强大。在编程任务中,它们的性能已接近专有模型。由于许多提供商都可以提供具有竞争力的服务,它们通常要便宜得多。

然而,获得可靠、低延迟的访问可能很困难。各提供商在质量和可用性方面参差不齐。

为了解决这个问题,我们做了以下几件事:

  1. 我们测试了一组精选的开源模型,并与他们的团队探讨了如何以最佳方式运行它们。
  2. 随后我们与一些提供商合作,以确保正确提供这些服务。
  3. 最后,我们对模型和提供商的组合进行了基准测试(benchmark),得出了一份我们乐于推荐的列表。

OpenCode Go 让你能够访问这些模型,首月只需 5 美元,之后 每月 10 美元


工作原理

OpenCode Go 的工作方式与 OpenCode 中的其他提供商一样。

  1. 登录 OpenCode Zen,订阅 Go,然后复制你的 API 密钥。
  2. 在 TUI 中运行 /connect 命令,选择 OpenCode Go,然后粘贴你的 API 密钥。
  3. 在 TUI 中运行 /models 以查看通过 Go 可用的模型列表。

当前支持的模型列表包括:

  • Grok 4.5
  • GLM-5.2
  • GLM-5.1
  • GPT 5.6 Luna
  • Kimi K3
  • Kimi K2.7 Code
  • Kimi K2.6
  • MiMo-V2.5
  • MiMo-V2.5-Pro
  • MiniMax M3
  • MiniMax M2.7
  • Qwen3.8 Max
  • Qwen3.7 Max
  • Qwen3.7 Plus
  • Qwen3.6 Plus
  • DeepSeek V4 Pro
  • DeepSeek V4 Flash
  • Hy3

随着我们进行测试和添加新模型,该列表可能会发生变化。


使用限制

OpenCode Go 包含以下限制:

  • 5 小时限制 — 12 美元使用额度
  • 每周限制 — 30 美元使用额度
  • 每月限制 — 60 美元使用额度

限制以美元价值定义。这意味着你的实际请求数取决于你所使用的模型。较便宜的模型(如 DeepSeek V4 Flash)允许更多请求,而较高成本的模型(如 GLM-5.2)允许较少请求。

下表提供了基于典型 Go 使用模式的预估请求数:

Model每 5 小时请求数每周请求数每月请求数
Grok 4.5120300600
GPT 5.6 Luna2,0505,10010,250
GLM-5.28802,1504,300
GLM-5.18802,1504,300
Kimi K3110250490
Kimi K2.7 Code1,3503,3806,750
Kimi K2.61,1502,8805,750
MiMo-V2.530,10075,200150,400
MiMo-V2.5-Pro3,2508,15016,300
MiniMax M33,2008,00016,000
MiniMax M2.73,4008,50017,000
Qwen3.8 Max160400810
Qwen3.7 Max3408401,690
Qwen3.7 Plus4,30010,80021,600
Qwen3.6 Plus3,3008,20016,300
DeepSeek V4 Pro3,4508,55017,150
DeepSeek V4 Flash31,65079,050158,150
Hy34,30010,75021,500

预估值基于观察到的请求模式:

  • Grok 4.5 — 每次请求 1,100 个输入 token,71,500 个缓存 token,220 个输出 token
  • GLM-5.2/5.1 — 每次请求 700 个输入 token,52,000 个缓存 token,150 个输出 token
  • GPT 5.6 Luna — 每次请求 1,000 个输入 token,50,000 个缓存 token,220 个输出 token
  • Kimi K3 — 每次请求 1,050 个输入 token,76,500 个缓存 token,300 个输出 token
  • Kimi K2.7/K2.6 — 每次请求 870 个输入 token,55,000 个缓存 token,200 个输出 token
  • DeepSeek V4 Pro — 每次请求 750 个输入 token,82,000 个缓存 token,290 个输出 token
  • DeepSeek V4 Flash — 每次请求 790 个输入 token,68,000 个缓存 token,280 个输出 token
  • MiMo-V2.5 — 每次请求 830 个输入 token,71,500 个缓存 token,295 个输出 token
  • MiMo-V2.5-Pro — 每次请求 790 个输入 token,86,000 个缓存 token,305 个输出 token
  • MiniMax M3 — 每次请求 510 个输入 token,56,000 个缓存 token,190 个输出 token
  • MiniMax M2.7 — 每次请求 300 个输入 token,55,000 个缓存 token,125 个输出 token
  • Qwen3.8 Max — 每次请求 420 个输入 token,66,000 个缓存 token,200 个输出 token
  • Qwen3.7 Max — 每次请求 420 个输入 token,66,000 个缓存 token,200 个输出 token
  • Qwen3.7 Plus — 每次请求 500 个输入 token,57,000 个缓存 token,190 个输出 token
  • Qwen3.6 Plus — 每次请求 500 个输入 token,57,000 个缓存 token,190 个输出 token
  • Hy3 — 每次请求 830 个输入 token,71,500 个缓存 token,295 个输出 token

预估值还基于以下每 1M tokens 的价格以及每个模型包含的每月使用额度:

模型输入输出缓存读取缓存写入使用额度
Grok 4.5$2.00$6.00$0.30-$15
GPT 5.6 Luna (≤ 272K tokens)$0.20$1.20$0.02$0.25$15
GPT 5.6 Luna (> 272K tokens)$0.40$1.80$0.04$0.50$15
GLM-5.2$1.40$4.40$0.26-$60
GLM-5.1$1.40$4.40$0.26-$60
Kimi K3$3.00$15.00$0.30-$15
Kimi K2.7 Code$0.95$4.00$0.19-$60
Kimi K2.6$0.95$4.00$0.16-$60
MiMo V2.5$0.14$0.28$0.0028-$60
MiMo V2.5 Pro$0.435$0.87$0.003625-$15
MiniMax M3$0.30$1.20$0.06-$60
MiniMax M2.7$0.30$1.20$0.06$0.375$60
MiniMax M2.5$0.30$1.20$0.06$0.375$60
Qwen3.8 Max$2.00$6.00$0.25$2.50$15
Qwen3.7 Max$2.50$7.50$0.50$3.125$60
Qwen3.7 Plus (≤ 256K tokens)$0.40$1.60$0.04$0.50$60
Qwen3.7 Plus (> 256K tokens)$1.20$4.80$0.12$1.50$60
Qwen3.6 Plus (≤ 256K tokens)$0.50$3.00$0.05$0.625$60
Qwen3.6 Plus (> 256K tokens)$2.00$6.00$0.20$2.50$60
DeepSeek V4 Pro$0.435$0.87$0.003625-$15
DeepSeek V4 Flash$0.14$0.28$0.0028-$60
Hy3$0.14$0.58$0.035-$60

你可以在 控制台 中跟踪你当前的使用情况。

使用限制可能会随着我们从早期使用和反馈中学习而发生变化。


超出限制的使用

如果你的 Zen 余额中还有积分,可以在控制台中启用 使用余额(Use balance) 选项。启用后,当你达到使用限制时,Go 会回退使用你的 Zen 余额,而不是拦截请求。


为什么某些模型的使用额度较低

使用 Go 时,你每月支付 $10,而我们的目标是为你提供 6 倍于此的使用额度。

对于大多数模型,我们通过批量折扣和预留 GPU 容量来实现这一目标。然后,我们通过 6 倍乘数将这些节省的成本回馈给你。

对于某些模型,我们还没有机会协商折扣或以更低的成本托管它们,这可能是因为模型较新,或者其公开价格已经是折扣价。

对于这些模型,你获得的使用额度仍会略高于直接向模型提供商付费;这就是它们在上表中的使用额度乘数较低的原因。


API 端点

你也可以通过以下 API 端点访问 Go 模型。

模型模型 ID端点AI SDK 包
Grok 4.5grok-4.5https://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
GPT 5.6 Lunagpt-5.6-lunahttps://opencode.ai/zen/go/v1/responses@ai-sdk/openai
GLM-5.2glm-5.2https://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
GLM-5.1glm-5.1https://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
Kimi K3kimi-k3https://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
Kimi K2.7 Codekimi-k2.7-codehttps://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
Kimi K2.6kimi-k2.6https://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
DeepSeek V4 Prodeepseek-v4-prohttps://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
DeepSeek V4 Flashdeepseek-v4-flashhttps://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
MiMo-V2.5mimo-v2.5https://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
MiMo-V2.5-Promimo-v2.5-prohttps://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
MiniMax M3minimax-m3https://opencode.ai/zen/go/v1/messages@ai-sdk/anthropic
MiniMax M2.7minimax-m2.7https://opencode.ai/zen/go/v1/messages@ai-sdk/anthropic
MiniMax M2.5minimax-m2.5https://opencode.ai/zen/go/v1/messages@ai-sdk/anthropic
Qwen3.8 Maxqwen3.8-maxhttps://opencode.ai/zen/go/v1/messages@ai-sdk/anthropic
Qwen3.7 Maxqwen3.7-maxhttps://opencode.ai/zen/go/v1/messages@ai-sdk/anthropic
Qwen3.7 Plusqwen3.7-plushttps://opencode.ai/zen/go/v1/messages@ai-sdk/anthropic
Qwen3.6 Plusqwen3.6-plushttps://opencode.ai/zen/go/v1/messages@ai-sdk/anthropic
Hy3hy3https://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible

你的 OpenCode 配置中的 模型 ID 使用 opencode-go/<model-id> 格式。例如,对于 Kimi K3,你将在配置中使用 opencode-go/kimi-k3


模型

你可以从以下地址获取可用模型及其元数据的完整列表:

https://opencode.ai/zen/go/v1/models

隐私保护

模型模型训练数据留存
Grok 4.5不使用30 天
GPT 5.6 Luna不使用30 天
GLM-5.2不使用0 天
GLM-5.1不使用0 天
Kimi K3不使用0 天
Kimi K2.7 Code不使用0 天
Kimi K2.6不使用0 天
MiMo-V2.5-Pro不使用0 天
MiMo-V2.5不使用0 天
Qwen3.8 Max不使用0 天
Qwen3.7 Max不使用0 天
Qwen3.7 Plus不使用0 天
Qwen3.6 Plus不使用0 天
MiniMax M3不使用0 天
MiniMax M2.7不使用0 天
DeepSeek V4 Pro不使用0 天
DeepSeek V4 Flash不使用0 天
Hy3不使用0 天
  • Grok 4.5: ZDR 会禁用依赖所存储数据的重要 API 功能,包括有状态的 Responses API、Files and Collections 和 Batch API。了解更多
  • GPT 5.6 Luna: 所有 API 功能的使用都会生成滥用监控日志,并最多保留 30 天。了解更多
  • DeepSeek V4 Flash: ZDR 协议每月续签。当前协议有效期至 2026 年 8 月 31 日。

目标

我们创建 OpenCode Go 的目的是:

  1. 通过低成本订阅让更多人能够 无门槛地 使用 AI 编程。
  2. 为最佳开源编程模型提供 可靠的 访问。
  3. 精选经过 测试和基准评估,适合编程 Agent 使用的模型。
  4. 无锁定(no lock-in),允许你与 OpenCode 一起使用任何其他提供商。