跳转到内容

Go

低成本的开源编程模型订阅服务。

AicippY Go 是一项每月 10 美元的低成本订阅服务,让你能够稳定地访问流行的开源编程模型。

Go 的工作方式与 AicippY 中的任何其他提供商(provider)一样。订阅 AicippY Go 后你将获得 API 密钥。它是 完全可选 的,并非使用 AicippY 所必需的条件。

它主要面向国际用户,并提供稳定的全球访问。


背景

开源模型现在变得非常强大。在编程任务中,它们的性能已接近专有模型。由于许多提供商都可以提供具有竞争力的服务,它们通常要便宜得多。

然而,获得可靠、低延迟的访问可能很困难。各提供商在质量和可用性方面参差不齐。

为了解决这个问题,我们做了以下几件事:

  1. 我们测试了一组精选的开源模型,并与他们的团队探讨了如何以最佳方式运行它们。
  2. 随后我们与一些提供商合作,以确保正确提供这些服务。
  3. 最后,我们对模型和提供商的组合进行了基准测试(benchmark),得出了一份我们乐于推荐的列表。

AicippY Go 让你能够以每月 10 美元的价格访问这些模型。


工作原理

AicippY Go 的工作方式与 AicippY 中的其他提供商一样。

  1. 登录 AicippY Zen,订阅 Go,然后复制你的 API 密钥。
  2. 在 TUI 中运行 /connect 命令,选择 AicippY Go,然后粘贴你的 API 密钥。
  3. 在 TUI 中运行 /models 以查看通过 Go 可用的模型列表。

当前支持的模型列表包括:

  • Grok 4.6
  • GLM-5.3-Flash
  • GLM-5.3
  • GLM-5.2
  • GLM-5.1
  • GPT 5.6 Luna
  • Kimi K3
  • Kimi K2.7 Code
  • Kimi K2.6
  • LongCat-2.0
  • MiMo-V2.5
  • MiMo-V2.5-Pro
  • MiniMax M3
  • MiniMax M2.7
  • Muse Spark 1.3 Contributor (仅限部分地区)
  • Muse Spark 1.2 Contributor (仅限部分地区)
  • Qwen3.8 Max
  • Qwen3.8 Flash
  • Qwen3.7 Max
  • Qwen3.7 Plus
  • Qwen3.6 Plus
  • DeepSeek V4.1 Flash
  • DeepSeek V4 Pro
  • DeepSeek V4 Flash
  • DeepSeek V4 Flash Vision Exp
  • Hy4 preview
  • Hy3

随着我们进行测试和添加新模型,该列表可能会发生变化。


可以在哪里使用?

AicippY Go 适用于 AicippY 以及其他会产生类似请求的编程 Agent。

我们会监控流量,以识别影响其他用户体验的滥用行为。

你的客户端应当:

  1. 发送典型的编程 Agent 流量。
  2. 使用自身专属的 user agent 标识(例如 my-coding-agent/1.0),而不是通用的 SDK 或 HTTP 库名称。
  3. 为每段对话在 x-aicippy-code-session 请求头中发送稳定的会话 ID,以便我们优化路由和提示词缓存。

已验证的客户端

除 AicippY 外,以下客户端已通过验证,能够正常使用 AicippY Go。但我们无法保证它们未来仍能正常使用。

客户端会话支持
Hermes包含 PR #101864 的构建版本会在主要和辅助 AicippY 请求中发送该请求头。此修复在 v0.21.0 发布后才合并,因此 v0.21.0 本身并不包含该修复。
Claude CodeGo 能识别其原生会话请求头,无需额外封装来添加自定义请求头。
CodexGo 能识别其原生会话请求头。某些版本和代理配置仍会遗漏该请求头;转发请求时请保留会话请求头。
ZCodeGo 能识别其原生会话请求头。我们请求支持 x-aicippy-code-session 的 issue 仍处于开放状态,但已不再需要发送这一特定请求头。
Pi当前构建版本会为 AicippY 发送会话信息。请更新旧版安装。
jcode请更新至 v0.81.6 或更高版本,其中包含会话请求头修复
Kilo Code CLI包含 PR #13752 的构建版本恢复了 AicippY 会话请求头。此修复仅适用于 CLI,不适用于 VS Code 扩展。参见 issue #13723

已知存在问题的客户端

在我们调查的版本中,以下客户端缺少会话支持,或支持不完整。相关报告链接可用于跟踪修复进展和临时解决方案。

客户端状态与跟踪
DeepSeek Harness某些模型调用路径会传递会话信息,但其他路径中缺失。我们能识别其原生请求头;剩余工作是在所有适配器中发送该请求头。参见讨论 #5495
GitHub Copilot ChatVS Code issue #334186 已提出自动发送会话请求头的支持请求。
Kimi Codeissue #3506 已提出自动发送会话请求头的支持请求。
MiMo CodeIssue #2317 已有拟议修复 PR #2327,但尚未合并。

使用限制

使用限制以每月美元金额定义。下表列出了每个模型的每月限制和 token 成本。

每个模型都有以下使用限制:5 小时 — 每月限制的 20%;每周 — 50%;每月 — 100%。

例如,如果某个模型的每月限制为 $60,你最多可以使用:

  • 5 小时限制 — $12 的使用额度
  • 每周限制 — $30 的使用额度
  • 每月限制 — $60 的使用额度

Token 价格按每 1M tokens 列示。

模型输入输出缓存读取缓存写入每月限制
GLM-5.3-Flash$0.15$0.50$0.03-$60
GLM-5.3$1.40$4.40$0.26-$15
GLM-5.2$1.40$4.40$0.26-$60
GLM-5.1$1.40$4.40$0.26-$60
Kimi K3$3.00$15.00$0.30-$15
Kimi K2.7 Code$0.95$4.00$0.19-$60
Kimi K2.6$0.95$4.00$0.16-$60
LongCat-2.0$0.30$1.20$0.006-$60
MiMo V2.5$0.14$0.28$0.0028-$60
MiMo V2.5 Pro$0.435$0.87$0.003625-$15
MiniMax M3$0.30$1.20$0.06-$60
MiniMax M2.7$0.30$1.20$0.06$0.375$60
MiniMax M2.5$0.30$1.20$0.06$0.375$60
Muse Spark 1.3 Contributor$0.10$0.20$0.002-$60
Muse Spark 1.2 Contributor$0.10$0.20$0.002-$60
Qwen3.8 Max$2.00$6.00$0.25$2.50$15
Qwen3.8 Flash$0.15$0.47$0.016$0.20$30
Qwen3.7 Max$2.50$7.50$0.50$3.125$30
Qwen3.7 Plus (≤ 256K tokens)$0.40$1.60$0.04$0.50$60
Qwen3.7 Plus (> 256K tokens)$1.20$4.80$0.12$1.50$60
Qwen3.6 Plus (≤ 256K tokens)$0.50$3.00$0.05$0.625$60
Qwen3.6 Plus (> 256K tokens)$2.00$6.00$0.20$2.50$60
DeepSeek V4.1 Flash (Off-Peak)$0.15$0.60$0.003-$15 $60
4x · 9 月 20 日结束
DeepSeek V4.1 Flash (Peak)$0.30$1.20$0.006-$15 $60
4x · 9 月 20 日结束
DeepSeek V4 Pro (Off-Peak)$0.66$1.98$0.022-$15
DeepSeek V4 Pro (Peak)$1.32$3.96$0.044-$15
DeepSeek V4 Flash (Off-Peak)$0.15$0.60$0.003-$30
DeepSeek V4 Flash (Peak)$0.30$1.20$0.006-$30
DeepSeek V4 Flash Vision Exp (Off-Peak)$0.15$0.60$0.003-$15
DeepSeek V4 Flash Vision Exp (Peak)$0.30$1.20$0.006-$15
Hy4 preview$0.834$2.501$0.042-$30
Hy3$0.14$0.58$0.035-$60
Grok 4.6 (≤ 200K tokens)$2.00$6.00$0.50-$15
Grok 4.6 (> 200K tokens)$4.00$12.00$1.00-$15
GPT 5.6 Luna (≤ 272K tokens)$0.20$1.20$0.02$0.25$15
GPT 5.6 Luna (> 272K tokens)$0.40$1.80$0.04$0.50$15

DeepSeek V4.1 Flash / V4 Pro / V4 Flash / V4 Flash Vision Exp: Peak 时段为周一至周五的 01:00-04:00 和 06:00-10:00 UTC;其他所有时段(包括周末)均为 Off-Peak。了解更多

DeepSeek V4 Flash Vision Exp: 图片会根据尺寸转换为 token,并与文本 token 一起按输入 token 计费。 了解更多

预估请求数

下表根据典型的 Go 使用模式提供了预估请求数:

Model每 5 小时请求数每周请求数每月请求数
GLM-5.3-Flash6,32015,79031,580
GLM-5.32205401,080
GLM-5.28802,1504,300
GLM-5.18802,1504,300
Kimi K3110250490
Kimi K2.7 Code1,3503,3806,750
Kimi K2.61,1502,8805,750
LongCat-2.011,40028,60057,200
MiMo-V2.530,10075,200150,400
MiMo-V2.5-Pro3,2508,15016,300
MiniMax M33,2008,00016,000
MiniMax M2.73,4008,50017,000
Muse Spark 1.3 Contributor45,300113,300226,600
Muse Spark 1.2 Contributor45,300113,300226,600
Qwen3.8 Max160400810
Qwen3.8 Flash5,40013,50027,000
Qwen3.7 Max170420840
Qwen3.7 Plus4,30010,80021,600
Qwen3.6 Plus3,3008,20016,300
DeepSeek V4.1 Flash
4x · 9 月 20 日结束
6,500
26,000
16,250
65,000
32,500
130,000
DeepSeek V4 Pro1,0502,6005,200
DeepSeek V4 Flash13,00032,50065,000
DeepSeek V4 Flash Vision Exp6,50016,25032,500
Hy4 preview1,3503,3806,770
Hy34,30010,75021,500
Grok 4.6169423845
GPT 5.6 Luna2,0505,10010,250

预估值采用以下每次请求的 token 数量;实际使用情况会有所不同。

  • Grok 4.6 — 每次请求 390 个输入 token,32,500 个缓存 token,120 个输出 token
  • GLM-5.3-Flash — 每次请求 1,000 个输入 token,55,000 个缓存 token,200 个输出 token
  • GLM-5.3/5.2/5.1 — 每次请求 700 个输入 token,52,000 个缓存 token,150 个输出 token
  • GPT 5.6 Luna — 每次请求 1,000 个输入 token,50,000 个缓存 token,220 个输出 token
  • Kimi K3 — 每次请求 1,050 个输入 token,76,500 个缓存 token,300 个输出 token
  • Kimi K2.7/K2.6 — 每次请求 870 个输入 token,55,000 个缓存 token,200 个输出 token
  • LongCat-2.0 — 每次请求 920 个输入 token,88,900 个缓存 token,200 个输出 token
  • DeepSeek V4.1 Flash — 每次请求 410 个输入 token,71,300 个缓存 token,310 个输出 token
  • DeepSeek V4 Pro — 每次请求 750 个输入 token,82,000 个缓存 token,290 个输出 token
  • DeepSeek V4 Flash — 每次请求 410 个输入 token,71,300 个缓存 token,310 个输出 token
  • DeepSeek V4 Flash Vision Exp — 每次请求 410 个输入 token,71,300 个缓存 token,310 个输出 token
  • MiMo-V2.5 — 每次请求 830 个输入 token,71,500 个缓存 token,295 个输出 token
  • MiMo-V2.5-Pro — 每次请求 790 个输入 token,86,000 个缓存 token,305 个输出 token
  • MiniMax M3 — 每次请求 510 个输入 token,56,000 个缓存 token,190 个输出 token
  • MiniMax M2.7 — 每次请求 300 个输入 token,55,000 个缓存 token,125 个输出 token
  • Muse Spark 1.3 Contributor — 每次请求 620 个输入 token,71,400 个缓存 token,300 个输出 token
  • Muse Spark 1.2 Contributor — 每次请求 620 个输入 token,71,400 个缓存 token,300 个输出 token
  • Qwen3.8 Max — 每次请求 420 个输入 token,66,000 个缓存 token,200 个输出 token
  • Qwen3.8 Flash — 每次请求 600 个输入 token,58,000 个缓存 token,200 个输出 token
  • Qwen3.7 Max — 每次请求 420 个输入 token,66,000 个缓存 token,200 个输出 token
  • Qwen3.7 Plus — 每次请求 500 个输入 token,57,000 个缓存 token,190 个输出 token
  • Qwen3.6 Plus — 每次请求 500 个输入 token,57,000 个缓存 token,190 个输出 token
  • Hy4 preview — 每次请求 830 个输入 token,71,500 个缓存 token,295 个输出 token
  • Hy3 — 每次请求 830 个输入 token,71,500 个缓存 token,295 个输出 token

你可以在 控制台 中跟踪你当前的使用情况。

使用限制可能会随着我们从早期使用和反馈中学习而发生变化。


超出限制的使用

如果你的 Zen 余额中还有积分,可以在控制台中启用 使用余额(Use balance) 选项。启用后,当你达到使用限制时,Go 会回退使用你的 Zen 余额,而不是拦截请求。


为什么某些模型的使用额度较低

使用 Go 时,你每月支付 $10,包含的每月使用额度因模型而异。

对于大多数模型,我们通过批量折扣和预留 GPU 容量来实现这一目标。然后,我们通过提高每月使用额度,将节省的成本回馈给你。

对于某些模型,我们还没有机会协商折扣或以更低的成本托管它们,这可能是因为模型较新,或者其公开价格已经是折扣价。

对于这些模型,你获得的使用额度仍会略高于直接向模型提供商付费;这就是它们包含的每月使用额度较低的原因。


API 端点

你也可以通过以下 API 端点访问 Go 模型。

模型模型 ID端点AI SDK 包
Grok 4.6grok-4.6https://code.aicippy.com/zen/go/v1/responses@ai-sdk/openai
GPT 5.6 Lunagpt-5.6-lunahttps://code.aicippy.com/zen/go/v1/responses@ai-sdk/openai
GLM-5.3-Flashglm-5.3-flashhttps://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
GLM-5.3glm-5.3https://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
GLM-5.2glm-5.2https://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
GLM-5.1glm-5.1https://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
Kimi K3kimi-k3https://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
Kimi K2.7 Codekimi-k2.7-codehttps://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
Kimi K2.6kimi-k2.6https://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
LongCat-2.0longcat-2.0https://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
DeepSeek V4.1 Flashdeepseek-v4.1-flashhttps://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
DeepSeek V4 Prodeepseek-v4-prohttps://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
DeepSeek V4 Flashdeepseek-v4-flashhttps://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
DeepSeek V4 Flash Vision Expdeepseek-v4-flash-vision-exphttps://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
MiMo-V2.5mimo-v2.5https://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
MiMo-V2.5-Promimo-v2.5-prohttps://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
MiniMax M3minimax-m3https://code.aicippy.com/zen/go/v1/messages@ai-sdk/anthropic
MiniMax M2.7minimax-m2.7https://code.aicippy.com/zen/go/v1/messages@ai-sdk/anthropic
MiniMax M2.5minimax-m2.5https://code.aicippy.com/zen/go/v1/messages@ai-sdk/anthropic
Muse Spark 1.3 Contributormuse-spark-1.3-contributorhttps://code.aicippy.com/zen/go/v1/responses@ai-sdk/openai
Muse Spark 1.2 Contributormuse-spark-1.2-contributorhttps://code.aicippy.com/zen/go/v1/responses@ai-sdk/openai
Qwen3.8 Maxqwen3.8-maxhttps://code.aicippy.com/zen/go/v1/messages@ai-sdk/anthropic
Qwen3.8 Flashqwen3.8-flashhttps://code.aicippy.com/zen/go/v1/messages@ai-sdk/anthropic
Qwen3.7 Maxqwen3.7-maxhttps://code.aicippy.com/zen/go/v1/messages@ai-sdk/anthropic
Qwen3.7 Plusqwen3.7-plushttps://code.aicippy.com/zen/go/v1/messages@ai-sdk/anthropic
Qwen3.6 Plusqwen3.6-plushttps://code.aicippy.com/zen/go/v1/messages@ai-sdk/anthropic
Hy4 previewhy4-previewhttps://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
Hy3hy3https://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible

你的 AicippY 配置中的 模型 ID 使用 aicippy-code-go/<model-id> 格式。例如,对于 Kimi K3,你将在配置中使用 aicippy-code-go/kimi-k3


模型

你可以从以下地址获取可用模型及其元数据的完整列表:

https://code.aicippy.com/zen/go/v1/models

隐私保护

模型模型训练数据留存
Grok 4.6不使用30 天
GPT 5.6 Luna不使用30 天
GLM-5.3-Flash不使用0 天
GLM-5.3不使用0 天
GLM-5.2不使用0 天
GLM-5.1不使用0 天
Kimi K3不使用0 天
Kimi K2.7 Code不使用0 天
Kimi K2.6不使用0 天
LongCat-2.0不使用0 天
MiMo-V2.5-Pro不使用0 天
MiMo-V2.5不使用0 天
Qwen3.8 Max不使用0 天
Qwen3.8 Flash不使用0 天
Qwen3.7 Max不使用0 天
Qwen3.7 Plus不使用0 天
Qwen3.6 Plus不使用0 天
MiniMax M3不使用0 天
MiniMax M2.7不使用0 天
Muse Spark 1.3 Contributor非 ZDR
Muse Spark 1.2 Contributor非 ZDR
DeepSeek V4.1 Flash不使用0 天
DeepSeek V4 Pro不使用0 天
DeepSeek V4 Flash不使用0 天
DeepSeek V4 Flash Vision Exp不使用0 天
Hy4 preview不使用0 天
Hy3不使用0 天
  • Grok 4.6: ZDR 会禁用依赖所存储数据的重要 API 功能,包括有状态的 Responses API、Files and Collections 和 Batch API。了解更多
  • GPT 5.6 Luna: 所有 API 功能的使用都会生成滥用监控日志,并最多保留 30 天。了解更多
  • Muse Spark 1.3 Contributor: 以允许使用你的提示词和补全结果训练未来的 Meta 模型为交换,token 价格可获得大幅折扣。仅在 Meta 的地理使用政策允许的地区提供。了解更多
  • Muse Spark 1.2 Contributor: 以允许使用你的提示词和补全结果训练未来的 Meta 模型为交换,token 价格可获得大幅折扣。仅在 Meta 的地理使用政策允许的地区提供。了解更多
  • DeepSeek: ZDR 协议每月续签。当前协议有效期至 2026 年 9 月 30 日。

目标

我们创建 AicippY Go 的目的是:

  1. 通过低成本订阅让更多人能够 无门槛地 使用 AI 编程。
  2. 为最佳开源编程模型提供 可靠的 访问。
  3. 精选经过 测试和基准评估,适合编程 Agent 使用的模型。
  4. 无锁定(no lock-in),允许你与 AicippY 一起使用任何其他提供商。