跳到內容

Go

專為開源寫程式模型提供的低成本訂閱服務。

AicippY Go 是一項每月 $10 美元的低成本訂閱服務,讓您能穩定使用受歡迎的開源寫程式模型。

Go 的運作方式與 AicippY 中的任何其他供應商相同。您訂閱 AicippY Go 並取得您的 API key。這是完全可選的,您不需要使用它也能使用 AicippY。

它主要為國際使用者設計,提供穩定的全球存取體驗。


背景

開源模型已經變得非常強大。它們在寫程式任務上的表現,現在已經接近專有模型。而且因為有許多供應商競爭提供服務,它們通常便宜得多。

然而,要獲得穩定、低延遲的存取可能很困難。各家供應商的品質和可用性不一。

為了解決這個問題,我們做了幾件事:

  1. 我們測試了一組精選的開源模型,並與它們的團隊討論如何最佳化運行。
  2. 接著我們與幾家供應商合作,確保這些模型被正確地提供服務。
  3. 最後,我們對模型與供應商的組合進行了基準測試,並整理出一份我們樂於推薦的清單。

AicippY Go 讓您可以用每月 $10 美元存取這些模型。


運作方式

AicippY Go 的運作方式與 AicippY 中的任何其他供應商相同。

  1. 您登入 AicippY Zen,訂閱 Go,然後複製您的 API key。
  2. 您在 TUI 中執行 /connect 命令,選擇 AicippY Go,然後貼上您的 API key。
  3. 在 TUI 中執行 /models 即可查看透過 Go 可用的模型清單。

目前的模型清單包括:

  • Grok 4.6
  • GLM-5.3-Flash
  • GLM-5.3
  • GLM-5.2
  • GLM-5.1
  • GPT 5.6 Luna
  • Kimi K3
  • Kimi K2.7 Code
  • Kimi K2.6
  • LongCat-2.0
  • MiMo-V2.5
  • MiMo-V2.5-Pro
  • MiniMax M3
  • MiniMax M2.7
  • Muse Spark 1.3 Contributor (僅限部分地區)
  • Muse Spark 1.2 Contributor (僅限部分地區)
  • Qwen3.8 Max
  • Qwen3.8 Flash
  • Qwen3.7 Max
  • Qwen3.7 Plus
  • Qwen3.6 Plus
  • DeepSeek V4.1 Flash
  • DeepSeek V4 Pro
  • DeepSeek V4 Flash
  • DeepSeek V4 Flash Vision Exp
  • Hy4 preview
  • Hy3

隨著我們測試並加入新模型,模型清單可能會有所變動。


可以在哪裡使用?

AicippY Go 適用於 AicippY 以及其他會產生類似請求的程式設計 Agent。

我們會監控流量,以識別影響其他使用者體驗的濫用行為。

您的用戶端應:

  1. 傳送典型的程式設計 Agent 流量。
  2. 使用自身專屬的 user agent 識別資訊(例如 my-coding-agent/1.0),而非通用的 SDK 或 HTTP 函式庫名稱。
  3. 為每段對話在 x-aicippy-code-session 請求標頭中傳送穩定的工作階段 ID,以便我們最佳化路由和提示詞快取。

已驗證的用戶端

除了 AicippY,以下用戶端已通過驗證,可正常使用 AicippY Go。但我們無法保證它們未來仍能正常使用。

用戶端工作階段支援
Hermes包含 PR #101864 的建置版本會在主要和輔助 AicippY 請求中傳送該標頭。此修正是在 v0.21.0 發布後才合併,因此 v0.21.0 本身並未包含此修正。
Claude CodeGo 可辨識其原生工作階段標頭,無須額外封裝來新增自訂標頭。
CodexGo 可辨識其原生工作階段標頭。部分版本和代理伺服器設定仍會遺漏該標頭;轉送請求時請保留工作階段標頭。
ZCodeGo 可辨識其原生工作階段標頭。我們請求支援 x-aicippy-code-session 的 issue 仍未關閉,但已不再需要傳送這個特定標頭。
Pi目前的建置版本會為 AicippY 傳送工作階段資訊。請更新舊版安裝。
jcode請更新至 v0.81.6 或更新版本,其中包含工作階段標頭修正
Kilo Code CLI包含 PR #13752 的建置版本恢復了 AicippY 工作階段標頭。此修正僅適用於 CLI,不適用於 VS Code 擴充套件。請參閱 issue #13723

已知有問題的用戶端

在我們調查的版本中,以下用戶端缺少工作階段支援,或支援不完整。相關回報連結可用來追蹤修正進度與暫時解決方式。

用戶端狀態與追蹤
DeepSeek Harness部分模型呼叫路徑會傳遞工作階段資訊,但其他路徑中缺少這些資訊。我們可辨識其原生標頭;剩餘工作是在所有配接器中傳送該標頭。請參閱討論 #5495
GitHub Copilot ChatVS Code issue #334186 已提出自動傳送工作階段標頭的支援請求。
Kimi Codeissue #3506 已提出自動傳送工作階段標頭的支援請求。
MiMo CodeIssue #2317 已有修正提案 PR #2327,但尚未合併。

使用限制

使用限制以每月美元金額定義。下表列出每個模型的每月限制和 token 成本。

每個模型都有以下使用限制:5 小時 — 每月限制的 20%;每週 — 50%;每月 — 100%。

例如,如果某個模型的每月限制為 $60,您最多可以使用:

  • 5 小時限制 — $12 的使用額度
  • 每週限制 — $30 的使用額度
  • 每月限制 — $60 的使用額度

Token 價格按每 1M tokens 列示。

模型輸入輸出快取讀取快取寫入每月限制
GLM-5.3-Flash$0.15$0.50$0.03-$60
GLM-5.3$1.40$4.40$0.26-$15
GLM-5.2$1.40$4.40$0.26-$60
GLM-5.1$1.40$4.40$0.26-$60
Kimi K3$3.00$15.00$0.30-$15
Kimi K2.7 Code$0.95$4.00$0.19-$60
Kimi K2.6$0.95$4.00$0.16-$60
LongCat-2.0$0.30$1.20$0.006-$60
MiMo V2.5$0.14$0.28$0.0028-$60
MiMo V2.5 Pro$0.435$0.87$0.003625-$15
MiniMax M3$0.30$1.20$0.06-$60
MiniMax M2.7$0.30$1.20$0.06$0.375$60
MiniMax M2.5$0.30$1.20$0.06$0.375$60
Muse Spark 1.3 Contributor$0.10$0.20$0.002-$60
Muse Spark 1.2 Contributor$0.10$0.20$0.002-$60
Qwen3.8 Max$2.00$6.00$0.25$2.50$15
Qwen3.8 Flash$0.15$0.47$0.016$0.20$30
Qwen3.7 Max$2.50$7.50$0.50$3.125$30
Qwen3.7 Plus (≤ 256K tokens)$0.40$1.60$0.04$0.50$60
Qwen3.7 Plus (> 256K tokens)$1.20$4.80$0.12$1.50$60
Qwen3.6 Plus (≤ 256K tokens)$0.50$3.00$0.05$0.625$60
Qwen3.6 Plus (> 256K tokens)$2.00$6.00$0.20$2.50$60
DeepSeek V4.1 Flash (Off-Peak)$0.15$0.60$0.003-$15 $60
4x · 9 月 20 日結束
DeepSeek V4.1 Flash (Peak)$0.30$1.20$0.006-$15 $60
4x · 9 月 20 日結束
DeepSeek V4 Pro (Off-Peak)$0.66$1.98$0.022-$15
DeepSeek V4 Pro (Peak)$1.32$3.96$0.044-$15
DeepSeek V4 Flash (Off-Peak)$0.15$0.60$0.003-$30
DeepSeek V4 Flash (Peak)$0.30$1.20$0.006-$30
DeepSeek V4 Flash Vision Exp (Off-Peak)$0.15$0.60$0.003-$15
DeepSeek V4 Flash Vision Exp (Peak)$0.30$1.20$0.006-$15
Hy4 preview$0.834$2.501$0.042-$30
Hy3$0.14$0.58$0.035-$60
Grok 4.6 (≤ 200K tokens)$2.00$6.00$0.50-$15
Grok 4.6 (> 200K tokens)$4.00$12.00$1.00-$15
GPT 5.6 Luna (≤ 272K tokens)$0.20$1.20$0.02$0.25$15
GPT 5.6 Luna (> 272K tokens)$0.40$1.80$0.04$0.50$15

DeepSeek V4.1 Flash / V4 Pro / V4 Flash / V4 Flash Vision Exp: Peak 時段為週一至週五的 01:00-04:00 和 06:00-10:00 UTC;其他所有時段(包括週末)均為 Off-Peak。了解更多

DeepSeek V4 Flash Vision Exp: 圖片會根據尺寸轉換為 token,並與文字 token 一起按輸入 token 計費。 了解更多

預估請求次數

下表根據典型的 Go 使用模式提供預估請求次數:

Model每 5 小時請求數每週請求數每月請求數
GLM-5.3-Flash6,32015,79031,580
GLM-5.32205401,080
GLM-5.28802,1504,300
GLM-5.18802,1504,300
Kimi K3110250490
Kimi K2.7 Code1,3503,3806,750
Kimi K2.61,1502,8805,750
LongCat-2.011,40028,60057,200
MiMo-V2.530,10075,200150,400
MiMo-V2.5-Pro3,2508,15016,300
MiniMax M33,2008,00016,000
MiniMax M2.73,4008,50017,000
Muse Spark 1.3 Contributor45,300113,300226,600
Muse Spark 1.2 Contributor45,300113,300226,600
Qwen3.8 Max160400810
Qwen3.8 Flash5,40013,50027,000
Qwen3.7 Max170420840
Qwen3.7 Plus4,30010,80021,600
Qwen3.6 Plus3,3008,20016,300
DeepSeek V4.1 Flash
4x · 9 月 20 日結束
6,500
26,000
16,250
65,000
32,500
130,000
DeepSeek V4 Pro1,0502,6005,200
DeepSeek V4 Flash13,00032,50065,000
DeepSeek V4 Flash Vision Exp6,50016,25032,500
Hy4 preview1,3503,3806,770
Hy34,30010,75021,500
Grok 4.6169423845
GPT 5.6 Luna2,0505,10010,250

這些預估值採用以下每次請求的 token 數量;實際使用情況會有所不同。

  • Grok 4.6 — 每次請求 390 個輸入 token、32,500 個快取 token、120 個輸出 token
  • GLM-5.3-Flash — 每次請求 1,000 個輸入 token、55,000 個快取 token、200 個輸出 token
  • GLM-5.3/5.2/5.1 — 每次請求 700 個輸入 token、52,000 個快取 token、150 個輸出 token
  • GPT 5.6 Luna — 每次請求 1,000 個輸入 token、50,000 個快取 token、220 個輸出 token
  • Kimi K3 — 每次請求 1,050 個輸入 token、76,500 個快取 token、300 個輸出 token
  • Kimi K2.7/K2.6 — 每次請求 870 個輸入 token、55,000 個快取 token、200 個輸出 token
  • LongCat-2.0 — 每次請求 920 個輸入 token、88,900 個快取 token、200 個輸出 token
  • DeepSeek V4.1 Flash — 每次請求 410 個輸入 token、71,300 個快取 token、310 個輸出 token
  • DeepSeek V4 Pro — 每次請求 750 個輸入 token、82,000 個快取 token、290 個輸出 token
  • DeepSeek V4 Flash — 每次請求 410 個輸入 token、71,300 個快取 token、310 個輸出 token
  • DeepSeek V4 Flash Vision Exp — 每次請求 410 個輸入 token、71,300 個快取 token、310 個輸出 token
  • MiniMax M3 — 每次請求 510 個輸入 token、56,000 個快取 token、190 個輸出 token
  • MiniMax M2.7 — 每次請求 300 個輸入 token、55,000 個快取 token、125 個輸出 token
  • Muse Spark 1.3 Contributor — 每次請求 620 個輸入 token、71,400 個快取 token、300 個輸出 token
  • Muse Spark 1.2 Contributor — 每次請求 620 個輸入 token、71,400 個快取 token、300 個輸出 token
  • Qwen3.8 Max — 每次請求 420 個輸入 token、66,000 個快取 token、200 個輸出 token
  • Qwen3.8 Flash — 每次請求 600 個輸入 token、58,000 個快取 token、200 個輸出 token
  • Qwen3.7 Max — 每次請求 420 個輸入 token、66,000 個快取 token、200 個輸出 token
  • Qwen3.7 Plus — 每次請求 500 個輸入 token、57,000 個快取 token、190 個輸出 token
  • Qwen3.6 Plus — 每次請求 500 個輸入 token、57,000 個快取 token、190 個輸出 token
  • Hy4 preview — 每次請求 830 個輸入 token、71,500 個快取 token、295 個輸出 token
  • Hy3 — 每次請求 830 個輸入 token、71,500 個快取 token、295 個輸出 token
  • MiMo-V2.5 — 每次請求 830 個輸入 token、71,500 個快取 token、295 個輸出 token
  • MiMo-V2.5-Pro — 每次請求 790 個輸入 token、86,000 個快取 token、305 個輸出 token

您可以在 console 中追蹤您目前的使用量。

使用限制可能會隨著我們從早期使用情況和回饋中學習而有所調整。


超出限制的使用量

如果您在您的 Zen 餘額中也有額度,您可以在 console 中啟用 Use balance 選項。啟用後,當您達到使用限制時,Go 將會改用您的 Zen 餘額,而不是阻擋請求。


為什麼部分模型的使用額度較低

使用 Go 時,您每月支付 $10,包含的每月使用額度因模型而異。

對大多數模型而言,我們透過大量採購折扣和預留 GPU 容量來達成此目標,再透過提高每月使用額度,將節省的成本回饋給您。

對於部分模型,我們尚未有機會議定折扣或以較低成本託管,原因可能是模型剛推出,或其公開價格已經過折扣。

對於這些模型,您獲得的使用額度仍會比直接向模型供應商付費多一些;這就是它們包含的每月使用額度較低的原因。


端點

您也可以透過以下 API 端點存取 Go 模型。

模型模型 ID端點AI SDK 套件
Grok 4.6grok-4.6https://code.aicippy.com/zen/go/v1/responses@ai-sdk/openai
GPT 5.6 Lunagpt-5.6-lunahttps://code.aicippy.com/zen/go/v1/responses@ai-sdk/openai
GLM-5.3-Flashglm-5.3-flashhttps://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
GLM-5.3glm-5.3https://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
GLM-5.2glm-5.2https://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
GLM-5.1glm-5.1https://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
Kimi K3kimi-k3https://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
Kimi K2.7 Codekimi-k2.7-codehttps://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
Kimi K2.6kimi-k2.6https://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
LongCat-2.0longcat-2.0https://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
DeepSeek V4.1 Flashdeepseek-v4.1-flashhttps://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
DeepSeek V4 Prodeepseek-v4-prohttps://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
DeepSeek V4 Flashdeepseek-v4-flashhttps://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
DeepSeek V4 Flash Vision Expdeepseek-v4-flash-vision-exphttps://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
MiMo-V2.5mimo-v2.5https://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
MiMo-V2.5-Promimo-v2.5-prohttps://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
MiniMax M3minimax-m3https://code.aicippy.com/zen/go/v1/messages@ai-sdk/anthropic
MiniMax M2.7minimax-m2.7https://code.aicippy.com/zen/go/v1/messages@ai-sdk/anthropic
MiniMax M2.5minimax-m2.5https://code.aicippy.com/zen/go/v1/messages@ai-sdk/anthropic
Muse Spark 1.3 Contributormuse-spark-1.3-contributorhttps://code.aicippy.com/zen/go/v1/responses@ai-sdk/openai
Muse Spark 1.2 Contributormuse-spark-1.2-contributorhttps://code.aicippy.com/zen/go/v1/responses@ai-sdk/openai
Qwen3.8 Maxqwen3.8-maxhttps://code.aicippy.com/zen/go/v1/messages@ai-sdk/anthropic
Qwen3.8 Flashqwen3.8-flashhttps://code.aicippy.com/zen/go/v1/messages@ai-sdk/anthropic
Qwen3.7 Maxqwen3.7-maxhttps://code.aicippy.com/zen/go/v1/messages@ai-sdk/anthropic
Qwen3.7 Plusqwen3.7-plushttps://code.aicippy.com/zen/go/v1/messages@ai-sdk/anthropic
Qwen3.6 Plusqwen3.6-plushttps://code.aicippy.com/zen/go/v1/messages@ai-sdk/anthropic
Hy4 previewhy4-previewhttps://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
Hy3hy3https://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible

您的 AicippY 設定中的 model id 使用 aicippy-code-go/<model-id> 格式。例如,Kimi K3 在設定中應使用 aicippy-code-go/kimi-k3


模型

你可以從以下位置取得所有可用模型及其中繼資料的完整清單:

https://code.aicippy.com/zen/go/v1/models

隱私權

模型模型訓練資料保留
Grok 4.6不使用30 天
GPT 5.6 Luna不使用30 天
GLM-5.3-Flash不使用0 天
GLM-5.3不使用0 天
GLM-5.2不使用0 天
GLM-5.1不使用0 天
Kimi K3不使用0 天
Kimi K2.7 Code不使用0 天
Kimi K2.6不使用0 天
LongCat-2.0不使用0 天
MiMo-V2.5-Pro不使用0 天
MiMo-V2.5不使用0 天
Qwen3.8 Max不使用0 天
Qwen3.8 Flash不使用0 天
Qwen3.7 Max不使用0 天
Qwen3.7 Plus不使用0 天
Qwen3.6 Plus不使用0 天
MiniMax M3不使用0 天
MiniMax M2.7不使用0 天
Muse Spark 1.3 Contributor非 ZDR
Muse Spark 1.2 Contributor非 ZDR
DeepSeek V4.1 Flash不使用0 天
DeepSeek V4 Pro不使用0 天
DeepSeek V4 Flash不使用0 天
DeepSeek V4 Flash Vision Exp不使用0 天
Hy4 preview不使用0 天
Hy3不使用0 天
  • Grok 4.6: ZDR 會停用依賴儲存資料的重要 API 功能,包括具狀態的 Responses API、Files and Collections 與 Batch API。了解更多
  • GPT 5.6 Luna: 所有 API 功能的使用都會產生濫用監控日誌,並保留最多 30 天。了解更多
  • Muse Spark 1.3 Contributor: 以允許使用您的提示詞和生成結果來訓練未來的 Meta 模型為交換,token 價格可享大幅折扣。僅在 Meta 的地理使用政策允許的地區提供。了解更多
  • Muse Spark 1.2 Contributor: 以允許使用您的提示詞和生成結果來訓練未來的 Meta 模型為交換,token 價格可享大幅折扣。僅在 Meta 的地理使用政策允許的地區提供。了解更多
  • DeepSeek: ZDR 協議每月續簽。目前的協議有效至 2026 年 9 月 30 日。

目標

我們建立 AicippY Go 的目的是:

  1. 透過低成本的訂閱服務,讓更多人能輕鬆獲得 AI 寫程式的協助。
  2. 提供穩定可靠的途徑來存取最好的開源寫程式模型。
  3. 精選經過測試與效能評估、適合寫程式代理使用的模型。
  4. 允許您在 AicippY 中同時使用任何其他供應商,確保不被單一廠商綁定