Salta ai contenuti

Go

Abbonamento a basso costo per modelli di programmazione aperti.

AicippY Go è un abbonamento a basso costo da 10 $/mese che ti offre un accesso affidabile ai popolari modelli di programmazione aperti.

Go funziona come qualsiasi altro provider in AicippY. Ti abboni a AicippY Go e ottieni la tua chiave API. È completamente facoltativo e non hai bisogno di usarlo per utilizzare AicippY.

È progettato principalmente per gli utenti internazionali e garantisce un accesso globale stabile.


Contesto

I modelli aperti sono diventati davvero validi. Ora raggiungono prestazioni vicine a quelle dei modelli proprietari per le attività di programmazione. E poiché molti provider possono fornirli in modo competitivo, di solito sono molto più economici.

Tuttavia, ottenere un accesso affidabile e a bassa latenza può essere difficile. I provider variano per qualità e disponibilità.

Per risolvere questo problema, abbiamo fatto un paio di cose:

  1. Abbiamo testato un gruppo selezionato di modelli aperti e parlato con i loro team su come eseguirli al meglio.
  2. Abbiamo quindi collaborato con alcuni provider per assicurarci che venissero forniti correttamente.
  3. Infine, abbiamo eseguito dei benchmark sulla combinazione modello/provider e abbiamo stilato un elenco che ci sentiamo di raccomandare.

AicippY Go ti dà accesso a questi modelli a 10 $/mese.


Come funziona

AicippY Go funziona come qualsiasi altro provider in AicippY.

  1. Accedi a AicippY Zen, ti abboni a Go e copi la tua chiave API.
  2. Esegui il comando /connect nella TUI, selezioni AicippY Go e incolli la tua chiave API.
  3. Esegui /models nella TUI per vedere l’elenco dei modelli disponibili tramite Go.

L’elenco attuale dei modelli include:

  • Grok 4.6
  • GLM-5.3-Flash
  • GLM-5.3
  • GLM-5.2
  • GLM-5.1
  • GPT 5.6 Luna
  • Kimi K3
  • Kimi K2.7 Code
  • Kimi K2.6
  • LongCat-2.0
  • MiMo-V2.5
  • MiMo-V2.5-Pro
  • MiniMax M3
  • MiniMax M2.7
  • Muse Spark 1.3 Contributor (regioni limitate)
  • Muse Spark 1.2 Contributor (regioni limitate)
  • Qwen3.8 Max
  • Qwen3.8 Flash
  • Qwen3.7 Max
  • Qwen3.7 Plus
  • Qwen3.6 Plus
  • DeepSeek V4.1 Flash
  • DeepSeek V4 Pro
  • DeepSeek V4 Flash
  • DeepSeek V4 Flash Vision Exp
  • Hy4 preview
  • Hy3

L’elenco dei modelli potrebbe cambiare man mano che ne testiamo e aggiungiamo di nuovi.


Dove posso usarlo?

AicippY Go è progettato per AicippY e altri agenti di programmazione che producono tipi di richieste simili. Il traffico viene monitorato per rilevare gli abusi che compromettono l’esperienza degli altri utenti.

Il tuo client deve:

  1. Inviare il traffico tipico di un agente di programmazione
  2. Identificarsi con un proprio user agent, ad esempio my-coding-agent/1.0, anziché con il nome generico di un SDK o di una libreria HTTP.
  3. Inviare un ID di sessione stabile in x-aicippy-code-session per ogni conversazione, in modo da consentirci di ottimizzare il routing e il caching dei prompt.

Client convalidati

Oltre a AicippY, è stato verificato che i seguenti client funzionino correttamente con AicippY Go. Tuttavia, non garantiamo che continueranno a funzionare in futuro.

ClientSupporto delle sessioni
HermesLe build contenenti la PR #101864 inviano l’header nelle richieste AicippY principali e ausiliarie. La correzione è stata unita dopo la v0.21.0; quella versione da sola non la include.
Claude CodeGo riconosce il suo header di sessione nativo. Non è necessario alcun wrapper per header personalizzati.
CodexGo riconosce il suo header di sessione nativo. Alcune versioni e configurazioni proxy continuano a ometterlo; mantieni l’header di sessione quando inoltri le richieste.
ZCodeGo riconosce il suo header di sessione nativo. La nostra richiesta per x-aicippy-code-session è ancora aperta, ma non è più necessario inviare proprio quell’header.
PiLe build attuali inviano le informazioni di sessione per AicippY. Aggiorna le installazioni meno recenti.
jcodeAggiorna alla versione v0.81.6 o successiva, che include la correzione dell’header di sessione.
Kilo Code CLILe build contenenti la PR #13752 ripristinano gli header di sessione AicippY. Questa correzione riguarda la CLI, non l’estensione VS Code. Consulta l’issue #13723.

Client con problemi noti

Nelle versioni che abbiamo esaminato, questi client non supportano le sessioni o le supportano solo parzialmente. Le segnalazioni collegate consentono di seguire le correzioni e le soluzioni alternative.

ClientStato e segnalazioni
DeepSeek HarnessLe informazioni di sessione arrivano tramite alcuni percorsi dei modelli, ma mancano in altri. Riconosciamo il suo header nativo; resta da inviarlo attraverso tutti gli adapter. Discussione #5495.
GitHub Copilot ChatIl supporto automatico dell’header di sessione è stato richiesto nell’issue #334186 di VS Code.
Kimi CodeIl supporto automatico dell’header di sessione è stato richiesto nell’issue #3506.
MiMo CodeL’issue #2317 ha una correzione proposta nella PR #2327, che non è stata ancora unita.

Limiti di utilizzo

I limiti di utilizzo sono definiti come importi mensili in dollari. La tabella seguente mostra il limite mensile e i prezzi dei token per ciascun modello.

Ogni modello ha i seguenti limiti di utilizzo: 5 ore — 20% del limite mensile; settimanale — 50%; mensile — 100%.

Ad esempio, se un modello ha un limite mensile di $60, puoi utilizzare fino a:

  • Limite di 5 ore — $12 di utilizzo
  • Limite settimanale — $30 di utilizzo
  • Limite mensile — $60 di utilizzo

I prezzi dei token sono indicati per 1M token.

ModelloInputOutputCached ReadCached WriteLimite mensile
GLM-5.3-Flash$0.15$0.50$0.03-$60
GLM-5.3$1.40$4.40$0.26-$15
GLM-5.2$1.40$4.40$0.26-$60
GLM-5.1$1.40$4.40$0.26-$60
Kimi K3$3.00$15.00$0.30-$15
Kimi K2.7 Code$0.95$4.00$0.19-$60
Kimi K2.6$0.95$4.00$0.16-$60
LongCat-2.0$0.30$1.20$0.006-$60
MiMo V2.5$0.14$0.28$0.0028-$60
MiMo V2.5 Pro$0.435$0.87$0.003625-$15
MiniMax M3$0.30$1.20$0.06-$60
MiniMax M2.7$0.30$1.20$0.06$0.375$60
MiniMax M2.5$0.30$1.20$0.06$0.375$60
Muse Spark 1.3 Contributor$0.10$0.20$0.002-$60
Muse Spark 1.2 Contributor$0.10$0.20$0.002-$60
Qwen3.8 Max$2.00$6.00$0.25$2.50$15
Qwen3.8 Flash$0.15$0.47$0.016$0.20$30
Qwen3.7 Max$2.50$7.50$0.50$3.125$30
Qwen3.7 Plus (≤ 256K tokens)$0.40$1.60$0.04$0.50$60
Qwen3.7 Plus (> 256K tokens)$1.20$4.80$0.12$1.50$60
Qwen3.6 Plus (≤ 256K tokens)$0.50$3.00$0.05$0.625$60
Qwen3.6 Plus (> 256K tokens)$2.00$6.00$0.20$2.50$60
DeepSeek V4.1 Flash (Off-Peak)$0.15$0.60$0.003-$15 $60
4x · Fino al 20 sett.
DeepSeek V4.1 Flash (Peak)$0.30$1.20$0.006-$15 $60
4x · Fino al 20 sett.
DeepSeek V4 Pro (Off-Peak)$0.66$1.98$0.022-$15
DeepSeek V4 Pro (Peak)$1.32$3.96$0.044-$15
DeepSeek V4 Flash (Off-Peak)$0.15$0.60$0.003-$30
DeepSeek V4 Flash (Peak)$0.30$1.20$0.006-$30
DeepSeek V4 Flash Vision Exp (Off-Peak)$0.15$0.60$0.003-$15
DeepSeek V4 Flash Vision Exp (Peak)$0.30$1.20$0.006-$15
Hy4 preview$0.834$2.501$0.042-$30
Hy3$0.14$0.58$0.035-$60
Grok 4.6 (≤ 200K tokens)$2.00$6.00$0.50-$15
Grok 4.6 (> 200K tokens)$4.00$12.00$1.00-$15
GPT 5.6 Luna (≤ 272K tokens)$0.20$1.20$0.02$0.25$15
GPT 5.6 Luna (> 272K tokens)$0.40$1.80$0.04$0.50$15

DeepSeek V4.1 Flash / V4 Pro / V4 Flash / V4 Flash Vision Exp: Gli orari Peak sono 01:00-04:00 e 06:00-10:00 UTC, dal lunedì al venerdì; tutti gli altri orari, inclusi i fine settimana, sono Off-Peak. Scopri di più.

DeepSeek V4 Flash Vision Exp: Le immagini vengono convertite in token in base alle loro dimensioni e fatturate come token di input insieme ai token di testo. Scopri di più.

Richieste stimate

La tabella seguente fornisce una stima del numero di richieste basata su pattern di utilizzo tipici di Go:

Modelrichieste ogni 5 orerichieste a settimanarichieste al mese
GLM-5.3-Flash6,32015,79031,580
GLM-5.32205401,080
GLM-5.28802,1504,300
GLM-5.18802,1504,300
Kimi K3110250490
Kimi K2.7 Code1,3503,3806,750
Kimi K2.61,1502,8805,750
LongCat-2.011,40028,60057,200
MiMo-V2.530,10075,200150,400
MiMo-V2.5-Pro3,2508,15016,300
MiniMax M33,2008,00016,000
MiniMax M2.73,4008,50017,000
Muse Spark 1.3 Contributor45,300113,300226,600
Muse Spark 1.2 Contributor45,300113,300226,600
Qwen3.8 Max160400810
Qwen3.8 Flash5,40013,50027,000
Qwen3.7 Max170420840
Qwen3.7 Plus4,30010,80021,600
Qwen3.6 Plus3,3008,20016,300
DeepSeek V4.1 Flash
4x · Fino al 20 sett.
6,500
26,000
16,250
65,000
32,500
130,000
DeepSeek V4 Pro1,0502,6005,200
DeepSeek V4 Flash13,00032,50065,000
DeepSeek V4 Flash Vision Exp6,50016,25032,500
Hy4 preview1,3503,3806,770
Hy34,30010,75021,500
Grok 4.6169423845
GPT 5.6 Luna2,0505,10010,250

Le stime utilizzano i seguenti conteggi di token per richiesta; l’utilizzo effettivo varia.

  • Grok 4.6 — 390 di input, 32.500 in cache, 120 token di output per richiesta
  • GLM-5.3-Flash — 1.000 di input, 55.000 in cache, 200 token di output per richiesta
  • GLM-5.3/5.2/5.1 — 700 di input, 52.000 in cache, 150 token di output per richiesta
  • GPT 5.6 Luna — 1.000 token di input, 50.000 in cache, 220 token di output per richiesta
  • Kimi K3 — 1.050 di input, 76.500 in cache, 300 token di output per richiesta
  • Kimi K2.7/K2.6 — 870 di input, 55.000 in cache, 200 token di output per richiesta
  • LongCat-2.0 — 920 di input, 88.900 in cache, 200 token di output per richiesta
  • DeepSeek V4.1 Flash — 410 di input, 71.300 in cache, 310 token di output per richiesta
  • DeepSeek V4 Pro — 750 di input, 82.000 in cache, 290 token di output per richiesta
  • DeepSeek V4 Flash — 410 di input, 71.300 in cache, 310 token di output per richiesta
  • DeepSeek V4 Flash Vision Exp — 410 di input, 71.300 in cache, 310 token di output per richiesta
  • MiniMax M3 — 510 di input, 56.000 in cache, 190 token di output per richiesta
  • MiniMax M2.7 — 300 di input, 55.000 in cache, 125 token di output per richiesta
  • Muse Spark 1.3 Contributor — 620 di input, 71.400 in cache, 300 token di output per richiesta
  • Muse Spark 1.2 Contributor — 620 di input, 71.400 in cache, 300 token di output per richiesta
  • Qwen3.8 Max — 420 di input, 66.000 in cache, 200 token di output per richiesta
  • Qwen3.8 Flash — 600 di input, 58.000 in cache, 200 token di output per richiesta
  • Qwen3.7 Max — 420 di input, 66.000 in cache, 200 token di output per richiesta
  • Qwen3.7 Plus — 500 di input, 57.000 in cache, 190 token di output per richiesta
  • Qwen3.6 Plus — 500 di input, 57.000 in cache, 190 token di output per richiesta
  • Hy4 preview — 830 di input, 71.500 in cache, 295 token di output per richiesta
  • Hy3 — 830 di input, 71.500 in cache, 295 token di output per richiesta
  • MiMo-V2.5 — 830 di input, 71.500 in cache, 295 token di output per richiesta
  • MiMo-V2.5-Pro — 790 di input, 86.000 in cache, 305 token di output per richiesta

Puoi monitorare il tuo utilizzo attuale nella console.

I limiti di utilizzo potrebbero cambiare man mano che raccogliamo dati sull’utilizzo iniziale e feedback.


Utilizzo oltre i limiti

Se hai anche dei crediti nel tuo saldo Zen, puoi abilitare l’opzione Use balance nella console. Quando è abilitata, Go ripiegherà sul tuo saldo Zen dopo che avrai raggiunto i limiti di utilizzo invece di bloccare le richieste.


Perché alcuni modelli hanno un utilizzo inferiore

Con Go, paghi $10/mese e l’utilizzo mensile incluso varia in base al modello.

Per la maggior parte dei modelli, ci riusciamo grazie a sconti sui volumi e capacità GPU riservata. Ti facciamo quindi beneficiare di questi risparmi offrendo un utilizzo mensile maggiore.

Per alcuni modelli, non abbiamo ancora avuto l’opportunità di negoziare uno sconto o di ospitarli a un costo inferiore, perché il modello è nuovo oppure perché il prezzo pubblico è già scontato.

Per questi modelli, ottieni comunque un po’ più di utilizzo rispetto a quanto otterresti pagando direttamente i provider dei modelli; per questo il loro utilizzo mensile incluso è inferiore.


Endpoint

Puoi anche accedere ai modelli Go tramite i seguenti endpoint API.

ModelloID ModelloEndpointPacchetto AI SDK
Grok 4.6grok-4.6https://code.aicippy.com/zen/go/v1/responses@ai-sdk/openai
GPT 5.6 Lunagpt-5.6-lunahttps://code.aicippy.com/zen/go/v1/responses@ai-sdk/openai
GLM-5.3-Flashglm-5.3-flashhttps://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
GLM-5.3glm-5.3https://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
GLM-5.2glm-5.2https://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
GLM-5.1glm-5.1https://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
Kimi K3kimi-k3https://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
Kimi K2.7 Codekimi-k2.7-codehttps://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
Kimi K2.6kimi-k2.6https://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
LongCat-2.0longcat-2.0https://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
DeepSeek V4.1 Flashdeepseek-v4.1-flashhttps://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
DeepSeek V4 Prodeepseek-v4-prohttps://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
DeepSeek V4 Flashdeepseek-v4-flashhttps://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
DeepSeek V4 Flash Vision Expdeepseek-v4-flash-vision-exphttps://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
MiMo-V2.5mimo-v2.5https://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
MiMo-V2.5-Promimo-v2.5-prohttps://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
MiniMax M3minimax-m3https://code.aicippy.com/zen/go/v1/messages@ai-sdk/anthropic
MiniMax M2.7minimax-m2.7https://code.aicippy.com/zen/go/v1/messages@ai-sdk/anthropic
MiniMax M2.5minimax-m2.5https://code.aicippy.com/zen/go/v1/messages@ai-sdk/anthropic
Muse Spark 1.3 Contributormuse-spark-1.3-contributorhttps://code.aicippy.com/zen/go/v1/responses@ai-sdk/openai
Muse Spark 1.2 Contributormuse-spark-1.2-contributorhttps://code.aicippy.com/zen/go/v1/responses@ai-sdk/openai
Qwen3.8 Maxqwen3.8-maxhttps://code.aicippy.com/zen/go/v1/messages@ai-sdk/anthropic
Qwen3.8 Flashqwen3.8-flashhttps://code.aicippy.com/zen/go/v1/messages@ai-sdk/anthropic
Qwen3.7 Maxqwen3.7-maxhttps://code.aicippy.com/zen/go/v1/messages@ai-sdk/anthropic
Qwen3.7 Plusqwen3.7-plushttps://code.aicippy.com/zen/go/v1/messages@ai-sdk/anthropic
Qwen3.6 Plusqwen3.6-plushttps://code.aicippy.com/zen/go/v1/messages@ai-sdk/anthropic
Hy4 previewhy4-previewhttps://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
Hy3hy3https://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible

Il model id nella tua AicippY config utilizza il formato aicippy-code-go/<model-id>. Ad esempio, per Kimi K3, useresti aicippy-code-go/kimi-k3 nella tua configurazione.


Modelli

Puoi recuperare l’elenco completo dei modelli disponibili e i relativi metadati da:

https://code.aicippy.com/zen/go/v1/models

Privacy

ModelloAddestramento del modelloConservazione dei dati
Grok 4.6Non utilizzato30 giorni
GPT 5.6 LunaNon utilizzato30 giorni
GLM-5.3-FlashNon utilizzato0 giorni
GLM-5.3Non utilizzato0 giorni
GLM-5.2Non utilizzato0 giorni
GLM-5.1Non utilizzato0 giorni
Kimi K3Non utilizzato0 giorni
Kimi K2.7 CodeNon utilizzato0 giorni
Kimi K2.6Non utilizzato0 giorni
LongCat-2.0Non utilizzato0 giorni
MiMo-V2.5-ProNon utilizzato0 giorni
MiMo-V2.5Non utilizzato0 giorni
Qwen3.8 MaxNon utilizzato0 giorni
Qwen3.8 FlashNon utilizzato0 giorni
Qwen3.7 MaxNon utilizzato0 giorni
Qwen3.7 PlusNon utilizzato0 giorni
Qwen3.6 PlusNon utilizzato0 giorni
MiniMax M3Non utilizzato0 giorni
MiniMax M2.7Non utilizzato0 giorni
Muse Spark 1.3 ContributorNon ZDR
Muse Spark 1.2 ContributorNon ZDR
DeepSeek V4.1 FlashNon utilizzato0 giorni
DeepSeek V4 ProNon utilizzato0 giorni
DeepSeek V4 FlashNon utilizzato0 giorni
DeepSeek V4 Flash Vision ExpNon utilizzato0 giorni
Hy4 previewNon utilizzato0 giorni
Hy3Non utilizzato0 giorni
  • Grok 4.6: ZDR disabilita importanti funzionalità API che dipendono dai dati archiviati, tra cui la Responses API con stato, Files and Collections e Batch API. Scopri di più.
  • GPT 5.6 Luna: I log di monitoraggio degli abusi vengono generati per l’utilizzo di tutte le funzionalità API e conservati per un massimo di 30 giorni. Scopri di più.
  • Muse Spark 1.3 Contributor: Prezzi dei token fortemente scontati in cambio dell’autorizzazione a utilizzare i tuoi prompt e completamenti per addestrare futuri modelli Meta. La disponibilità è limitata alle regioni consentite dalla Politica sull’uso geografico di Meta. Scopri di più.
  • Muse Spark 1.2 Contributor: Prezzi dei token fortemente scontati in cambio dell’autorizzazione a utilizzare i tuoi prompt e completamenti per addestrare futuri modelli Meta. La disponibilità è limitata alle regioni consentite dalla Politica sull’uso geografico di Meta. Scopri di più.
  • DeepSeek: L’accordo ZDR viene rinnovato mensilmente. L’accordo attuale è valido fino al 30 settembre 2026.

Obiettivi

Abbiamo creato AicippY Go per:

  1. Rendere la programmazione con l’IA accessibile a più persone tramite un abbonamento a basso costo.
  2. Fornire un accesso affidabile ai migliori modelli di programmazione aperti.
  3. Curare modelli che sono testati e valutati tramite benchmark per l’uso con gli agenti di programmazione.
  4. Non avere nessun lock-in, permettendoti di utilizzare anche qualsiasi altro provider con AicippY.