Go
Abbonamento a basso costo per modelli di programmazione aperti.
AicippY Go è un abbonamento a basso costo da 10 $/mese che ti offre un accesso affidabile ai popolari modelli di programmazione aperti.
Go funziona come qualsiasi altro provider in AicippY. Ti abboni a AicippY Go e ottieni la tua chiave API. È completamente facoltativo e non hai bisogno di usarlo per utilizzare AicippY.
È progettato principalmente per gli utenti internazionali e garantisce un accesso globale stabile.
Contesto
I modelli aperti sono diventati davvero validi. Ora raggiungono prestazioni vicine a quelle dei modelli proprietari per le attività di programmazione. E poiché molti provider possono fornirli in modo competitivo, di solito sono molto più economici.
Tuttavia, ottenere un accesso affidabile e a bassa latenza può essere difficile. I provider variano per qualità e disponibilità.
Per risolvere questo problema, abbiamo fatto un paio di cose:
- Abbiamo testato un gruppo selezionato di modelli aperti e parlato con i loro team su come eseguirli al meglio.
- Abbiamo quindi collaborato con alcuni provider per assicurarci che venissero forniti correttamente.
- Infine, abbiamo eseguito dei benchmark sulla combinazione modello/provider e abbiamo stilato un elenco che ci sentiamo di raccomandare.
AicippY Go ti dà accesso a questi modelli a 10 $/mese.
Come funziona
AicippY Go funziona come qualsiasi altro provider in AicippY.
- Accedi a AicippY Zen, ti abboni a Go e copi la tua chiave API.
- Esegui il comando
/connectnella TUI, selezioniAicippY Goe incolli la tua chiave API. - Esegui
/modelsnella TUI per vedere l’elenco dei modelli disponibili tramite Go.
L’elenco attuale dei modelli include:
- Grok 4.6
- GLM-5.3-Flash
- GLM-5.3
- GLM-5.2
- GLM-5.1
- GPT 5.6 Luna
- Kimi K3
- Kimi K2.7 Code
- Kimi K2.6
- LongCat-2.0
- MiMo-V2.5
- MiMo-V2.5-Pro
- MiniMax M3
- MiniMax M2.7
- Muse Spark 1.3 Contributor (regioni limitate)
- Muse Spark 1.2 Contributor (regioni limitate)
- Qwen3.8 Max
- Qwen3.8 Flash
- Qwen3.7 Max
- Qwen3.7 Plus
- Qwen3.6 Plus
- DeepSeek V4.1 Flash
- DeepSeek V4 Pro
- DeepSeek V4 Flash
- DeepSeek V4 Flash Vision Exp
- Hy4 preview
- Hy3
L’elenco dei modelli potrebbe cambiare man mano che ne testiamo e aggiungiamo di nuovi.
Dove posso usarlo?
AicippY Go è progettato per AicippY e altri agenti di programmazione che producono tipi di richieste simili. Il traffico viene monitorato per rilevare gli abusi che compromettono l’esperienza degli altri utenti.
Il tuo client deve:
- Inviare il traffico tipico di un agente di programmazione
- Identificarsi con un proprio user agent, ad esempio
my-coding-agent/1.0, anziché con il nome generico di un SDK o di una libreria HTTP. - Inviare un ID di sessione stabile in
x-aicippy-code-sessionper ogni conversazione, in modo da consentirci di ottimizzare il routing e il caching dei prompt.
Client convalidati
Oltre a AicippY, è stato verificato che i seguenti client funzionino correttamente con AicippY Go. Tuttavia, non garantiamo che continueranno a funzionare in futuro.
| Client | Supporto delle sessioni |
|---|---|
| Hermes | Le build contenenti la PR #101864 inviano l’header nelle richieste AicippY principali e ausiliarie. La correzione è stata unita dopo la v0.21.0; quella versione da sola non la include. |
| Claude Code | Go riconosce il suo header di sessione nativo. Non è necessario alcun wrapper per header personalizzati. |
| Codex | Go riconosce il suo header di sessione nativo. Alcune versioni e configurazioni proxy continuano a ometterlo; mantieni l’header di sessione quando inoltri le richieste. |
| ZCode | Go riconosce il suo header di sessione nativo. La nostra richiesta per x-aicippy-code-session è ancora aperta, ma non è più necessario inviare proprio quell’header. |
| Pi | Le build attuali inviano le informazioni di sessione per AicippY. Aggiorna le installazioni meno recenti. |
| jcode | Aggiorna alla versione v0.81.6 o successiva, che include la correzione dell’header di sessione. |
| Kilo Code CLI | Le build contenenti la PR #13752 ripristinano gli header di sessione AicippY. Questa correzione riguarda la CLI, non l’estensione VS Code. Consulta l’issue #13723. |
Client con problemi noti
Nelle versioni che abbiamo esaminato, questi client non supportano le sessioni o le supportano solo parzialmente. Le segnalazioni collegate consentono di seguire le correzioni e le soluzioni alternative.
| Client | Stato e segnalazioni |
|---|---|
| DeepSeek Harness | Le informazioni di sessione arrivano tramite alcuni percorsi dei modelli, ma mancano in altri. Riconosciamo il suo header nativo; resta da inviarlo attraverso tutti gli adapter. Discussione #5495. |
| GitHub Copilot Chat | Il supporto automatico dell’header di sessione è stato richiesto nell’issue #334186 di VS Code. |
| Kimi Code | Il supporto automatico dell’header di sessione è stato richiesto nell’issue #3506. |
| MiMo Code | L’issue #2317 ha una correzione proposta nella PR #2327, che non è stata ancora unita. |
Limiti di utilizzo
I limiti di utilizzo sono definiti come importi mensili in dollari. La tabella seguente mostra il limite mensile e i prezzi dei token per ciascun modello.
Ogni modello ha i seguenti limiti di utilizzo: 5 ore — 20% del limite mensile; settimanale — 50%; mensile — 100%.
Ad esempio, se un modello ha un limite mensile di $60, puoi utilizzare fino a:
- Limite di 5 ore — $12 di utilizzo
- Limite settimanale — $30 di utilizzo
- Limite mensile — $60 di utilizzo
I prezzi dei token sono indicati per 1M token.
| Modello | Input | Output | Cached Read | Cached Write | Limite mensile |
|---|---|---|---|---|---|
| GLM-5.3-Flash | $0.15 | $0.50 | $0.03 | - | $60 |
| GLM-5.3 | $1.40 | $4.40 | $0.26 | - | $15 |
| GLM-5.2 | $1.40 | $4.40 | $0.26 | - | $60 |
| GLM-5.1 | $1.40 | $4.40 | $0.26 | - | $60 |
| Kimi K3 | $3.00 | $15.00 | $0.30 | - | $15 |
| Kimi K2.7 Code | $0.95 | $4.00 | $0.19 | - | $60 |
| Kimi K2.6 | $0.95 | $4.00 | $0.16 | - | $60 |
| LongCat-2.0 | $0.30 | $1.20 | $0.006 | - | $60 |
| MiMo V2.5 | $0.14 | $0.28 | $0.0028 | - | $60 |
| MiMo V2.5 Pro | $0.435 | $0.87 | $0.003625 | - | $15 |
| MiniMax M3 | $0.30 | $1.20 | $0.06 | - | $60 |
| MiniMax M2.7 | $0.30 | $1.20 | $0.06 | $0.375 | $60 |
| MiniMax M2.5 | $0.30 | $1.20 | $0.06 | $0.375 | $60 |
| Muse Spark 1.3 Contributor | $0.10 | $0.20 | $0.002 | - | $60 |
| Muse Spark 1.2 Contributor | $0.10 | $0.20 | $0.002 | - | $60 |
| Qwen3.8 Max | $2.00 | $6.00 | $0.25 | $2.50 | $15 |
| Qwen3.8 Flash | $0.15 | $0.47 | $0.016 | $0.20 | $30 |
| Qwen3.7 Max | $2.50 | $7.50 | $0.50 | $3.125 | $30 |
| Qwen3.7 Plus (≤ 256K tokens) | $0.40 | $1.60 | $0.04 | $0.50 | $60 |
| Qwen3.7 Plus (> 256K tokens) | $1.20 | $4.80 | $0.12 | $1.50 | $60 |
| Qwen3.6 Plus (≤ 256K tokens) | $0.50 | $3.00 | $0.05 | $0.625 | $60 |
| Qwen3.6 Plus (> 256K tokens) | $2.00 | $6.00 | $0.20 | $2.50 | $60 |
| DeepSeek V4.1 Flash (Off-Peak) | $0.15 | $0.60 | $0.003 | - | 4x · Fino al 20 sett. |
| DeepSeek V4.1 Flash (Peak) | $0.30 | $1.20 | $0.006 | - | 4x · Fino al 20 sett. |
| DeepSeek V4 Pro (Off-Peak) | $0.66 | $1.98 | $0.022 | - | $15 |
| DeepSeek V4 Pro (Peak) | $1.32 | $3.96 | $0.044 | - | $15 |
| DeepSeek V4 Flash (Off-Peak) | $0.15 | $0.60 | $0.003 | - | $30 |
| DeepSeek V4 Flash (Peak) | $0.30 | $1.20 | $0.006 | - | $30 |
| DeepSeek V4 Flash Vision Exp (Off-Peak) | $0.15 | $0.60 | $0.003 | - | $15 |
| DeepSeek V4 Flash Vision Exp (Peak) | $0.30 | $1.20 | $0.006 | - | $15 |
| Hy4 preview | $0.834 | $2.501 | $0.042 | - | $30 |
| Hy3 | $0.14 | $0.58 | $0.035 | - | $60 |
| Grok 4.6 (≤ 200K tokens) | $2.00 | $6.00 | $0.50 | - | $15 |
| Grok 4.6 (> 200K tokens) | $4.00 | $12.00 | $1.00 | - | $15 |
| GPT 5.6 Luna (≤ 272K tokens) | $0.20 | $1.20 | $0.02 | $0.25 | $15 |
| GPT 5.6 Luna (> 272K tokens) | $0.40 | $1.80 | $0.04 | $0.50 | $15 |
DeepSeek V4.1 Flash / V4 Pro / V4 Flash / V4 Flash Vision Exp: Gli orari Peak sono 01:00-04:00 e 06:00-10:00 UTC, dal lunedì al venerdì; tutti gli altri orari, inclusi i fine settimana, sono Off-Peak. Scopri di più.
DeepSeek V4 Flash Vision Exp: Le immagini vengono convertite in token in base alle loro dimensioni e fatturate come token di input insieme ai token di testo. Scopri di più.
Richieste stimate
La tabella seguente fornisce una stima del numero di richieste basata su pattern di utilizzo tipici di Go:
| Model | richieste ogni 5 ore | richieste a settimana | richieste al mese |
|---|---|---|---|
| GLM-5.3-Flash | 6,320 | 15,790 | 31,580 |
| GLM-5.3 | 220 | 540 | 1,080 |
| GLM-5.2 | 880 | 2,150 | 4,300 |
| GLM-5.1 | 880 | 2,150 | 4,300 |
| Kimi K3 | 110 | 250 | 490 |
| Kimi K2.7 Code | 1,350 | 3,380 | 6,750 |
| Kimi K2.6 | 1,150 | 2,880 | 5,750 |
| LongCat-2.0 | 11,400 | 28,600 | 57,200 |
| MiMo-V2.5 | 30,100 | 75,200 | 150,400 |
| MiMo-V2.5-Pro | 3,250 | 8,150 | 16,300 |
| MiniMax M3 | 3,200 | 8,000 | 16,000 |
| MiniMax M2.7 | 3,400 | 8,500 | 17,000 |
| Muse Spark 1.3 Contributor | 45,300 | 113,300 | 226,600 |
| Muse Spark 1.2 Contributor | 45,300 | 113,300 | 226,600 |
| Qwen3.8 Max | 160 | 400 | 810 |
| Qwen3.8 Flash | 5,400 | 13,500 | 27,000 |
| Qwen3.7 Max | 170 | 420 | 840 |
| Qwen3.7 Plus | 4,300 | 10,800 | 21,600 |
| Qwen3.6 Plus | 3,300 | 8,200 | 16,300 |
| DeepSeek V4.1 Flash 4x · Fino al 20 sett. | 26,000 | 65,000 | 130,000 |
| DeepSeek V4 Pro | 1,050 | 2,600 | 5,200 |
| DeepSeek V4 Flash | 13,000 | 32,500 | 65,000 |
| DeepSeek V4 Flash Vision Exp | 6,500 | 16,250 | 32,500 |
| Hy4 preview | 1,350 | 3,380 | 6,770 |
| Hy3 | 4,300 | 10,750 | 21,500 |
| Grok 4.6 | 169 | 423 | 845 |
| GPT 5.6 Luna | 2,050 | 5,100 | 10,250 |
Le stime utilizzano i seguenti conteggi di token per richiesta; l’utilizzo effettivo varia.
- Grok 4.6 — 390 di input, 32.500 in cache, 120 token di output per richiesta
- GLM-5.3-Flash — 1.000 di input, 55.000 in cache, 200 token di output per richiesta
- GLM-5.3/5.2/5.1 — 700 di input, 52.000 in cache, 150 token di output per richiesta
- GPT 5.6 Luna — 1.000 token di input, 50.000 in cache, 220 token di output per richiesta
- Kimi K3 — 1.050 di input, 76.500 in cache, 300 token di output per richiesta
- Kimi K2.7/K2.6 — 870 di input, 55.000 in cache, 200 token di output per richiesta
- LongCat-2.0 — 920 di input, 88.900 in cache, 200 token di output per richiesta
- DeepSeek V4.1 Flash — 410 di input, 71.300 in cache, 310 token di output per richiesta
- DeepSeek V4 Pro — 750 di input, 82.000 in cache, 290 token di output per richiesta
- DeepSeek V4 Flash — 410 di input, 71.300 in cache, 310 token di output per richiesta
- DeepSeek V4 Flash Vision Exp — 410 di input, 71.300 in cache, 310 token di output per richiesta
- MiniMax M3 — 510 di input, 56.000 in cache, 190 token di output per richiesta
- MiniMax M2.7 — 300 di input, 55.000 in cache, 125 token di output per richiesta
- Muse Spark 1.3 Contributor — 620 di input, 71.400 in cache, 300 token di output per richiesta
- Muse Spark 1.2 Contributor — 620 di input, 71.400 in cache, 300 token di output per richiesta
- Qwen3.8 Max — 420 di input, 66.000 in cache, 200 token di output per richiesta
- Qwen3.8 Flash — 600 di input, 58.000 in cache, 200 token di output per richiesta
- Qwen3.7 Max — 420 di input, 66.000 in cache, 200 token di output per richiesta
- Qwen3.7 Plus — 500 di input, 57.000 in cache, 190 token di output per richiesta
- Qwen3.6 Plus — 500 di input, 57.000 in cache, 190 token di output per richiesta
- Hy4 preview — 830 di input, 71.500 in cache, 295 token di output per richiesta
- Hy3 — 830 di input, 71.500 in cache, 295 token di output per richiesta
- MiMo-V2.5 — 830 di input, 71.500 in cache, 295 token di output per richiesta
- MiMo-V2.5-Pro — 790 di input, 86.000 in cache, 305 token di output per richiesta
Puoi monitorare il tuo utilizzo attuale nella console.
I limiti di utilizzo potrebbero cambiare man mano che raccogliamo dati sull’utilizzo iniziale e feedback.
Utilizzo oltre i limiti
Se hai anche dei crediti nel tuo saldo Zen, puoi abilitare l’opzione Use balance nella console. Quando è abilitata, Go ripiegherà sul tuo saldo Zen dopo che avrai raggiunto i limiti di utilizzo invece di bloccare le richieste.
Perché alcuni modelli hanno un utilizzo inferiore
Con Go, paghi $10/mese e l’utilizzo mensile incluso varia in base al modello.
Per la maggior parte dei modelli, ci riusciamo grazie a sconti sui volumi e capacità GPU riservata. Ti facciamo quindi beneficiare di questi risparmi offrendo un utilizzo mensile maggiore.
Per alcuni modelli, non abbiamo ancora avuto l’opportunità di negoziare uno sconto o di ospitarli a un costo inferiore, perché il modello è nuovo oppure perché il prezzo pubblico è già scontato.
Per questi modelli, ottieni comunque un po’ più di utilizzo rispetto a quanto otterresti pagando direttamente i provider dei modelli; per questo il loro utilizzo mensile incluso è inferiore.
Endpoint
Puoi anche accedere ai modelli Go tramite i seguenti endpoint API.
| Modello | ID Modello | Endpoint | Pacchetto AI SDK |
|---|---|---|---|
| Grok 4.6 | grok-4.6 | https://code.aicippy.com/zen/go/v1/responses | @ai-sdk/openai |
| GPT 5.6 Luna | gpt-5.6-luna | https://code.aicippy.com/zen/go/v1/responses | @ai-sdk/openai |
| GLM-5.3-Flash | glm-5.3-flash | https://code.aicippy.com/zen/go/v1/chat/completions | @ai-sdk/openai-compatible |
| GLM-5.3 | glm-5.3 | https://code.aicippy.com/zen/go/v1/chat/completions | @ai-sdk/openai-compatible |
| GLM-5.2 | glm-5.2 | https://code.aicippy.com/zen/go/v1/chat/completions | @ai-sdk/openai-compatible |
| GLM-5.1 | glm-5.1 | https://code.aicippy.com/zen/go/v1/chat/completions | @ai-sdk/openai-compatible |
| Kimi K3 | kimi-k3 | https://code.aicippy.com/zen/go/v1/chat/completions | @ai-sdk/openai-compatible |
| Kimi K2.7 Code | kimi-k2.7-code | https://code.aicippy.com/zen/go/v1/chat/completions | @ai-sdk/openai-compatible |
| Kimi K2.6 | kimi-k2.6 | https://code.aicippy.com/zen/go/v1/chat/completions | @ai-sdk/openai-compatible |
| LongCat-2.0 | longcat-2.0 | https://code.aicippy.com/zen/go/v1/chat/completions | @ai-sdk/openai-compatible |
| DeepSeek V4.1 Flash | deepseek-v4.1-flash | https://code.aicippy.com/zen/go/v1/chat/completions | @ai-sdk/openai-compatible |
| DeepSeek V4 Pro | deepseek-v4-pro | https://code.aicippy.com/zen/go/v1/chat/completions | @ai-sdk/openai-compatible |
| DeepSeek V4 Flash | deepseek-v4-flash | https://code.aicippy.com/zen/go/v1/chat/completions | @ai-sdk/openai-compatible |
| DeepSeek V4 Flash Vision Exp | deepseek-v4-flash-vision-exp | https://code.aicippy.com/zen/go/v1/chat/completions | @ai-sdk/openai-compatible |
| MiMo-V2.5 | mimo-v2.5 | https://code.aicippy.com/zen/go/v1/chat/completions | @ai-sdk/openai-compatible |
| MiMo-V2.5-Pro | mimo-v2.5-pro | https://code.aicippy.com/zen/go/v1/chat/completions | @ai-sdk/openai-compatible |
| MiniMax M3 | minimax-m3 | https://code.aicippy.com/zen/go/v1/messages | @ai-sdk/anthropic |
| MiniMax M2.7 | minimax-m2.7 | https://code.aicippy.com/zen/go/v1/messages | @ai-sdk/anthropic |
| MiniMax M2.5 | minimax-m2.5 | https://code.aicippy.com/zen/go/v1/messages | @ai-sdk/anthropic |
| Muse Spark 1.3 Contributor | muse-spark-1.3-contributor | https://code.aicippy.com/zen/go/v1/responses | @ai-sdk/openai |
| Muse Spark 1.2 Contributor | muse-spark-1.2-contributor | https://code.aicippy.com/zen/go/v1/responses | @ai-sdk/openai |
| Qwen3.8 Max | qwen3.8-max | https://code.aicippy.com/zen/go/v1/messages | @ai-sdk/anthropic |
| Qwen3.8 Flash | qwen3.8-flash | https://code.aicippy.com/zen/go/v1/messages | @ai-sdk/anthropic |
| Qwen3.7 Max | qwen3.7-max | https://code.aicippy.com/zen/go/v1/messages | @ai-sdk/anthropic |
| Qwen3.7 Plus | qwen3.7-plus | https://code.aicippy.com/zen/go/v1/messages | @ai-sdk/anthropic |
| Qwen3.6 Plus | qwen3.6-plus | https://code.aicippy.com/zen/go/v1/messages | @ai-sdk/anthropic |
| Hy4 preview | hy4-preview | https://code.aicippy.com/zen/go/v1/chat/completions | @ai-sdk/openai-compatible |
| Hy3 | hy3 | https://code.aicippy.com/zen/go/v1/chat/completions | @ai-sdk/openai-compatible |
Il model id nella tua AicippY config
utilizza il formato aicippy-code-go/<model-id>. Ad esempio, per Kimi K3, useresti
aicippy-code-go/kimi-k3 nella tua configurazione.
Modelli
Puoi recuperare l’elenco completo dei modelli disponibili e i relativi metadati da:
https://code.aicippy.com/zen/go/v1/modelsPrivacy
| Modello | Addestramento del modello | Conservazione dei dati |
|---|---|---|
| Grok 4.6 | Non utilizzato | 30 giorni |
| GPT 5.6 Luna | Non utilizzato | 30 giorni |
| GLM-5.3-Flash | Non utilizzato | 0 giorni |
| GLM-5.3 | Non utilizzato | 0 giorni |
| GLM-5.2 | Non utilizzato | 0 giorni |
| GLM-5.1 | Non utilizzato | 0 giorni |
| Kimi K3 | Non utilizzato | 0 giorni |
| Kimi K2.7 Code | Non utilizzato | 0 giorni |
| Kimi K2.6 | Non utilizzato | 0 giorni |
| LongCat-2.0 | Non utilizzato | 0 giorni |
| MiMo-V2.5-Pro | Non utilizzato | 0 giorni |
| MiMo-V2.5 | Non utilizzato | 0 giorni |
| Qwen3.8 Max | Non utilizzato | 0 giorni |
| Qwen3.8 Flash | Non utilizzato | 0 giorni |
| Qwen3.7 Max | Non utilizzato | 0 giorni |
| Qwen3.7 Plus | Non utilizzato | 0 giorni |
| Qwen3.6 Plus | Non utilizzato | 0 giorni |
| MiniMax M3 | Non utilizzato | 0 giorni |
| MiniMax M2.7 | Non utilizzato | 0 giorni |
| Muse Spark 1.3 Contributor | Sì | Non ZDR |
| Muse Spark 1.2 Contributor | Sì | Non ZDR |
| DeepSeek V4.1 Flash | Non utilizzato | 0 giorni |
| DeepSeek V4 Pro | Non utilizzato | 0 giorni |
| DeepSeek V4 Flash | Non utilizzato | 0 giorni |
| DeepSeek V4 Flash Vision Exp | Non utilizzato | 0 giorni |
| Hy4 preview | Non utilizzato | 0 giorni |
| Hy3 | Non utilizzato | 0 giorni |
- Grok 4.6: ZDR disabilita importanti funzionalità API che dipendono dai dati archiviati, tra cui la Responses API con stato, Files and Collections e Batch API. Scopri di più.
- GPT 5.6 Luna: I log di monitoraggio degli abusi vengono generati per l’utilizzo di tutte le funzionalità API e conservati per un massimo di 30 giorni. Scopri di più.
- Muse Spark 1.3 Contributor: Prezzi dei token fortemente scontati in cambio dell’autorizzazione a utilizzare i tuoi prompt e completamenti per addestrare futuri modelli Meta. La disponibilità è limitata alle regioni consentite dalla Politica sull’uso geografico di Meta. Scopri di più.
- Muse Spark 1.2 Contributor: Prezzi dei token fortemente scontati in cambio dell’autorizzazione a utilizzare i tuoi prompt e completamenti per addestrare futuri modelli Meta. La disponibilità è limitata alle regioni consentite dalla Politica sull’uso geografico di Meta. Scopri di più.
- DeepSeek: L’accordo ZDR viene rinnovato mensilmente. L’accordo attuale è valido fino al 30 settembre 2026.
Obiettivi
Abbiamo creato AicippY Go per:
- Rendere la programmazione con l’IA accessibile a più persone tramite un abbonamento a basso costo.
- Fornire un accesso affidabile ai migliori modelli di programmazione aperti.
- Curare modelli che sono testati e valutati tramite benchmark per l’uso con gli agenti di programmazione.
- Non avere nessun lock-in, permettendoti di utilizzare anche qualsiasi altro provider con AicippY.