Go
Lavkostnadsabonnement for åpne kodemodeller.
AicippY Go er et lavkostnadsabonnement til $10/måned som gir deg pålitelig tilgang til populære åpne kodemodeller.
Go fungerer som enhver annen leverandør i AicippY. Du abonnerer på AicippY Go og får din API-nøkkel. Det er helt valgfritt, og du trenger ikke å bruke det for å bruke AicippY.
Det er først og fremst utviklet for internasjonale brukere og gir stabil global tilgang.
Bakgrunn
Åpne modeller har blitt veldig gode. De oppnår nå ytelse nær proprietære modeller for kodeoppgaver. Og fordi mange leverandører kan tilby dem konkurransedyktig, er de vanligvis mye billigere.
Imidlertid kan det være vanskelig å få pålitelig tilgang med lav forsinkelse til dem. Leverandører varierer i kvalitet og tilgjengelighet.
For å fikse dette, gjorde vi et par ting:
- Vi testet en utvalgt gruppe åpne modeller og snakket med teamene deres om hvordan de best kan kjøres.
- Deretter samarbeidet vi med noen få leverandører for å sikre at disse ble levert riktig.
- Til slutt utførte vi ytelsestester på kombinasjonen av modell og leverandør, og kom frem til en liste som vi trygt kan anbefale.
AicippY Go gir deg tilgang til disse modellene for $10/måned.
Hvordan det fungerer
AicippY Go fungerer som enhver annen leverandør i AicippY.
- Du logger inn på AicippY Zen, abonnerer på Go, og kopierer din API-nøkkel.
- Du kjører kommandoen
/connecti TUI-en, velgerAicippY Go, og limer inn din API-nøkkel. - Kjør
/modelsi TUI-en for å se listen over modeller som er tilgjengelige gjennom Go.
Den nåværende listen over modeller inkluderer:
- Grok 4.6
- GLM-5.3-Flash
- GLM-5.3
- GLM-5.2
- GLM-5.1
- GPT 5.6 Luna
- Kimi K3
- Kimi K2.7 Code
- Kimi K2.6
- LongCat-2.0
- MiMo-V2.5
- MiMo-V2.5-Pro
- MiniMax M3
- MiniMax M2.7
- Muse Spark 1.3 Contributor (begrensede regioner)
- Muse Spark 1.2 Contributor (begrensede regioner)
- Qwen3.8 Max
- Qwen3.8 Flash
- Qwen3.7 Max
- Qwen3.7 Plus
- Qwen3.6 Plus
- DeepSeek V4.1 Flash
- DeepSeek V4 Pro
- DeepSeek V4 Flash
- DeepSeek V4 Flash Vision Exp
- Hy4 preview
- Hy3
Listen over modeller kan endres etter hvert som vi tester og legger til nye.
Hvor kan jeg bruke det?
AicippY Go er utviklet for AicippY og andre kodeagenter som sender lignende typer forespørsler. Trafikken overvåkes for misbruk som forringer opplevelsen for andre brukere.
Klienten din skal:
- Sende typisk trafikk fra en kodeagent.
- Identifisere seg med sin egen user agent, for eksempel
my-coding-agent/1.0, i stedet for et generisk navn på et SDK eller HTTP-bibliotek. - Sende en stabil sesjons-ID i
x-aicippy-code-sessionfor hver samtale, slik at vi kan optimalisere ruting og promptbufring.
Validerte klienter
I tillegg til AicippY er følgende klienter validert for å fungere riktig med AicippY Go. Vi garanterer imidlertid ikke at de vil fortsette å fungere i fremtiden.
| Klient | Sesjonsstøtte |
|---|---|
| Hermes | Bygg som inneholder PR #101864, sender headeren i primære og sekundære AicippY-forespørsler. Rettelsen ble slått sammen etter v0.21.0; den versjonen inneholder den ikke alene. |
| Claude Code | Go gjenkjenner den innebygde sesjonsheaderen. En wrapper for en egendefinert header er ikke nødvendig. |
| Codex | Go gjenkjenner den innebygde sesjonsheaderen. Noen versjoner og proxyoppsett utelater den fortsatt; behold sesjonsheaderen når forespørsler videresendes. |
| ZCode | Go gjenkjenner den innebygde sesjonsheaderen. Vår forespørsel om x-aicippy-code-session er fortsatt åpen, men det er ikke lenger nødvendig å sende akkurat denne headeren. |
| Pi | Gjeldende bygg sender sesjonsinformasjon for AicippY. Oppdater eldre installasjoner. |
| jcode | Oppdater til v0.81.6 eller nyere, som inneholder rettelsen for sesjonsheaderen. |
| Kilo Code CLI | Bygg som inneholder PR #13752, gjenoppretter AicippY-sesjonsheadere. Denne rettelsen dekker CLI-en, ikke VS Code-utvidelsen. Se issue #13723. |
Kjente problematiske klienter
Disse klientene mangler sesjonsstøtte eller har ufullstendig støtte i versjonene vi undersøkte. De lenkede rapportene følger rettelser og midlertidige løsninger.
| Klient | Status og oppfølging |
|---|---|
| DeepSeek Harness | Sesjonsinformasjon mottas på noen modellbaner, men mangler på andre. Vi gjenkjenner den innebygde headeren; det gjenstående arbeidet er å sende den gjennom alle adaptere. Discussion #5495. |
| GitHub Copilot Chat | Automatisk støtte for sesjonsheaderen er etterspurt i VS Code issue #334186. |
| Kimi Code | Automatisk støtte for sesjonsheaderen er etterspurt i issue #3506. |
| MiMo Code | Issue #2317 har en foreslått rettelse i PR #2327, som ennå ikke er slått sammen. |
Bruksgrenser
Bruksgrenser defineres som månedlige dollarbeløp. Tabellen nedenfor viser den månedlige grensen og tokenkostnadene for hver modell.
Hver modell har følgende bruksgrenser: 5-timersgrense — 20 % av den månedlige grensen; ukentlig grense — 50 %; og månedlig grense — 100 %.
Hvis en modell for eksempel har en månedlig grense på $60, kan du bruke opptil:
- 5-timers grense — $12 i bruk
- Ukentlig grense — $30 i bruk
- Månedlig grense — $60 i bruk
Tokenpriser er oppgitt per 1M tokens.
| Model | Input | Output | Cached Read | Cached Write | Månedlig grense |
|---|---|---|---|---|---|
| GLM-5.3-Flash | $0.15 | $0.50 | $0.03 | - | $60 |
| GLM-5.3 | $1.40 | $4.40 | $0.26 | - | $15 |
| GLM-5.2 | $1.40 | $4.40 | $0.26 | - | $60 |
| GLM-5.1 | $1.40 | $4.40 | $0.26 | - | $60 |
| Kimi K3 | $3.00 | $15.00 | $0.30 | - | $15 |
| Kimi K2.7 Code | $0.95 | $4.00 | $0.19 | - | $60 |
| Kimi K2.6 | $0.95 | $4.00 | $0.16 | - | $60 |
| LongCat-2.0 | $0.30 | $1.20 | $0.006 | - | $60 |
| MiMo V2.5 | $0.14 | $0.28 | $0.0028 | - | $60 |
| MiMo V2.5 Pro | $0.435 | $0.87 | $0.003625 | - | $15 |
| MiniMax M3 | $0.30 | $1.20 | $0.06 | - | $60 |
| MiniMax M2.7 | $0.30 | $1.20 | $0.06 | $0.375 | $60 |
| MiniMax M2.5 | $0.30 | $1.20 | $0.06 | $0.375 | $60 |
| Muse Spark 1.3 Contributor | $0.10 | $0.20 | $0.002 | - | $60 |
| Muse Spark 1.2 Contributor | $0.10 | $0.20 | $0.002 | - | $60 |
| Qwen3.8 Max | $2.00 | $6.00 | $0.25 | $2.50 | $15 |
| Qwen3.8 Flash | $0.15 | $0.47 | $0.016 | $0.20 | $30 |
| Qwen3.7 Max | $2.50 | $7.50 | $0.50 | $3.125 | $30 |
| Qwen3.7 Plus (≤ 256K tokens) | $0.40 | $1.60 | $0.04 | $0.50 | $60 |
| Qwen3.7 Plus (> 256K tokens) | $1.20 | $4.80 | $0.12 | $1.50 | $60 |
| Qwen3.6 Plus (≤ 256K tokens) | $0.50 | $3.00 | $0.05 | $0.625 | $60 |
| Qwen3.6 Plus (> 256K tokens) | $2.00 | $6.00 | $0.20 | $2.50 | $60 |
| DeepSeek V4.1 Flash (Off-Peak) | $0.15 | $0.60 | $0.003 | - | 4x · Slutter 20. sep. |
| DeepSeek V4.1 Flash (Peak) | $0.30 | $1.20 | $0.006 | - | 4x · Slutter 20. sep. |
| DeepSeek V4 Pro (Off-Peak) | $0.66 | $1.98 | $0.022 | - | $15 |
| DeepSeek V4 Pro (Peak) | $1.32 | $3.96 | $0.044 | - | $15 |
| DeepSeek V4 Flash (Off-Peak) | $0.15 | $0.60 | $0.003 | - | $30 |
| DeepSeek V4 Flash (Peak) | $0.30 | $1.20 | $0.006 | - | $30 |
| DeepSeek V4 Flash Vision Exp (Off-Peak) | $0.15 | $0.60 | $0.003 | - | $15 |
| DeepSeek V4 Flash Vision Exp (Peak) | $0.30 | $1.20 | $0.006 | - | $15 |
| Hy4 preview | $0.834 | $2.501 | $0.042 | - | $30 |
| Hy3 | $0.14 | $0.58 | $0.035 | - | $60 |
| Grok 4.6 (≤ 200K tokens) | $2.00 | $6.00 | $0.50 | - | $15 |
| Grok 4.6 (> 200K tokens) | $4.00 | $12.00 | $1.00 | - | $15 |
| GPT 5.6 Luna (≤ 272K tokens) | $0.20 | $1.20 | $0.02 | $0.25 | $15 |
| GPT 5.6 Luna (> 272K tokens) | $0.40 | $1.80 | $0.04 | $0.50 | $15 |
DeepSeek V4.1 Flash / V4 Pro / V4 Flash / V4 Flash Vision Exp: Peak-tidene er 01:00-04:00 og 06:00-10:00 UTC fra mandag til fredag; alle andre tider, inkludert helger, er Off-Peak. Les mer.
DeepSeek V4 Flash Vision Exp: Bilder konverteres til tokens basert på dimensjonene og faktureres som input-tokens sammen med tekst-tokens. Les mer.
Estimerte forespørsler
Tabellen nedenfor viser et estimert antall forespørsler basert på typiske bruksmønstre for Go:
| Model | forespørsler per 5 timer | forespørsler per uke | forespørsler per måned |
|---|---|---|---|
| GLM-5.3-Flash | 6,320 | 15,790 | 31,580 |
| GLM-5.3 | 220 | 540 | 1,080 |
| GLM-5.2 | 880 | 2,150 | 4,300 |
| GLM-5.1 | 880 | 2,150 | 4,300 |
| Kimi K3 | 110 | 250 | 490 |
| Kimi K2.7 Code | 1,350 | 3,380 | 6,750 |
| Kimi K2.6 | 1,150 | 2,880 | 5,750 |
| LongCat-2.0 | 11,400 | 28,600 | 57,200 |
| MiMo-V2.5 | 30,100 | 75,200 | 150,400 |
| MiMo-V2.5-Pro | 3,250 | 8,150 | 16,300 |
| MiniMax M3 | 3,200 | 8,000 | 16,000 |
| MiniMax M2.7 | 3,400 | 8,500 | 17,000 |
| Muse Spark 1.3 Contributor | 45,300 | 113,300 | 226,600 |
| Muse Spark 1.2 Contributor | 45,300 | 113,300 | 226,600 |
| Qwen3.8 Max | 160 | 400 | 810 |
| Qwen3.8 Flash | 5,400 | 13,500 | 27,000 |
| Qwen3.7 Max | 170 | 420 | 840 |
| Qwen3.7 Plus | 4,300 | 10,800 | 21,600 |
| Qwen3.6 Plus | 3,300 | 8,200 | 16,300 |
| DeepSeek V4.1 Flash 4x · Slutter 20. sep. | 26,000 | 65,000 | 130,000 |
| DeepSeek V4 Pro | 1,050 | 2,600 | 5,200 |
| DeepSeek V4 Flash | 13,000 | 32,500 | 65,000 |
| DeepSeek V4 Flash Vision Exp | 6,500 | 16,250 | 32,500 |
| Hy4 preview | 1,350 | 3,380 | 6,770 |
| Hy3 | 4,300 | 10,750 | 21,500 |
| Grok 4.6 | 169 | 423 | 845 |
| GPT 5.6 Luna | 2,050 | 5,100 | 10,250 |
Estimatene bruker følgende antall tokens per forespørsel; faktisk bruk varierer.
- Grok 4.6 — 390 input, 32 500 bufret, 120 output-tokens per forespørsel
- GLM-5.3-Flash — 1 000 input, 55 000 bufret, 200 output-tokens per forespørsel
- GLM-5.3/5.2/5.1 — 700 input, 52 000 bufret, 150 output-tokens per forespørsel
- GPT 5.6 Luna — 1 000 input, 50 000 bufret, 220 output-tokens per forespørsel
- Kimi K3 — 1 050 input, 76 500 bufret, 300 output-tokens per forespørsel
- Kimi K2.7/K2.6 — 870 input, 55 000 bufret, 200 output-tokens per forespørsel
- LongCat-2.0 — 920 input, 88 900 bufret, 200 output-tokens per forespørsel
- DeepSeek V4.1 Flash — 410 input, 71 300 bufret, 310 output-tokens per forespørsel
- DeepSeek V4 Pro — 750 input, 82 000 bufret, 290 output-tokens per forespørsel
- DeepSeek V4 Flash — 410 input, 71 300 bufret, 310 output-tokens per forespørsel
- DeepSeek V4 Flash Vision Exp — 410 input, 71 300 bufret, 310 output-tokens per forespørsel
- MiniMax M3 — 510 input, 56 000 bufret, 190 output-tokens per forespørsel
- MiniMax M2.7 — 300 input, 55 000 bufret, 125 output-tokens per forespørsel
- Muse Spark 1.3 Contributor — 620 input, 71 400 bufret, 300 output-tokens per forespørsel
- Muse Spark 1.2 Contributor — 620 input, 71 400 bufret, 300 output-tokens per forespørsel
- Qwen3.8 Max — 420 input, 66 000 bufret, 200 output-tokens per forespørsel
- Qwen3.8 Flash — 600 input, 58 000 bufret, 200 output-tokens per forespørsel
- Qwen3.7 Max — 420 input, 66 000 bufret, 200 output-tokens per forespørsel
- Qwen3.7 Plus — 500 input, 57 000 bufret, 190 output-tokens per forespørsel
- Qwen3.6 Plus — 500 input, 57 000 bufret, 190 output-tokens per forespørsel
- Hy4 preview — 830 input, 71 500 bufret, 295 output-tokens per forespørsel
- Hy3 — 830 input, 71 500 bufret, 295 output-tokens per forespørsel
- MiMo-V2.5 — 830 input, 71 500 bufret, 295 output-tokens per forespørsel
- MiMo-V2.5-Pro — 790 input, 86 000 bufret, 305 output-tokens per forespørsel
Du kan spore din nåværende bruk i konsollen.
Bruksgrenser kan endres etter hvert som vi lærer fra tidlig bruk og tilbakemeldinger.
Bruk utover grensene
Hvis du også har kreditt på din Zen-saldo, kan du aktivere alternativet Bruk saldo i konsollen. Når dette er aktivert, vil Go falle tilbake på din Zen-saldo etter at du har nådd bruksgrensene dine, i stedet for å blokkere forespørsler.
Hvorfor noen modeller har lavere bruk
Med Go betaler du $10/måned, og den inkluderte månedlige bruken varierer etter modell.
For de fleste modeller får vi dette til gjennom volumrabatter og reservert GPU-kapasitet. Deretter gir vi disse besparelsene videre til deg i form av mer månedlig bruk.
For noen modeller har vi ikke hatt muligheten til å forhandle frem en rabatt eller drifte dem til en lavere kostnad, enten fordi modellen er ny, eller fordi den offentlige prisen allerede er rabattert.
For disse modellene får du fortsatt litt mer enn om du betalte modellleverandørene direkte. Derfor er den inkluderte månedlige bruken deres lavere.
Endepunkter
Du kan også få tilgang til Go-modeller gjennom følgende API-endepunkter.
| Modell | Modell-ID | Endepunkt | AI SDK Package |
|---|---|---|---|
| Grok 4.6 | grok-4.6 | https://code.aicippy.com/zen/go/v1/responses | @ai-sdk/openai |
| GPT 5.6 Luna | gpt-5.6-luna | https://code.aicippy.com/zen/go/v1/responses | @ai-sdk/openai |
| GLM-5.3-Flash | glm-5.3-flash | https://code.aicippy.com/zen/go/v1/chat/completions | @ai-sdk/openai-compatible |
| GLM-5.3 | glm-5.3 | https://code.aicippy.com/zen/go/v1/chat/completions | @ai-sdk/openai-compatible |
| GLM-5.2 | glm-5.2 | https://code.aicippy.com/zen/go/v1/chat/completions | @ai-sdk/openai-compatible |
| GLM-5.1 | glm-5.1 | https://code.aicippy.com/zen/go/v1/chat/completions | @ai-sdk/openai-compatible |
| Kimi K3 | kimi-k3 | https://code.aicippy.com/zen/go/v1/chat/completions | @ai-sdk/openai-compatible |
| Kimi K2.7 Code | kimi-k2.7-code | https://code.aicippy.com/zen/go/v1/chat/completions | @ai-sdk/openai-compatible |
| Kimi K2.6 | kimi-k2.6 | https://code.aicippy.com/zen/go/v1/chat/completions | @ai-sdk/openai-compatible |
| LongCat-2.0 | longcat-2.0 | https://code.aicippy.com/zen/go/v1/chat/completions | @ai-sdk/openai-compatible |
| DeepSeek V4.1 Flash | deepseek-v4.1-flash | https://code.aicippy.com/zen/go/v1/chat/completions | @ai-sdk/openai-compatible |
| DeepSeek V4 Pro | deepseek-v4-pro | https://code.aicippy.com/zen/go/v1/chat/completions | @ai-sdk/openai-compatible |
| DeepSeek V4 Flash | deepseek-v4-flash | https://code.aicippy.com/zen/go/v1/chat/completions | @ai-sdk/openai-compatible |
| DeepSeek V4 Flash Vision Exp | deepseek-v4-flash-vision-exp | https://code.aicippy.com/zen/go/v1/chat/completions | @ai-sdk/openai-compatible |
| MiMo-V2.5 | mimo-v2.5 | https://code.aicippy.com/zen/go/v1/chat/completions | @ai-sdk/openai-compatible |
| MiMo-V2.5-Pro | mimo-v2.5-pro | https://code.aicippy.com/zen/go/v1/chat/completions | @ai-sdk/openai-compatible |
| MiniMax M3 | minimax-m3 | https://code.aicippy.com/zen/go/v1/messages | @ai-sdk/anthropic |
| MiniMax M2.7 | minimax-m2.7 | https://code.aicippy.com/zen/go/v1/messages | @ai-sdk/anthropic |
| MiniMax M2.5 | minimax-m2.5 | https://code.aicippy.com/zen/go/v1/messages | @ai-sdk/anthropic |
| Muse Spark 1.3 Contributor | muse-spark-1.3-contributor | https://code.aicippy.com/zen/go/v1/responses | @ai-sdk/openai |
| Muse Spark 1.2 Contributor | muse-spark-1.2-contributor | https://code.aicippy.com/zen/go/v1/responses | @ai-sdk/openai |
| Qwen3.8 Max | qwen3.8-max | https://code.aicippy.com/zen/go/v1/messages | @ai-sdk/anthropic |
| Qwen3.8 Flash | qwen3.8-flash | https://code.aicippy.com/zen/go/v1/messages | @ai-sdk/anthropic |
| Qwen3.7 Max | qwen3.7-max | https://code.aicippy.com/zen/go/v1/messages | @ai-sdk/anthropic |
| Qwen3.7 Plus | qwen3.7-plus | https://code.aicippy.com/zen/go/v1/messages | @ai-sdk/anthropic |
| Qwen3.6 Plus | qwen3.6-plus | https://code.aicippy.com/zen/go/v1/messages | @ai-sdk/anthropic |
| Hy4 preview | hy4-preview | https://code.aicippy.com/zen/go/v1/chat/completions | @ai-sdk/openai-compatible |
| Hy3 | hy3 | https://code.aicippy.com/zen/go/v1/chat/completions | @ai-sdk/openai-compatible |
Modell-ID-en i din AicippY-konfigurasjon
bruker formatet aicippy-code-go/<model-id>. For eksempel, for Kimi K3, vil du
bruke aicippy-code-go/kimi-k3 i konfigurasjonen din.
Modeller
Du kan hente hele listen over tilgjengelige modeller og metadataene deres fra:
https://code.aicippy.com/zen/go/v1/modelsPersonvern
| Modell | Modelltrening | Dataoppbevaring |
|---|---|---|
| Grok 4.6 | Brukes ikke | 30 dager |
| GPT 5.6 Luna | Brukes ikke | 30 dager |
| GLM-5.3-Flash | Brukes ikke | 0 dager |
| GLM-5.3 | Brukes ikke | 0 dager |
| GLM-5.2 | Brukes ikke | 0 dager |
| GLM-5.1 | Brukes ikke | 0 dager |
| Kimi K3 | Brukes ikke | 0 dager |
| Kimi K2.7 Code | Brukes ikke | 0 dager |
| Kimi K2.6 | Brukes ikke | 0 dager |
| LongCat-2.0 | Brukes ikke | 0 dager |
| MiMo-V2.5-Pro | Brukes ikke | 0 dager |
| MiMo-V2.5 | Brukes ikke | 0 dager |
| Qwen3.8 Max | Brukes ikke | 0 dager |
| Qwen3.8 Flash | Brukes ikke | 0 dager |
| Qwen3.7 Max | Brukes ikke | 0 dager |
| Qwen3.7 Plus | Brukes ikke | 0 dager |
| Qwen3.6 Plus | Brukes ikke | 0 dager |
| MiniMax M3 | Brukes ikke | 0 dager |
| MiniMax M2.7 | Brukes ikke | 0 dager |
| Muse Spark 1.3 Contributor | Ja | Ikke ZDR |
| Muse Spark 1.2 Contributor | Ja | Ikke ZDR |
| DeepSeek V4.1 Flash | Brukes ikke | 0 dager |
| DeepSeek V4 Pro | Brukes ikke | 0 dager |
| DeepSeek V4 Flash | Brukes ikke | 0 dager |
| DeepSeek V4 Flash Vision Exp | Brukes ikke | 0 dager |
| Hy4 preview | Brukes ikke | 0 dager |
| Hy3 | Brukes ikke | 0 dager |
- Grok 4.6: ZDR deaktiverer viktige API-funksjoner som er avhengige av lagrede data, inkludert den tilstandsbaserte Responses API, Files and Collections og Batch API. Les mer.
- GPT 5.6 Luna: Logger for overvåking av misbruk genereres for all bruk av API-funksjoner og oppbevares i opptil 30 dager. Les mer.
- Muse Spark 1.3 Contributor: Kraftig rabatterte tokenpriser i bytte mot tillatelse til å bruke ledetekstene og fullføringene dine til å trene fremtidige Meta-modeller. Tilgjengeligheten er begrenset til regioner som er tillatt i henhold til retningslinjene for geografisk bruk fra Meta. Les mer.
- Muse Spark 1.2 Contributor: Kraftig rabatterte tokenpriser i bytte mot tillatelse til å bruke ledetekstene og fullføringene dine til å trene fremtidige Meta-modeller. Tilgjengeligheten er begrenset til regioner som er tillatt i henhold til retningslinjene for geografisk bruk fra Meta. Les mer.
- DeepSeek: ZDR-avtalen fornyes månedlig. Den gjeldende avtalen er gyldig til og med 30. september 2026.
Mål
Vi opprettet AicippY Go for å:
- Gjøre AI-koding tilgjengelig for flere mennesker med et lavkostnadsabonnement.
- Gi pålitelig tilgang til de beste åpne kodemodellene.
- Kuratere modeller som er testet og ytelsesmålt for bruk av kodeagenter.
- Ha ingen innelåsing ved å la deg bruke en hvilken som helst annen leverandør med AicippY også.