Przejdź do głównej zawartości

Go

Niskokosztowa subskrypcja na otwarte modele do kodowania.

AicippY Go to niskokosztowa subskrypcja za 10 $/miesiąc, która zapewnia niezawodny dostęp do popularnych otwartych modeli do kodowania.

Go działa jak każdy inny dostawca w AicippY. Subskrybujesz AicippY Go i otrzymujesz swój klucz API. Jest to całkowicie opcjonalne i nie musisz z tego korzystać, aby używać AicippY.

Jest przeznaczony przede wszystkim dla użytkowników z całego świata i zapewnia stabilny dostęp globalny.


Tło

Otwarte modele stały się naprawdę dobre. Obecnie osiągają wydajność zbliżoną do modeli własnościowych w zadaniach związanych z kodowaniem. A ponieważ wielu dostawców może je oferować konkurencyjnie, są one zazwyczaj znacznie tańsze.

Jednak uzyskanie do nich niezawodnego dostępu o niskich opóźnieniach może być trudne. Dostawcy różnią się pod względem jakości i dostępności.

Aby to naprawić, zrobiliśmy kilka rzeczy:

  1. Przetestowaliśmy wybraną grupę otwartych modeli i porozmawialiśmy z ich zespołami na temat najlepszych sposobów ich uruchamiania.
  2. Następnie nawiązaliśmy współpracę z kilkoma dostawcami, aby upewnić się, że są one obsługiwane poprawnie.
  3. Na koniec przetestowaliśmy kombinację modelu/dostawcy i stworzyliśmy listę, którą możemy z przekonaniem polecić.

AicippY Go daje Ci dostęp do tych modeli za 10 $/miesiąc.


Jak to działa

AicippY Go działa jak każdy inny dostawca w AicippY.

  1. Logujesz się do AicippY Zen, subskrybujesz Go i kopiujesz swój klucz API.
  2. Uruchamiasz komendę /connect w TUI, wybierasz AicippY Go i wklejasz swój klucz API.
  3. Uruchom /models w TUI, aby zobaczyć listę modeli dostępnych w ramach Go.

Obecna lista modeli obejmuje:

  • Grok 4.6
  • GLM-5.3-Flash
  • GLM-5.3
  • GLM-5.2
  • GLM-5.1
  • GPT 5.6 Luna
  • Kimi K3
  • Kimi K2.7 Code
  • Kimi K2.6
  • LongCat-2.0
  • MiMo-V2.5
  • MiMo-V2.5-Pro
  • MiniMax M3
  • MiniMax M2.7
  • Muse Spark 1.3 Contributor (ograniczone regiony)
  • Muse Spark 1.2 Contributor (ograniczone regiony)
  • Qwen3.8 Max
  • Qwen3.8 Flash
  • Qwen3.7 Max
  • Qwen3.7 Plus
  • Qwen3.6 Plus
  • DeepSeek V4.1 Flash
  • DeepSeek V4 Pro
  • DeepSeek V4 Flash
  • DeepSeek V4 Flash Vision Exp
  • Hy4 preview
  • Hy3

Lista modeli może ulec zmianie w miarę testowania i dodawania nowych.


Gdzie można z tego korzystać?

AicippY Go jest przeznaczony dla AicippY i innych agentów kodujących, którzy wysyłają podobne rodzaje żądań. Ruch jest monitorowany pod kątem nadużyć, które pogarszają komfort korzystania z usługi przez innych użytkowników.

Twój klient powinien:

  1. Wysyłać ruch typowy dla agenta kodującego.
  2. Identyfikować się za pomocą własnego user agenta, na przykład my-coding-agent/1.0, zamiast ogólnej nazwy SDK lub biblioteki HTTP.
  3. Wysyłać stabilny identyfikator sesji w nagłówku x-aicippy-code-session dla każdej rozmowy, aby umożliwić optymalizację routingu i buforowania promptów.

Zweryfikowane klienty

Poza AicippY zweryfikowano, że poniżsi klienci działają prawidłowo z AicippY Go. Nie gwarantujemy jednak, że będą nadal działać w przyszłości.

KlientObsługa sesji
HermesKompilacje zawierające PR #101864 wysyłają nagłówek w głównych i pomocniczych żądaniach AicippY. Poprawkę scalono po wersji v0.21.0; samo to wydanie jej nie zawiera.
Claude CodeGo rozpoznaje jego natywny nagłówek sesji. Wrapper dodający niestandardowy nagłówek nie jest potrzebny.
CodexGo rozpoznaje jego natywny nagłówek sesji. Niektóre wersje i konfiguracje proxy nadal go pomijają; podczas przekazywania żądań należy zachować nagłówek sesji.
ZCodeGo rozpoznaje jego natywny nagłówek sesji. Nasza prośba o x-aicippy-code-session pozostaje otwarta, ale wysyłanie tego konkretnego nagłówka nie jest już konieczne.
PiAktualne kompilacje wysyłają informacje o sesji dla AicippY. Zaktualizuj starsze instalacje.
jcodeZaktualizuj do wersji v0.81.6 lub nowszej, która zawiera poprawkę nagłówka sesji.
Kilo Code CLIKompilacje zawierające PR #13752 przywracają nagłówki sesji AicippY. Ta poprawka obejmuje CLI, ale nie rozszerzenie VS Code. Zobacz issue #13723.

Klienty ze znanymi problemami

W badanych przez nas wersjach tych klientów obsługa sesji jest niepełna lub jej brakuje. Raporty pod podanymi linkami służą do śledzenia poprawek i obejść.

KlientStan i śledzenie
DeepSeek HarnessInformacje o sesji docierają w niektórych ścieżkach modeli, ale brakuje ich w innych. Rozpoznajemy jego natywny nagłówek; pozostaje zapewnić jego wysyłanie przez wszystkie adaptery. Discussion #5495.
GitHub Copilot ChatProśbę o automatyczną obsługę nagłówka sesji zgłoszono w VS Code issue #334186.
Kimi CodeProśbę o automatyczną obsługę nagłówka sesji zgłoszono w issue #3506.
MiMo CodeDla issue #2317 zaproponowano poprawkę w PR #2327, który nie został jeszcze scalony.

Limity użycia

Limity użycia są określane jako miesięczne kwoty w dolarach. Poniższa tabela przedstawia miesięczny limit i koszty tokenów dla każdego modelu.

Każdy model ma następujące limity użycia: 5-godzinny — 20% miesięcznego limitu; tygodniowy — 50%; miesięczny — 100%.

Na przykład, jeśli model ma miesięczny limit $60, możesz wykorzystać do:

  • Limit 5-godzinny — użycie o wartości $12
  • Limit tygodniowy — użycie o wartości $30
  • Limit miesięczny — użycie o wartości $60

Ceny tokenów podano za 1M tokenów.

ModelWejścieWyjścieOdczyt z cacheZapis do cacheLimit miesięczny
GLM-5.3-Flash$0.15$0.50$0.03-$60
GLM-5.3$1.40$4.40$0.26-$15
GLM-5.2$1.40$4.40$0.26-$60
GLM-5.1$1.40$4.40$0.26-$60
Kimi K3$3.00$15.00$0.30-$15
Kimi K2.7 Code$0.95$4.00$0.19-$60
Kimi K2.6$0.95$4.00$0.16-$60
LongCat-2.0$0.30$1.20$0.006-$60
MiMo V2.5$0.14$0.28$0.0028-$60
MiMo V2.5 Pro$0.435$0.87$0.003625-$15
MiniMax M3$0.30$1.20$0.06-$60
MiniMax M2.7$0.30$1.20$0.06$0.375$60
MiniMax M2.5$0.30$1.20$0.06$0.375$60
Muse Spark 1.3 Contributor$0.10$0.20$0.002-$60
Muse Spark 1.2 Contributor$0.10$0.20$0.002-$60
Qwen3.8 Max$2.00$6.00$0.25$2.50$15
Qwen3.8 Flash$0.15$0.47$0.016$0.20$30
Qwen3.7 Max$2.50$7.50$0.50$3.125$30
Qwen3.7 Plus (≤ 256K tokens)$0.40$1.60$0.04$0.50$60
Qwen3.7 Plus (> 256K tokens)$1.20$4.80$0.12$1.50$60
Qwen3.6 Plus (≤ 256K tokens)$0.50$3.00$0.05$0.625$60
Qwen3.6 Plus (> 256K tokens)$2.00$6.00$0.20$2.50$60
DeepSeek V4.1 Flash (Off-Peak)$0.15$0.60$0.003-$15 $60
4x · Do 20 września
DeepSeek V4.1 Flash (Peak)$0.30$1.20$0.006-$15 $60
4x · Do 20 września
DeepSeek V4 Pro (Off-Peak)$0.66$1.98$0.022-$15
DeepSeek V4 Pro (Peak)$1.32$3.96$0.044-$15
DeepSeek V4 Flash (Off-Peak)$0.15$0.60$0.003-$30
DeepSeek V4 Flash (Peak)$0.30$1.20$0.006-$30
DeepSeek V4 Flash Vision Exp (Off-Peak)$0.15$0.60$0.003-$15
DeepSeek V4 Flash Vision Exp (Peak)$0.30$1.20$0.006-$15
Hy4 preview$0.834$2.501$0.042-$30
Hy3$0.14$0.58$0.035-$60
Grok 4.6 (≤ 200K tokens)$2.00$6.00$0.50-$15
Grok 4.6 (> 200K tokens)$4.00$12.00$1.00-$15
GPT 5.6 Luna (≤ 272K tokens)$0.20$1.20$0.02$0.25$15
GPT 5.6 Luna (> 272K tokens)$0.40$1.80$0.04$0.50$15

DeepSeek V4.1 Flash / V4 Pro / V4 Flash / V4 Flash Vision Exp: Godziny Peak to 01:00-04:00 i 06:00-10:00 UTC od poniedziałku do piątku; wszystkie pozostałe godziny, w tym weekendy, to Off-Peak. Dowiedz się więcej.

DeepSeek V4 Flash Vision Exp: Obrazy są przeliczane na tokeny na podstawie ich wymiarów i rozliczane jako tokeny wejściowe razem z tokenami tekstowymi. Dowiedz się więcej.

Szacunkowa liczba żądań

Poniższa tabela przedstawia szacunkową liczbę żądań na podstawie typowych wzorców korzystania z Go:

Modelżądania na 5 godzinżądania na tydzieńżądania na miesiąc
GLM-5.3-Flash6,32015,79031,580
GLM-5.32205401,080
GLM-5.28802,1504,300
GLM-5.18802,1504,300
Kimi K3110250490
Kimi K2.7 Code1,3503,3806,750
Kimi K2.61,1502,8805,750
LongCat-2.011,40028,60057,200
MiMo-V2.530,10075,200150,400
MiMo-V2.5-Pro3,2508,15016,300
MiniMax M33,2008,00016,000
MiniMax M2.73,4008,50017,000
Muse Spark 1.3 Contributor45,300113,300226,600
Muse Spark 1.2 Contributor45,300113,300226,600
Qwen3.8 Max160400810
Qwen3.8 Flash5,40013,50027,000
Qwen3.7 Max170420840
Qwen3.7 Plus4,30010,80021,600
Qwen3.6 Plus3,3008,20016,300
DeepSeek V4.1 Flash
4x · Do 20 września
6,500
26,000
16,250
65,000
32,500
130,000
DeepSeek V4 Pro1,0502,6005,200
DeepSeek V4 Flash13,00032,50065,000
DeepSeek V4 Flash Vision Exp6,50016,25032,500
Hy4 preview1,3503,3806,770
Hy34,30010,75021,500
Grok 4.6169423845
GPT 5.6 Luna2,0505,10010,250

Szacunki wykorzystują następującą liczbę tokenów na żądanie; rzeczywiste użycie jest zmienne.

  • Grok 4.6 — 390 tokenów wejściowych, 32 500 w pamięci podręcznej, 120 tokenów wyjściowych na żądanie
  • GLM-5.3-Flash — 1 000 tokenów wejściowych, 55 000 w pamięci podręcznej, 200 tokenów wyjściowych na żądanie
  • GLM-5.3/5.2/5.1 — 700 tokenów wejściowych, 52 000 w pamięci podręcznej, 150 tokenów wyjściowych na żądanie
  • GPT 5.6 Luna — 1 000 tokenów wejściowych, 50 000 w pamięci podręcznej, 220 tokenów wyjściowych na żądanie
  • Kimi K3 — 1 050 tokenów wejściowych, 76 500 w pamięci podręcznej, 300 tokenów wyjściowych na żądanie
  • Kimi K2.7/K2.6 — 870 tokenów wejściowych, 55 000 w pamięci podręcznej, 200 tokenów wyjściowych na żądanie
  • LongCat-2.0 — 920 tokenów wejściowych, 88 900 w pamięci podręcznej, 200 tokenów wyjściowych na żądanie
  • DeepSeek V4.1 Flash — 410 tokenów wejściowych, 71 300 w pamięci podręcznej, 310 tokenów wyjściowych na żądanie
  • DeepSeek V4 Pro — 750 tokenów wejściowych, 82 000 w pamięci podręcznej, 290 tokenów wyjściowych na żądanie
  • DeepSeek V4 Flash — 410 tokenów wejściowych, 71 300 w pamięci podręcznej, 310 tokenów wyjściowych na żądanie
  • DeepSeek V4 Flash Vision Exp — 410 tokenów wejściowych, 71 300 w pamięci podręcznej, 310 tokenów wyjściowych na żądanie
  • MiniMax M3 — 510 tokenów wejściowych, 56 000 w pamięci podręcznej, 190 tokenów wyjściowych na żądanie
  • MiniMax M2.7 — 300 tokenów wejściowych, 55 000 w pamięci podręcznej, 125 tokenów wyjściowych na żądanie
  • Muse Spark 1.3 Contributor — 620 tokenów wejściowych, 71 400 w pamięci podręcznej, 300 tokenów wyjściowych na żądanie
  • Muse Spark 1.2 Contributor — 620 tokenów wejściowych, 71 400 w pamięci podręcznej, 300 tokenów wyjściowych na żądanie
  • Qwen3.8 Max — 420 tokenów wejściowych, 66 000 w pamięci podręcznej, 200 tokenów wyjściowych na żądanie
  • Qwen3.8 Flash — 600 tokenów wejściowych, 58 000 w pamięci podręcznej, 200 tokenów wyjściowych na żądanie
  • Qwen3.7 Max — 420 tokenów wejściowych, 66 000 w pamięci podręcznej, 200 tokenów wyjściowych na żądanie
  • Qwen3.7 Plus — 500 tokenów wejściowych, 57 000 w pamięci podręcznej, 190 tokenów wyjściowych na żądanie
  • Qwen3.6 Plus — 500 tokenów wejściowych, 57 000 w pamięci podręcznej, 190 tokenów wyjściowych na żądanie
  • Hy4 preview — 830 tokenów wejściowych, 71 500 w pamięci podręcznej, 295 tokenów wyjściowych na żądanie
  • Hy3 — 830 tokenów wejściowych, 71 500 w pamięci podręcznej, 295 tokenów wyjściowych na żądanie
  • MiMo-V2.5 — 830 tokenów wejściowych, 71 500 w pamięci podręcznej, 295 tokenów wyjściowych na żądanie
  • MiMo-V2.5-Pro — 790 tokenów wejściowych, 86 000 w pamięci podręcznej, 305 tokenów wyjściowych na żądanie

Możesz śledzić swoje bieżące zużycie w konsoli.

Limity użycia mogą ulec zmianie w miarę wyciągania wniosków z wczesnego użytkowania i opinii.


Użycie ponad limity

Jeśli masz również środki na swoim saldzie Zen, możesz włączyć opcję Użyj salda (Use balance) w konsoli. Po włączeniu Go będzie korzystać z Twojego salda Zen po osiągnięciu limitów użycia zamiast blokować żądania.


Dlaczego niektóre modele mają niższe limity użycia

Go kosztuje $10/miesiąc, a miesięczne użycie w ramach subskrypcji różni się w zależności od modelu.

W przypadku większości modeli jest to możliwe dzięki rabatom hurtowym i zarezerwowanej mocy obliczeniowej GPU. Uzyskane w ten sposób oszczędności przekazujemy Tobie w postaci większego miesięcznego użycia.

W przypadku niektórych modeli nie mieliśmy jeszcze możliwości wynegocjowania rabatu ani hostowania ich po niższym koszcie, ponieważ model jest nowy lub jego publiczny cennik już uwzględnia rabat.

W przypadku tych modeli nadal otrzymujesz nieco więcej, niż płacąc bezpośrednio ich dostawcom. Dlatego ich miesięczne użycie w ramach subskrypcji jest niższe.


Punkty końcowe

Możesz również uzyskać dostęp do modeli Go za pośrednictwem następujących punktów końcowych API.

ModelID modeluPunkt końcowyPakiet AI SDK
Grok 4.6grok-4.6https://code.aicippy.com/zen/go/v1/responses@ai-sdk/openai
GPT 5.6 Lunagpt-5.6-lunahttps://code.aicippy.com/zen/go/v1/responses@ai-sdk/openai
GLM-5.3-Flashglm-5.3-flashhttps://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
GLM-5.3glm-5.3https://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
GLM-5.2glm-5.2https://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
GLM-5.1glm-5.1https://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
Kimi K3kimi-k3https://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
Kimi K2.7 Codekimi-k2.7-codehttps://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
Kimi K2.6kimi-k2.6https://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
LongCat-2.0longcat-2.0https://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
DeepSeek V4.1 Flashdeepseek-v4.1-flashhttps://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
DeepSeek V4 Prodeepseek-v4-prohttps://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
DeepSeek V4 Flashdeepseek-v4-flashhttps://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
DeepSeek V4 Flash Vision Expdeepseek-v4-flash-vision-exphttps://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
MiMo-V2.5mimo-v2.5https://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
MiMo-V2.5-Promimo-v2.5-prohttps://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
MiniMax M3minimax-m3https://code.aicippy.com/zen/go/v1/messages@ai-sdk/anthropic
MiniMax M2.7minimax-m2.7https://code.aicippy.com/zen/go/v1/messages@ai-sdk/anthropic
MiniMax M2.5minimax-m2.5https://code.aicippy.com/zen/go/v1/messages@ai-sdk/anthropic
Muse Spark 1.3 Contributormuse-spark-1.3-contributorhttps://code.aicippy.com/zen/go/v1/responses@ai-sdk/openai
Muse Spark 1.2 Contributormuse-spark-1.2-contributorhttps://code.aicippy.com/zen/go/v1/responses@ai-sdk/openai
Qwen3.8 Maxqwen3.8-maxhttps://code.aicippy.com/zen/go/v1/messages@ai-sdk/anthropic
Qwen3.8 Flashqwen3.8-flashhttps://code.aicippy.com/zen/go/v1/messages@ai-sdk/anthropic
Qwen3.7 Maxqwen3.7-maxhttps://code.aicippy.com/zen/go/v1/messages@ai-sdk/anthropic
Qwen3.7 Plusqwen3.7-plushttps://code.aicippy.com/zen/go/v1/messages@ai-sdk/anthropic
Qwen3.6 Plusqwen3.6-plushttps://code.aicippy.com/zen/go/v1/messages@ai-sdk/anthropic
Hy4 previewhy4-previewhttps://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
Hy3hy3https://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible

ID modelu w Twojej konfiguracji AicippY używa formatu aicippy-code-go/<model-id>. Na przykład dla Kimi K3 należy użyć aicippy-code-go/kimi-k3 w swojej konfiguracji.


Modele

Pełną listę dostępnych modeli i ich metadane możesz pobrać z:

https://code.aicippy.com/zen/go/v1/models

Prywatność

ModelTrenowanie modeluRetencja danych
Grok 4.6Niewykorzystywane30 dni
GPT 5.6 LunaNiewykorzystywane30 dni
GLM-5.3-FlashNiewykorzystywane0 dni
GLM-5.3Niewykorzystywane0 dni
GLM-5.2Niewykorzystywane0 dni
GLM-5.1Niewykorzystywane0 dni
Kimi K3Niewykorzystywane0 dni
Kimi K2.7 CodeNiewykorzystywane0 dni
Kimi K2.6Niewykorzystywane0 dni
LongCat-2.0Niewykorzystywane0 dni
MiMo-V2.5-ProNiewykorzystywane0 dni
MiMo-V2.5Niewykorzystywane0 dni
Qwen3.8 MaxNiewykorzystywane0 dni
Qwen3.8 FlashNiewykorzystywane0 dni
Qwen3.7 MaxNiewykorzystywane0 dni
Qwen3.7 PlusNiewykorzystywane0 dni
Qwen3.6 PlusNiewykorzystywane0 dni
MiniMax M3Niewykorzystywane0 dni
MiniMax M2.7Niewykorzystywane0 dni
Muse Spark 1.3 ContributorTakNie ZDR
Muse Spark 1.2 ContributorTakNie ZDR
DeepSeek V4.1 FlashNiewykorzystywane0 dni
DeepSeek V4 ProNiewykorzystywane0 dni
DeepSeek V4 FlashNiewykorzystywane0 dni
DeepSeek V4 Flash Vision ExpNiewykorzystywane0 dni
Hy4 previewNiewykorzystywane0 dni
Hy3Niewykorzystywane0 dni
  • Grok 4.6: ZDR wyłącza ważne funkcje API zależne od przechowywanych danych, w tym stanowy Responses API, Files and Collections oraz Batch API. Dowiedz się więcej.
  • GPT 5.6 Luna: Dzienniki monitorowania nadużyć są generowane dla każdego użycia funkcji API i przechowywane przez maksymalnie 30 dni. Dowiedz się więcej.
  • Muse Spark 1.3 Contributor: Znacznie obniżone ceny tokenów w zamian za zgodę na wykorzystanie Twoich promptów i odpowiedzi do trenowania przyszłych modeli Meta. Dostępność jest ograniczona do regionów dozwolonych przez Zasady korzystania w poszczególnych regionach geograficznych firmy Meta. Dowiedz się więcej.
  • Muse Spark 1.2 Contributor: Znacznie obniżone ceny tokenów w zamian za zgodę na wykorzystanie Twoich promptów i odpowiedzi do trenowania przyszłych modeli Meta. Dostępność jest ograniczona do regionów dozwolonych przez Zasady korzystania w poszczególnych regionach geograficznych firmy Meta. Dowiedz się więcej.
  • DeepSeek: Umowa ZDR jest odnawiana co miesiąc. Obecna umowa obowiązuje do 30 września 2026 r.

Cele

Stworzyliśmy AicippY Go, aby:

  1. Uczynić kodowanie z pomocą sztucznej inteligencji dostępnym dla większej liczby osób dzięki niskokosztowej subskrypcji.
  2. Zapewnić niezawodny dostęp do najlepszych otwartych modeli do kodowania.
  3. Wybierać modele, które są przetestowane i sprawdzone w testach wydajności do użytku przez agentów kodujących.
  4. Zapewnić brak ograniczeń (no lock-in), pozwalając na korzystanie z dowolnego innego dostawcy wraz z AicippY.