Aller au contenu

Go

Abonnement à bas coût pour les modèles de codage ouverts.

AicippY Go est un abonnement à bas coût à 10 $/mois qui vous donne un accès fiable aux modèles de codage ouverts populaires.

Go fonctionne comme n’importe quel autre fournisseur dans AicippY. Vous vous abonnez à AicippY Go et obtenez votre clé d’API. C’est totalement facultatif et vous n’avez pas besoin de l’utiliser pour utiliser AicippY.

Il est conçu principalement pour les utilisateurs internationaux et offre un accès mondial stable.


Contexte

Les modèles ouverts sont devenus vraiment performants. Ils atteignent désormais des performances proches de celles des modèles propriétaires pour les tâches de codage. Et comme de nombreux fournisseurs peuvent les proposer de manière compétitive, ils sont généralement beaucoup moins chers.

Cependant, obtenir un accès fiable et à faible latence à ces modèles peut être difficile. Les fournisseurs varient en qualité et en disponibilité.

Pour remédier à cela, nous avons fait plusieurs choses :

  1. Nous avons testé un groupe sélectionné de modèles ouverts et discuté avec leurs équipes de la meilleure façon de les exécuter.
  2. Nous avons ensuite travaillé avec quelques fournisseurs pour nous assurer qu’ils étaient correctement servis.
  3. Enfin, nous avons évalué les performances de la combinaison modèle/fournisseur et avons dressé une liste que nous nous sentons à l’aise de recommander.

AicippY Go vous donne accès à ces modèles pour 10 $/mois.


Comment ça marche

AicippY Go fonctionne comme n’importe quel autre fournisseur dans AicippY.

  1. Vous vous connectez à AicippY Zen, vous vous abonnez à Go et copiez votre clé d’API.
  2. Vous exécutez la commande /connect dans la TUI, sélectionnez AicippY Go et collez votre clé d’API.
  3. Exécutez /models dans la TUI pour voir la liste des modèles disponibles via Go.

La liste actuelle des modèles comprend :

  • Grok 4.6
  • GLM-5.3-Flash
  • GLM-5.3
  • GLM-5.2
  • GLM-5.1
  • GPT 5.6 Luna
  • Kimi K3
  • Kimi K2.7 Code
  • Kimi K2.6
  • LongCat-2.0
  • MiMo-V2.5
  • MiMo-V2.5-Pro
  • MiniMax M3
  • MiniMax M2.7
  • Muse Spark 1.3 Contributor (régions limitées)
  • Muse Spark 1.2 Contributor (régions limitées)
  • Qwen3.8 Max
  • Qwen3.8 Flash
  • Qwen3.7 Max
  • Qwen3.7 Plus
  • Qwen3.6 Plus
  • DeepSeek V4.1 Flash
  • DeepSeek V4 Pro
  • DeepSeek V4 Flash
  • DeepSeek V4 Flash Vision Exp
  • Hy4 preview
  • Hy3

La liste des modèles peut changer au fur et à mesure que nous en testons et en ajoutons de nouveaux.


Où puis-je l’utiliser ?

AicippY Go est conçu pour AicippY et d’autres agents de codage qui produisent des types de requêtes similaires. Le trafic est surveillé afin de détecter les abus qui dégradent l’expérience des autres utilisateurs.

Votre client doit :

  1. Envoyer le trafic habituel d’un agent de codage
  2. S’identifier avec son propre agent utilisateur, tel que my-coding-agent/1.0, plutôt qu’avec le nom générique d’un SDK ou d’une bibliothèque HTTP.
  3. Envoyer un ID de session stable dans x-aicippy-code-session pour chaque conversation afin que nous puissions optimiser le routage et la mise en cache des prompts.

Clients validés

Outre AicippY, le bon fonctionnement des clients suivants avec AicippY Go a été validé. Nous ne garantissons toutefois pas qu’ils continueront à fonctionner à l’avenir.

ClientPrise en charge des sessions
HermesLes builds contenant la PR #101864 envoient l’en-tête sur les requêtes AicippY principales et auxiliaires. Le correctif a été fusionné après la v0.21.0 ; cette version seule ne l’inclut pas.
Claude CodeGo reconnaît son en-tête de session natif. Aucun wrapper d’en-tête personnalisé n’est nécessaire.
CodexGo reconnaît son en-tête de session natif. Certaines versions et configurations de proxy l’omettent encore ; conservez l’en-tête de session lors du transfert des requêtes.
ZCodeGo reconnaît son en-tête de session natif. Notre demande concernant x-aicippy-code-session reste ouverte, mais il n’est plus nécessaire d’envoyer spécifiquement cet en-tête.
PiLes builds actuels envoient les informations de session pour AicippY. Mettez à jour les installations plus anciennes.
jcodePassez à la version v0.81.6 ou ultérieure, qui inclut le correctif de l’en-tête de session.
Kilo Code CLILes builds contenant la PR #13752 rétablissent les en-têtes de session AicippY. Ce correctif concerne la CLI, pas l’extension VS Code. Consultez l’issue #13723.

Clients connus pour poser problème

Dans les versions que nous avons examinées, ces clients ne prennent pas en charge les sessions ou ne les prennent en charge que partiellement. Les rapports associés permettent de suivre les correctifs et les solutions de contournement.

ClientÉtat et suivi
DeepSeek HarnessLes informations de session sont présentes pour certains chemins de modèles, mais absentes pour d’autres. Nous reconnaissons son en-tête natif ; il reste à l’envoyer depuis tous les adaptateurs. Discussion #5495.
GitHub Copilot ChatLa prise en charge automatique de l’en-tête de session fait l’objet de l’issue VS Code #334186.
Kimi CodeLa prise en charge automatique de l’en-tête de session fait l’objet de l’issue #3506.
MiMo CodeL’issue #2317 dispose d’un correctif proposé dans la PR #2327, qui n’a pas encore été fusionnée.

Limites d’utilisation

Les limites d’utilisation sont définies sous forme de montants mensuels en dollars. Le tableau ci-dessous indique la limite mensuelle et les prix des tokens pour chaque modèle.

Chaque modèle est soumis aux limites d’utilisation suivantes : 5 heures — 20 % de la limite mensuelle ; hebdomadaire — 50 % ; et mensuelle — 100 %.

Par exemple, si un modèle a une limite mensuelle de $60, vous pouvez utiliser jusqu’à :

  • Limite de 5 heures — $12 d’utilisation
  • Limite hebdomadaire — $30 d’utilisation
  • Limite mensuelle — $60 d’utilisation

Les prix des tokens sont indiqués par million de tokens.

ModèleInputOutputCached ReadCached WriteLimite mensuelle
GLM-5.3-Flash$0.15$0.50$0.03-$60
GLM-5.3$1.40$4.40$0.26-$15
GLM-5.2$1.40$4.40$0.26-$60
GLM-5.1$1.40$4.40$0.26-$60
Kimi K3$3.00$15.00$0.30-$15
Kimi K2.7 Code$0.95$4.00$0.19-$60
Kimi K2.6$0.95$4.00$0.16-$60
LongCat-2.0$0.30$1.20$0.006-$60
MiMo V2.5$0.14$0.28$0.0028-$60
MiMo V2.5 Pro$0.435$0.87$0.003625-$15
MiniMax M3$0.30$1.20$0.06-$60
MiniMax M2.7$0.30$1.20$0.06$0.375$60
MiniMax M2.5$0.30$1.20$0.06$0.375$60
Muse Spark 1.3 Contributor$0.10$0.20$0.002-$60
Muse Spark 1.2 Contributor$0.10$0.20$0.002-$60
Qwen3.8 Max$2.00$6.00$0.25$2.50$15
Qwen3.8 Flash$0.15$0.47$0.016$0.20$30
Qwen3.7 Max$2.50$7.50$0.50$3.125$30
Qwen3.7 Plus (≤ 256K tokens)$0.40$1.60$0.04$0.50$60
Qwen3.7 Plus (> 256K tokens)$1.20$4.80$0.12$1.50$60
Qwen3.6 Plus (≤ 256K tokens)$0.50$3.00$0.05$0.625$60
Qwen3.6 Plus (> 256K tokens)$2.00$6.00$0.20$2.50$60
DeepSeek V4.1 Flash (Off-Peak)$0.15$0.60$0.003-$15 $60
4x · Fin le 20 sept.
DeepSeek V4.1 Flash (Peak)$0.30$1.20$0.006-$15 $60
4x · Fin le 20 sept.
DeepSeek V4 Pro (Off-Peak)$0.66$1.98$0.022-$15
DeepSeek V4 Pro (Peak)$1.32$3.96$0.044-$15
DeepSeek V4 Flash (Off-Peak)$0.15$0.60$0.003-$30
DeepSeek V4 Flash (Peak)$0.30$1.20$0.006-$30
DeepSeek V4 Flash Vision Exp (Off-Peak)$0.15$0.60$0.003-$15
DeepSeek V4 Flash Vision Exp (Peak)$0.30$1.20$0.006-$15
Hy4 preview$0.834$2.501$0.042-$30
Hy3$0.14$0.58$0.035-$60
Grok 4.6 (≤ 200K tokens)$2.00$6.00$0.50-$15
Grok 4.6 (> 200K tokens)$4.00$12.00$1.00-$15
GPT 5.6 Luna (≤ 272K tokens)$0.20$1.20$0.02$0.25$15
GPT 5.6 Luna (> 272K tokens)$0.40$1.80$0.04$0.50$15

DeepSeek V4.1 Flash / V4 Pro / V4 Flash / V4 Flash Vision Exp: Les heures Peak sont 01:00-04:00 et 06:00-10:00 UTC, du lundi au vendredi ; toutes les autres heures, y compris le week-end, sont Off-Peak. En savoir plus.

DeepSeek V4 Flash Vision Exp: Les images sont converties en tokens selon leurs dimensions et facturées comme tokens d’entrée avec les tokens de texte. En savoir plus.

Requêtes estimées

Le tableau ci-dessous fournit une estimation du nombre de requêtes basée sur les habitudes d’utilisation typiques de Go :

Modelrequêtes par 5 heuresrequêtes par semainerequêtes par mois
GLM-5.3-Flash6,32015,79031,580
GLM-5.32205401,080
GLM-5.28802,1504,300
GLM-5.18802,1504,300
Kimi K3110250490
Kimi K2.7 Code1,3503,3806,750
Kimi K2.61,1502,8805,750
LongCat-2.011,40028,60057,200
MiMo-V2.530,10075,200150,400
MiMo-V2.5-Pro3,2508,15016,300
MiniMax M33,2008,00016,000
MiniMax M2.73,4008,50017,000
Muse Spark 1.3 Contributor45,300113,300226,600
Muse Spark 1.2 Contributor45,300113,300226,600
Qwen3.8 Max160400810
Qwen3.8 Flash5,40013,50027,000
Qwen3.7 Max170420840
Qwen3.7 Plus4,30010,80021,600
Qwen3.6 Plus3,3008,20016,300
DeepSeek V4.1 Flash
4x · Fin le 20 sept.
6,500
26,000
16,250
65,000
32,500
130,000
DeepSeek V4 Pro1,0502,6005,200
DeepSeek V4 Flash13,00032,50065,000
DeepSeek V4 Flash Vision Exp6,50016,25032,500
Hy4 preview1,3503,3806,770
Hy34,30010,75021,500
Grok 4.6169423845
GPT 5.6 Luna2,0505,10010,250

Les estimations utilisent les nombres de tokens suivants par requête ; l’utilisation réelle varie.

  • Grok 4.6 — 390 tokens en entrée, 32,500 en cache, 120 tokens en sortie par requête
  • GLM-5.3-Flash — 1,000 tokens en entrée, 55,000 en cache, 200 tokens en sortie par requête
  • GLM-5.3/5.2/5.1 — 700 tokens en entrée, 52,000 en cache, 150 tokens en sortie par requête
  • GPT 5.6 Luna — 1,000 tokens en entrée, 50,000 en cache, 220 tokens en sortie par requête
  • Kimi K3 — 1,050 tokens en entrée, 76,500 en cache, 300 tokens en sortie par requête
  • Kimi K2.7/K2.6 — 870 tokens en entrée, 55,000 en cache, 200 tokens en sortie par requête
  • LongCat-2.0 — 920 tokens en entrée, 88,900 en cache, 200 tokens en sortie par requête
  • DeepSeek V4.1 Flash — 410 tokens en entrée, 71,300 en cache, 310 tokens en sortie par requête
  • DeepSeek V4 Pro — 750 tokens en entrée, 82,000 en cache, 290 tokens en sortie par requête
  • DeepSeek V4 Flash — 410 tokens en entrée, 71,300 en cache, 310 tokens en sortie par requête
  • DeepSeek V4 Flash Vision Exp — 410 tokens en entrée, 71,300 en cache, 310 tokens en sortie par requête
  • MiniMax M3 — 510 tokens en entrée, 56,000 en cache, 190 tokens en sortie par requête
  • MiniMax M2.7 — 300 tokens en entrée, 55,000 en cache, 125 tokens en sortie par requête
  • Muse Spark 1.3 Contributor — 620 tokens en entrée, 71,400 en cache, 300 tokens en sortie par requête
  • Muse Spark 1.2 Contributor — 620 tokens en entrée, 71,400 en cache, 300 tokens en sortie par requête
  • Qwen3.8 Max — 420 tokens en entrée, 66,000 en cache, 200 tokens en sortie par requête
  • Qwen3.8 Flash — 600 tokens en entrée, 58,000 en cache, 200 tokens en sortie par requête
  • Qwen3.7 Max — 420 tokens en entrée, 66,000 en cache, 200 tokens en sortie par requête
  • Qwen3.7 Plus — 500 tokens en entrée, 57,000 en cache, 190 tokens en sortie par requête
  • Qwen3.6 Plus — 500 tokens en entrée, 57,000 en cache, 190 tokens en sortie par requête
  • Hy4 preview — 830 tokens en entrée, 71,500 en cache, 295 tokens en sortie par requête
  • Hy3 — 830 tokens en entrée, 71,500 en cache, 295 tokens en sortie par requête
  • MiMo-V2.5 — 830 tokens en entrée, 71,500 en cache, 295 tokens en sortie par requête
  • MiMo-V2.5-Pro — 790 tokens en entrée, 86,000 en cache, 305 tokens en sortie par requête

Vous pouvez suivre votre utilisation actuelle dans la console.

Les limites d’utilisation peuvent changer au fur et à mesure que nous tirons des enseignements des premières utilisations et des retours.


Utilisation au-delà des limites

Si vous avez également des crédits sur votre solde Zen, vous pouvez activer l’option Use balance dans la console. Lorsqu’elle est activée, Go se rabattra sur votre solde Zen après que vous ayez atteint vos limites d’utilisation au lieu de bloquer les requêtes.


Pourquoi certains modèles offrent un volume d’utilisation inférieur

Avec Go, vous payez 10 $/mois, et l’utilisation mensuelle incluse varie selon le modèle.

Pour la plupart des modèles, nous y parvenons grâce à des remises sur volume et à une capacité GPU réservée. Nous vous faisons ensuite bénéficier de ces économies sous la forme d’une utilisation mensuelle plus élevée.

Pour certains modèles, nous n’avons pas encore eu l’occasion de négocier une remise ou de les héberger à moindre coût, soit parce que le modèle est nouveau, soit parce que son tarif public est déjà réduit.

Pour ces modèles, vous obtenez tout de même un peu plus que si vous payiez directement les fournisseurs de modèles ; c’est pourquoi leur utilisation mensuelle incluse est plus faible.


Points de terminaison

Vous pouvez également accéder aux modèles Go via les points de terminaison d’API suivants.

ModèleID de modèlePoint de terminaisonPackage AI SDK
Grok 4.6grok-4.6https://code.aicippy.com/zen/go/v1/responses@ai-sdk/openai
GPT 5.6 Lunagpt-5.6-lunahttps://code.aicippy.com/zen/go/v1/responses@ai-sdk/openai
GLM-5.3-Flashglm-5.3-flashhttps://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
GLM-5.3glm-5.3https://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
GLM-5.2glm-5.2https://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
GLM-5.1glm-5.1https://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
Kimi K3kimi-k3https://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
Kimi K2.7 Codekimi-k2.7-codehttps://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
Kimi K2.6kimi-k2.6https://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
LongCat-2.0longcat-2.0https://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
DeepSeek V4.1 Flashdeepseek-v4.1-flashhttps://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
DeepSeek V4 Prodeepseek-v4-prohttps://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
DeepSeek V4 Flashdeepseek-v4-flashhttps://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
DeepSeek V4 Flash Vision Expdeepseek-v4-flash-vision-exphttps://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
MiMo-V2.5mimo-v2.5https://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
MiMo-V2.5-Promimo-v2.5-prohttps://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
MiniMax M3minimax-m3https://code.aicippy.com/zen/go/v1/messages@ai-sdk/anthropic
MiniMax M2.7minimax-m2.7https://code.aicippy.com/zen/go/v1/messages@ai-sdk/anthropic
MiniMax M2.5minimax-m2.5https://code.aicippy.com/zen/go/v1/messages@ai-sdk/anthropic
Muse Spark 1.3 Contributormuse-spark-1.3-contributorhttps://code.aicippy.com/zen/go/v1/responses@ai-sdk/openai
Muse Spark 1.2 Contributormuse-spark-1.2-contributorhttps://code.aicippy.com/zen/go/v1/responses@ai-sdk/openai
Qwen3.8 Maxqwen3.8-maxhttps://code.aicippy.com/zen/go/v1/messages@ai-sdk/anthropic
Qwen3.8 Flashqwen3.8-flashhttps://code.aicippy.com/zen/go/v1/messages@ai-sdk/anthropic
Qwen3.7 Maxqwen3.7-maxhttps://code.aicippy.com/zen/go/v1/messages@ai-sdk/anthropic
Qwen3.7 Plusqwen3.7-plushttps://code.aicippy.com/zen/go/v1/messages@ai-sdk/anthropic
Qwen3.6 Plusqwen3.6-plushttps://code.aicippy.com/zen/go/v1/messages@ai-sdk/anthropic
Hy4 previewhy4-previewhttps://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible
Hy3hy3https://code.aicippy.com/zen/go/v1/chat/completions@ai-sdk/openai-compatible

L’ID de modèle dans votre configuration AicippY utilise le format aicippy-code-go/<model-id>. Par exemple, pour Kimi K3, vous utiliseriez aicippy-code-go/kimi-k3 dans votre configuration.


Modèles

Vous pouvez récupérer la liste complète des modèles disponibles et leurs métadonnées à partir de :

https://code.aicippy.com/zen/go/v1/models

Confidentialité

ModèleEntraînement des modèlesConservation des données
Grok 4.6Non utilisé30 jours
GPT 5.6 LunaNon utilisé30 jours
GLM-5.3-FlashNon utilisé0 jour
GLM-5.3Non utilisé0 jour
GLM-5.2Non utilisé0 jour
GLM-5.1Non utilisé0 jour
Kimi K3Non utilisé0 jour
Kimi K2.7 CodeNon utilisé0 jour
Kimi K2.6Non utilisé0 jour
LongCat-2.0Non utilisé0 jour
MiMo-V2.5-ProNon utilisé0 jour
MiMo-V2.5Non utilisé0 jour
Qwen3.8 MaxNon utilisé0 jour
Qwen3.8 FlashNon utilisé0 jour
Qwen3.7 MaxNon utilisé0 jour
Qwen3.7 PlusNon utilisé0 jour
Qwen3.6 PlusNon utilisé0 jour
MiniMax M3Non utilisé0 jour
MiniMax M2.7Non utilisé0 jour
Muse Spark 1.3 ContributorOuiPas de ZDR
Muse Spark 1.2 ContributorOuiPas de ZDR
DeepSeek V4.1 FlashNon utilisé0 jour
DeepSeek V4 ProNon utilisé0 jour
DeepSeek V4 FlashNon utilisé0 jour
DeepSeek V4 Flash Vision ExpNon utilisé0 jour
Hy4 previewNon utilisé0 jour
Hy3Non utilisé0 jour
  • Grok 4.6: Le ZDR désactive d’importantes fonctionnalités API qui dépendent des données stockées, notamment Responses API avec état, Files and Collections et Batch API. En savoir plus.
  • GPT 5.6 Luna: Des journaux de surveillance des abus sont générés pour toute utilisation des fonctionnalités API et conservés pendant un maximum de 30 jours. En savoir plus.
  • Muse Spark 1.3 Contributor: Des tarifs de tokens fortement réduits en échange de l’autorisation d’utiliser vos prompts et vos complétions pour entraîner de futurs modèles Meta. La disponibilité est limitée aux régions autorisées par la Politique d’utilisation géographique de Meta. En savoir plus.
  • Muse Spark 1.2 Contributor: Des tarifs de tokens fortement réduits en échange de l’autorisation d’utiliser vos prompts et vos complétions pour entraîner de futurs modèles Meta. La disponibilité est limitée aux régions autorisées par la Politique d’utilisation géographique de Meta. En savoir plus.
  • DeepSeek: L’accord ZDR est renouvelé chaque mois. L’accord actuel est valable jusqu’au 30 septembre 2026.

Objectifs

Nous avons créé AicippY Go pour :

  1. Rendre le codage par IA accessible à un plus grand nombre de personnes avec un abonnement à bas coût.
  2. Fournir un accès fiable aux meilleurs modèles de codage ouverts.
  3. Sélectionner des modèles qui sont testés et évalués pour une utilisation en tant qu’agent de codage.
  4. N’avoir aucun verrouillage exclusif en vous permettant d’utiliser n’importe quel autre fournisseur avec AicippY également.