Tous les grands modèles avec une seule clé
Claude pour le raisonnement, DeepSeek pour le code, Qwen pour le prix, Kimi et GLM pour les workflows multilingues. Claude et GPT facturés à 66% des tarifs officiels ; les autres grands modèles à des remises compétitives. Liste en direct par clé sur GET /v1/models.
GPT-5.5 pour le raisonnement phare et des routes de code optimisées Codex dans l’écosystème d’agents OpenAI — formats Responses et Chat.
Opus 5 : « l’intelligence de pointe de Fable 5 à moitié prix ». Sonnet 5 : « le Sonnet le plus agentique à ce jour ». Haiku 4.5 : le Claude le plus rapide et le moins cher — SWE-bench 73,3 %.
« Le premier modèle ouvert de classe 3T au monde » — 2,8T de paramètres, vision native, fenêtre de 1M de tokens, conçu pour le code et le travail de connaissance sur le long terme.
GLM-5.3 : « tous les gains viennent du post-entraînement » — code +50 % vs 5.2, SOTA en poids ouverts. GLM-5.2 : modèle phare ouvert sous licence MIT avec un vrai contexte 1M.
V4-Pro (1,6T / 49B actifs) : « des performances rivalisant avec les meilleurs modèles propriétaires ». V4-Flash (284B / 13B) : rapide, efficace et économique. Contexte natif de 1M.
3.8-Max : MoE ouvert de 2,4T de paramètres qui « code et livre des projets complets sur plus de 10 jours ». 3.8-Flash : 6B actifs par token avec contexte 1M. VL pour la vision.
Feuille de route multi-fournisseurs — dites-nous ce dont vous avez besoin sur Telegram.
Comment l’usage est facturé
À l’usage, mesuré par appel. Sans abonnement, les crédits n’expirent jamais.
Chaque appel est détaillé dans la console — tokens d’entrée, de sortie, de cache et de raisonnement par requête. Vérifiez les tarifs en direct avec GET /v1/models.