Accueil / Apprendre

Centre de connaissances API IA

Choisir le bon modèle, parler les protocoles, comprendre la facture — des guides clairs pour le monde des API de modèles.

1 · Quel modèle choisir ?

Il n’existe pas de « meilleur modèle » unique en 2026 — il existe les meilleurs ajustements. Le plus rapide est de choisir selon le type de charge :

Charge de travailChoisirPourquoi
Raisonnement le plus difficile
recherche, maths, architecture
Claude Opus 5 / GLM-5.3La plus grande profondeur de chaîne de raisonnement ; Opus 5 offre une fenêtre de contexte complète de 1M de tokens.
Code quotidien
agents d’IDE, revue de code
Claude Sonnet 5 / DeepSeek V4Le meilleur équilibre vitesse-qualité dans des outils comme Claude Code et Codex ; DeepSeek V4 est le choix économique à poids ouverts.
Gros volume
classification, extraction, lots
Haiku 4.5 / DeepSeek V4 Flash / Qwen 3.8 FlashUne fraction du coût avec un bon suivi des instructions.
Workflows multilingues
contenu CJK, documents longs, localisation
Qwen 3.8 / Kimi K3 / GLMLa meilleure compréhension et génération CJK ; Kimi excelle sur le contexte très long.
Vision / multimodalQwen 3-VL PlusCompréhension d’images pour une fraction du prix de la vision phare.
Écosystème Codex / GPTGPT-5.5 / 5.4Intégration naturelle aux frameworks d’agents alignés OpenAI.

Règle générale : commencez par la gamme intermédiaire (Sonnet 5 / DeepSeek V4) pour le vrai travail, montez en classe Opus seulement si la tâche se révèle difficile, et descendez en classe Haiku/Flash pour le répétitif. Votre facture est divisée par ~10, la perte de qualité est souvent nulle.

2 · Une passerelle, trois protocoles

Les API de modèles parlent des formats différents. ThunderPeak les expose tous derrière une clé et un solde :

ProtocolePoint de terminaisonUtilisé par
OpenAI Chat Completions/v1/chat/completionsSDK OpenAI, Cherry Studio, la plupart des outils
Anthropic Messages/v1/messagesClaude Code, SDK Anthropic, Cursor
Responses/v1/responsesCodex CLI et son extension, SDK OpenAI récents

Pointez un outil compatible OpenAI vers https://thunder-peak.com/v1, ou un outil Anthropic vers https://thunder-peak.com — la même clé fonctionne pour les deux. Si un client tiers signale une erreur de chemin, ajoutez /v1.

3 · Comment la facture est calculée

Chaque requête mesure cinq catégories de tokens — le même modèle que les fournisseurs, donc nos prix au token correspondent 1:1 à ce que vous attendez :

CatégorieSignificationCoût relatif
Tokens d’entréeVotre prompt, le system prompt, les définitions d’outils1×
Tokens de sortieLa réponse généréegénéralement 5× l’entrée
Écriture de cachePremière mise en cache d’un préfixe de prompt1,25× l’entrée
Lecture de cacheRéutiliser un préfixe en cache (prompts répétés)0,1× l’entrée — le plus grand levier
Tokens de raisonnementRaisonnement caché (Opus/Sonnet/modèles à réflexion)au prix de sortie

Conseils pratiques : gardez un system prompt stable pour maximiser les lectures de cache (10× moins cher que l’entrée nouvelle) ; le streaming coûte comme le non-streaming ; et l’historique du tableau de bord détaille chaque requête jusqu’au token.

4 · Pourquoi passer par une passerelle ?

⚡ Une clé pour tous les modèles
Aucun compte par fournisseur, aucun tableau de facturation par fournisseur. Claude, GPT, DeepSeek, Qwen, Kimi et GLM partagent un solde.
💳 Sans carte étrangère
Payez en USDT sur TRC-20 / BSC / Solana. Rechargez $10 ou $10 000 — même procédure.
🎯 Remise fixe sur les modèles phares
Claude et GPT à 66 % des tarifs officiels ; les autres grands modèles au tarif officiel — la remise est une politique, pas une promo qui expire.
🛡 Contrôle par clé
Émettez des clés distinctes par projet avec des plafonds individuels. Gelez-les ou supprimez-les depuis la console en un clic.

5 · Glossaire

TermeSignification simple
Clé APIVotre identifiant secret ; envoyez-le comme Authorization: Bearer sk-tp-…
URL de baseL’adresse de la passerelle que vous collez dans un outil, par ex. https://thunder-peak.com/v1
Fenêtre de contexteTokens maximum visibles par requête (par ex. 1M ≈ tout un codebase)
SSE / streamingSortie token par token ; ce qui rend chats et agents instantanés
Appel d’outilsLe modèle demande à votre app d’exécuter des fonctions — la base des agents
Raisonnement / réflexionDes modèles qui « réfléchissent » avant de répondre ; plus forts mais plus chers au token
Limite de débitRequêtes par minute autorisées par clé — configurable par clé dans ThunderPeak

Toujours indécis ? Essayez-les côte à côte.

Inscrivez-vous, obtenez $2.50 offerts et comparez les modèles vous-même.