Start / Wissen

Wissens-Hub für KI-APIs

Das richtige Modell wählen, die Protokolle sprechen, die Rechnung verstehen — verständliche Leitfäden zur Modell-API-Welt.

1 · Welches Modell soll ich wählen?

Es gibt 2026 kein einzelnes „bestes Modell“ — es gibt die besten Passungen. Am schnellsten wählt man nach Arbeitslast:

ArbeitslastWählenWarum
Härtestes Reasoning
Forschung, Mathematik, Architektur
Claude Opus 5 / GLM-5.3Tiefste Gedankenketten-Qualität; Opus 5 bringt ein volles 1-Mio.-Token-Kontextfenster.
Tägliches Coding
IDE-Agenten, Code-Review
Claude Sonnet 5 / DeepSeek V4Beste Balance aus Tempo und Qualität in Tools wie Claude Code und Codex; DeepSeek V4 ist die preiswerte Open-Weights-Wahl.
Hohes Volumen
Klassifizierung, Extraktion, Batch
Haiku 4.5 / DeepSeek V4 Flash / Qwen 3.8 FlashBruchteil der Kosten bei starker Instruktionsbefolgung.
Mehrsprachige Workflows
CJK-Inhalte, lange Dokumente, Lokalisierung
Qwen 3.8 / Kimi K3 / GLMStärkstes CJK-Verständnis und -Generierung; Kimi glänzt bei sehr langem Kontext.
Vision / multimodalQwen 3-VL PlusBildverständnis zu einem Bruchteil der Flaggschiff-Vision-Preise.
Codex-/GPT-ÖkosystemGPT-5.5 / 5.4Native Passung für OpenAI-nahe Agent-Frameworks.

Faustregel: für echte Arbeit mit der Mittelklasse (Sonnet 5 / DeepSeek V4) starten, nur bei nachweislich harten Aufgaben auf Opus-Klasse gehen und bei Wiederholungen auf Haiku/Flash-Klasse. Die Rechnung schrumpft ~10×, Qualitätsverlust ist oft null.

2 · Ein Gateway, drei Protokolle

Modell-APIs sprechen unterschiedliche Formate. ThunderPeak stellt sie alle hinter einem Schlüssel und einem Guthaben bereit:

ProtokollEndpunktGenutzt von
OpenAI Chat Completions/v1/chat/completionsOpenAI-SDK, Cherry Studio, die meisten Tools
Anthropic Messages/v1/messagesClaude Code, Anthropic-SDK, Cursor
Responses/v1/responsesCodex CLI und Erweiterung, neuere OpenAI-SDKs

Richten Sie ein OpenAI-kompatibles Tool auf https://thunder-peak.com/v1, oder ein Anthropic-Tool auf https://thunder-peak.com — derselbe Schlüssel gilt für beide. Meldet ein Drittanbieter-Client einen Pfadfehler, hängen Sie an /v1.

3 · Wie die Rechnung berechnet wird

Jede Anfrage misst fünf Token-Kategorien — dasselbe Modell wie bei den Anbietern, daher entsprechen unsere Token-Preise 1:1 dem Erwarteten:

KategorieBedeutungRelativer Preis
Eingabe-TokenIhr Prompt, System-Prompt, Tool-Definitionen1×
Ausgabe-TokenDie generierte Antwortmeist 5× Eingabe
Cache-SchreibenErstes Caching eines Prompt-Präfixes1,25× Eingabe
Cache-LesenWiederverwendung eines gecachten Präfixes (wiederholte Prompts)0,1× Eingabe — größter Hebel
Thinking-TokenVerborgenes Reasoning (Opus/Sonnet/Thinking-Modelle)zum Ausgabepreis

Praxistipps: System-Prompt stabil halten, um Cache-Lesevorgänge zu maximieren (10× günstiger als frische Eingabe); Streaming kostet wie ohne Streaming; und der Nutzungsverlauf im Dashboard schlüsselt jede Anfrage bis zum Token auf.

4 · Warum überhaupt über ein Gateway?

⚡ Ein Schlüssel für alle Modelle
Keine Konten pro Anbieter, keine Abrechnungs-Dashboards pro Anbieter. Claude, GPT, DeepSeek, Qwen, Kimi und GLM teilen ein Guthaben.
💳 Keine Auslandskarte nötig
Zahlen Sie mit USDT auf TRC-20 / BSC / Solana. $10 oder $10.000 — derselbe Ablauf.
🎯 Fester Rabatt auf Flaggschiffe
Claude und GPT zu 66% der offiziellen Preise; andere wichtige Modelle zum offiziellen Preis — der Rabatt ist Grundsatz, keine auslaufende Aktion.
🛡 Kontrolle pro Schlüssel
Eigene Schlüssel pro Projekt mit individuellen Limits. In der Konsole mit einem Klick sperren oder löschen.

5 · Glossar

BegriffEinfache Bedeutung
API-SchlüsselIhr geheimes Zugangsmerkmal; senden Sie es als Authorization: Bearer sk-tp-…
Base-URLDie Gateway-Adresse, die Sie in ein Tool einfügen, z. B. https://thunder-peak.com/v1
KontextfensterMaximale Token pro Anfrage (z. B. 1 Mio. ≈ eine ganze Codebasis)
SSE / StreamingAusgabe Token für Token; lässt Chat- und Agent-UIs sofort wirken
Tool-AufrufDas Modell bittet Ihre App, Funktionen auszuführen — die Grundlage von Agenten
Reasoning / ThinkingModelle, die vor der Antwort „denken“; stärker, aber teurer pro Token
RatenlimitAnfragen pro Minute je Schlüssel — in ThunderPeak pro Schlüssel konfigurierbar

Noch unentschlossen? Testen Sie sie nebeneinander.

Registrieren, $2.50 gratis sichern und Modelle selbst vergleichen.