Start / Modelle

Modellkatalog

Claude und GPT zu 66% der offiziellen Preise · DeepSeek und Kimi K3 zu 88% · GLM ab 70% · Qwen zum offiziellen Preis. Rabatte sind Grundsatz, keine Aktion — Live-Modelle prüfen mit GET /v1/models.

Modellkatalog

Alle wichtigen Modelle mit einem Schlüssel

Claude für Reasoning, DeepSeek für Code, Qwen für den Preis, Kimi und GLM für mehrsprachige Workflows. Claude und GPT werden abgerechnet zu 66% der offiziellen Preise; weitere wichtige Modelle zu wettbewerbsfähigen Rabatten. Live-Liste pro Schlüssel über GET /v1/models.

OpenAI GPT
GPT-5.5 · Codex-Routen

GPT-5.5 für Flaggschiff-Reasoning und Codex-optimierte Coding-Routen für das OpenAI-Agenten-Ökosystem — Formate Responses und Chat.

GPT-5.5 · Flaggschiff
Codex · Coding-Routen
VerfügbarResponses-API
Claude
Anthropic · Frontier-Trio

Opus 5: „Frontier-Intelligenz von Fable 5 zum halben Preis.“ Sonnet 5: „das bislang agentischste Sonnet.“ Haiku 4.5: schnellstes und günstigstes Claude — SWE-bench 73,3%.

Opus 5 · 1M Kontext
Fable 5 · 1M Kontext
Sonnet 5 · 1M Kontext
Haiku 4.5 · 200K
Verfügbar
Kimi
Moonshot · langer Kontext

„Das weltweit erste offene Modell der 3T-Klasse“ — 2,8T Parameter, native Vision, 1-Mio.-Token-Fenster, für langfristige Coding- und Wissensarbeit konzipiert.

Kimi K3
Verfügbar
GLM
Zhipu · mehrsprachig

GLM-5.3: „alle Fortschritte aus dem Post-Training“ — Coding +50% gegenüber 5.2, SOTA bei offenen Gewichten. GLM-5.2: offenes MIT-Flaggschiff mit echtem 1-Mio.-Kontext.

GLM-5.3
GLM-5.3 Flash
GLM-5.2
Verfügbar
DeepSeek
DeepSeek · Preis-Leistung

V4-Pro (1,6T / 49B aktiv): „Leistung auf Augenhöhe mit den besten Closed-Source-Modellen.“ V4-Flash (284B / 13B): schnell, effizient und wirtschaftlich. Nativ 1 Mio. Kontext.

V4 Pro / V4 Flash
Verfügbar
Qwen
Alibaba · Preis und Vision

3.8-Max: offenes 2,4T-MoE, das „Projekte über 10 Tage hinweg programmiert und vollständig liefert“. 3.8-Flash: 6B aktiv pro Token mit 1 Mio. Kontext. VL für Vision.

3.8 Max / Flash
3-VL Plus · Vision
Verfügbar
Ist Ihr Stack der nächste?
Bereit für GPT-5.5 / Codex

Multi-Provider-Roadmap — sagen Sie uns auf Telegram, was Sie brauchen.

Wie die Nutzung abgerechnet wird

Nutzungsbasiert, pro Aufruf gemessen. Kein Abo, Guthaben verfällt nie.

Eingabe-Token 1×
An das Modell gesendeter Prompt und Kontext. Abgerechnet zum veröffentlichten Preis je Modell — Claude und GPT zu 66% der offiziellen Preise, weitere wichtige Modelle zum offiziellen Preis.
Ausgabe-Token 5× input
Generierter Text. Die meisten Modelle berechnen die Ausgabe mit dem 5-Fachen der Eingabe (DeepSeek 2-Fach). Streaming-Antworten zählen wie ohne Streaming.
Cache-Treffer (Lesen) 0.1× input
Wiederverwendeter Kontext aus dem Prompt-Cache des Anbieters — berechnet zu 10% des Eingabepreises. Halten Sie den System-Prompt stabil, um den Cache zu treffen — das ist die größte Kostenersparnis.
Cache-Schreiben 1.25× input
Kontext zur Wiederverwendung speichern (Claude-Modelle). Einmalig berechnet zu 125% des Eingabepreises, danach 10% beim Lesen.
Thinking-Token = output
Reasoning-Token von Modellen mit erweitertem Denken werden exakt wie Ausgabe-Token berechnet — kein versteckter Multiplikator.
Rabatte dauerhaft
Rabatte sind Grundsatz, keine Aktionen: Claude und GPT zu 66% der offiziellen Preise; DeepSeek · Kimi · GLM · Qwen zum offiziellen Preis. Sie verfallen nicht und hängen an keinem Aktionszeitraum.

Jeder Aufruf wird in der Konsole aufgeschlüsselt — Eingabe-, Ausgabe-, Cache- und Thinking-Token pro Anfrage. Live-Preise prüfen mit GET /v1/models.