Alle wichtigen Modelle mit einem Schlüssel
Claude für Reasoning, DeepSeek für Code, Qwen für den Preis, Kimi und GLM für mehrsprachige Workflows. Claude und GPT werden abgerechnet zu 66% der offiziellen Preise; weitere wichtige Modelle zu wettbewerbsfähigen Rabatten. Live-Liste pro Schlüssel über GET /v1/models.
GPT-5.5 für Flaggschiff-Reasoning und Codex-optimierte Coding-Routen für das OpenAI-Agenten-Ökosystem — Formate Responses und Chat.
Opus 5: „Frontier-Intelligenz von Fable 5 zum halben Preis.“ Sonnet 5: „das bislang agentischste Sonnet.“ Haiku 4.5: schnellstes und günstigstes Claude — SWE-bench 73,3%.
„Das weltweit erste offene Modell der 3T-Klasse“ — 2,8T Parameter, native Vision, 1-Mio.-Token-Fenster, für langfristige Coding- und Wissensarbeit konzipiert.
GLM-5.3: „alle Fortschritte aus dem Post-Training“ — Coding +50% gegenüber 5.2, SOTA bei offenen Gewichten. GLM-5.2: offenes MIT-Flaggschiff mit echtem 1-Mio.-Kontext.
V4-Pro (1,6T / 49B aktiv): „Leistung auf Augenhöhe mit den besten Closed-Source-Modellen.“ V4-Flash (284B / 13B): schnell, effizient und wirtschaftlich. Nativ 1 Mio. Kontext.
3.8-Max: offenes 2,4T-MoE, das „Projekte über 10 Tage hinweg programmiert und vollständig liefert“. 3.8-Flash: 6B aktiv pro Token mit 1 Mio. Kontext. VL für Vision.
Multi-Provider-Roadmap — sagen Sie uns auf Telegram, was Sie brauchen.
Wie die Nutzung abgerechnet wird
Nutzungsbasiert, pro Aufruf gemessen. Kein Abo, Guthaben verfällt nie.
Jeder Aufruf wird in der Konsole aufgeschlüsselt — Eingabe-, Ausgabe-, Cache- und Thinking-Token pro Anfrage. Live-Preise prüfen mit GET /v1/models.