主要モデルをすべて 1 つのキーで
推論は Claude、コードは DeepSeek、コスト重視は Qwen、多言語ワークフローは Kimi と GLM。Claude と GPT は次の料率で課金されます: 公式価格の 66%。その他の主要モデルも競争力のある割引価格です。キーごとの最新リストは次で取得できます GET /v1/models.
GPT-5.5 は旗艦の推論モデル、Codex は OpenAI エージェントエコシステム向けに調整されたコーディングルート — Responses と Chat の両形式に対応。
Opus 5 は「Fable 5 のフロンティア知能を半額で」。Sonnet 5 は「これまでで最もエージェント的な Sonnet」。Haiku 4.5 は最速かつ最安の Claude — SWE-bench 73.3%。
「世界初のオープン 3T クラスモデル」— 2.8T パラメータ、ネイティブ視覚、100 万トークン窓、長期にわたるコーディングと知識作業のために設計。
GLM-5.3 は「すべての改善をポストトレーニングから」— コーディング性能は 5.2 比 +50%、オープンウェイトで SOTA。GLM-5.2 は MIT ライセンスのオープン旗艦で、真の 100 万文脈に対応。
V4-Pro(1.6T / アクティブ 49B)は「世界最高水準のクローズドモデルに匹敵する性能」。V4-Flash(284B / 13B)は高速・高効率・低コスト。ネイティブ 100 万文脈。
3.8-Max は 2.4T パラメータのオープン MoE で「10 日以上に及ぶプロジェクトを完遂」。3.8-Flash はトークンあたり 6B アクティブで 100 万文脈。VL は視覚対応。
マルチプロバイダーのロードマップ — 必要なモデルを Telegram でお知らせください。
利用量の課金方法
従量制で呼び出しごとに計量。サブスクリプションなし、クレジットは失効しません。
すべての呼び出しはコンソールで明細表示されます — リクエストごとの入力・出力・キャッシュ・思考トークン。最新料率は次で確認できます GET /v1/models.