ホーム / ナレッジ

AI API ナレッジハブ

適切なモデルを選び、プロトコルを理解し、請求を読み解く — モデル API の世界を平易に解説します。

1 · どのモデルを選ぶべきか?

2026 年に「唯一最高のモデル」は存在しません — あるのは最適な 適合です。最も早い選び方は、作業の種類で決めることです:

作業選ぶもの理由
最も難しい推論
研究、数学、アーキテクチャ
Claude Opus 5 / GLM-5.3最も深い思考連鎖の品質。Opus 5 は 100 万トークンの文脈ウィンドウを備えます。
日常のコーディング
IDE エージェント、コードレビュー
Claude Sonnet 5 / DeepSeek V4Claude Code や Codex のようなツールで速度と品質のバランスが最良。DeepSeek V4 はオープンウェイトのコスパ最良の選択です。
大量処理
分類、抽出、バッチ
Haiku 4.5 / DeepSeek V4 Flash / Qwen 3.8 Flash指示追従性を保ちつつ、コストはわずかです。
多言語ワークフロー
CJK コンテンツ、長文書、ローカライズ
Qwen 3.8 / Kimi K3 / GLMCJK の理解と生成が最も強力。Kimi は超長文脈に優れます。
視覚 / マルチモーダルQwen 3-VL Plus旗艦級の視覚モデルよりはるかに低い価格で画像理解を。
Codex / GPT エコシステムGPT-5.5 / 5.4OpenAI 系のエージェントフレームワークに自然に適合します。

経験則: 実務は中間層(Sonnet 5 / DeepSeek V4)から始め、難題と判明したときだけ Opus 級に上げ、反復作業は Haiku / Flash 級に落とす。請求は約 10 分の 1 になり、品質劣化は多くの場合ゼロです。

2 · ひとつのゲートウェイ、3 つのプロトコル

モデル API はそれぞれ異なる形式で通信します。ThunderPeak はそれらを 1 つのキーと 1 つの残高の背後にまとめます:

プロトコルエンドポイント利用者
OpenAI Chat Completions/v1/chat/completionsOpenAI SDK、Cherry Studio、多くのツール
Anthropic Messages/v1/messagesClaude Code、Anthropic SDK、Cursor
Responses/v1/responsesCodex CLI と拡張、新しい OpenAI SDK

OpenAI 互換ツールは次に向けてください: https://thunder-peak.com/v1、Anthropic 系ツールは次へ: https://thunder-peak.com — 同じキーが両方で使えます。サードパーティのクライアントがパスエラーを出す場合は、次を付けてください: /v1.

3 · 請求の計算方法

すべてのリクエストは 5 つのトークン区分で計量されます — プロバイダーと同じ方式なので、当社のトークン単価は想定と 1:1 で対応します:

区分内容相対コスト
入力トークンプロンプト、システムプロンプト、ツール定義1×
出力トークン生成された回答通常は入力の 5 倍
キャッシュ書き込みプロンプト接頭辞が初めてキャッシュされる時入力の 1.25 倍
キャッシュ読み取りキャッシュ済み接頭辞の再利用(プロンプトの繰り返し)入力の 0.1 倍 — 最大の削減レバー
思考トークン隠れた推論(Opus / Sonnet / 思考モデル)出力と同価格

実践のヒント:システムプロンプトを固定して キャッシュ読み取り を最大化する(新規入力より 10 倍安い)。ストリーミングも非ストリーミングと同じ料金。ダッシュボードの利用履歴はすべてのリクエストをトークン単位で分解します。

4 · なぜゲートウェイを経由するのか?

⚡ 全モデルを 1 つのキーで
プロバイダーごとのアカウントも請求ダッシュボードも不要。Claude、GPT、DeepSeek、Qwen、Kimi、GLM が 1 つの残高を共有します。
💳 海外カード不要
TRC-20 / BSC / Solana の USDT で支払えます。$10 でも $10,000 でも手順は同じです。
🎯 旗艦モデルの固定割引
Claude と GPT は公式価格の 66%、その他の主要モデルは公式価格 — 割引は方針であり、期限切れになるキャンペーンではありません。
🛡 キー単位の管理
プロジェクトごとに個別の上限付きキーを発行。コンソールからワンクリックで凍結・削除できます。

5 · 用語集

用語やさしい意味
API キー秘密の認証情報。次の形で送ります: Authorization: Bearer sk-tp-…
ベース URLツールに貼り付けるゲートウェイのアドレス。例: https://thunder-peak.com/v1
文脈ウィンドウ1 リクエストでモデルが見られる最大トークン数(例:100 万 ≒ コードベース全体)
SSE / ストリーミングトークン単位の出力。チャットやエージェント UI を即時的に感じさせる仕組み
ツール呼び出しモデルがアプリに関数の実行を求める仕組み — エージェントの基盤
推論 / 思考答える前に「考える」モデル。強力だがトークン単価は高め
レート制限キーごとに許される毎分リクエスト数 — ThunderPeak ではキー単位で設定可能

まだ迷っていますか?並べて試してみてください。

登録して $2.50 の無料枠を取得し、ご自身でモデルを比較してください。