1 · どのモデルを選ぶべきか?
2026 年に「唯一最高のモデル」は存在しません — あるのは最適な 適合です。最も早い選び方は、作業の種類で決めることです:
| 作業 | 選ぶもの | 理由 |
|---|---|---|
| 最も難しい推論 研究、数学、アーキテクチャ | Claude Opus 5 / GLM-5.3 | 最も深い思考連鎖の品質。Opus 5 は 100 万トークンの文脈ウィンドウを備えます。 |
| 日常のコーディング IDE エージェント、コードレビュー | Claude Sonnet 5 / DeepSeek V4 | Claude Code や Codex のようなツールで速度と品質のバランスが最良。DeepSeek V4 はオープンウェイトのコスパ最良の選択です。 |
| 大量処理 分類、抽出、バッチ | Haiku 4.5 / DeepSeek V4 Flash / Qwen 3.8 Flash | 指示追従性を保ちつつ、コストはわずかです。 |
| 多言語ワークフロー CJK コンテンツ、長文書、ローカライズ | Qwen 3.8 / Kimi K3 / GLM | CJK の理解と生成が最も強力。Kimi は超長文脈に優れます。 |
| 視覚 / マルチモーダル | Qwen 3-VL Plus | 旗艦級の視覚モデルよりはるかに低い価格で画像理解を。 |
| Codex / GPT エコシステム | GPT-5.5 / 5.4 | OpenAI 系のエージェントフレームワークに自然に適合します。 |
経験則: 実務は中間層(Sonnet 5 / DeepSeek V4)から始め、難題と判明したときだけ Opus 級に上げ、反復作業は Haiku / Flash 級に落とす。請求は約 10 分の 1 になり、品質劣化は多くの場合ゼロです。
2 · ひとつのゲートウェイ、3 つのプロトコル
モデル API はそれぞれ異なる形式で通信します。ThunderPeak はそれらを 1 つのキーと 1 つの残高の背後にまとめます:
| プロトコル | エンドポイント | 利用者 |
|---|---|---|
| OpenAI Chat Completions | /v1/chat/completions | OpenAI SDK、Cherry Studio、多くのツール |
| Anthropic Messages | /v1/messages | Claude Code、Anthropic SDK、Cursor |
| Responses | /v1/responses | Codex CLI と拡張、新しい OpenAI SDK |
OpenAI 互換ツールは次に向けてください: https://thunder-peak.com/v1、Anthropic 系ツールは次へ: https://thunder-peak.com — 同じキーが両方で使えます。サードパーティのクライアントがパスエラーを出す場合は、次を付けてください: /v1.
3 · 請求の計算方法
すべてのリクエストは 5 つのトークン区分で計量されます — プロバイダーと同じ方式なので、当社のトークン単価は想定と 1:1 で対応します:
| 区分 | 内容 | 相対コスト |
|---|---|---|
| 入力トークン | プロンプト、システムプロンプト、ツール定義 | 1× |
| 出力トークン | 生成された回答 | 通常は入力の 5 倍 |
| キャッシュ書き込み | プロンプト接頭辞が初めてキャッシュされる時 | 入力の 1.25 倍 |
| キャッシュ読み取り | キャッシュ済み接頭辞の再利用(プロンプトの繰り返し) | 入力の 0.1 倍 — 最大の削減レバー |
| 思考トークン | 隠れた推論(Opus / Sonnet / 思考モデル) | 出力と同価格 |
実践のヒント:システムプロンプトを固定して キャッシュ読み取り を最大化する(新規入力より 10 倍安い)。ストリーミングも非ストリーミングと同じ料金。ダッシュボードの利用履歴はすべてのリクエストをトークン単位で分解します。
4 · なぜゲートウェイを経由するのか?
⚡ 全モデルを 1 つのキーで
プロバイダーごとのアカウントも請求ダッシュボードも不要。Claude、GPT、DeepSeek、Qwen、Kimi、GLM が 1 つの残高を共有します。
💳 海外カード不要
TRC-20 / BSC / Solana の USDT で支払えます。$10 でも $10,000 でも手順は同じです。
🎯 旗艦モデルの固定割引
Claude と GPT は公式価格の 66%、その他の主要モデルは公式価格 — 割引は方針であり、期限切れになるキャンペーンではありません。
🛡 キー単位の管理
プロジェクトごとに個別の上限付きキーを発行。コンソールからワンクリックで凍結・削除できます。
5 · 用語集
| 用語 | やさしい意味 |
|---|---|
| API キー | 秘密の認証情報。次の形で送ります: Authorization: Bearer sk-tp-… |
| ベース URL | ツールに貼り付けるゲートウェイのアドレス。例: https://thunder-peak.com/v1 |
| 文脈ウィンドウ | 1 リクエストでモデルが見られる最大トークン数(例:100 万 ≒ コードベース全体) |
| SSE / ストリーミング | トークン単位の出力。チャットやエージェント UI を即時的に感じさせる仕組み |
| ツール呼び出し | モデルがアプリに関数の実行を求める仕組み — エージェントの基盤 |
| 推論 / 思考 | 答える前に「考える」モデル。強力だがトークン単価は高め |
| レート制限 | キーごとに許される毎分リクエスト数 — ThunderPeak ではキー単位で設定可能 |