首页 / 模型

模型目录

Claude / GPT 官方价 6.6 折 · DeepSeek / Kimi K3 8.8 折 · GLM 低至 7 折 · Qwen 官方价。折扣是长期政策而非促销——用 GET /v1/models 查看你的 Key 实时可用模型。

模型目录

一把 Key 通调所有主流模型

Claude / GPT 官方价 6.6 折;DeepSeek / Kimi 8.8 折、GLM 低至 7 折。以 Key 查实时目录:GET /v1/models

Opus 5 · 1M 上下文
Anthropic · 推理旗舰

以约一半价格逼近前沿智能,1M 上下文,长程推理与复杂 Agent 首选。

已上线
Fable 5 · 1M 上下文
Anthropic · 前沿智能

Anthropic 前沿模型,1M 上下文,面向最高难度推理与创作。

已上线
Sonnet 5 · 1M 上下文
Anthropic · 最具 Agent 能力

最具 Agent 能力的 Sonnet,1M 上下文,性能与成本均衡。

已上线
Haiku 4.5 · 200K
Anthropic · 最快最省

最快最省的 Claude,SWE-bench 73.3%,适合高并发批处理。

已上线
GPT-5.5 · 旗舰
OpenAI · 旗舰推理

旗舰推理模型,适配 Responses 与 Chat 双格式。

已上线
Codex · 编码线路
OpenAI · 编码专用

面向代码生成与编辑的专用线路,适配 Codex CLI 等编码工具。

已上线
Kimi K3
月之暗面 · 长上下文

全球首个 3 万亿级开源模型——2.8T 参数、原生视觉、百万级上下文。

已上线
GLM-5.3
智谱 · 编程旗舰

全部增益来自后训练,编程较 5.2 提升 50%,开源最强。

已上线
GLM-5.3 Flash
智谱 · 高速平价

GLM-5.3 的高速平价版本,适合大批量与低延迟场景。

已上线
GLM-5.2
智谱 · MIT 开源旗舰

MIT 开源旗舰,真 1M 上下文,中文原生优化。

已上线
V4 Pro
深度求索 · 旗舰

V4-Pro(1.6T/49B 激活)性能对标顶级闭源模型,原生 1M 上下文。

已上线
V4 Flash
深度求索 · 高效平价

V4-Flash(284B/13B)高效平价,原生 1M 上下文。

已上线
3.8 Max
阿里 · 性价比旗舰

2.4 万亿 MoE 开源旗舰,可自主编码并交付横跨 10 天以上的完整项目。

已上线
3.8 Flash
阿里 · 长上下文

每 token 仅激活 6B 参数却拥有 1M 上下文。

已上线
3-VL Plus · 视觉
阿里 · 视觉理解

视觉理解模型,支持图像与视频内容分析与结构化输出。

已上线

计费方式说明

按量计费,逐次计量。无订阅、额度永不过期。

输入 tokens
发送给模型的提示词与上下文,按各模型公布价计费——Claude 与 GPT 官方价 6.6 折,其他主流模型按官方价。
输出 tokens 输入价的 5×
模型生成的文本。多数模型输出价为输入价的 5 倍(DeepSeek 为 2 倍)。流式与非流式计费相同。
缓存命中(读取) 输入价的 0.1×
命中厂商提示词缓存的上下文——按输入价的 10% 计费。保持 system prompt 稳定即可命中,这是最大的省钱杠杆。
缓存写入 输入价的 1.25×
为复用而存储上下文(Claude 系列模型),按输入价的 125% 一次性计费,之后读取按 10%。
思考 tokens = 输出价
扩展思考模型的推理 tokens 完全按输出价计费——没有任何隐藏倍率。
折扣 长期有效
折扣是政策而非促销:Claude 与 GPT 官方价 6.6 折,DeepSeek/Kimi 8.8 折,GLM 7–8 折。永不过期、不绑定活动窗口。

控制台逐条列明每次调用——输入、输出、缓存与思考 tokens 均可查。实时价格可用 GET /v1/models 核验。