/ 모델

model 카탈로그

Claude & GPT는 공식 요율의 66% · DeepSeek & Kimi K3는 88% · GLM은 70%부터 · Qwen은 공식 요율. 할인은 프로모션이 아니라 정책입니다 — GET /v1/models로 라이브 model을 확인하세요.

model 카탈로그

모든 주요 model을 하나의 키로

추론에는 Claude, 코드에는 DeepSeek, 가성비에는 Qwen, 다국어 워크플로에는 Kimi와 GLM. Claude & GPT는 공식 요율의 66%로 청구되며, 기타 주요 model은 경쟁력 있는 할인가로 제공됩니다. GET /v1/models를 통해 키별 라이브 목록을 확인하세요.

OpenAI GPT
GPT-5.5 · Codex 라우트

OpenAI agent 생태계를 위한 GPT-5.5 플래그십 추론 및 Codex 튜닝 코딩 라우트 — Responses 및 Chat 형식.

GPT-5.5 · 플래그십
Codex · 코딩 라우트
라이브Responses API
Claude
Anthropic · 최전선 트리오

Opus 5: "Fable 5의 최전선 지능을 절반 가격에." Sonnet 5: "지금까지 가장 agentic한 Sonnet." Haiku 4.5: 가장 빠르고 저렴한 Claude — SWE-bench 73.3%.

Opus 5 · 1M ctx
Fable 5 · 1M ctx
Sonnet 5 · 1M ctx
Haiku 4.5 · 200K
온라인
Kimi
Moonshot · 긴 컨텍스트

"세계 최초의 오픈 3T급 model" — 2.8T 파라미터, 네이티브 비전, 1M-token 윈도우, 장기 지평의 코딩 & 지식 작업을 위해 설계됨.

Kimi K3
온라인
GLM
Zhipu · 다국어

GLM-5.3: "post-training의 모든 이점" — 코딩은 5.2 대비 +50%, 오픈 가중치 SOTA. GLM-5.2: 진정한 1M 컨텍스트의 MIT 오픈 플래그십.

GLM-5.3
GLM-5.3 Flash
GLM-5.2
온라인
DeepSeek
DeepSeek · 가성비

V4-Pro(1.6T / 49B 활성): "세계 최고의 클로즈드 소스 model에 필적하는 성능." V4-Flash(284B / 13B): 빠르고 효율적이며 경제적. 네이티브 1M 컨텍스트.

V4 Pro / V4 Flash
온라인
Qwen
Alibaba · 가성비 & 비전

3.8-Max: "10일 이상 걸치는 완전한 프로젝트를 코딩하고 납품하는" 2.4T 파라미터 오픈 MoE. 3.8-Flash: 1M 컨텍스트에서 token당 6B 활성. 비전에는 VL.

3.8 Max / Flash
3-VL Plus · 비전
온라인
다음은 귀하의 스택?
GPT-5.5 / Codex 준비 완료

다중 제공업체 로드맵 — Telegram에서 필요한 것을 알려주세요.

사용량 청구 방식

사용량 기반, 호출당 계량. 구독 없음, 크레딧은 만료되지 않습니다.

Input tokens
model로 전송되는 prompt와 컨텍스트. 각 model의 공개 요율로 청구됩니다 — Claude & GPT는 공식 요율의 66%, 기타 주요 model은 공식 요율.
Output tokens 5× input
생성된 텍스트. 대부분의 model은 output을 input 요율의 5배로 청구합니다(DeepSeek은 2배). streaming 응답은 non-streaming과 동일하게 계산됩니다.
Cache hit (read) 0.1× input
제공업체의 prompt 캐시에서 재사용된 컨텍스트 — input 요율의 10%로 청구됩니다. 캐시를 활용하려면 system prompt를 안정적으로 유지하세요. 이는 가장 큰 단일 비용 절감 요소입니다.
Cache write 1.25× input
재사용을 위한 컨텍스트 저장(Claude model). input 요율의 125%로 한 번 청구되며, 이후 읽기는 10%입니다.
Thinking tokens = output
extended-thinking model의 추론 token은 output token과 정확히 동일하게 청구됩니다 — 숨겨진 배수는 없습니다.
할인 상시
할인은 프로모션이 아니라 정책입니다: Claude & GPT는 공식 요율의 66%; DeepSeek · Kimi · GLM · Qwen은 공식 요율. 만료되지 않으며 프로모션 기간과 무관합니다.

모든 호출은 console에 항목별로 표시됩니다 — 요청당 input, output, cache 및 thinking token. GET /v1/models로 라이브 요율을 확인하세요.