모든 주요 model을 하나의 키로
추론에는 Claude, 코드에는 DeepSeek, 가성비에는 Qwen, 다국어 워크플로에는 Kimi와 GLM. Claude & GPT는 공식 요율의 66%로 청구되며, 기타 주요 model은 경쟁력 있는 할인가로 제공됩니다. GET /v1/models를 통해 키별 라이브 목록을 확인하세요.
OpenAI agent 생태계를 위한 GPT-5.5 플래그십 추론 및 Codex 튜닝 코딩 라우트 — Responses 및 Chat 형식.
Opus 5: "Fable 5의 최전선 지능을 절반 가격에." Sonnet 5: "지금까지 가장 agentic한 Sonnet." Haiku 4.5: 가장 빠르고 저렴한 Claude — SWE-bench 73.3%.
"세계 최초의 오픈 3T급 model" — 2.8T 파라미터, 네이티브 비전, 1M-token 윈도우, 장기 지평의 코딩 & 지식 작업을 위해 설계됨.
GLM-5.3: "post-training의 모든 이점" — 코딩은 5.2 대비 +50%, 오픈 가중치 SOTA. GLM-5.2: 진정한 1M 컨텍스트의 MIT 오픈 플래그십.
V4-Pro(1.6T / 49B 활성): "세계 최고의 클로즈드 소스 model에 필적하는 성능." V4-Flash(284B / 13B): 빠르고 효율적이며 경제적. 네이티브 1M 컨텍스트.
3.8-Max: "10일 이상 걸치는 완전한 프로젝트를 코딩하고 납품하는" 2.4T 파라미터 오픈 MoE. 3.8-Flash: 1M 컨텍스트에서 token당 6B 활성. 비전에는 VL.
다중 제공업체 로드맵 — Telegram에서 필요한 것을 알려주세요.
사용량 청구 방식
사용량 기반, 호출당 계량. 구독 없음, 크레딧은 만료되지 않습니다.
모든 호출은 console에 항목별로 표시됩니다 — 요청당 input, output, cache 및 thinking token. GET /v1/models로 라이브 요율을 확인하세요.