Все ведущие модели по одному ключу
Claude для рассуждений, DeepSeek для кода, Qwen для экономии, Kimi и GLM для мультиязычных задач. Claude и GPT тарифицируются по 66% от официальных цен; другие ведущие модели — с конкурентными скидками. Актуальный список для ключа через GET /v1/models.
Флагманские рассуждения GPT-5.5 и маршруты кодинга, настроенные под Codex, для агентной экосистемы OpenAI — форматы Responses и Chat.
Opus 5: «передовой интеллект Fable 5 за полцены». Sonnet 5: «самый агентный Sonnet на сегодня». Haiku 4.5: самый быстрый и дешёвый Claude — SWE-bench 73.3%.
«Первая в мире открытая модель класса 3T» — 2.8T параметров, нативный vision, окно 1M токенов, создана для долгосрочной работы с кодом и знаниями.
GLM-5.3: «весь прирост — от пост-тренировки» — кодинг +50% против 5.2, SOTA с открытыми весами. GLM-5.2: открытый флагман под лицензией MIT на настоящем контексте 1M.
V4-Pro (1.6T / 49B активных): «производительность на уровне лучших закрытых моделей мира». V4-Flash (284B / 13B): быстрая, эффективная и экономичная. Нативный контекст 1M.
3.8-Max: открытая MoE с 2.4T параметров, которая «пишет код и доводит до конца целые проекты на 10+ дней». 3.8-Flash: 6B активных на токен с контекстом 1M. VL для vision.
Дорожная карта мультипровайдеров — расскажите, что вам нужно, в Telegram.
Как тарифицируется использование
По факту использования, с оплатой за вызов. Без подписки, кредиты не сгорают.
Каждый вызов детализирован в консоли — входные и выходные токены, cache и токены размышления по каждому запросу. Проверяйте актуальные ставки через GET /v1/models.