Todos los modelos principales con una sola clave
Claude para razonamiento, DeepSeek para código, Qwen para precio, Kimi y GLM para flujos multilingües. Claude y GPT se facturan al 66% de las tarifas oficiales; otros modelos principales con descuentos competitivos. Lista en vivo por clave en GET /v1/models.
GPT-5.5 para razonamiento insignia y rutas de código ajustadas para Codex dentro del ecosistema de agentes de OpenAI — formatos Responses y Chat.
Opus 5: «inteligencia frontera de Fable 5 a mitad de precio». Sonnet 5: «el Sonnet más agéntico hasta ahora». Haiku 4.5: el Claude más rápido y económico — SWE-bench 73,3%.
«El primer modelo abierto de clase 3T del mundo»: 2,8T de parámetros, visión nativa, ventana de 1M de tokens, diseñado para código y trabajo de conocimiento de largo horizonte.
GLM-5.3: «todas las mejoras vienen del post-entrenamiento» — código +50% frente a 5.2, SOTA en pesos abiertos. GLM-5.2: insignia abierto con licencia MIT y contexto real de 1M.
V4-Pro (1,6T / 49B activos): «rendimiento que rivaliza con los mejores modelos cerrados del mundo». V4-Flash (284B / 13B): rápido, eficiente y económico. Contexto nativo de 1M.
3.8-Max: MoE abierto de 2,4T de parámetros que «programa y entrega proyectos completos de más de 10 días». 3.8-Flash: 6B activos por token con contexto de 1M. VL para visión.
Hoja de ruta multiproveedor — cuéntanos qué necesitas por Telegram.
Cómo se factura el uso
Por uso, medido por llamada. Sin suscripción, los créditos no caducan.
Cada llamada se detalla en la consola: tokens de entrada, salida, caché y razonamiento por petición. Verifica las tarifas en vivo con GET /v1/models.