Inicio / Aprender

Centro de conocimiento de API de IA

Elige el modelo adecuado, habla los protocolos y entiende la factura: guías claras para el mundo de las API de modelos.

1 · ¿Qué modelo debo elegir?

En 2026 no existe un único «mejor modelo» — existen los mejores encajes. La forma más rápida de elegir es por tipo de carga:

Carga de trabajoEligePor qué
Razonamiento más difícil
investigación, matemáticas, arquitectura
Claude Opus 5 / GLM-5.3La mayor profundidad de cadena de pensamiento; Opus 5 lleva una ventana de contexto completa de 1M de tokens.
Código diario
agentes de IDE, revisión de código
Claude Sonnet 5 / DeepSeek V4El mejor equilibrio velocidad-calidad en herramientas como Claude Code y Codex; DeepSeek V4 es la opción económica de pesos abiertos.
Gran volumen
clasificación, extracción, lotes
Haiku 4.5 / DeepSeek V4 Flash / Qwen 3.8 FlashUna fracción del coste con buen seguimiento de instrucciones.
Flujos multilingües
contenido CJK, documentos largos, localización
Qwen 3.8 / Kimi K3 / GLMLa mejor comprensión y generación en CJK; Kimi destaca en contexto muy largo.
Visión / multimodalQwen 3-VL PlusComprensión de imágenes por una fracción del precio de la visión insignia.
Ecosistema Codex / GPTGPT-5.5 / 5.4Encaje nativo con frameworks de agentes alineados con OpenAI.

Regla práctica: empieza con la gama media (Sonnet 5 / DeepSeek V4) para trabajo real, sube a la clase Opus solo cuando la tarea se demuestre difícil y baja a la clase Haiku/Flash para lo repetitivo. Tu factura se reduce ~10× y la pérdida de calidad suele ser cero.

2 · Una pasarela, tres protocolos

Las API de modelos hablan formatos distintos. ThunderPeak los expone todos tras una clave y un saldo:

ProtocoloEndpointUsado por
OpenAI Chat Completions/v1/chat/completionsSDK de OpenAI, Cherry Studio, la mayoría de herramientas
Anthropic Messages/v1/messagesClaude Code, SDK de Anthropic, Cursor
Responses/v1/responsesCodex CLI y su extensión, SDK de OpenAI más recientes

Apunta una herramienta compatible con OpenAI a https://thunder-peak.com/v1, o una herramienta de Anthropic a https://thunder-peak.com — la misma clave sirve para ambos. Si un cliente de terceros da error de ruta, añade /v1.

3 · Cómo se calcula la factura

Cada petición mide cinco categorías de tokens — es el mismo modelo que usan los proveedores, así que nuestros precios por token corresponden 1:1 con lo esperado:

CategoríaSignificadoCoste relativo
Tokens de entradaTu prompt, system prompt y definiciones de herramientas1×
Tokens de salidaLa respuesta generadanormalmente 5× la entrada
Escritura de cachéPrimera vez que se cachea un prefijo del prompt1,25× la entrada
Lectura de cachéReutilizar un prefijo en caché (prompts repetidos)0,1× la entrada — la mayor palanca
Tokens de razonamientoRazonamiento oculto (Opus/Sonnet/modelos con pensamiento)al precio de salida

Consejos prácticos: mantén estable el system prompt para maximizar las lecturas de caché (10× más baratas que la entrada nueva); el streaming cuesta igual que sin streaming; y el historial del panel desglosa cada petición hasta el token.

4 · ¿Por qué pasar por una pasarela?

⚡ Una clave para todos los modelos
Sin cuentas por proveedor ni paneles de facturación por proveedor. Claude, GPT, DeepSeek, Qwen, Kimi y GLM comparten un saldo.
💳 Sin tarjeta extranjera
Paga con USDT en TRC-20 / BSC / Solana. Recarga $10 o $10.000: el mismo proceso.
🎯 Descuento fijo en los insignia
Claude y GPT al 66% de las tarifas oficiales; otros modelos principales a tarifa oficial — el descuento es política, no una promo que caduca.
🛡 Control por clave
Emite claves separadas por proyecto con límites individuales. Congélalas o elimínalas desde la consola con un clic.

5 · Glosario

TérminoSignificado claro
Clave de APITu credencial secreta; envíala como Authorization: Bearer sk-tp-…
Base URLLa dirección de la pasarela que pegas en una herramienta, p. ej. https://thunder-peak.com/v1
Ventana de contextoMáximo de tokens que el modelo ve por petición (p. ej. 1M ≈ todo un código base)
SSE / streamingSalida token a token; lo que hace que los chats y agentes se sientan instantáneos
Llamada a herramientasEl modelo pidiendo a tu app ejecutar funciones — la base de los agentes
Razonamiento / pensamientoModelos que «piensan» antes de responder; más potentes pero más caros por token
Límite de velocidadPeticiones por minuto permitidas por clave — configurable por clave en ThunderPeak

¿Aún eligiendo? Pruébalos lado a lado.

Regístrate, obtén $2.50 gratis y compara los modelos tú mismo.