Início / Aprender

Central de conhecimento de API de IA

Escolha o modelo certo, fale os protocolos, entenda a fatura — guias claros para o mundo das APIs de modelos.

1 · Qual modelo devo escolher?

Não existe um único «melhor modelo» em 2026 — existem os melhores encaixes. A forma mais rápida de escolher é por tipo de carga:

Carga de trabalhoEscolhaPor quê
Raciocínio mais difícil
pesquisa, matemática, arquitetura
Claude Opus 5 / GLM-5.3A maior profundidade de cadeia de pensamento; o Opus 5 traz janela completa de 1M de tokens.
Código diário
agentes de IDE, revisão de código
Claude Sonnet 5 / DeepSeek V4O melhor equilíbrio velocidade-qualidade em ferramentas como Claude Code e Codex; o DeepSeek V4 é a opção econômica de pesos abertos.
Grande volume
classificação, extração, lote
Haiku 4.5 / DeepSeek V4 Flash / Qwen 3.8 FlashUma fração do custo com bom seguimento de instruções.
Fluxos multilíngues
conteúdo CJK, documentos longos, localização
Qwen 3.8 / Kimi K3 / GLMA melhor compreensão e geração em CJK; o Kimi se destaca em contexto muito longo.
Visão / multimodalQwen 3-VL PlusCompreensão de imagens por uma fração do preço da visão de ponta.
Ecossistema Codex / GPTGPT-5.5 / 5.4Encaixe nativo com frameworks de agentes alinhados à OpenAI.

Regra prática: comece pela faixa intermediária (Sonnet 5 / DeepSeek V4) para trabalho real, suba para a classe Opus só quando a tarefa se mostrar difícil e caia para a classe Haiku/Flash no que for repetitivo. Sua fatura cai ~10× e a perda de qualidade costuma ser zero.

2 · Um gateway, três protocolos

As APIs de modelos falam formatos diferentes. O ThunderPeak expõe todos atrás de uma chave e um saldo:

ProtocoloEndpointUsado por
OpenAI Chat Completions/v1/chat/completionsSDK da OpenAI, Cherry Studio, a maioria das ferramentas
Anthropic Messages/v1/messagesClaude Code, SDK da Anthropic, Cursor
Responses/v1/responsesCodex CLI e extensão, SDKs mais recentes da OpenAI

Aponte uma ferramenta compatível com OpenAI para https://thunder-peak.com/v1, ou uma ferramenta da Anthropic para https://thunder-peak.com — a mesma chave serve para ambos. Se um cliente de terceiros der erro de caminho, acrescente /v1.

3 · Como a fatura é calculada

Cada requisição mede cinco categorias de tokens — é o mesmo modelo que os provedores usam, então nossos preços por token correspondem 1:1 ao esperado:

CategoriaSignificadoCusto relativo
Tokens de entradaSeu prompt, system prompt e definições de ferramentas1×
Tokens de saídaA resposta geradanormalmente 5× a entrada
Escrita em cachePrimeira vez que um prefixo do prompt é cacheado1,25× a entrada
Leitura de cacheReutilizar um prefixo em cache (prompts repetidos)0,1× a entrada — a maior alavanca
Tokens de raciocínioRaciocínio oculto (Opus/Sonnet/modelos com pensamento)ao preço de saída

Dicas práticas: mantenha o system prompt estável para maximizar as leituras de cache (10× mais baratas que a entrada nova); streaming custa o mesmo que sem streaming; e o histórico do painel detalha cada requisição até o token.

4 · Por que passar por um gateway?

⚡ Uma chave para todos os modelos
Sem contas por provedor nem painéis de cobrança por provedor. Claude, GPT, DeepSeek, Qwen, Kimi e GLM compartilham um saldo.
💳 Sem cartão internacional
Pague com USDT em TRC-20 / BSC / Solana. Recarregue $10 ou $10.000 — o mesmo processo.
🎯 Desconto fixo nos modelos de ponta
Claude e GPT a 66% das tarifas oficiais; outros modelos principais na tarifa oficial — o desconto é política, não uma promoção que expira.
🛡 Controle por chave
Emita chaves separadas por projeto com limites individuais. Congele ou exclua no console com um clique.

5 · Glossário

TermoSignificado simples
Chave de APISua credencial secreta; envie como Authorization: Bearer sk-tp-…
Base URLO endereço do gateway que você cola numa ferramenta, por exemplo https://thunder-peak.com/v1
Janela de contextoMáximo de tokens que o modelo vê por requisição (ex.: 1M ≈ um codebase inteiro)
SSE / streamingSaída token a token; o que faz chats e agentes parecerem instantâneos
Chamada de ferramentasO modelo pedindo que seu app execute funções — a base dos agentes
Raciocínio / pensamentoModelos que «pensam» antes de responder; mais fortes, porém mais caros por token
Limite de taxaRequisições por minuto por chave — configurável por chave no ThunderPeak

Ainda escolhendo? Teste lado a lado.

Cadastre-se, ganhe $2.50 grátis e compare os modelos você mesmo.