IA e Programadores

Calculadora de preços da API Z.AI GLM

Estima quanto vai custar a API Z.AI GLM. Escolhe um modelo, introduz os tokens de entrada e saída por pedido e quantos pedidos fazes — obtém o custo por pedido, por dia e por mês.

Preços atualizados: July 22, 2026.

Como funciona o preço da API Z.AI GLM

A Z.AI GLM cobra por tokens, não por pedido. Um token é um pedaço de texto — cerca de quatro carateres ou três quartos de uma palavra em inglês. Pagas em separado os tokens de entrada (o teu prompt) e de saída (a resposta do modelo), e a saída é quase sempre mais cara.

Os preços são indicados por 1.000.000 de tokens, por isso o custo por pedido é minúsculo — é precisamente por isso que é fácil subestimar o orçamento até multiplicares pelo tráfego real.

custo = (entrada ÷ 1M × preço entrada) + (saída ÷ 1M × preço saída), × pedidos

Preços dos modelos Z.AI GLM

Por 1M de tokens, à data de junho de 2026. Confirma sempre o mais recente na página oficial de preços da Z.AI GLM antes de orçamentar:

ModeloEntrada / 1MSaída / 1M
GLM-5.1$1.40$4.40
GLM-5$1.00$3.20
GLM-5-Turbo$1.20$4.00

Estimar o teu número de tokens

  • Regra geral: ~4 carateres ou ~0,75 palavras por token. 1.000 tokens ≈ 750 palavras ≈ 1,5 páginas.
  • Não esqueças o prompt de sistema nem os exemplos few-shot — são cobrados como entrada em cada chamada.
  • A saída é variável. Limita-a com um máximo de tokens para que uma resposta descontrolada não rebente o orçamento.

Exemplo prático

Com GLM-5.1 a $1.40 de entrada / $4.40 de saída por 1M de tokens, um pedido de 1000 tokens de entrada e 500 de saída custa cerca de $0.0036. Faz 10 000 por mês e ficas perto de $36.00/mês — cerca de $432.00 por ano. Troca de modelo acima para comparar ao instante.

Como reduzir a tua fatura de API

  • Dimensiona o modelo. Usa um mais pequeno/barato para tarefas fáceis e reserva o topo de gama para as difíceis.
  • Usa cache de prompt se a Z.AI GLM a oferecer — contexto repetido (prompts de sistema, documentos) pode ser cobrado com grande desconto.
  • Corta o prompt. Remove instruções redundantes e exemplos longos demais; entrada mais curta é diretamente mais barata.
  • Agrupa e limita. As APIs em lote custam muitas vezes menos, e um limite de saída evita cobranças-surpresa.

Como usar esta calculadora

  1. Escolhe um modelo. Escolhe o modelo de Z.AI GLM que vais chamar — os preços de entrada e saída variam muito entre níveis.
  2. Insere os tokens por pedido. Define os tokens médios de entrada e saída de um pedido típico (cerca de 4 carateres por token).
  3. Insere os pedidos por mês. O teu volume mensal de chamadas previsto.
  4. Lê a projeção. Vê o custo por pedido, por 1.000 pedidos, por dia e por ano, atualizado ao instante.

Compara outros fornecedores: vê todas as ferramentas de IA e programadores.

Perguntas frequentes

Estes preços estão atualizados?

Os preços são de junho de 2026 e podem mudar. Confirma sempre na página oficial de preços do fornecedor antes de orçamentar. O cálculo em si é exato.

Como é calculado o custo?

Custo = (tokens de entrada ÷ 1.000.000 × preço de entrada) + (tokens de saída ÷ 1.000.000 × preço de saída), multiplicado pelo teu número de pedidos.

Quantos tokens tem o meu texto?

Regra aproximada para inglês: ~4 carateres ou ~0,75 palavras por token. 1.000 tokens ≈ 750 palavras.

Porque é a saída mais cara que a entrada?

Gerar tokens exige mais computação do que lê-los, por isso os fornecedores cobram mais a saída — muitas vezes 3 a 5× a tarifa de entrada. Manter respostas concisas é uma das formas mais fáceis de cortar custos.

Estes preços incluem impostos ou mínimos?

Não. A calculadora mostra apenas o custo de uso. A tua fatura pode acrescentar impostos, e alguns planos têm mínimos ou descontos de volume — verifica as condições da tua conta.