Quantos Tokens Gratuitos o Programa Z.ai Startups Oferece?
O Programa Z.ai Startups concede às startups aprovadas até 1 bilhão de tokens gratuitos da API GLM.
A maioria dos programas de startups de fornecedores é denominada em dólares. A Zhipu AI, o laboratório por trás do Z.ai e dos modelos GLM, denomina este em tokens em vez disso. Essa única diferença torna a oferta estranha de comparar em uma planilha, e é provavelmente por isso que a concessão recebe tão pouca atenção em relação ao seu tamanho.
Junto com os tokens, o Z.ai lista preços por volume, limites de taxa prioritários e suporte técnico para empresas aprovadas. O AI Perks rastreia os termos atuais ao lado do restante dos programas de fornecedores.
Esta página realiza o trabalho de conversão e rotula qualquer valor que é reportado em vez de confirmado nas próprias páginas do Z.ai.

GLM-5.1, 5.2 e 5.3: O Que Foi Lançado e Quando
A Zhipu AI lançou três lançamentos principais do GLM em cerca de quatro meses, e os números de versão os tornam fáceis de confundir.
| Lançamento | Data | O Que É |
|---|---|---|
| GLM-5.1 | 8 de abril de 2026 | Modelo agente principal de código aberto, com codificação mais forte, suporte de visão e entrada de arquivo |
| GLM-5.2 | 13 de junho de 2026 | Principal modelo de mistura de especialistas de 744B parâmetros, totalmente de código aberto sob uma licença MIT simples |
| GLM-5.3 e GLM-5.3-Flash | 14 de agosto de 2026 | Principal modelo de raciocínio voltado para codificação e defesa cibernética, além de um irmão Flash mais barato e rápido |
Uma fonte secundária data o GLM-5.3 em 17 de agosto em vez de 14 de agosto. A discrepância não foi reconciliada, portanto, trate o dia exato como incerto.
O GLM-5.3 carrega a tag "Construído para Codificar. Pronto para Defesa Cibernética." e é pós-treinado em uma base de 743B parâmetros. Contagens de parâmetros em torno desta família variam entre fontes em um ou dois bilhões, então o conselho prático é citar a ficha do modelo no repositório de pesos em vez de um comunicado de lançamento. A janela de contexto e o comprimento máximo de saída valem a pena serem lidos na documentação do próprio Z.ai no momento em que você precisar deles, pois são as especificações mais frequentemente refeitas incorretamente de segunda mão.
O padrão útil aqui é a cadência, não os números de versão. Três lançamentos principais em aproximadamente quatro meses significam que qualquer modelo que você adote hoje é um para esperar revisitar dentro de um trimestre, o que é um argumento para manter o nome do modelo na configuração em vez de espalhado pelo seu código.
Quanto Custa o GLM ao Preço de Tabela
GLM-5.1, GLM-5.2 e GLM-5.3 custam exatamente o mesmo: $1,40 por milhão de tokens de entrada, $4,40 por milhão de tokens de saída e $0,26 por milhão de tokens de entrada em cache.
Esses valores vêm da documentação oficial de preços do Z.ai.
| Modelo | Entrada / 1M | Saída / 1M | Entrada em cache / 1M |
|---|---|---|---|
| GLM-5.3 | $1,40 | $4,40 | $0,26 |
| GLM-5.2 | $1,40 | $4,40 | $0,26 |
| GLM-5.1 | $1,40 | $4,40 | $0,26 |
| GLM-5.3-Flash | $0,15 | $0,50 | $0,03 |
O caminho de atualização do GLM-5.1 para o GLM-5.3 é gratuito em termos de preço. Se você ainda está chamando o GLM-5.1 por hábito, está pagando a taxa do GLM-5.3 pelo modelo mais antigo, o que é uma alteração de uma linha na maioria das bases de código e a atualização mais barata nesta página.
O GLM-5.3-Flash merece uma segunda olhada: a $0,15 de entrada e $0,50 de saída, ele funciona a aproximadamente um décimo da taxa principal em ambos os lados do medidor. Compare isso com o resto do mercado em AI Perks.
A entrada em cache a $0,26 por milhão é o número que a maioria das equipes ignora, e decide se um prompt de sistema longo é acessível para reenviar a cada turno. Os preços mudam, então releia a página de preços antes de comprometer um orçamento com qualquer valor aqui.

Onde a Camada Flash se Encaixa
A diferença entre o GLM-5.3 e o GLM-5.3-Flash é de aproximadamente dez para um, o que torna o roteamento de modelos mais valioso do que o "prompt golfing".
Um bilhão de tokens parece ilimitado até que um loop de agente comece a tentar novamente. A consequência prática é uma decisão de sequenciamento em vez de uma única escolha de modelo: coloque prototipagem, mecanismos de avaliação, classificação, roteamento e outros trabalhos de segundo plano de baixo risco na camada Flash mais barata, e reserve o modelo principal para tráfego que realmente precise do raciocínio mais forte.
Feito corretamente, essa divisão reduz a conta no caminho pago e estende uma concessão denominada em tokens por muito mais uso real do que uma implantação de modelo único permitiria.
Os limites de taxa são uma das coisas que o programa para startups melhora explicitamente para empresas aprovadas, e não conseguimos confirmar uma tabela de limites publicada para nenhuma das camadas fora do programa. Construa o caminho de fallback antes de depender de um. O AI Perks rastreia quais fornecedores publicam seus limites e quais os deixam para tickets de suporte.
Quanto Vale Um Bilhão de Tokens Gratuitos em Dólares
Entre $1.400 e $4.400 com preços de tabela do GLM-5.3, dependendo de como a concessão é dividida entre tokens de entrada e saída. O Z.ai não publicou essa divisão.
A aritmética, usando os preços de tabela verificados acima:
- 1 bilhão de tokens, tudo de entrada: 1.000 x $1,40 = $1.400
- 1 bilhão de tokens, 70% de entrada e 30% de saída: $980 + $1.320 = $2.300
- 1 bilhão de tokens, tudo de saída: 1.000 x $4,40 = $4.400
Uma carga de trabalho realista de agente ou codificação se encaixa perto do caso intermediário, então aproximadamente $2.300 em valor equivalente ao preço de tabela é o número honesto para planejar, não o bilhão do título.
Gasto no GLM-5.3-Flash em vez disso, o mesmo bilhão de tokens vale entre $150 e $500, porque o modelo é mais barato. Isso inverte o instinto usual: com uma concessão denominada em tokens, você extrai o máximo de valor executando-a no modelo mais caro, o que é o oposto de como os créditos denominados em dólares se comportam. O AI Perks é construído em torno exatamente dessas comparações.

Leia o Arquivo de Licença, Não a Cobertura do Lançamento
O GLM-5.2 é totalmente de código aberto sob uma licença MIT simples. Isso é confirmado. Não assuma que os mesmos termos se aplicam a todas as versões posteriores da linha.
A família GLM é genuinamente de pesos abertos, que é grande parte do motivo pelo qual é interessante para uma startup: você pode auto-hospedar, ajustar e manter a inferência em infraestrutura que você controla, então a concessão de API se torna uma conveniência em vez de uma dependência. Mas "os modelos GLM são MIT" é uma generalização, e uma generalização não é uma licença.
A cobertura de um novo lançamento carrega rotineiramente o enquadramento de licenciamento da versão anterior, pois é a frase mais rápida de escrever e ninguém verifica. Não conseguimos confirmar a licença exata anexada aos pesos do GLM-5.3, portanto, esta página não declara nenhuma. Abra o arquivo de licença no repositório de pesos para o modelo específico e a versão específica que você pretende lançar, e peça para o jurídico ler esse arquivo em vez de um post de blog, incluindo este.
Os termos de licenciamento mudam com a mesma frequência que os preços, que é por isso que o AI Perks os reexamina em vez de arquivar um instantâneo do dia do lançamento.
O Que o Z.ai Não Publicou
Três coisas alteram materialmente o valor desta oferta, e nenhuma delas pode ser respondida nas páginas públicas do Z.ai hoje.
Se a concessão expira. Nenhuma janela de expiração é publicada para a concessão de tokens para startups. Um bilhão de tokens que não expiram e um bilhão de tokens em 90 dias são produtos muito diferentes, e o segundo deveria mudar sua ordem de lançamento: você priorizaria o tráfego caro em vez de economizar a concessão para mais tarde.
Se a concessão é restrita a modelos. Nada afirma se os tokens podem ser gastos no modelo principal atual ou apenas em modelos mais antigos, o que é a diferença entre aproximadamente $2.300 e algumas centenas de dólares de valor equivalente. Pergunte antes de planejar um orçamento em torno do número mais alto.
O nível gratuito para novos usuários. Relata-se que novas contas Z.ai recebem 5 milhões de tokens gratuitos mais um crédito de API de 100 yuans. Esse é um relatório de terceiros, não confirmado nas próprias páginas do Z.ai, portanto, trate-o como não verificado e não o coloque em uma previsão.
Separadamente, e também relatado em vez de confirmado, a Baseten adicionou o GLM-5.3 às suas APIs de Modelo no final de agosto de 2026 e uma variante mais rápida no início de setembro. A tabela de preços da Baseten lista a entrada do GLM-5.3 a $1,40 por milhão, correspondendo à própria taxa do Z.ai, mas o valor de saída foi renderizado inconsistente entre as buscas, portanto, verifique-o diretamente na página de preços da Baseten antes de confiar nele. A oferta padrão de novo espaço de trabalho da Baseten é relatada como $30 em créditos de teste, que é um crédito geral de inscrição em vez de algo específico para GLM.
Uma concessão denominada em tokens tem mais área de superfície não documentada do que uma denominada em dólares, porque os dólares carregam sua própria definição e os tokens não. Faça as perguntas de expiração e escopo de modelo na mesma mensagem, antes de projetar em torno da resposta.

Perguntas Frequentes
Quantos tokens gratuitos o Programa Z.ai Startups oferece?
Até 1 bilhão de tokens gratuitos da API GLM para startups aprovadas, mais preços por volume, limites de taxa prioritários e suporte técnico. Com as taxas de tabela do GLM-5.3, isso vale aproximadamente $1.400 a $4.400, dependendo da mistura de entrada e saída. Os termos atuais são rastreados em getaiperks.com.
Quanto custa a API GLM-5.3?
$1,40 por milhão de tokens de entrada, $4,40 por milhão de tokens de saída e $0,26 por milhão de tokens de entrada em cache, de acordo com a documentação oficial de preços do Z.ai. O GLM-5.3-Flash custa muito menos, a $0,15 de entrada e $0,50 de saída por milhão, aproximadamente um décimo da taxa principal.
O GLM é de código aberto?
O GLM-5.2 é totalmente de código aberto sob uma licença MIT simples, e o GLM-5.1 foi lançado como um modelo principal de código aberto. O licenciamento é definido por lançamento, no entanto, portanto, não assuma que o MIT se estende a uma versão mais nova. Abra o arquivo de licença no repositório de pesos para o modelo exato que você pretende lançar.
Qual é o modelo GLM mais barato?
Dos modelos com preços confirmados, o GLM-5.3-Flash é o mais barato a $0,15 por milhão de tokens de entrada e $0,50 por milhão de saída, com entrada em cache a $0,03. Isso é aproximadamente um décimo da taxa principal, o que o torna o padrão sensato para prototipagem, execuções de avaliação e trabalhos de segundo plano. Compare-o com outros fornecedores em getaiperks.com.
Os tokens de startup do Z.ai expiram?
O Z.ai não publicou uma janela de expiração ou uma restrição de modelo para a concessão de tokens de startup. Ambos alterariam substancialmente o valor da concessão, portanto, não assuma nada até que o fornecedor o declare. O AI Perks rastreia os termos do programa à medida que os fornecedores os confirmam.
Como o Z.ai se compara aos créditos da OpenAI e Anthropic?
O Z.ai denomina sua concessão em tokens em vez de dólares, portanto, não se alinha diretamente com programas denominados em dólares em uma planilha. Convertido aos próprios preços de tabela do Z.ai, um bilhão de tokens vale aproximadamente $2.300 de valor equivalente em uma carga de trabalho mista. Se ele pode ser combinado com o programa de qualquer outro fornecedor depende dos termos desse fornecedor, que valem a pena serem lidos individualmente em vez de presumidos.
Inscreva-se em getaiperks.com →
Uma concessão denominada em tokens é mais difícil de comparar do que uma denominada em dólares, que é exatamente por que menos pessoas se incomodam em reivindicá-la.