O que um novo workspace Baseten começa?
Novos workspaces Baseten começam com um crédito de teste de US$ 30, que parece ser uma oferta permanente em vez de uma promoção de lançamento limitada.
Essa frase carrega uma ressalva que a maioria das coberturas ignora. O valor de US$ 30 vem de relatórios sobre os preços do Baseten e logs de alterações, em vez de uma oferta principal declarada em um local óbvio, e a página de preços não foi renderizada de forma consistente em verificações repetidas. Portanto: relatado, não confirmado pelo fornecedor. Verifique o saldo que seu workspace realmente exibe.
O que o crédito se aplica é mais claro do que o número. Ele se aplica às APIs de Modelos do Baseten, a camada de endpoint compartilhada que hospeda modelos de peso aberto como Kimi K3, GLM-5.3 e DeepSeek V4.1 Flash, a mesma superfície que uma carga de trabalho de produção chamaria. O crédito compra um teste real, não um sandbox. AI Perks rastreia os termos atuais, juntamente com US$ 7,7 milhões em créditos em 194 empresas.

O que a Baseten lançou entre julho e setembro de 2026
A Baseten passou o trimestre fazendo duas coisas ao mesmo tempo: adicionando modelos de peso aberto de ponta às suas APIs de Modelos e construindo produtos para os laboratórios que criam esses modelos.
| Data | O que foi lançado | Para quem é |
|---|---|---|
| 27 de julho de 2026 | API Kimi K3 do dia do lançamento | Desenvolvedores |
| 29 de julho de 2026 | Baseten para Model Labs | Laboratórios de modelos |
| 28 de agosto de 2026 | GLM-5.3 nas APIs de Modelos | Desenvolvedores |
| 29 de agosto de 2026 | Frontier Gateway | Laboratórios de modelos |
| 3 de setembro de 2026 | GLM-5.3-Flash em capacidade rápida | Desenvolvedores |
| 10 de setembro de 2026 | DeepSeek V4.1 Flash | Desenvolvedores |
| 13 de setembro de 2026 | Anúncio de seis descontinuações de modelos | Todos |
O lançamento do Kimi K3 é o que vale a pena entender. Moonshot AI lançou um modelo de peso aberto de mistura de especialistas, relatado em 2,8 trilhões a 3 trilhões de parâmetros com visão nativa e uma janela de contexto de 1 milhão de tokens, e Fireworks AI, Modal e Baseten lançaram cada um uma API hospedada no mesmo dia. Fireworks e Baseten lançaram APIs de treinamento juntamente com inferência. Uma corrida dia-zero de três vias significa que os mesmos pesos vêm de três fornecedores em três modelos de faturamento, portanto, a escolha do provedor é uma questão de preço, não de capacidade.
Preços das APIs de Modelos Baseten: Apenas Metade da Tabela é Clara
A Baseten publica um preço de entrada por milhão de tokens para cada API de Modelo. O lado de saída não é algo que esta página possa citar com confiança.
| Modelo | Entrada por 1 milhão de tokens | Saída por 1 milhão de tokens | Observações |
|---|---|---|---|
| Kimi K3 | US$ 3,00 | Não confiável para leitura | Peso aberto, visão nativa, 1 milhão de contexto |
| GLM-5.3 | US$ 1,40 | Não confiável para leitura | Contexto de 1 milhão de tokens |
| DeepSeek V4.1 Flash | US$ 0,30 | Não confiável para leitura | 552 bilhões de parâmetros, multimodal |
| GLM-5.3-Flash | Não confirmado | Não confirmado | Capacidade dedicada de serviço rápido |
Essas taxas de entrada são o que a tabela de preços do Baseten listava na verificação. A coluna de saída não foi renderizada consistentemente entre as buscas, é por isso que nenhuma taxa de saída do Baseten aparece acima.
Para ter uma ideia da escala da metade que falta, olhe para o único provedor que publica tudo. Fireworks AI lista Kimi K3 a US$ 3,00 por entrada, US$ 0,30 de entrada em cache e US$ 15,00 de saída por milhão de tokens em seu nível Padrão. A saída custa cinco vezes a entrada. Qualquer modelo de custo Baseten construído apenas na taxa de entrada de US$ 3,00 está incorreto por um múltiplo desconhecido, e em cargas de trabalho com uso intensivo de geração, esse múltiplo é a maior parte da fatura. Trate qualquer artigo que imprima um preço de saída Baseten sem um aviso como um palpite. AI Perks rastreia os preços dos provedores à medida que eles mudam.

Seis Modelos Deixam as APIs de Modelos Baseten em 25 de Setembro de 2026
A Baseten anunciou em 13 de setembro de 2026 que GLM-4.7, Kimi K2.7, Kimi K2.6, Inkling, Inkling-Small e DeepSeek V4 Pro serão descontinuados das APIs de Modelos em 25 de setembro de 2026.
Esta é a parte que silenciosamente causa problemas. Três tipos de leitores são afetados.
Qualquer pessoa com um slug de modelo codificado em produção. Um endpoint compatível com OpenAI falha da mesma forma, quer o modelo tenha sido renomeado ou removido. Fixe um substituto antes do dia 25, não depois.
Qualquer pessoa que mantenha uma postagem de comparação. Cada lista que precifica DeepSeek V4 Pro ou a linha Kimi K2.x na Baseten fica incorreta em 25 de setembro, e a maioria nunca será atualizada. Assuma que uma compilação pré-setembro tem linhas mortas.
Qualquer pessoa que esteja avaliando com benchmarks antigos. Se seu sistema de teste tem como alvo Kimi K2.7 ou K2.6, o sucessor no catálogo é Kimi K3 a um ponto de preço diferente, portanto, a comparação do mês passado não se mantém.
Trate esses pares como julgamento editorial, em vez de um caminho de migração publicado pelo fornecedor: GLM-4.7 para GLM-5.3, a linha Kimi K2.x para Kimi K3, DeepSeek V4 Pro para DeepSeek V4.1 Flash. Os preços se movem em ambas as direções nessas transições, que é exatamente quando um crédito de teste vale a pena. Veja o que está atualmente disponível em AI Perks.
Onde Executar Kimi K3: Baseten, Fireworks ou Modal
Três provedores lançaram Kimi K3 no dia do lançamento, e apenas um publica um preço completo por token contra o qual você pode planejar.
| Provedor | Kimi K3 entrada por 1 milhão | Preços completos de tokens publicados | Ponto de entrada gratuito |
|---|---|---|---|
| Fireworks AI | US$ 3,00 Padrão, US$ 4,50 Rápido | Sim | Nível gratuito Fire Pass, com Kimi K3 Fast |
| Baseten | US$ 3,00 | Não, saída não legível | Crédito de teste, relatado em US$ 30, uma vez |
| Modal | Não publicado | Não | US$ 30 por mês de computação geral para novos workspaces |
Fireworks publica o quadro completo: US$ 3,00 de entrada, US$ 0,30 de entrada em cache e US$ 15,00 de saída por milhão no Padrão, o nível Rápido a US$ 4,50, US$ 0,45 e US$ 22,50, e uma variante hospedada nos EUA com um prêmio de cerca de 10%. Seu nível gratuito, Fire Pass, mudou para Kimi K3 Fast como seu modelo gratuito em destaque com o contexto completo de 1 milhão de tokens, a maneira mais barata de saber se o modelo atende à sua tarefa. O preço de entrada da Baseten corresponde a US$ 3,00. Modal confirmou preços baseados em tokens em sua postagem de lançamento sem publicar uma taxa por milhão.
Os dois valores de US$ 30 são uma coincidência que vale a pena ler com atenção: não são a mesma oferta. O da Modal é uma alocação de computação mensal recorrente que cobre computação em geral, em vez de uma API de modelo. O da Baseten é um crédito de teste único em um workspace. Ao longo de uma avaliação de três meses, isso equivale a US$ 90 contra US$ 30. Ambos valem a pena: AI Perks existe porque créditos em várias camadas superam um grande crédito em um único fornecedor.

Baseten para Model Labs e Frontier Gateway Explicados
Esses dois lançamentos de 2026 são os que a maioria dos desenvolvedores achará irrelevantes, e saber o porquê economiza uma semana de avaliação.
Baseten for Model Labs, anunciado em 29 de julho de 2026, é uma linha de produtos para laboratórios de modelos de peso fechado que desejam distribuir e monetizar seus modelos por meio da infraestrutura da Baseten. Ele inverte a relação usual: em vez de a Baseten hospedar modelos de peso aberto para desenvolvedores, o laboratório é o cliente e os usuários do laboratório são o tráfego.
Frontier Gateway, anunciado em 29 de agosto de 2026, é um gateway de API gerenciado e multilocatário que permite que um laboratório configure uma API de inferência de nível de produção na pilha da Baseten, em vez de construir uma camada de serviço por conta própria.
Nenhum deles tem preços publicados, ambos são voltados para laboratórios e não para desenvolvedores, e um crédito de teste não se aplica a nenhum deles. Os relatórios sobre ambos são escassos e de média confiança, portanto, trate qualquer lista detalhada de recursos ou benchmark de latência encontrado em outro lugar como não confirmado até que o fornecedor o declare. Para um desenvolvedor que chama modelos, a consequência é indireta: se os laboratórios adotarem essa rota, mais modelos de peso fechado se tornarão acessíveis por meio de endpoints semelhantes aos que você já chama. Vale a pena observar em AI Perks.
Como Fazer um Crédito Inicial Durar
Confirme os preços de saída antes de extrapolar qualquer coisa. As taxas de entrada sozinhas subestimam o custo real em cargas de trabalho com uso intensivo de geração, e a coluna de saída da Baseten é o único número que esta página não pode fornecer. Um orçamento construído com base em US$ 3,00 por milhão para Kimi K3 é um orçamento construído com base em metade da fatura.
Depure nos modelos do nível Flash. GLM-5.3-Flash e a linha DeepSeek Flash existem para latência e custo, em vez de qualidade máxima. A canalização de prompts, a lógica de retentativas e os bugs de esquema não precisam de um modelo de ponta para aparecer, e trocar o slug depois é uma mudança de uma linha.
Fixe suas versões de modelo. Seis modelos serão descontinuados em 25 de setembro de 2026. Slugs desatualizados impedem que uma descontinuação se torne uma interrupção, e um crédito de teste é mais útil enquanto você reavalia os substitutos.
Mantenha créditos em mais de uma camada. Inferência, computação geral e acesso a modelos de ponta são cobrados separadamente. A Baseten cobre o primeiro, Modal ou um provedor de nuvem o segundo, um laboratório de ponta o terceiro.

Perguntas Frequentes
Quanto valem os créditos gratuitos da Baseten?
Novos workspaces começam com um crédito de teste de US$ 30, descrito como uma oferta permanente em vez de uma promoção. O valor vem de relatórios, em vez de um título claro do fornecedor, portanto, considere US$ 30 como relatado e confirme o saldo que seu workspace exibe. Os termos atuais são rastreados em getaiperks.com.
Quanto a Baseten cobra por token?
As taxas de entrada são claras: Kimi K3 a US$ 3,00 por milhão de tokens, GLM-5.3 a US$ 1,40 e DeepSeek V4.1 Flash a US$ 0,30. As taxas de saída não são confiavelmente legíveis da tabela de preços pública, e esta página não fará suposições sobre elas. Confirme os preços de saída no console antes de modelar uma fatura mensal.
Quais modelos a Baseten está descontinuando em setembro de 2026?
GLM-4.7, Kimi K2.7, Kimi K2.6, Inkling, Inkling-Small e DeepSeek V4 Pro serão descontinuados das APIs de Modelos Baseten em 25 de setembro de 2026, anunciado em 13 de setembro. Os substitutos mais próximos no catálogo são GLM-5.3, Kimi K3 e DeepSeek V4.1 Flash, embora essa combinação seja editorial em vez de um caminho de migração publicado pelo fornecedor.
A Baseten é mais barata que a Fireworks para Kimi K3?
Em tokens de entrada, ambos listam US$ 3,00 por milhão, portanto, estão no mesmo nível no único número que compara claramente. A Fireworks também publica US$ 0,30 de entrada em cache e US$ 15,00 de saída por milhão em seu nível Padrão. Até que a taxa de saída da Baseten seja confirmada, uma comparação completa de custos não é possível em nenhuma direção.
O que é Kimi K3 e por que três provedores o lançaram ao mesmo tempo?
Kimi K3 é o modelo de mistura de especialistas de peso aberto da Moonshot AI, relatado em 2,8 trilhões a 3 trilhões de parâmetros com visão nativa e uma janela de contexto de 1 milhão de tokens, lançado em 27 de julho de 2026. Fireworks AI, Modal e Baseten lançaram cada um uma API hospedada no mesmo dia. Pesos abertos tornam isso possível: nenhum provedor precisa de permissão, então o dia do lançamento se torna uma corrida de preços em vez de uma exclusividade.
Posso combinar créditos Baseten com outros créditos de IA?
Sim, e essa é a abordagem normal. Créditos de inferência, computação geral e modelos de ponta são três contas separadas com três fornecedores diferentes, e possuir um não bloqueia o outro. A Baseten cobre a camada de inferência, Modal ou um provedor de nuvem cobre a computação, e um laboratório de ponta cobre chamadas de modelo diretas. AI Perks rastreia US$ 7,7 milhões em 194 empresas em getaiperks.com.
Fixe suas versões de modelo. Deixe outra pessoa pagar pelos tokens.