Quelle est la valeur des crédits Vertex AI gratuits ?
Les crédits Vertex AI valent jusqu'à 100 000 $ pour les startups éligibles, et constituent la subvention IA importante la plus flexible disponible, car le même solde peut être dépensé auprès de plusieurs fournisseurs de modèles au lieu d'un seul.
C'est la partie que les fondateurs sous-évaluent. La plupart des crédits de modèles vous lient à un seul fournisseur. Les crédits Vertex AI couvrent les propres modèles de Google, les modèles tiers proposés via Model Garden, y compris Claude d'Anthropic, et les familles de poids ouverts telles que Llama et Mistral, la disponibilité variant selon la région et évoluant dans le temps.
Un pool, plusieurs fournisseurs. Cette flexibilité est le véritable point fort, pas le montant en dollars.
L'éligibilité dépend de l'étape, du financement et de la manière dont vous accédez au programme, et ces règles changent plus souvent que le montant du crédit. AI Perks suit les conditions actuelles aux côtés de 7,7 millions de dollars de crédits pour 194 entreprises.

À quoi sert réellement Vertex AI
Vertex AI est la plateforme gérée de Google Cloud pour appeler, régler, contextualiser et déployer des modèles. Vous achetez donc la couche opérationnelle autour d'un modèle plutôt que le modèle lui-même.
Concrètement, cette couche couvre :
- Une surface d'API commune à plusieurs fournisseurs de modèles, permettant de remplacer des modèles par une simple modification de configuration plutôt qu'une réécriture.
- Le réglage et l'évaluation, vous permettant de mesurer un changement au lieu de deviner.
- La récupération d'informations, y compris la recherche vectorielle et les outils RAG gérés.
- Le déploiement, y compris les points d'accès en ligne, la prédiction par lots et le débit réservé.
- La gouvernance, y compris IAM, la mise en réseau privée, la résidence des données et la journalisation d'audit.
Voici le test d'adoption honnête. Si votre produit envoie des requêtes à un seul modèle et lit la réponse, une clé API directe est plus simple et généralement moins chère. Vertex AI justifie sa complexité lorsque vous avez besoin de plusieurs fournisseurs, de contrôles d'entreprise qu'un acheteur demandera, ou de récupération et d'évaluation que vous construiriez autrement vous-même.
Comportement des coûts Vertex AI à grande échelle
Vertex AI facture selon deux horloges différentes : l'utilisation facturée au jeton qui évolue avec le trafic, et l'infrastructure facturée au nœud qui facture que le trafic arrive ou non. Confondre les deux est la raison pour laquelle les équipes brûlent un solde à six chiffres sur un produit que personne n'utilise encore.
| Levier de coût | Comment il est facturé | Comportement à grande échelle |
|---|---|---|
| Appels de modèles génératifs | Par jeton d'entrée et de sortie | S'adapte au trafic, tombe à zéro lorsqu'il est inactif |
| Points d'accès personnalisés déployés | Par nœud-heure pendant le déploiement | Fixe, facturé à 3h du matin sans aucun utilisateur |
| Service d'index de recherche vectorielle | Par nœud-heure pendant que l'index est servi | Fixe, augmente à mesure que l'index grandit |
| Jobs de réglage et d'entraînement | Par accélérateur-heure pour le job | Ponctuel, une passe est une ligne d'élément importante |
| Prédiction par lots | Par jeton, généralement inférieur aux tarifs en ligne | Le chemin le moins cher pour tout ce que personne n'attend |
| Appels contextualisés et basés sur la recherche | Par requête, en plus des jetons | Peut doubler le coût unitaire d'une boucle RAG naïve |
Trois conséquences sur lesquelles il vaut la peine de concevoir.
L'infrastructure inactive est la principale fuite. Un point d'accès de démonstration laissé déployé pendant un trimestre calme peut consommer plus de crédits que le produit servi en trafic. Les dépenses en jetons sont auto-limitées, les dépenses en nœuds ne le sont pas.
Les jetons de sortie dominent. Sur la plupart des modèles de pointe, la sortie est tarifée plusieurs fois plus cher que l'entrée, donc un système qui renvoie de la prose là où un champ structuré suffirait est l'endroit où la marge disparaît silencieusement.
La mise en cache et le traitement par lots sont les deux plus grands leviers. La mise en cache du contexte réduit le coût de renvoi du même long préfixe à chaque appel, et le mode batch réduit le travail qui n'est pas orienté utilisateur. Ce sont deux décisions de configuration, pas des réécritures.

Ce que 100 000 $ de crédits Vertex AI achètent réellement
Un solde de 100 000 $ représente soit la majeure partie d'une année de piste, soit deux mois, selon presque entièrement si vos dépenses sont facturées au jeton ou au nœud.
| Forme de charge de travail | Ce que 100 000 $ représentent approximativement |
|---|---|
| Produit basé uniquement sur les requêtes sur un modèle de niveau intermédiaire | Plusieurs mois, souvent l'année entière avant le revenu |
| Produit RAG avec récupération contextualisée | Piste significative si la récupération est mise en cache |
| Points d'accès personnalisés toujours actifs, multirégionaux | Bien moins que prévu, dépenses principalement fixes |
| Cycles de réglage et d'évaluation | Un véritable budget de recherche, consommé par pics |
| Génération d'images ou de vidéos en volume | Le moyen le plus rapide de dépenser l'intégralité du solde |
Les lignes du milieu sont là où les estimations se trompent. Les équipes modélisent soigneusement leurs coûts en jetons, puis déploient trois points d'accès et un index toujours servi et découvrent que la couche fixe était le nombre le plus important. Avant de postuler, déterminez sur quelle horloge votre architecture fonctionne, puis faites correspondre le programme à celle-ci en utilisant les filtres de catégorie sur AI Perks.
Avec quoi les crédits Vertex AI se cumulent
Les crédits Vertex AI couvrent la ligne Google de votre facture et aucune des quatre autres, c'est pourquoi les crédits sont collectés par ensembles plutôt qu'un par un.
Un produit IA typique au douzième mois paie pour :
- L'accès aux modèles, en partie sur Vertex AI, en partie directement auprès d'un deuxième fournisseur comme plan de redondance.
- Le calcul pour l'entraînement, les travaux par lots et tout ce qui n'appartient pas à un point d'accès géré.
- Les données, c'est-à-dire Postgres, un magasin vectoriel et un entrepôt.
- Les outils, c'est-à-dire l'observabilité, l'évaluation et les assistants de codage.
- La diffusion, c'est-à-dire l'hébergement, le CDN et l'e-mail.
Chacune de ces couches a des programmes de crédit en cours d'exécution, et la plupart d'entre elles sont compatibles avec une subvention cloud car elles facturent séparément. Les équipes qui atteignent l'adéquation produit-marché sans tour de table sont généralement titulaires de quatre ou cinq subventions moyennes à la fois, et non d'une seule grosse. AI Perks existe pour montrer quelles combinaisons sont actives et quelles couches vous avez laissées découvertes.

Ce que les fondateurs comprennent mal à propos des crédits Vertex AI
L'erreur la plus coûteuse est de démarrer le compte à rebours des crédits avant qu'il n'y ait de charge de travail pour les dépenser. Les crédits sont limités dans le temps, et un solde important qui commence à s'écouler pendant une phase de prototypage expire en grande partie inutilisé.
Confondre un niveau gratuit avec la facturation Vertex. Les surfaces développeur gratuites de Google sont un produit différent de l'utilisation facturée de Vertex AI au sein d'un projet Cloud. Les prototypes construits sur un niveau gratuit comportent des hypothèses de quotas et de tarification qui ne survivent pas au transfert, et les limites de débit se comportent différemment une fois que le trafic réel arrive.
Laisser des points d'accès et des index déployés. Déployez tout ce qui ne sert pas. Cette seule habitude vaut plus que toute optimisation de requête que la plupart des équipes feront.
Supposer que tous les modèles et régions sont couverts. Les crédits s'appliquent à la facturation Google Cloud, mais des modèles spécifiques, des régions et des listes de tiers dans Model Garden peuvent comporter leurs propres conditions. Vérifiez avant de concevoir une architecture autour d'un modèle.
Considérer les crédits comme de l'argent gratuit. Mesurez le coût par requête dès la première semaine. Les crédits masquent votre économie unitaire exactement aussi longtemps qu'ils durent, et les équipes qui sont blessées sont celles qui voient une facture réelle pour la première fois au même moment où elles voient une facture réelle de leurs propres clients.
Postuler à un seul programme. Les critères d'approbation diffèrent, et trois approbations sur huit candidatures valent mieux qu'une sur une.
Ce qu'il faut couvrir en plus des crédits Vertex AI
Une subvention cloud couvre les couches de modèles et d'infrastructure d'un budget IA et aucune des autres, donc la question utile est de savoir quelles couches restent non couvertes plutôt que quel programme unique est le plus important. Les catégories Outils IA et Cloud sur getaiperks.com sont là où se trouvent les plus gros soldes.
L'éligibilité varie plus que les montants. Les exigences en matière d'étape, de financement et de constitution de société diffèrent d'un programme à l'autre, et les conditions actuelles sont répertoriées par entreprise sur AI Perks plutôt que d'être une supposition.
Le timing prime sur le volume. Une subvention ne vaut que ce que vous dépensez pendant sa fenêtre, donc un solde correspondant au trimestre où vous expédierez réellement vaut plus que deux conservés en même temps et laissés expirer ensemble.
Couvrir les couches, pas les titres. Une subvention cloud de 100 000 $ plus rien ne vous laisse payer pour votre base de données, votre observabilité et votre deuxième fournisseur de modèles.
Les conditions évoluent. Les programmes de crédit d'infrastructure et d'IA changent de montants et d'éligibilité plusieurs fois par an, donc une liste vérifiée une fois est déjà obsolète.

Questions fréquentes
Quelle est la valeur des crédits Vertex AI gratuits ?
Jusqu'à 100 000 $ pour les startups éligibles, généralement émis sous forme de crédit Google Cloud qui peut être dépensé sur Vertex AI et d'autres services Cloud. Sa portée dépend si vos dépenses sont facturées au jeton ou au nœud. Les montants et l'éligibilité actuels sont suivis sur getaiperks.com.
Que couvrent les crédits Vertex AI ?
Appels de modèles génératifs, jobs de réglage et d'entraînement, prédiction par lots, recherche vectorielle, points d'accès déployés et les services Google Cloud environnants que votre application utilise. Comme il s'agit de crédits Cloud plutôt que de crédits de modèles à fournisseur unique, ils absorbent également les coûts de stockage, de réseau et de données qui se situent aux côtés de la couche modèle.
Puis-je utiliser les crédits Vertex AI pour Claude et d'autres modèles non-Google ?
Généralement oui. Model Garden répertorie les modèles tiers et ouverts aux côtés de ceux de Google, et l'utilisation est facturée via Google Cloud. La disponibilité et les conditions varient selon le modèle et la région, alors confirmez que votre modèle spécifique est proposé là où vous déployez avant de concevoir une architecture autour de lui.
Vertex AI est-il gratuit à essayer sans crédits ?
Google Cloud propose des crédits d'essai pour les nouveaux comptes et certains services disposent d'allocations d'utilisation gratuite, ce qui est la manière normale d'évaluer avant de demander une subvention plus importante. Il s'agit d'une surface distincte d'un programme de crédit pour startups, avec des limites différentes. Voir ce qui est actuellement disponible sur getaiperks.com.
Les crédits Vertex AI se cumulent-ils avec les crédits OpenAI ou Anthropic ?
Oui, et ils devraient. Il s'agit de factures différentes : les crédits Vertex AI couvrent Google Cloud, tandis que les crédits de modèles directs couvrent les appels à l'API de ce fournisseur. Détenir les deux vous donne un deuxième fournisseur pour la redondance et l'effet de levier sur les prix. AI Perks suit 7,7 millions de dollars pour 194 entreprises sur getaiperks.com.
Pourquoi ma facture Vertex AI a-t-elle augmenté alors que le trafic est resté stable ?
Presque toujours une ressource facturée au nœud. Les points d'accès déployés, les index vectoriels servis et le débit réservé facturent à l'heure, quel que soit le nombre de requêtes, donc un mois calme coûte le même que mois occupé. Déployez tout ce qui ne sert pas de trafic et déplacez le travail non urgent vers le traitement par lots.
Abonnez-vous sur getaiperks.com →
Construisez sur Vertex AI. Laissez les crédits prendre en charge la couche modèle.