Quota de débit

Gemini Enterprise Agent Platform propose différentes façons de gérer le débit des modèles d'IA générative pour vous aider à équilibrer les coûts et les performances. Ce document décrit les options disponibles : un modèle flexible de paiement à l'usage et une capacité réservée pour un débit prévisible.

Quotas de modèles gérés

Agent Platform propose deux façons de gérer le débit des modèles d'IA générative gérés sur Gemini Enterprise Agent Platform, ce qui vous permet d'équilibrer les coûts, la flexibilité et les performances. Vous pouvez utiliser un modèle de paiement à l'usage ou réserver une quantité de débit dédiée à un prix fixe.

Pay-as-you-go

Pour le modèle de paiement à l'usage par défaut, Agent Platform utilise le paiement à l'usage standard. Le paiement à l'usage vous permet de ne payer que les ressources que vous consommez, sans engagement financier préalable. Il existe d'autres options de paiement à l'usage dont les coûts et les performances varient. Pour en savoir plus, consultez la section Paiement à l'usage prioritaire ou Paiement à l'usage flexible.

Capacité réservée

Pour les applications de production critiques qui nécessitent des performances constantes et des coûts prévisibles, vous pouvez utiliser débit provisionné. Le débit provisionné est un abonnement à coût fixe qui réserve une quantité spécifique de débit pour vos modèles dans un emplacement de votre choix.

Quotas pour les services d'IA générative

Gemini Enterprise Agent Platform propose une suite de services d'IA générative, tels que l'ajustement de modèles, l'évaluation de modèles, la prédiction par lot, les embeddings et la génération augmentée par récupération. Pour en savoir plus sur les quotas de ces services, consultez la section Quotas et limites système de l'IA générative sur Agent Platform.

Étape suivante