Les traductions sont fournies par des outils de traduction automatique. En cas de conflit entre le contenu d'une traduction et celui de la version originale en anglais, la version anglaise prévaudra.
Inférence Amazon Bedrock
Une fois que vous avez entraîné et testé votre modèle Amazon Nova, vous pouvez le déployer sur Amazon Bedrock à des fins d'inférence à l'échelle de la production. Le processus de déploiement implique la création d'un modèle Amazon Bedrock avec l' CreateCustomModel API, l'exportation des artefacts de votre modèle vers celui-ci à partir d'un compartiment Amazon S3 géré, puis, une fois le modèle ACTIF, la configuration d'un point de terminaison avec une inférence de débit à la demande ou provisionnée.
Vous pouvez également utiliser le SDK SageMaker Python pour déployer des modèles Amazon Nova personnalisés sur les points de terminaison Amazon Bedrock On-Demand ou SageMaker AI Real-time Inference. Pour plus d'informations, consultez Personnalisation à l'aide du SDK SageMaker Python.
Pour connaître les étapes détaillées de configuration de l'inférence Amazon Bedrock pour un modèle personnalisé, consultez la section suivante.