Passer au contenu principal
Après avoir entraîné un modèle avec Serverless RL, il est automatiquement disponible pour l’inférence. Pour envoyer des requêtes à votre modèle entraîné, vous avez besoin de :
  • Votre clé API W&B
  • L’URL de base de la Training API, https://api.training.wandb.ai/v1/
  • L’endpoint de votre modèle
L’endpoint du modèle suit le schéma suivant :
Le schéma se compose des éléments suivants :
  • Le nom de votre entité W&B (team)
  • Le nom du projet associé à votre modèle
  • Le nom du modèle entraîné
  • L’étape d’entraînement du modèle que vous souhaitez déployer (il s’agit généralement de l’étape où le modèle a obtenu les meilleurs résultats lors de vos évaluations)
Par exemple, si votre team W&B s’appelle email-specialists, que votre projet s’appelle mail-search, que votre modèle entraîné s’appelle agent-001 et que vous souhaitez le déployer à l’étape 25, l’endpoint se présente ainsi :
Une fois que vous avez votre endpoint, vous pouvez l’intégrer à vos flux de travail d’inférence habituels. Les exemples suivants montrent comment envoyer des requêtes d’inférence à votre modèle entraîné à l’aide d’une requête cURL ou du Python OpenAI SDK.

cURL

OpenAI SDK