Modèles Microsoft compatibles

Vous pouvez importer de grands modèles de langage à partir de seaux de stockage d'objets Hugging Face et OCI dans le service d'intelligence artificielle générative pour OCI, créer des points d'extrémité pour ces modèles et les utiliser dans le service d'intelligence artificielle générative.

Note

Avant de sélectionner un modèle, consultez les conseils qui suivent les tableaux de modèle de cette page pour sélectionner une forme d'unité matérielle compatible et comprendre la facturation pour les grappes d'intelligence artificielle dédiées qui hébergent les modèles importés.

Les modèles Microsoft Phi-3, connus pour leur efficacité et leur compacité, sont conçus pour des performances évolutives et flexibles. Voir la documentation Phi-3 sur Hugging Face.

Phi 3

Modèles Phi 3 compatibles
ID modèle de visage Hugging Capacité du modèle Forme minimale d'unité de grappe dédiée à l'IA
microsoft/phi-4 TEXT_TO_TEXT A100_80G_X1
microsoft/Phi-3-mini-4k-instruct TEXT_TO_TEXT A100_80G_X1
microsoft/Phi-3-mini-128k-instruct TEXT_TO_TEXT A100_80G_X1
microsoft/Phi-3-small-8k-instruct TEXT_TO_TEXT A100_80G_X1
microsoft/Phi-3-medium-4k-instruct TEXT_TO_TEXT A100_80G_X1
microsoft/Phi-3-vision-128k-instruct IMAGE_TEXT_TO_TEXT H100_X1
Important

  • Pour les modèles importés, vous pouvez utiliser la longueur du contexte natif spécifiée par le fournisseur de modèle. Toutefois, la longueur de contexte maximale en vigueur est limitée par la configuration matérielle sous-jacente que vous sélectionnez pour les grappes d'IA dédiées à l'hébergement dans l'IA générative OCI. Pour tirer pleinement parti de la longueur du contexte natif d'un modèle, vous devrez peut-être provisionner davantage de ressources matérielles.
  • Utilisez les modèles affinés uniquement s'ils correspondent à la version du transformateur du modèle de base compatible et ont un nombre de paramètres inférieur à ± 10 % de l'original.
  • Pour déterminer où vous pouvez héberger un modèle importé, recherchez une forme d'unité compatible pour le modèle dans le tableau de cette page, puis vérifiez que la forme matérielle est disponible dans la région cible sous Formes d'unité matérielle par région. Un modèle ne peut être hébergé dans une région que si la région fournit une forme matérielle répertoriée pour ce modèle.
  • Pour savoir comment déployer les modèles importés, voir Gestion des modèles importés.
Note

Facturation pour les grappes d'IA dédiées hébergeant des modèles importés

Les grappes dédiées à l'IA qui hébergent des modèles importés ne nécessitent pas l'engagement minimum de 744 heures qui s'applique aux grappes dédiées à l'IA hébergeant des modèles préentraînés disponibles dans OCI Generative AI. À la place, une grappe dédiée à l'IA de modèle importé a une durée minimale facturable d'une heure. Par exemple, une grappe qui utilise une unité d'IA et qui s'exécute pendant 30 minutes est facturée pour une unité d'IA par heure.

Après la première heure, les frais sont basés sur le temps d'exécution réel de la grappe et sont calculés au prorata de la milliseconde. Par exemple, une grappe qui s'exécute pendant une heure et une minute est facturée pour cette durée, plutôt que pour deux heures complètes.

OCI envoie les enregistrements d'utilisation aux services de mesure et de facturation toutes les cinq minutes pendant l'exécution de la grappe. Si la grappe est supprimée avant que le minimum d'une heure soit atteint, OCI continue à déclarer l'utilisation facturable jusqu'à ce que le minimum soit atteint. Si la grappe s'exécute pendant plus d'une heure, OCI continue d'envoyer des enregistrements d'utilisation toutes les cinq minutes jusqu'à ce que la grappe soit supprimée.