Modelli Mistral compatibili
Puoi importare modelli di linguaggio di grandi dimensioni dai bucket di storage degli oggetti Hugging Face e OCI nell'AI generativa OCI, creare endpoint per tali modelli e utilizzarli nel servizio AI generativa.
Questi modelli hanno un'architettura Transformer ad alte prestazioni e solo decodificatore con Sliding Window Attention (SWA) per una gestione efficiente del lungo contesto e un'attenzione alle query raggruppate (GQA) opzionale per una maggiore scalabilità. Per ulteriori dettagli, vedere Mistral nella documentazione di Hugging Face.
Mistral
| ID modello viso abbraccio | Capacità modello | Forme unità cluster AI dedicate consigliate |
|---|---|---|
| Mistralai/Mistral-Medium-3.5-128B | TEXT_TO_TEXT |
|
| mistralai/Devstral-2-123B-Instruct-2512 | TEXT_TO_TEXT |
|
| mistralai/Mixtral-8x7B-Instruct-v0.1 | TEXT_TO_TEXT | A100_80G_X2 |
| Mistralai/Mistral-Nemo-Instruct-2407 | TEXT_TO_TEXT | A100_80G_X1 |
| mistralai/Mistral-7B-Instruct-v0.3 | TEXT_TO_TEXT | A100_80G_X1 |
| mistralai/Mistral-7B-Instruct-v0.2 | TESTO_A_TESTO | A100_80G_X1 |
| mistralai/Mistral-7B-Instruct-v0.1 | TESTO_A_TESTO | A100_80G_X1 |
| intfloat/e5-mistral-7b-istruzioni | INTEGRAZIONE | A10_X1 |
Importante
- Per i modelli importati, è possibile utilizzare la lunghezza del contesto nativo specificata dal provider del modello. Tuttavia, la lunghezza massima effettiva del contesto è limitata dall'impostazione hardware di base selezionata per l'hosting dei cluster AI dedicati in OCI Generative AI. Per sfruttare appieno la lunghezza del contesto nativo di un modello, potrebbe essere necessario eseguire il provisioning di più risorse hardware.
- Utilizzare i modelli ottimizzati solo se corrispondono alla versione del trasformatore del modello di base compatibile e hanno un conteggio dei parametri entro ±10% dell'originale.
- Per informazioni sull'hardware disponibile e sulla procedura per distribuire i modelli importati, vedere Gestione dei modelli importati.