Modelli Google compatibili

Puoi importare modelli di linguaggio di grandi dimensioni dai bucket di storage degli oggetti Hugging Face e OCI nell'AI generativa OCI, creare endpoint per tali modelli e utilizzarli nel servizio AI generativa.

Per i dettagli dei modelli, vedere i collegamenti riportati di seguito.

MedGemma

Google MedGemma 27B Text IT è un modello linguistico di 27 miliardi di parametri basato sull'architettura Gemma 3. Addestrato sulla letteratura medica e sulle cartelle cliniche, il modello è sintonizzato sulle istruzioni (IT), che consente di seguire meglio le richieste degli utenti e aiutare a eseguire attività incentrate sull'assistenza sanitaria come la risposta alle domande mediche, il supporto clinico e il riepilogo.

Modello MedGemma compatibile
ID modello viso abbraccio Capacità modello Forma unità cluster AI dedicata consigliata
google/medgemma-27b-testo-it TEXT_TO_TEXT
  • A100_80 GB_X2
  • H100_X2
  • H200_X1
  • B200_X1

Gemma

Modelli compatibili Gemma
ID modello viso abbraccio Capacità modello Forma unità cluster AI dedicata consigliata
google/gemma-4-31B-it IMAGE_TEXT_TO_TEXT
  • A100_40G_X4
  • A100_80G_X2
  • B200_X1
  • H100_X2
  • H200_X1
google/gemma-3-4b-it IMAGE_TEXT_TO_TEXT A100_80G_X1
google/gemma-3-270m-it TEXT_TO_TEXT A100_80G_X1
google/gemma-3-27b-it IMAGE_TEXT_TO_TEXT A100_80G_X2
google/gemma-3-12b-it TESTO_IMMAGINE_TESTO_TESTO
  • A100_40G_X4
  • A100_80G_X1
  • H100_X2
  • H200_X1
google/gemma-3-1b-it TEXT_TO_TEXT A100_80G_X1
google/gemma-2-9b-it TEXT_TO_TEXT A100_80G_X1
google/gemma-2-27b-it TEXT_TO_TEXT A100_80G_X2
google/gemma-2-2b-it TESTO_A_TESTO A100_80G_X1
Importante

  • Per i modelli importati, è possibile utilizzare la lunghezza del contesto nativo specificata dal provider del modello. Tuttavia, la lunghezza massima effettiva del contesto è limitata dall'impostazione hardware di base selezionata per l'hosting dei cluster AI dedicati in OCI Generative AI. Per sfruttare appieno la lunghezza del contesto nativo di un modello, potrebbe essere necessario eseguire il provisioning di più risorse hardware.
  • Utilizzare i modelli ottimizzati solo se corrispondono alla versione del trasformatore del modello di base compatibile e hanno un conteggio dei parametri entro ±10% dell'originale.
  • Per informazioni sull'hardware disponibile e sulla procedura per distribuire i modelli importati, vedere Gestione dei modelli importati.