Modelos compatibles de Google

Puede importar modelos de lenguaje grandes de cubos de Hugging Face y OCI Object Storage a OCI Generative AI, crear puntos finales para esos modelos y utilizarlos en el servicio Generative AI.

Para obtener más información sobre los modelos, consulte los siguientes enlaces:

MedGemma

Google MedGemma 27B Text IT es un modelo de lenguaje de 27 mil millones de parámetros basado en la arquitectura Gemma 3. Formado en literatura médica y registros clínicos, el modelo es sintonizado por instrucciones (IT), lo que le permite seguir mejor las solicitudes de los usuarios y ayudar a realizar tareas centradas en la atención médica, como responder preguntas médicas, apoyo clínico y resumir.

Modelo MedGemma compatible
ID de modelo facial de abrazo Capacidad del modelo Unidad de cluster de IA dedicada recomendada
google/medgemma-27b-text-it TEXT_TO_TEXT
  • A100_80 GB_X2
  • H100_X2
  • H200_X1
  • B200_X1

Gemma

Modelos Gemma compatibles
ID de modelo facial de abrazo Capacidad del modelo Unidad de cluster de IA dedicada recomendada
google/gemma-4-31B-it IMAGE_TEXT_TO_TEXT
  • A100_80 GB_X2
  • H100_X2
  • H200_X1
  • B200_X1
google/gemma-3-4b-it IMAGE_TEXT_TO_TEXT A100_80G_X1
google/gemma-3-270m-it TEXT_TO_TEXT A100_80G_X1
google/gemma-3-27b-it IMAGE_TEXT_TO_TEXT A100_80G_X2
google/gemma-3-12b-it TEXTO_IMAGEN A TEXTO A100_80G_X1
google/gemma-3-1b-it TEXT_TO_TEXT A100_80G_X1
google/gemma-2-9b-it TEXT_TO_TEXT A100_80G_X1
google/gemma-2-27b-it TEXT_TO_TEXT A100_80G_X2
google/gemma-2-2b-it TEXTO_A_TEXTO A100_80G_X1
Importante

  • Para los modelos importados, puede utilizar la longitud de contexto nativo especificada por el proveedor del modelo. Sin embargo, la longitud máxima efectiva del contexto está limitada por la configuración de hardware subyacente que seleccione para alojar clusters de IA dedicados en OCI Generative AI. Para aprovechar al máximo la longitud del contexto nativo de un modelo, puede que necesite aprovisionar más recursos de hardware.
  • Utilice los modelos ajustados solo si coinciden con la versión del transformador del modelo base compatible y tienen un recuento de parámetros dentro del ±10% del original.
  • Para obtener información sobre el hardware disponible y los pasos para desplegar los modelos importados, consulte Gestión de modelos importados.