Modelos de OpenAI compatibles

Puede importar modelos compatibles de cubos de Hugging Face y OCI Object Storage a OCI Generative AI, crear puntos finales para esos modelos y utilizarlos en el servicio Generative AI.

OpenAI Whisper

El modelo OpenAI Whisper Large V3 Turbo está optimizado para cargas de trabajo automáticas de reconocimiento de voz y transcripción de audio. Este modelo de audio a texto es una versión ajustada de un modelo Whisper Large V3 podado, con menos capas de decodificador para una transcripción más rápida con una menor compensación de calidad. El modelo admite la transcripción multilingüe, la identificación de idiomas y la traducción de voz de los idiomas admitidos al texto en inglés y es adecuado para casos de uso de procesamiento de audio de alto rendimiento y sensibles a la latencia. Para obtener más información, consulte OpenAI Whisper Large V3 Turbo en la documentación de Hugging Face.

Modelo OpenAI Whisper compatible
ID de modelo facial de abrazo Capacidad del modelo Unidades de cluster de IA dedicadas recomendadas
openai/whisper-large-v3-turbo AUDIO_TO_TEXTO
  • H100_X1
  • A100_80G_X1
Importante

  • Para los modelos importados, puede utilizar la longitud de contexto nativo especificada por el proveedor del modelo. Sin embargo, la longitud máxima efectiva del contexto está limitada por la configuración de hardware subyacente que seleccione para alojar clusters de IA dedicados en OCI Generative AI. Para aprovechar al máximo la longitud del contexto nativo de un modelo, puede que necesite aprovisionar más recursos de hardware.
  • Utilice los modelos ajustados solo si coinciden con la versión del transformador del modelo base compatible y tienen un recuento de parámetros dentro del ±10% del original.
  • Para obtener información sobre el hardware disponible y los pasos para desplegar los modelos importados, consulte Gestión de modelos importados.