Modelos compatibles con Moonshot AI Kimi

Puede importar modelos de lenguaje grandes de cubos de Hugging Face y OCI Object Storage a OCI Generative AI, crear puntos finales para esos modelos y utilizarlos en el servicio Generative AI.

Kimi

Los modelos Kimi K2.6 y Kimi K2.7 Code están optimizados para tareas de ingeniería de software complejas, flujos de trabajo ágiles y codificación de horizonte largo. Kimi K2.6 está diseñado para la codificación, el diseño basado en codificación, la ejecución autónoma y la orquestación de tareas, mientras que Kimi K2.7 Code es un modelo centrado en la codificación basado en Kimi K2.6 para flujos de trabajo de ingeniería de software de largo alcance.

Modelos Kimi compatibles
ID de modelo facial de abrazo Capacidad del modelo Unidad de cluster de IA dedicada mínima
Moonshotai/Kimi-K3 TEXTO_IMAGEN A TEXTO
  • B300_X8
  • B200_X16
  • H100_X32
Moonshotai/Kimi-K2.6 TEXTO_A_TEXTO
  • H200_X8
  • B200_X8
Moonshotai/Kimi-K2.7-Código TEXTO_A_TEXTO
  • H200_X8
  • B200_X8
Nota

Para Kimi K3, la unidad H100_X32 está disponible en las regiones Medio oeste de EE. UU. (Chicago) y Central de Japón (Osaka), y la unidad B200_X16 está disponible en la región Central de Emiratos Árabes Unidos (Abu Dhabi). El servicio de varios nodos también está disponible en las regiones Central de los Emiratos Árabes Unidos (Abu Dhabi) y Central de Japón (Osaka).
Importante

  • Para los modelos importados, puede utilizar la longitud de contexto nativo especificada por el proveedor del modelo. Sin embargo, la longitud máxima efectiva del contexto está limitada por la configuración de hardware subyacente que seleccione para alojar clusters de IA dedicados en OCI Generative AI. Para aprovechar al máximo la longitud del contexto nativo de un modelo, puede que necesite aprovisionar más recursos de hardware.
  • Utilice los modelos ajustados solo si coinciden con la versión del transformador del modelo base compatible y tienen un recuento de parámetros dentro del ±10% del original.
  • Para obtener información sobre el hardware disponible y los pasos para desplegar los modelos importados, consulte Gestión de modelos importados.