Modelos compatibles de Alibaba

Puede importar modelos de lenguaje grandes de cubos de Hugging Face y OCI Object Storage a OCI Generative AI, crear puntos finales para esos modelos y utilizarlos en el servicio Generative AI.

Nota

Antes de seleccionar un modelo, revise las instrucciones que se muestran a continuación de las tablas de modelos de esta página para seleccionar una unidad de hardware compatible y comprender la facturación de los clusters de IA dedicados que alojan modelos importados.

La familia de modelos Alibaba Qwen cuenta con capacidades multilingües y multimodales avanzadas. Para las tarjetas modelo en Hugging Face, consulte los enlaces en las siguientes tablas.

Qwen 3 Next

Modelo Qwen 3 Next compatible
ID de modelo facial de abrazo Capacidad del modelo Unidad de cluster de IA dedicada mínima
Qwen/Qwen3-Next-80B-A3B-Instruct TEXT_TO_TEXT
  • A100_80G_X4
  • H100_X4
  • H200_X4

Qwen 3.8

Modelos Qwen 3.8 compatibles
ID de modelo facial de abrazo Capacidad del modelo Unidad de cluster de IA dedicada mínima
Qwen/Qwen3.8-27B TEXT_TO_TEXT
  • A100_40G_X2
  • A100_80G_X1
  • H100_X1
  • H200_X1
  • B200_X1
  • B300_X1
Qwen/Qwen3.8-2.4T-A95B-FP8 TEXT_TO_TEXT
  • B200_X16

Qwen 3.6

Modelo Qwen 3.6 compatible
ID de modelo facial de abrazo Capacidad del modelo Unidad de cluster de IA dedicada mínima
Qwen/Qwen3.6-35B-A3B IMAGE_TEXT_TO_TEXT
  • A100_80G_X2
  • H100_X2
  • H200_X1
  • B200_X1
Nota

Después de importar Qwen/Qwen3.6-35B-A3B y crear un punto final para él en un cluster de IA dedicado de alojamiento, puede llamar al modelo a través de la API de respuestas de OCI. Para obtener la lista completa de modelos de chat disponibles para la API de respuestas, consulte Modelos disponibles.

Qwen 3.5

Modelo Qwen 3.5 compatible
ID de modelo facial de abrazo Capacidad del modelo Unidad de cluster de IA dedicada mínima
Qwen/Qwen3.5-397B-A17B TEXT_TO_TEXT
  • H200_X8
  • B200_X8
  • B300_X4
Qwen/Qwen3.5-9B IMAGE_TEXT_TO_TEXT
  • A100_80GB_X1
  • H100_X1
  • H200_X1
  • B200_X1

Imagen de Qwen

Modelos Qwen Image compatibles
ID de modelo facial de abrazo Capacidad del modelo Unidad de cluster de IA dedicada mínima
Qwen/Qwen-Imagen TEXT_TO_IMAGE A100_80G_X1
Qwen/Qwen-Imagen-Editar IMAGE_TEXT_TO_IMAGE A100_80G_X1
Qwen/Qwen-Imagen-2512 TEXT_TO_IMAGE A100_80G_X1
Qwen/Qwen-Image-Edit-2511 IMAGE_TEXT_TO_IMAGE A100_80G_X1
Qwen/Qwen-Imagen-Edit-2509 IMAGE_TEXT_TO_IMAGE A100_80G_X1
Nota

  • response_format: "url" no funciona y devuelve un error de solicitud errónea HTTP 400.
  • n (número de imágenes): solo funcionan 0 o 1.
  • Streaming no es compatible.
  • Los tamaños de imagen no estándar pueden redondearse (por ejemplo, 999x999992x992) en lugar de devolver un HTTP 400 (a diferencia de la API de OpenAI).
  • Es posible que la transparencia no funcione debido a las limitaciones del modelo.

Qwen Q (razonamiento)

Modelos Qwen Q compatibles
ID de modelo facial de abrazo Capacidad del modelo Unidad de cluster de IA dedicada mínima
Qwen/QwQ-32B TEXT_TO_TEXT A100_80G_X2

Qwen 3

Modelos Qwen 3 compatibles
ID de modelo facial de abrazo Capacidad del modelo Unidad de cluster de IA dedicada mínima
Qwen/Qwen3-Embedding-0.6B INCRUSTAR A10_X1
Qwen/Qwen3-Embedding-4B INCRUSTAR A10_X2
Qwen/Qwen3-Embedding-8B INCRUSTAR A100_80G_X1
Qwen/Qwen3-0.6B TEXT_TO_TEXT A100_80G_X1
Qwen/Qwen3-1.7B TEXT_TO_TEXT A100_80G_X1
Qwen/Qwen3-4B TEXT_TO_TEXT A100_80G_X1
Qwen/Qwen3-8B TEXT_TO_TEXT A100_80G_X1
Qwen/Qwen3-14B TEXT_TO_TEXT A100_80G_X1
Qwen/Qwen3-32B TEXT_TO_TEXT A100_80G_X2
Qwen/Qwen3-4B-Instruct-2507 TEXT_TO_TEXT A100_80G_X1
Qwen/Qwen3-30B-A3B-Instruct-2507 TEXT_TO_TEXT A100_80G_X2
Qwen/Qwen3-235B-A22B-Instruct-2507 TEXT_TO_TEXT H100_X8
Qwen/Qwen3-VL-30B-A3B-Instruct IMAGE_TEXT_TO_TEXT H100_X2
Qwen/Qwen3-VL-30B-A3B-Instruct-FP8 IMAGE_TEXT_TO_TEXT
  • H100_X2
  • H200_X2
Qwen/Qwen3-VL-235B-A22B-Instruct IMAGE_TEXT_TO_TEXT H100_X8

Qwen 2,5

Modelos Qwen2.5 compatibles
ID de modelo facial de abrazo Capacidad del modelo Unidad de cluster de IA dedicada mínima
Qwen/Qwen2.5-Codificador-32B-Instruct TEXT_TO_TEXT A100_80G_X2
Qwen/Qwen2.5-0.5B-Instruct TEXT_TO_TEXT A100_80G_X1
Qwen/Qwen2.5-1.5B-Instruct TEXT_TO_TEXT A100_80G_X1
Qwen/Qwen2.5-3B-Instruct TEXT_TO_TEXT A100_80G_X1
Qwen/Qwen2.5-7B-Instruct TEXT_TO_TEXT A100_80G_X1
Qwen/Qwen2.5-14B-Instruct TEXT_TO_TEXT A100_80G_X1
Qwen/Qwen2.5-32B-Instruct TEXT_TO_TEXT A100_80G_X2
Qwen/Qwen2.5-72B-Instruct TEXT_TO_TEXT A100_80G_X4
Qwen/Qwen2.5-VL-3B-Instruct IMAGE_TEXT_TO_TEXT A100_80G_X1
Qwen/Qwen2.5-VL-7B-Instruct IMAGE_TEXT_TO_TEXT A100_80G_X1
Qwen/Qwen2.5-VL-32B-Instruct IMAGE_TEXT_TO_TEXT A100_80G_X2
Qwen/Qwen2.5-VL-72B-Instruct IMAGE_TEXT_TO_TEXT A100_80G_X4

Qwen 2

Modelos Qwen2 compatibles
ID de modelo facial de abrazo Capacidad del modelo Unidad de cluster de IA dedicada mínima
Qwen/Qwen2-0.5B-Instruct TEXTO_A_TEXTO A100_80G_X1
Qwen/Qwen2-1.5B-Instruct TEXTO_A_TEXTO A100_80G_X1
Qwen/Qwen2-7B-Instruct TEXTO_A_TEXTO A100_80G_X1
Qwen/Qwen2-72B-Instruct TEXTO_A_TEXTO A100_80G_X4
Qwen/Qwen2-VL-2B-Instruct TEXTO_IMAGEN A TEXTO A100_80G_X1
Qwen/Qwen2-VL-7B-Instruct TEXTO_IMAGEN A TEXTO A100_80G_X1
Qwen/Qwen2-VL-72B-Instruct TEXTO_IMAGEN A TEXTO A100_80G_X4
Importante

  • Para los modelos importados, puede utilizar la longitud de contexto nativo especificada por el proveedor del modelo. Sin embargo, la longitud máxima efectiva del contexto está limitada por la configuración de hardware subyacente que seleccione para alojar clusters de IA dedicados en OCI Generative AI. Para aprovechar al máximo la longitud del contexto nativo de un modelo, puede que necesite aprovisionar más recursos de hardware.
  • Utilice los modelos ajustados solo si coinciden con la versión del transformador del modelo base compatible y tienen un recuento de parámetros dentro del ±10% del original.
  • Para decidir dónde puede alojar un modelo importado, busque una unidad compatible para el modelo en la tabla de esta página y, a continuación, confirme que la unidad de hardware está disponible en la región de destino en Unidades de unidad de hardware por región. Un modelo se puede alojar en una región solo cuando la región proporciona una unidad de hardware que se muestra para ese modelo.
  • Para obtener más información sobre cómo desplegar los modelos importados, consulte Gestión de modelos importados.
Nota

Facturación para clusters de IA dedicados que alojan modelos importados

Los clusters de IA dedicados que alojan modelos importados no requieren el compromiso mínimo de 744 horas de unidades que se aplica a los clusters de IA dedicados que alojan modelos preentrenados disponibles en OCI Generative AI. En cambio, un cluster de IA dedicado de modelo importado tiene una duración mínima facturable de una hora. Por ejemplo, un cluster que utiliza una unidad AI y se ejecuta durante 30 minutos se factura por una unidad AI-hora.

Después de la primera hora, los cargos se basan en el tiempo de ejecución real del cluster y se prorratean hasta el milisegundo. Por ejemplo, un cluster que se ejecuta durante una hora y un minuto se factura por esa duración, en lugar de por dos horas completas.

OCI envía registros de uso a Medición y facturación cada cinco minutos mientras se ejecuta el cluster. Si el cluster se suprime antes de que se alcance el mínimo de una hora, OCI sigue informando sobre el uso facturable hasta que se alcance el mínimo. Si el cluster se ejecuta durante más de una hora, OCI sigue enviando registros de uso cada cinco minutos hasta que se suprime el cluster.