Modelo NVIDIA Nemotron compatible

Puede importar modelos de lenguaje grandes de cubos de Hugging Face y OCI Object Storage a OCI Generative AI, crear puntos finales para esos modelos y utilizarlos en el servicio Generative AI.

NVIDIA Nemotron™ es una familia de modelos abiertos con pesas abiertas, datos de entrenamiento y recetas, adecuados para flujos de trabajo ágiles, razonamiento de contexto largo, cargas de trabajo de gran volumen (por ejemplo, automatización de tickets de TI), uso de herramientas y RAG. Para los modelos compatibles en Hugging Face, consulte los enlaces de la siguiente tabla. Obtén más información sobre NVIDIA Nemotron.

NVIDIA Nemotron

Modelos NVIDIA Nemotron compatibles
ID de modelo facial de abrazo Capacidad del modelo Unidad de cluster de IA dedicada recomendada
nvidia/Llama-3.1-Nemotrón-Nano-8B-v1 TEXT_TO_TEXT A100_80G_X1
nvidia/Llama-3.1-Nemotrón-70B-Instruct-HF TEXT_TO_TEXT A100_80G_X4
NVIDIA/NVIDIA-Nemotron-3-Ultra-550B-A55B-NVFP4 TEXT_TO_TEXT B200_X4
NVIDIA/NVIDIA-Nemotron-3-Super-120B-A12B-BF16 TEXT_TO_TEXT H100_X8
NVIDIA/NVIDIA-Nemotron-3-Nano-30B-A3B-FP8 TEXTO_A_TEXTO H100_X4
NVIDIA/NVIDIA-Nemotron-3-Nano-30B-A3B-BF16 TEXTO_A_TEXTO A100_80G_X1
Importante

  • Para los modelos importados, puede utilizar la longitud de contexto nativo especificada por el proveedor del modelo. Sin embargo, la longitud máxima efectiva del contexto está limitada por la configuración de hardware subyacente que seleccione para alojar clusters de IA dedicados en OCI Generative AI. Para aprovechar al máximo la longitud del contexto nativo de un modelo, puede que necesite aprovisionar más recursos de hardware.
  • Utilice los modelos ajustados solo si coinciden con la versión del transformador del modelo base compatible y tienen un recuento de parámetros dentro del ±10% del original.
  • Para obtener información sobre el hardware disponible y los pasos para desplegar los modelos importados, consulte Gestión de modelos importados.