Modelos MiniMax compatíveis

Você pode importar grandes modelos de linguagem de Hugging Face e buckets do OCI Object Storage para a OCI Generative AI, criar pontos finais para esses modelos e usá-los no serviço Generative AI.

MiniMax M3

O modelo MiniMax-M3-MXFP8 é a variante quantizada MXFP8 de MiniMax M3, um modelo multimodal nativo com um milhão de contexto de token. O modelo tem cerca de 428 bilhões de parâmetros totais com cerca de 23 bilhões de parâmetros ativados e usa a Atenção Esparsa MiniMax (MSA) para processamento eficiente de longo contexto. Esse modelo é otimizado para codificação, fluxos de trabalho agênticos de longa duração e tarefas de produtividade colaborativas.

Modelos MiniMax M3 Compatíveis
Abraçando o ID do modelo facial Capacidade do Modelo Formas Recomendadas de Unidade de Cluster de IA Dedicada
MiniMaxAI/MiniMax-M3-MXFP8 TEXTO_PARA_TEXTO
  • H200_X8
  • B200_X8

MiniMax M2

Os modelos de texto para texto MiniMax M2 são otimizados para codificação, raciocínio complexo e fluxos de trabalho agênticos, como tarefas de uso de ferramentas, pesquisa e produtividade. MiniMax-M2 é um modelo Mixture-of-Experts (MoE) projetado para codificação eficiente e desempenho agêntico, e mais tarde modelos MiniMax-M2 estender esse foco para mais avançada engenharia de software e tarefas de trabalho profissional. Para mais detalhes, consulte MiniMax na documentação Hugging Face.

Modelos MiniMax M2 Compatíveis
Abraçando o ID do modelo facial Capacidade do Modelo Formas Recomendadas de Unidade de Cluster de IA Dedicada
MiniMaxAI/MiniMax-M2.7 TEXTO_PARA_TEXTO
  • H100_X8
  • H200_X8
MiniMaxAI/MiniMax-M2.5 TEXTO_PARA_TEXTO
  • H100_X8
  • H200_X8
MiniMaxAI/MiniMax-M2 TEXTO_PARA_TEXTO
  • H100_X8
  • H200_X8
Importante

  • Para modelos importados, você pode usar o tamanho do contexto nativo especificado pelo provedor do modelo. No entanto, o tamanho máximo de contexto efetivo é limitado pela configuração de hardware subjacente que você seleciona para hospedar clusters de IA dedicados na OCI Generative AI. Para aproveitar ao máximo o tamanho do contexto nativo de um modelo, talvez seja necessário provisionar mais recursos de hardware.
  • Use os modelos ajustados somente se eles corresponderem à versão do transformador do modelo base compatível e tiverem uma contagem de parâmetros dentro de ± 10% do original.
  • Para obter o hardware disponível e as etapas sobre como implantar os modelos importados, consulte Gerenciando Modelos Importados.