xAI Grok 4.6
O Grok 4.6 (xai.grok-4.6) foi projetado para codificação, tarefas ágeis e trabalho de conhecimento. O modelo suporta fluxos de trabalho de agentes de longa execução, pesquisa em domínios desconhecidos, exploração de base de código e desenvolvimento iterativo de aplicativos e artefatos de trabalho. Tem uma janela de contexto de 500.000 toques.
Saiba mais sobre Grok 4.6.
Regiões para este Modelo
Para regiões suportadas, tipos de ponto final (clusters de IA sob demanda ou dedicados) e hospedagem (OCI Generative AI ou chamadas externas) para esse modelo, consulte a página Modelos por Região. Para obter detalhes sobre as regiões, consulte a página Regiões de IA Generativa.
Acessar este Modelo
Acesse esse modelo sob demanda por meio de solicitações de API de texto suportadas nas regiões suportadas.
Principais Recursos
- Nome do modelo na OCI Generative AI:
xai.grok-4.6 - Disponível sob Demanda: Acesse esse modelo com processamento padrão ou prioritário por meio de solicitações de API de texto suportadas.
- Tamanho do Contexto: 500.000 tokens.
- Tokens de Entrada em Cache: Sim. Para obter o número de tokens de entrada armazenados no cache, consulte o atributo
cachedTokensna API Referência de PromptTokensDetails e, para obter preços, consulte a Página de Preços.
Limites
- Tokens por minuto (TPM)
- Para um aumento de limite de TPM, use o nome de limite
grok-4-6-tokens-per-minute-count. Consulte Criando uma Solicitação de Aumento de Limite.
Modo sob Demanda
Os modelos Grok só estão disponíveis no modo sob demanda.
| Nome do Modelo | Nome do Modelo do OCI |
|---|---|
| xAI Grok 4.6 | xai.grok-4.6 |
Datas de Lançamento e Baixa do OCI
Para datas de liberação e baixa e opções de modelo de substituição, consulte Datas de Baixa do Modelo (Modo Sob Demanda).
Preços
Grok 4.6 tem taxas separadas para processamento padrão e prioritário e para solicitações de contexto curto e longo. Quando um prompt atinge 200.000 tokens, o preço de contexto longo se aplica a toda a solicitação, incluindo todos os tokens de entrada e saída. Para obter as taxas atuais, consulte a Página Preços.
O processamento de prioridade está disponível apenas para solicitações de API de texto suportadas. Uma solicitação de prioridade é cobrada na taxa de prioridade somente quando a resposta inclui
service_tier: priority. Caso contrário, as taxas padrão serão aplicadas.