xAI Grok 4.6
Grok 4.6 (xai.grok-4.6) está diseñado para la codificación, las tareas genéricas y el trabajo de conocimientos. El modelo admite flujos de trabajo de agentes de larga ejecución, investigación en dominios desconocidos, exploración de base de código y desarrollo iterativo de aplicaciones y artefactos de trabajo. Tiene una ventana de contexto de 500.000 tokens.
Obtenga información sobre Grok 4.6.
Regiones para este modelo
Para las regiones soportadas, los tipos de punto final (clusters de IA dedicados o a demanda) y el alojamiento (OCI Generative AI o llamadas externas) para este modelo, consulte la página Modelos por región. Para obtener más información sobre las regiones, consulte la página Regiones de IA generativa.
Acceder a este modelo
Acceda a este modelo a demanda mediante solicitudes de API de texto soportadas en las regiones soportadas.
Funciones clave
- Nombre del modelo en OCI Generative AI:
xai.grok-4.6 - Disponible bajo demanda: acceda a este modelo con procesamiento estándar o prioritario a través de solicitudes de API de texto soportadas.
- Longitud de contexto: 500 000 tokens.
- Tokens de entrada almacenados en caché: sí. Para conocer el número de tokens de entrada almacenados en caché, consulte el atributo
cachedTokensen la API Referencia de Petición de Datos de Detalles y, para ver los precios, consulte la página de precios.
Límites
- Tokens por minuto (TPM)
- Para un aumento del límite de TPM, utilice el nombre de límite
grok-4-6-tokens-per-minute-count. Consulte Creación de una solicitud de aumento de límite.
Modo bajo demanda
Los modelos Grok solo están disponibles en el modo bajo demanda.
| Nombre de modelo | Nombre de modelo de OCI |
|---|---|
| xAI Grok 4.6 | xai.grok-4.6 |
Fechas de lanzamiento y baja de OCI
Para conocer las fechas de lanzamiento y baja y las opciones del modelo de sustitución, consulte Model Retirement Dates (On-Demand Mode).
Pricing
Grok 4.6 tiene tarifas independientes para el procesamiento estándar y prioritario, así como para solicitudes de contexto corto y largo. Cuando una petición de datos alcanza los 200.000 tokens, los precios de contexto largo se aplican a toda la solicitud, incluidos todos los tokens de entrada y salida. Para conocer las tarifas actuales, consulte la página de precios.
El procesamiento prioritario solo está disponible para solicitudes de API de texto soportadas. Una solicitud de prioridad se carga a la tasa de prioridad solo cuando la respuesta incluye
service_tier: priority. De lo contrario, se aplicarán tarifas estándar.