xAI Grok 4.6
Grok 4.6 (xai.grok-4.6) è progettato per la codifica, le attività identiche e il knowledge work. Il modello supporta i flussi di lavoro degli agenti a lungo termine, la ricerca in domini sconosciuti, l'esplorazione del codebase e lo sviluppo iterativo di applicazioni e artifact di lavoro. Ha una finestra di contesto da 500.000 token.
Informazioni su Grok 4.6.
Aree per questo modello
Per le aree supportate, i tipi di endpoint (cluster AI su richiesta o dedicati) e l'hosting (AI generativa OCI o chiamate esterne) per questo modello, vedere la pagina Modelli per area. Per informazioni dettagliate sulle aree, vedere la pagina Aree AI generative.
Accedi a questo modello
Accedi a questo modello su richiesta tramite le richieste API di testo supportate nelle aree supportate.
Caratteristiche principali
- Nome del modello in OCI Generative AI:
xai.grok-4.6 - Disponibile su richiesta: accedi a questo modello con elaborazione standard o prioritaria tramite richieste API di testo supportate.
- Lunghezza contesto: 500.000 token.
- Token di input inseriti nella cache: Sì. Per il numero di token di input inseriti nella cache, vedere l'attributo
cachedTokensnell'API Riferimento PromptTokensDetails e per i prezzi, vedere la pagina Determinazione prezzi.
Limiti
- Token al minuto (TPM)
- Per un aumento del limite TPM, utilizzare il nome limite
grok-4-6-tokens-per-minute-count. Vedere Creazione di una richiesta di aumento del limite.
Modalità su richiesta
I modelli Grok sono disponibili solo in modalità su richiesta.
| Nome modello | Nome modello OCI |
|---|---|
| xAI Grok 4.6 | xai.grok-4.6 |
Date di rilascio e ritiro OCI
Per le date di rilascio e smobilizzo e le opzioni del modello di sostituzione, vedere Date di smobilizzo del modello (modalità su richiesta).
Pricing
Grok 4.6 ha tariffe separate per l'elaborazione standard e prioritaria e per le richieste di breve e lungo contesto. Quando un prompt raggiunge i 200.000 token, i prezzi contestuali si applicano all'intera richiesta, inclusi tutti i token di input e output. Per i tassi correnti, vedere la pagina Determinazione prezzi.
L'elaborazione delle priorità è disponibile solo per le richieste API di testo supportate. Una richiesta di priorità viene addebitata al tasso di priorità solo se la risposta include
service_tier: priority. Altrimenti si applicano tariffe standard.