xAI Grok 4.6
Grok 4.6 (xai.grok-4.6) ist für Codierung, agentenbezogene Aufgaben und Wissensarbeit konzipiert. Das Modell unterstützt lang andauernde Agent-Workflows, Forschung in unbekannten Bereichen, Codebase-Exploration und iterative Entwicklung von Anwendungen und Arbeitsartefakten. Es verfügt über ein Kontextfenster mit 500.000 Token.
Weitere Informationen zu Grok 4.6.
Regionen für dieses Modell
Informationen zu unterstützten Regionen, Endpunkttypen (On-Demand- oder dedizierte KI-Cluster) und Hosting (OCI Generative AI oder externe Aufrufe) für dieses Modell finden Sie auf der Seite Modelle nach Region. Details zu den Regionen finden Sie auf der Seite Regionen für generative KI.
Zugriff auf dieses Modell
Greifen Sie auf dieses Modell bei Bedarf über unterstützte Text-API-Anforderungen in den unterstützten Regionen zu.
Wichtige Features
- Modellname in OCI Generative AI:
xai.grok-4.6 - Verfügbar auf Anforderung: Greifen Sie über unterstützte Text-API-Anforderungen mit Standard- oder Prioritätsverarbeitung auf dieses Modell zu.
- Kontextlänge: 500.000 Token.
- Gecachte Eingabetoken: Ja. Die Anzahl der gecachten Eingabetoken finden Sie im Attribut
cachedTokensin der PromptTokensDetails-Referenz-API. Preise finden Sie auf der Seite "Preisfindung".
Limits
- Token pro Minute (TPM)
- Für eine Erhöhung des TPM-Limits verwenden Sie den Limitnamen
grok-4-6-tokens-per-minute-count. Siehe Limiterhöhungsanforderungen erstellen.
Bedarfsgesteuerter Modus
Die Grok-Modelle sind nur im On-Demand-Modus verfügbar.
| Modellname | OCI-Modellname |
|---|---|
| xAI Grok 4.6 | xai.grok-4.6 |
OCI-Release- und -Abgangsdaten
Informationen zu Freigabe- und Abgangsdaten und Ersatzmodelloptionen finden Sie unter Abgangsdatumsangaben für Modelle (On-Demand-Modus).
Preisfindung
Grok 4.6 verfügt über separate Sätze für die Standard- und Prioritätsverarbeitung sowie für Kurz- und Langkontextanforderungen. Wenn ein Prompt 200.000 Token erreicht, gilt die Long-Context-Preisgestaltung für die gesamte Anforderung, einschließlich aller Eingabe- und Ausgabetoken. Aktuelle Kurse finden Sie auf der Seite Preisfindung.
Die Prioritätsverarbeitung ist nur für unterstützte Text-API-Anforderungen verfügbar. Eine Prioritätsanforderung wird nur dann mit der Prioritätsrate berechnet, wenn die Antwort
service_tier: priority enthält. Andernfalls gelten die Standardsätze.