Generative KI-Modelle und -Regionen für KI-Agents in Unternehmen

Enterprise AI Agents unterstützen eine Teilmenge der grundlegenden und importierten OCI Generative AI-Modelle in ausgewählten Regionen. Auf dieser Seite werden die unterstützten Modelle und Regionen für Laufzeit-Agent-Inferenz und Projektspeicher aufgeführt.

So rufen Sie Modelle auf

Für OCI-OpenAI-kompatible Endpunkte und Tools
Hinweis

In den folgenden Abschnitten werden die grundlegenden und importierten Modelle aufgeführt, die für OCI-OpenAI-kompatible Endpunkte unterstützt werden. Einige Modelle unterstützen auch OpenAI-kompatible Tools. Informationen zum unterstützten Zugriffspfad finden Sie in den einzelnen Abschnitten.

Verfügbare Modelle

Agents können die folgenden grundlegenden und importierten Modelle für Anwendungsfälle für Agentic Inference aufrufen. Der unterstützte Zugriffspfad hängt vom Modelltyp ab.

Verfügbare Basismodelle

Die folgenden vortrainierten Basismodelle werden für die OCI OpenAI-kompatiblen Endpunkte und OpenAI-kompatiblen Tools unterstützt:

Google Vertex AI-Plattform
OpenAI Open Source
xAI-Plattform
Wichtig

Externe Aufrufe

Die Modelle Google Gemini und xAI Grok werden extern gehostet. Modell- und regionsspezifische Informationen finden Sie unter Externe Anrufe.

Verfügbare importierte Modelle

Die folgenden importierten Modelle werden für die OCI-Antworten-API unterstützt:

Alibaba Qwen
Qwen/Qwen3.6-35B-A3B
Google Gemma
google/gemma-4-31B-it

Diese Modelle werden über den Modellimport unterstützt und sind nicht über den On-Demand-Serving-Modus verfügbar. Um eines dieser Modelle über die OCI Responses API aufzurufen, importieren Sie zunächst das Modell in OCI Generative AI, und erstellen Sie dann einen Endpunkt für das importierte Modell in einem dedizierten KI-Hostcluster.

Wählen Sie einen Modelllink in der vorherigen Liste aus, um die minimal unterstützten Ausprägungen für dedizierte KI-Clustereinheiten für dieses Modell anzuzeigen. Verwenden Sie dann die folgenden Hardwareausprägungsinformationen, um das Deployment zu planen:

Verfügbare Handelsregionen (OC1)

Sie können in mindestens einer der folgenden OC1-Regionen auf agentenbezogene Inferenzmodelle zugreifen:

Regionsname Standort Regions-ID Regionsschlüssel
Brazil East (Sao Paulo) São Paulo sa-saopaulo-1 GRU
Germany Central (Frankfurt) Frankfurt am Main eu-frankfurt-1 FRA
India South (Hyderabad) Hyderabad ap-hyderabad-1 HYD
Japan Central (Osaka) Ōsaka ap-osaka-1 KIX
Saudi Arabia Central (Riad) Riad me-riyadh-1 RUH
UK South (London) London uk-london-1 LHR
US East (Ashburn) Ashburn us-ashburn-1 IAD
US Midwest (Chicago) Chicago us-chicago-1 ORD
US West (Phoenix) Phoenix us-phoenix-1 PHX

Lernen Sie Regionen und Availability-Domains kennen.

Hinweis

  • UAE East (Dubai): OCI-OpenAI-kompatible Endpunkte und Tools sind in dieser Region nicht verfügbar.
  • Verfügbarkeit: Nicht jedes aufgelistete Modell ist in den oben aufgeführten Regionen verfügbar. Unterstützte Regionen und Deployment-Details für jedes Modell finden Sie auf der Seite Modelle nach Region.
  • Externe Anrufe: Hinweise zu Modellen mit externen Aufrufen finden Sie unter Externe Anrufe.
Für xAI-kompatible Tools
Hinweis

Die folgenden Modelle werden für die xAI-kompatiblen Tools unterstützt, die mit der OCI Responses-API verwendet werden.

Unterstützte Regionen

Sie können auf die xAI-Modelle zugreifen, indem Sie die Endpunkte in den folgenden OC1-Regionen aufrufen:

Regionsname Standort Regions-ID Regionsschlüssel
US East (Ashburn) Ashburn us-ashburn-1 IAD
US Midwest (Chicago) Chicago us-chicago-1 ORD
US West (Phoenix) Phoenix us-phoenix-1 PHX
Wichtig

Externe Aufrufe von xAI Grok-Modellen

Die xAI Grok-Modelle, auf die über den OCI Generative AI-Service in einer OCI-Region zugegriffen werden kann, werden extern von xAI gehostet. Daher führt ein Aufruf eines xAI Grok-Modells über den OCI Generative AI-Service zu einem Aufruf an einen xAI-Standort.

So aktivieren Sie den Projektspeicher

Für Kurzzeitgedächtnis (Konversationshistorie) Verdichtung

Wenn Sie ein Projekt erstellen, können Sie die Kurzzeitgedächtniskomprimierung für Unterhaltungen und Antworten im Zusammenhang mit diesem Projekt aktivieren. In der folgenden Tabelle sind die verfügbaren Modelle und Regionen für die Speicherkomprimierung aufgeführt.

Region Regions-Code Kurzfristiges Speichermodell
Brazil East (Sao Paulo) sa-saopaulo-1
Germany Central (Frankfurt) eu-frankfurt-1
UK South (London) uk-london-1
India South (Hyderabad) ap-hyderabad-1
US East (Ashburn) (regional zu US Midwest (Chicago) us-ahsburn-1 (regionsübergreifend zu us-chicago-1)
Japan Central (Osaka) ap-osaka-1
Saudi Arabia Central (Riad) me-riyadh-1
US Midwest (Chicago) us-chicago-1
US West (Phoenix) (regional zu US Midwest (Chicago) us-phoenix-1(regionsübergreifend nach us-chicago-1)

Zum Extrahieren von Schlüsselinformationen für Langzeitspeicher

hat

Wenn Sie ein Projekt erstellen, können Sie die Informationsextraktion aus Unterhaltungen und Antworten für eine Langzeitgedächtnisfunktion aktivieren. Sie wählen ein Extraktionsmodell aus, das wichtige Informationen aus Unterhaltungen extrahieren soll. In der folgenden Tabelle finden Sie Regionen und Modelle, die zum Extrahieren von Schlüsselinformationen für den Langzeitgedächtnis unterstützt werden.

Region Verfügbares Extraktionsmodell
Querverweis zu Available Commercial Regions (OC1) mit Regionen, in denen OpenAI gpt-oss-120b verfügbar ist OpenAI gpt-oss-120b
Für die Speicherung von Schlüsselinformationen als Einbettung für langfristigen Speicher

Wenn Sie ein Projekt erstellen, können Sie ein Einbettungsmodell auswählen, um extrahierte Speicher als durchsuchbare Vektoren zu speichern. Das verfügbare Einbettungsmodell hängt von der Projektregion ab. In der folgenden Tabelle finden Sie das Einbettungsmodell, das in jeder Region verfügbar ist:

Region Regions-Code Verfügbares Einbettungsmodell
Brazil East (Sao Paulo) sa-saopaulo-1 Cohere Embed Multilingual 3 (veraltet)
Germany Central (Frankfurt) eu-frankfurt-1 Cohere Embed Multilingual 3 (veraltet)
UK South (London) uk-london-1 Cohere Embed Multilingual 3 (veraltet)
India South (Hyderabad) ap-hyderabad-1 Cohere Embed Multilingual Image 3 (veraltet)
US East (Ashburn) (regional zu US Midwest (Chicago) us-ahsburn-1 Cohere Embed 4
Japan Central (Osaka) ap-osaka-1 Cohere Embed 4
Saudi Arabia Central (Riad) me-riyadh-1 Cohere Embed 4
US Midwest (Chicago) us-chicago-1 Cohere Embed 4
US West (Phoenix) (regional zu US Midwest (Chicago) us-phoenix-1 Cohere Embed 4

Externe Aufrufe

Externe Aufrufe von xAI Grok-Modellen

Wichtig

Externe Aufrufe von xAI Grok-Modellen

Die xAI Grok-Modelle, auf die über den OCI Generative AI-Service in einer OCI-Region zugegriffen werden kann, werden extern von xAI gehostet. Daher führt ein Aufruf eines xAI Grok-Modells über den OCI Generative AI-Service zu einem Aufruf an einen xAI-Standort.

Externe Anrufe zu Google Gemini-Modellen

Wichtig

Externe Aufrufe an Google Gemini 2.5 Pro für US-Regionen

Das Google Gemini 2.5 Pro-Modell, auf das über den OCI Generative AI-Service in US-Regionen zugegriffen werden kann, wird extern von Google gehostet. Daher führt ein Aufruf an ein Google Gemini 2.5 Pro-Modell (über den OCI Generative AI-Service) zu einem Aufruf an einen Google-Standort. Für Google Gemini 2.5 Pro wird ein regionaler Standort von Google Americas verwendet, der die Anforderung nur an einen Standort von Google Americas weiterleitet. Machine Learning Processing findet an einem Standort in Google Americas statt.

Wichtig

Externe Aufrufe an Google Gemini 2.5 Pro für EU-Regionen

Das Google Gemini 2.5 Pro-Modell, auf das über den OCI Generative AI-Service in der Region Frankfurt zugegriffen werden kann, wird extern von Google gehostet. Daher führt ein Aufruf an ein Google Gemini 2.5 Pro-Modell (über den OCI Generative AI-Service) zu einem Aufruf an einen Google-Standort. Für Gemini 2.5 Pro wird ein regionaler Standort der Google Europäischen Union (EU) verwendet, der die Anfrage nur an einen Standort der Google EU weiterleitet. Machine Learning Processing findet innerhalb eines Google-Standorts in der EU statt.

Wichtig

Externe Aufrufe an Google Gemini 2.5 Pro für KR-Regionen

Das Modell Google Gemini 2.5 Pro, auf das über den OCI Generative AI-Service in der Region Osaka zugegriffen werden kann, wird extern von Google gehostet. Daher führt ein Aufruf an ein Google Gemini 2.5 Pro-Modell (über den OCI Generative AI-Service) zu einem Aufruf an einen Google-Standort. Für Gemini 2.5 Pro wird ein regionaler Standort von Google Asia Pacific verwendet, der die Anforderung nur an einen Standort von Google Asia Pacific weiterleitet. Machine Learning Processing kann an jedem Google-Standort weltweit stattfinden.

Wichtig

Externe Aufrufe an Gemini 2.5 Flash für US-Regionen

Das Gemini 2.5 Flash-Modell, auf das über den OCI Generative AI-Service in US-Regionen zugegriffen werden kann, wird extern von Google gehostet. Daher führt ein Aufruf an ein Gemini 2.5 Flash-Modell (über den OCI Generative AI-Service) zu einem Aufruf an einen Google-Standort. Für Gemini 2.5 Flash wird ein regionaler Standort von Google Americas verwendet, der die Anforderung nur an einen Standort von Google Americas weiterleitet. Machine Learning Processing findet an einem Standort in Google Americas statt.

Wichtig

Externe Anrufe an Gemini 2.5 Flash in der Region Brasilien

Das Modell Gemini 2.5 Flash, auf das über den OCI Generative AI-Service am Standort Brasilien zugegriffen werden kann, wird extern von Google gehostet. Daher führt ein Aufruf an ein Gemini 2.5 Flash-Modell über den OCI Generative AI-Service zu einem Anruf an einen Google-Standort in Brasilien. Die Verarbeitung von maschinellem Lernen findet nur am brasilianischen Standort von Google statt.

Wichtig

Externe Aufrufe an Gemini 2.5 Flash für EU-Regionen

Das Gemini 2.5 Flash-Modell, auf das über den OCI Generative AI-Service in der Region Frankfurt zugegriffen werden kann, wird extern von Google gehostet. Daher führt ein Aufruf an ein Gemini 2.5 Flash-Modell (über den OCI Generative AI-Service) zu einem Aufruf an einen Google-Standort. Für Gemini 2.5 Flash wird ein regionaler Standort der Google Europäischen Union (EU) verwendet, der die Anfrage nur an einen Standort der Google EU weiterleitet. Machine Learning Processing findet innerhalb eines Google-Standorts in der EU statt.

Wichtig

Externe Aufrufe an Gemini 2.5 Flash für KR-Regionen

Das Modell Gemini 2.5 Flash, auf das über den OCI Generative AI-Service in der Region Osaka und in der Region Hyderabad zugegriffen werden kann, wird extern von Google gehostet. Daher führt ein Aufruf an ein Gemini 2.5 Flash-Modell (über den OCI Generative AI-Service) zu einem Aufruf an einen Google-Standort. Für Gemini 2.5 Flash wird ein regionaler Standort von Google Asia Pacific verwendet, der die Anforderung nur an einen Standort von Google Asia Pacific weiterleitet. Machine Learning Processing kann an jedem Google-Standort weltweit stattfinden.

Wichtig

Externe Aufrufe an Gemini 2.5 Flash-Lite für US-Regionen

Das Gemini 2.5 Flash-Lite-Modell, auf das über den OCI Generative AI-Service in US-Regionen zugegriffen werden kann, wird extern von Google gehostet. Daher führt ein Aufruf an ein Gemini 2.5 Flash-Lite-Modell (über den OCI Generative AI-Service) zu einem Aufruf an einen Google-Standort. Für Gemini 2.5 Flash-Lite wird ein regionaler Standort von Google Americas verwendet, der die Anforderung nur an einen Standort von Google Americas weiterleitet. Machine Learning Processing findet an einem Standort in Google Americas statt.

Wichtig

Externe Aufrufe an Gemini 2.5 Flash-Lite für EU-Regionen

Das Gemini 2.5 Flash-Lite-Modell, auf das über den OCI Generative AI-Service in der Region Frankfurt zugegriffen werden kann, wird extern von Google gehostet. Daher führt ein Aufruf an ein Gemini 2.5 Flash-Lite-Modell (über den OCI Generative AI-Service) zu einem Aufruf an einen Google-Standort. Für Gemini 2.5 Flash-Lite wird ein regionaler Standort der Google Europäischen Union (EU) verwendet, der die Anfrage nur an einen Standort der Google EU weiterleitet. Machine Learning Processing findet innerhalb eines Google-Standorts in der EU statt.