Compute verwalten

In diesem Abschnitt werden die grundlegenden Funktionen zum Erstellen, Ändern oder Entfernen von Compute-Clustern in AI Data Platform Workbench beschrieben.

Compute-Cluster

Allzweck-Compute-Cluster stellen Ihnen die Compute-Ressourcen zur Verfügung, um Ihre Workloads in einer AI Data Platform Workbench-Instanz zu verarbeiten.

Sie verwalten Ihre Compute-Cluster auf der Seite Compute in Oracle AI Data Platform Workbench.


Compute-Seite für AI Data Platform, wobei Compute im linken Fensterbereich hervorgehoben ist

Berechnungstypen

In AI Data Platform Workbench sind zwei Compute-Typen vorhanden: Allzweck-Compute-Cluster und Standard-Masterkatalog-Compute-Cluster.

In AI Data Platform Workbench können Sie nur Allzweck-Compute-Cluster erstellen. Allzweck-Compute-Cluster eignen sich für eine vielseitige Palette von Workloads und können an Ihre Notizbücher angehängt und in Workflows verwendet werden. Sofern nicht anders angegeben, beziehen sich Verweise auf "Compute Cluster" oder "Cluster" in der Dokumentation auf Allzweck-Compute-Cluster.

Wenn Sie ein neues Allzweck-Compute-Cluster erstellen, können Sie entweder die Schnellstart- oder die benutzerdefinierte Konfiguration auswählen. Die Schnellstartkonfiguration ist für einen schnellen Start optimiert. Mit der benutzerdefinierten Konfiguration können Sie Ihr Allzweck-Compute-Cluster an die spezifischen Workloads anpassen, die Sie für die Verarbeitung benötigen. In den Konfigurationsoptionen "Schnellstart" und "Benutzerdefiniert" können Sie Kostenprognosen anzeigen und Optionen für den Leerlaufzeit-Timeout ändern.

Hinweis:

Wenn Sie benutzerdefinierte Librarys in einem konfigurierten Allzweck-Compute-Cluster installieren, wird das Cluster automatisch in die benutzerdefinierte Konfiguration geändert. Dies kann sich auf die Startleistung auswirken.

Standard-Masterkatalog-Compute-Cluster ist in allen AI Data Platform Workbench-Instanzen vorhanden. Dieses Cluster ist für wesentliche AI Data Platform Workbench-Funktionen verantwortlich, wie Such-Crawls, das Aktualisieren von Katalogobjekten, das Erstellen, Bearbeiten und Löschen von Objekten und das Testen von Verbindungen.

Clusterlaufzeit

Allzweck-Compute-Cluster können mit einer Apache Spark 3.5-Laufzeit erstellt werden. Die Laufzeitumgebung ist kompatibel mit:

  • Spark 3.5.0
  • Delta 3.2.0 (vorab enthalten)
  • Python 3.11
  • Scala 2.12
  • Hadoop 3.3.4
  • Java 17

Export und Import von Compute-Konfiguration

Nachdem Sie ein Compute-Cluster erstellt haben, können Sie die Einstellungen, die Sie für dieses Cluster konfiguriert haben, in Ihren Workspace oder ein Volume in einem Katalog exportieren, um es erneut für andere Cluster zu verwenden. Sie können Ihre gespeicherten Konfigurationen in andere erstellte Cluster importieren oder im Rahmen des Erstellungsprozesses importieren.

Ihre Konfigurationen stehen anderen Benutzern mit Zugriff auf den Arbeitsbereich oder das Volume zur Verfügung, in dem Sie die Konfiguration gespeichert haben. So können Konfigurationen ganz einfach teamübergreifend freigegeben werden.

Schnellstartcluster erstellen

Sie können ein Allzweck-Compute-Cluster mit vorkonfigurierten Einstellungen zur Verarbeitung von Daten und AI-Workloads in Ihrer AI Data Platform Workbench erstellen.

Die Schnellstartkonfiguration ist ein Apache Spark-Cluster mit 1 Treiber und bis zu 10 Workern, jeweils mit AMD 2 OCPU und 32 GB Arbeitsspeicher. Autoscaling ist standardmäßig für die Schnellstartkonfiguration aktiviert. Sie können festlegen, dass Ihre Cluster ständig aktiv sind, oder Sie können ein Intervall für Inaktivität festlegen, nach dem das Cluster automatisch gestoppt wird (Leerlaufzeit-Timeout). Gestoppte Cluster werden fortgesetzt, wenn sie von einem angehängten Workflow oder Notizbuch aufgerufen werden.

Sie können das Cluster nach der Erstellung jederzeit bearbeiten.

  1. Klicken Sie im linken Navigationsbereich auf Erstellen und dann auf Compute. Sie können auch zu Ihrem Workspace navigieren und auf Compute klicken und dann auf Cluster erstellen (Symbol) Cluster erstellen klicken.

    Dialogfeld "Cluster erstellen" geöffnet, wobei die radiale Option "Schnellstart" ausgewählt ist

  2. Geben Sie einen Namen und eine Beschreibung zur Identifizierung des Clusters an.
  3. Wählen Sie Laufzeitversion aus.
  4. Wählen Sie Schnellstart als Clusterkonfiguration aus.
  5. Wählen Sie aus, ob die Anzahl der Mitarbeiter statisch ist oder automatisch skaliert wird. Autoscaling ist standardmäßig für die Schnellstartkonfiguration aktiviert.
  6. Wählen Sie unter Ausführungsdauer aus, ob das Cluster nach einer festgelegten Dauer der Inaktivität nicht mehr ausgeführt wird. Wenn Leerlaufzeit-Timeout ausgewählt ist, geben Sie die Leerlaufzeit in Minuten an, bevor das Cluster abläuft.
  7. Klicken Sie auf Create.

Benutzerdefiniertes Cluster erstellen

Sie können ein Allzweck-Compute-Cluster mit Konfigurationseinstellungen Ihrer Wahl erstellen, um Daten und KI-Workloads in Oracle AI Data Platform Workbench zu verarbeiten.

Benutzerdefinierte Cluster sind für fortgeschrittene Benutzer gedacht, die das gesamte Spektrum an Konfigurationsoptionen entsprechend ihren Anforderungen nutzen möchten. Wählen Sie die Treiber- und Mitarbeiteroptionen aus, die am besten zu den Arbeitslasten passen, die Sie verarbeiten möchten. Sie können festlegen, dass Ihre Cluster ständig aktiv sind, oder Sie können ein Intervall für Inaktivität festlegen, nach dem das Cluster automatisch gestoppt wird (Leerlaufzeit-Timeout). Gestoppte Cluster werden fortgesetzt, wenn sie von einem angehängten Workflow oder Notizbuch aufgerufen werden.

Sie können das Cluster nach der Erstellung jederzeit bearbeiten.

  1. Klicken Sie im linken Navigationsbereich auf Erstellen und dann auf Compute. Sie können auch zu Ihrem Workspace navigieren und auf Compute klicken und dann auf Cluster erstellen (Symbol) Cluster erstellen klicken.

    Dialogfeld "Compute-Cluster erstellen" mit ausgewählter Option "Benutzerdefiniert" öffnen

  2. Wählen Sie unter Methode erstellen die Option Neues Cluster konfigurieren aus.
  3. Geben Sie einen Namen und eine Beschreibung zur Identifizierung des Clusters an.
  4. Wählen Sie Laufzeitversion aus.
  5. Wählen Sie Benutzerdefiniert als Clusterkonfiguration aus.
  6. Wählen Sie die Treiberoptionen für Ihr Cluster aus.
  7. Wählen Sie die Worker-Optionen für Ihr Cluster aus. Diese Optionen gelten für alle Cluster Worker.
  8. Wählen Sie aus, ob die Anzahl der Mitarbeiter statisch ist oder automatisch skaliert werden soll.
    • Wenn Statischer Betrag angegeben ist, geben Sie die Anzahl der Worker an.
    • Geben Sie bei Autoscaling die Mindest- und Höchstanzahl der Worker an, auf die das Cluster skalieren kann.
  9. Wählen Sie unter Ausführungsdauer aus, ob das Cluster nach einer festgelegten Dauer der Inaktivität nicht mehr ausgeführt wird. Wenn Leerlaufzeit-Timeout ausgewählt ist, geben Sie die Leerlaufzeit in Minuten an, bevor das Cluster abläuft.
  10. Klicken Sie auf Create.

Cluster mit einer importierten Konfiguration erstellen

Sie können ein Allzweck-Compute-Cluster mit Konfigurationseinstellungen erstellen, die aus einem vorhandenen Compute-Cluster in Ihrer Oracle AI Data Platform Workbench exportiert werden.

Wenn Sie Einstellungen aus einer exportierten YAML-Datei importieren, können Sie Cluster mit denselben Einstellungen schnell replizieren. Sie können YAML-Dateien aus AI Data Platform-Workspaces oder Volumes importieren, die mit Ihnen gemeinsam verwendet werden.

Sie können das Cluster nach der Erstellung jederzeit bearbeiten.

  1. Klicken Sie im linken Navigationsbereich auf Erstellen und dann auf Compute. Sie können auch zu Ihrem Workspace navigieren und auf Compute klicken und dann auf Cluster erstellen (Symbol) Cluster erstellen klicken.
  2. Wählen Sie unter Erstellen die Option Exportierte Konfiguration verwenden aus.
  3. Wählen Sie im Dropdown-Menü Konfigurationsdatei die exportierte Konfiguration aus, die für das neue Cluster verwendet werden soll. Laufzeit-, Bibliotheks- und Umgebungseinstellungen werden von der importierten Datei vorausgefüllt.
  4. Geben Sie einen Namen und eine Beschreibung zur Identifizierung des Clusters an.
  5. Ändern Sie die restlichen Einstellungen nach Bedarf.
  6. Klicken Sie auf Create.

NVIDIA-GPU-Cluster erstellen

Sie können eine NVIDIA-GPU in einem All Purpose Compute-Cluster verwenden, um jede Workload in Ihrer einheitlichen KI- und Datenpipeline zu beschleunigen.

NVIDIA-GPU-Ausprägungen verwenden die folgenden Konfigurationen:

Tabelle 9-1: NVIDIA-GPU-Ausprägungen

GPU-Anzahl OCPU Blockspeicher (GB) GPU-Arbeitsspeicher (GB) CPU-Arbeitsspeicher (GB)
1 15 1500 24 240
2 30 3000 48 480

Hinweis:

Wenn Sie NVIDIA-GPU-Ausprägungen verwenden, müssen sowohl die Ausprägung "Treiber" als auch die Ausprägung "Worker" eine NVIDIA-GPU sein. Das Mischen von CPU- und GPU-Ausprägungen für dasselbe Cluster wird derzeit nicht unterstützt.
  1. Klicken Sie im linken Navigationsbereich auf Erstellen und dann auf Compute. Sie können auch zu Ihrem Workspace navigieren und auf Compute klicken und dann auf Cluster erstellen (Symbol) Cluster erstellen klicken.

    Dialogfeld "Compute-Cluster erstellen" mit ausgewählter Option "Benutzerdefiniert radial" geöffnet

  2. Geben Sie einen Namen und eine Beschreibung zur Identifizierung des Clusters an.
  3. Wählen Sie Laufzeitversion aus.
  4. Wählen Sie Benutzerdefiniert als Clusterkonfiguration aus.
  5. Für die Clustertreiberoptionen:
    • Wählen Sie NVIDIA-GPU als Treiberausprägung aus.
    • Wählen Sie 1 oder 2 als GPU-Anzahl aus.
  6. Für die Cluster Worker-Optionen:
    • Wählen Sie NVIDIA-GPU als Worker-Ausprägung aus.
    • Wählen Sie 1 oder 2 als GPU-Anzahl aus.
  7. Wählen Sie aus, ob die Anzahl der Mitarbeiter statisch ist oder automatisch skaliert werden soll.
    • Wenn Statischer Betrag angegeben ist, geben Sie die Anzahl der Worker an.
    • Geben Sie bei Autoscaling die Mindest- und Höchstanzahl der Worker an, auf die das Cluster skalieren kann.
  8. Wählen Sie unter Ausführungsdauer aus, ob das Cluster nach einer festgelegten Dauer der Inaktivität nicht mehr ausgeführt wird. Wenn Leerlaufzeit-Timeout ausgewählt ist, geben Sie die Leerlaufzeit in Minuten an, bevor das Cluster abläuft.
  9. Klicken Sie auf Create.

Compute-Konfiguration exportieren

Sie können die Compute-Clusterkonfiguration und Abhängigkeiten in einen Speicherort in Ihrem Workspace exportieren, damit sie in andere Compute-Cluster importiert werden können.

  1. Navigieren Sie zu Ihrem Workspace, und klicken Sie auf Compute.
  2. Klicken Sie neben dem Compute-Cluster, für das Sie Einstellungen exportieren möchten, auf Aktionssymbol mit drei Punkten Aktionen und dann auf Compute-Konfiguration exportieren. Sie können auch auf den Clusternamen klicken, oben rechts auf Aktionen klicken und dann auf Compute-Konfiguration exportieren klicken.
  3. Überprüfen Sie die Abhängigkeiten, wie Bibliotheken und Umgebungsvariablen. Heben Sie die Auswahl auf, die nicht exportiert werden soll.
  4. Wählen Sie einen Speicherort in Ihrem Workspace oder in einem Volume aus.
  5. Klicken Sie auf Exportieren.

Compute-Konfiguration importieren

Mit YAML-Konfigurationsdateien in Ihrem Workspace können Sie vorhandene Compute-Clusterkonfigurationen und deren Abhängigkeiten in ein Allzweckcluster importieren.

  1. Navigieren Sie zu Ihrem Workspace, und klicken Sie auf Compute.
  2. Klicken Sie neben dem Compute-Cluster, für das Sie Einstellungen importieren möchten, auf Aktionssymbol mit drei Punkten Aktionen und dann auf Compute-Konfiguration importieren. Sie können auch auf den Clusternamen klicken, oben rechts auf Aktionen und dann auf Compute-Konfiguration importieren klicken.
  3. Suchen Sie Ihren Workspace oder Ihr Volume nach den YAML-Konfigurationsdateien, die Sie hochladen möchten, und wählen Sie mindestens eine Datei aus.
  4. Prüfen Sie die ausgewählten Konfigurationsdateien, und klicken Sie auf Importieren.

Cluster ändern

Sie können Einstellungen ändern oder zusätzliche Parameter für Ihre Cluster hinzufügen.

  1. Navigieren Sie zu Ihrem Workspace, und klicken Sie auf Compute.
  2. Klicken Sie neben dem Compute-Cluster, das Sie ändern möchten, auf Aktionssymbol mit drei Punkten Aktionen und dann auf Bearbeiten.
  3. Ändern Sie die Attribute des Compute-Clusters, oder fügen Sie bei Bedarf zusätzliche Parameter hinzu.
  4. Klicken Sie auf Speichern.

Cluster löschen

Sie können Compute-Cluster löschen, die nicht verwendet oder nicht mehr benötigt werden.

  1. Navigieren Sie zu Ihrem Workspace, und klicken Sie auf Compute.
  2. Klicken Sie neben dem zu löschenden Cluster auf Aktionssymbol mit drei Punkten Aktionen, und klicken Sie auf Löschen.
  3. Klicken Sie auf Löschen.

Clusterdetails anzeigen

Sie können die Ausprägung und die Einstellungen eines Clusters jederzeit prüfen.

  1. Navigieren Sie zu Ihrem Workspace, und klicken Sie auf Compute.
  2. Klicken Sie auf den Namen des Clusters, für das Sie Details anzeigen möchten.
  3. Klicken Sie auf die Registerkarte Details.

Wartungsupdates für Compute-Cluster

Oracle AI Data Platform-Compute wendet Wartungsupdates automatisch ohne Benutzereingriff an.

Die Wartungsupdates decken alle erforderlichen Sicherheitspatches oder -fehlerkorrekturen für Betriebssystem und interne Komponenten der AI Data Platform ab. AI Data Platform prüft, ob keine aktiven Cluster vorhanden sind, bevor diese monatlichen Wartungsupdates eingespielt werden.