Forme delle unità hardware per area
Questa pagina elenca le forme hardware disponibili per i cluster AI dedicati in OCI Generative AI per area.
Utilizzare le forme hardware quando si crea un cluster AI dedicato per ospitare un modello. La forma hardware identifica l'hardware di base per il cluster AI dedicato, come A100_80G o H100.
Le tabelle di riepilogo dell'area elencano solo la forma hardware. I prefissi del provider e i conteggi delle unità non vengono visualizzati nelle tabelle di riepilogo dell'area.
Il nome completo della forma dell'unità nella console o nell'API dipende dal modo in cui il modello viene reso disponibile:
- Modelli offerti da OCI Generative AI per l'hosting dedicato: il nome della forma dell'unità inizia con un prefisso provider o famiglia di modelli. Ad esempio,
Cohere_A100_80G_X4,Meta_H100_X8eOAI_A10_X2. - Modelli importati: il nome della forma dell'unità non include un prefisso del provider. Ad esempio, utilizzare
A100_80G_X4oH100_X8. Quando si crea il cluster AI dedicato di hosting, si seleziona il modello importato separatamente dalla forma dell'unità hardware.
In entrambi i pattern di denominazione, i valori A100_80G e H100 identificano la forma dell'hardware e il valore che segue X identifica il numero di unità hardware.
Il conteggio delle unità AI si basa sulla forma hardware e sul numero di unità hardware, non sul prefisso del provider. Ad esempio, H100_X2 e Cohere_H100_X2 utilizzano entrambe due unità hardware H100 e hanno lo stesso conteggio di unità AI. Per il conteggio delle unità AI di ciascuna forma di unità hardware, vedere Hardware Unit Shapes, Limits di Servizio e AI Unit Count.
America del Nord
Nella tabella seguente sono elencate le forme hardware per le aree del Nord America.
| Stati Uniti (Est) - Ashburn (OC1) |
Stati Uniti (Midwest) - Chicago (OC1) |
Stati Uniti (Ovest) - Phoenix (OC1) |
Governo degli Stati Uniti (Ovest) - Phoenix (OC2) |
Stati Uniti DoD (Ovest) - Phoenix (OC3) |
|---|---|---|---|---|
|
|
|
|
|
|
Per utilizzare le unità B300 in un'area governativa, richiedere un aumento del limite del servizio per il limite dedicated-unit-b300-count. Per istruzioni, vedere Richiesta di un aumento del limite del servizio per le tenancy cloud per il governo degli Stati Uniti e la difesa degli Stati Uniti.
Sud America
Nella tabella seguente sono elencate le forme hardware per le aree del Sud America.
| Brasile (Est) - San Paolo (OC1) |
|---|
|
|
Europa
Nella tabella seguente sono elencate le forme hardware per le aree geografiche europee.
| Germania (Centro) - Francoforte (OC1) |
Sovrano centrale UE (Francoforte) (OC19) |
Regno Unito (Sud) - Londra (OC1) |
Governo del Regno Unito (Sud) - Londra (OC4) |
|---|---|---|---|
|
|
|
|
|
Medio Oriente
Nella tabella seguente sono elencate le forme hardware per le aree del Medio Oriente.
| Arabia Saudita centrale (Riad) (OC1) |
Emirati Arabi Uniti (Centro) - Abu Dhabi (OC1) |
Emirati Arabi Uniti (Est) - Dubai (OC1) |
|---|---|---|
|
|
|
|
Asia Pacifico
Nella tabella seguente sono elencate le forme hardware per le aree Asia/Pacifico.
| India (Sud) - Hyderabad (OC1) |
Giappone centrale (Osaka) (OC1) |
|---|---|
|
|
|
Forme delle unità hardware, limiti del servizio e conteggi delle unità AI
Nella tabella seguente sono elencati il limite del servizio, le unità hardware necessarie e il conteggio delle unità AI per ogni forma dell'unità hardware. Il conteggio di unità AI è determinato dalla forma hardware e dal numero dopo X. Un prefisso provider o modello-famiglia non modifica il conteggio delle unità AI. Ad esempio, cercare H100_X2 in questa tabella per H100_X2 o Cohere_H100_X2.
Il conteggio unità AI è il moltiplicatore di prezzo per una replica di una forma di unità hardware. Per stimare il prezzo orario di una replica, moltiplicare il prezzo Unità AI all'ora applicabile nella pagina Determinazione prezzi per il conteggio di unità AI nella tabella. Se il cluster dispone di più repliche, moltiplicare anche il risultato per il numero di repliche.
| Forma unità hardware | Nome limite servizio | Unità hardware richieste | Conteggio unità AI |
|---|---|---|---|
A10_X1 |
dedicated-unit-a10-count |
1 | 1,77 |
A10_X2 |
dedicated-unit-a10-count |
2 | 3,54 |
A10_X4 |
dedicated-unit-a10-count |
4 | 7,08 |
A100_40G_X1 |
dedicated-unit-a100-40g-count |
1 | 2,7 |
A100_40G_X2 |
dedicated-unit-a100-40g-count |
2 | 5,4 |
A100_40G_X4 |
dedicated-unit-a100-40g-count |
4 | 10,8 |
A100_40G_X8 |
dedicated-unit-a100-40g-count |
8 | 21,6 |
A100_80G_X1 |
dedicated-unit-a100-80g-count |
1 | 3,24 |
A100_80G_X2 |
dedicated-unit-a100-80g-count |
2 | 6,48 |
A100_80G_X4 |
dedicated-unit-a100-80g-count |
4 | 12,96 |
A100_80G_X8 |
dedicated-unit-a100-80g-count |
8 | 25,92 |
B200_X1 |
dedicated-unit-b200-count |
1 | 8,02 |
B200_X2 |
dedicated-unit-b200-count |
2 | 16,04 |
B200_X4 |
dedicated-unit-b200-count |
4 | 32,08 |
B200_X8 |
dedicated-unit-b200-count |
8 | 64,16 |
B300_X1 |
dedicated-unit-b300-count |
1 | 9,75 |
B300_X2 |
dedicated-unit-b300-count |
2 | 19,5 |
B300_X4 |
dedicated-unit-b300-count |
4 | 39 |
H100_X1 |
dedicated-unit-h100-count |
1 | 6,01 |
H100_X2 |
dedicated-unit-h100-count |
2 | 12,02 |
H100_X4 |
dedicated-unit-h100-count |
4 | 24,04 |
H100_X8 |
dedicated-unit-h100-count |
8 | 48,08 |
H100_X16 |
dedicated-unit-h100-count |
16 | 96,16 |
H200_X1 |
dedicated-unit-h200-count |
1 | 6,22 |
H200_X2 |
dedicated-unit-h200-count |
2 | 12,44 |
H200_X4 |
dedicated-unit-h200-count |
4 | 24,88 |
H200_X8 |
dedicated-unit-h200-count |
8 | 49,76 |
Utilizza Oracle Cloud Cost Estimator per stimare il costo della configurazione del cluster AI dedicata. Se la tenancy non ha limiti sufficienti per la forma hardware e il conteggio di unità selezionati, creare una richiesta di aumento del limite.
Forme unità hardware per modelli importati
Per un modello importato, selezionare una forma di unità hardware compatibile disponibile nell'area di destinazione. I nomi forma unità modello importato non includono un prefisso provider perché si seleziona il modello importato separatamente quando si crea il cluster AI dedicato di hosting. Ad esempio, H100_X2 richiede due unità hardware H100. Vedere Forme delle unità hardware, limiti del servizio e conteggi delle unità AI per il limite del servizio e il conteggio delle unità AI.
Utilizzare le tabelle di riepilogo delle aree in questa pagina per identificare le forme hardware disponibili in ogni area. Per le forme di unità cluster AI dedicate consigliate per ogni modello importato, vedere Modelli compatibili. La forma consigliata può essere utilizzata come baseline, ma è possibile utilizzare più risorse hardware quando il modello le supporta e la forma è disponibile nell'area.
Dopo aver identificato una forma di unità compatibile per il modello e l'area di destinazione, creare un cluster AI dedicato per l'hosting dei modelli e selezionare la forma dell'unità. Quando il cluster diventa attivo, creare un endpoint per il modello nel cluster.
Per calcolare il prezzo orario di un cluster modello importato, moltiplicare il prezzo Unità AI all'ora per Oracle Cloud Infrastructure Generative AI - Importazione modello nella pagina Determinazione prezzi per il conteggio di unità AI per la forma selezionata. Se il cluster dispone di più repliche, moltiplicare anche il risultato per il numero di repliche.
Fatturazione per cluster AI dedicati che ospitano modelli importati
I cluster AI dedicati che ospitano modelli importati non richiedono l'impegno minimo di 744 ore che si applica AI cluster AI dedicati che ospitano modelli pre-addestrati disponibili nell'AI generativa OCI. Invece, un cluster AI dedicato modello importato ha una durata fatturabile minima di un'ora. Ad esempio, un cluster che utilizza un'unità AI ed è in esecuzione per 30 minuti viene fatturato per un'unità oraria AI.
Dopo la prima ora, i costi si basano sul tempo di esecuzione effettivo del cluster e vengono ripartiti proporzionalmente al millisecondo. Ad esempio, un cluster che viene eseguito per un'ora e un minuto viene fatturato per tale durata, anziché per due ore complete.
OCI invia record d'uso alla misurazione e alla fatturazione ogni cinque minuti durante l'esecuzione del cluster. Se il cluster viene eliminato prima del raggiungimento del valore minimo di un'ora, OCI continua a generare report sull'uso fatturabile fino a quando non viene raggiunto il valore minimo. Se il cluster viene eseguito per più di un'ora, OCI continua a inviare record di utilizzo ogni cinque minuti fino all'eliminazione del cluster.
Per il flusso di lavoro del modello importato, vedere Gestione dei modelli importati.
Forme unità hardware di base per i modelli OCI
Le tabelle regionali riportate di seguito mostrano i nomi completi delle forme di unità specifiche del provider per i modelli offerti da OCI Generative AI per l'hosting dedicato. Per trovare il conteggio delle unità AI, rimuovere il prefisso del provider o della famiglia di modelli e trovare la forma rimanente dell'unità hardware in Forme delle unità hardware, limiti del servizio e conteggi delle unità AI. Ad esempio, utilizzare la riga H100_X2 per trovare il conteggio delle unità AI per Cohere_H100_X2.
Forme baseline Nord America
Nella tabella seguente sono elencati i nomi di forma dell'unità hardware baseline per i modelli in Nord America. È possibile specificare più repliche di una forma baseline quando si crea un cluster AI dedicato o in un secondo momento quando si aggiorna il cluster.
| Nome modello | Stati Uniti (Est) - Ashburn (OC1) |
Stati Uniti (Midwest) - Chicago (OC1) |
Stati Uniti (Ovest) - Phoenix (OC1) |
Governo degli Stati Uniti (Ovest) - Phoenix (OC2) |
Stati Uniti DoD (Ovest) - Phoenix (OC3) |
|---|---|---|---|---|---|
| Comando Cohere A |
|
|
|
- | - |
| Comando Cohere un ragionamento |
|
|
|
- | - |
| Cohere Comando Una Visione |
|
|
|
- | - |
| Cohere Embed 4 |
|
|
- |
|
|
| Ripetizione Cohere 4 Pro |
|
|
|
- | - |
| Rerank Cohere 4 veloce |
|
|
|
- | - |
| Meta Llama 4 Maverick |
|
|
- | - | - |
| Meta Llama 4 Scout |
|
|
- | - | - |
| Meta Llama 3.3 70B (standard) | - |
|
|
- | - |
| Meta Llama 3.3 70B (PQ dinamico8) | - |
|
|
|
|
| OpenAI gpt-oss-20b |
|
|
|
- | - |
| OpenAI gpt-oss-120b |
|
|
|
|
|
Forme baseline Sud America
Nella tabella seguente sono elencati i nomi di forma dell'unità hardware baseline per i modelli in Sud America. È possibile specificare più repliche di una forma baseline quando si crea un cluster AI dedicato o in un secondo momento quando si aggiorna il cluster.
| Nome modello | Brasile (Est) - San Paolo (OC1) |
|---|---|
| Comando Cohere A |
|
| Comando Cohere un ragionamento |
|
| Cohere Comando Una Visione |
|
| Cohere Embed 4 |
|
| Ripetizione Cohere 4 Pro |
|
| Rerank Cohere 4 veloce |
|
| Meta Llama 4 Maverick |
|
| Meta Llama 4 Scout |
|
| Meta Llama 3.3 70B (standard) |
|
| Meta Llama 3.3 70B (PQ dinamico8) |
|
| OpenAI gpt-oss-20b |
|
| OpenAI gpt-oss-120b |
|
Forme baseline Europa
Nella tabella seguente sono elencati i nomi delle forme delle unità hardware di riferimento per i modelli in Europa. È possibile specificare più repliche di una forma baseline quando si crea un cluster AI dedicato o in un secondo momento quando si aggiorna il cluster.
| Nome modello | Germania (Centro) - Francoforte (OC1) |
Sovrano centrale UE (Francoforte) (OC19) |
Regno Unito (Sud) - Londra (OC1) |
Governo del Regno Unito (Sud) - Londra (OC4) |
|---|---|---|---|---|
| Comando Cohere A |
|
|
| - |
| Comando Cohere un ragionamento |
| - |
| - |
| Cohere Comando Una Visione |
| - |
| - |
| Cohere Embed 4 |
| - |
| - |
| Ripetizione Cohere 4 Pro |
| - |
| - |
| Rerank Cohere 4 veloce |
| - |
| - |
| Meta Llama 4 Maverick | - | - |
| - |
| Meta Llama 4 Scout | - | - |
| - |
| Meta Llama 3.3 70B (standard) |
|
|
|
|
| Meta Llama 3.3 70B (PQ dinamico8) |
|
|
|
|
| OpenAI gpt-oss-20b |
| - |
| - |
| OpenAI gpt-oss-120b |
| - |
| - |
Forme baseline in Medio Oriente
Nella tabella seguente sono elencati i nomi delle forme delle unità hardware baseline per i modelli in Medio Oriente. È possibile specificare più repliche di una forma baseline quando si crea un cluster AI dedicato o in un secondo momento quando si aggiorna il cluster.
| Nome modello | Arabia Saudita centrale (Riad) (OC1) |
Emirati Arabi Uniti (Centro) - Abu Dhabi (OC1) |
Emirati Arabi Uniti (Est) - Dubai (OC1) |
|---|---|---|---|
| Comando Cohere A |
| - |
|
| Comando Cohere un ragionamento |
| - |
|
| Cohere Comando Una Visione |
|
|
|
| Cohere Embed 4 |
|
|
|
| Ripetizione Cohere 4 Pro |
| - | - |
| Rerank Cohere 4 veloce |
| - | - |
| Meta Llama 4 Maverick |
|
| - |
| Meta Llama 4 Scout |
|
| - |
| Meta Llama 3.3 70B (standard) |
| - | - |
| Meta Llama 3.3 70B (PQ dinamico8) | - |
|
|
| OpenAI gpt-oss-20b |
| - |
|
| OpenAI gpt-oss-120b |
| - |
|
Forme di base Asia/Pacifico
Nella tabella seguente sono elencati i nomi delle forme delle unità hardware di riferimento per i modelli nell'area Asia Pacifico. È possibile specificare più repliche di una forma baseline quando si crea un cluster AI dedicato o in un secondo momento quando si aggiorna il cluster.
| Nome modello | India (Sud) - Hyderabad (OC1) |
Giappone centrale (Osaka) (OC1) |
|---|---|---|
| Comando Cohere A |
|
|
| Comando Cohere un ragionamento |
|
|
| Cohere Comando Una Visione |
|
|
| Cohere Embed 4 |
|
|
| Ripetizione Cohere 4 Pro |
|
|
| Rerank Cohere 4 veloce |
|
|
| Meta Llama 4 Maverick |
|
|
| Meta Llama 4 Scout |
|
|
| Meta Llama 3.3 70B (standard) |
|
|
| Meta Llama 3.3 70B (PQ dinamico8) |
|
|
| OpenAI gpt-oss-20b |
|
|
| OpenAI gpt-oss-120b |
|
|