互換性のあるメタ・モデル

大規模言語モデルをHugging FaceおよびOCI Object StorageバケットからOCI生成AIにインポートし、それらのモデルのエンドポイントを作成して生成AIサービスで使用できます。

Meta Llama

次のモデルは、Grouped Query Attention (GQA)を使用したMeta Llamaモデルの改良版です。詳細は、Hugging FaceドキュメントのLlama 3.3およびLlama 4を参照してください。

互換性のあるMeta Llamaモデル
Hugging FaceモデルID	モデル機能	推奨される専用AIクラスタ・ユニット・シェイプ
meta-llama/Llama-4-Maverick-17B-128E-Instruct-FP8	IMAGE_TEXT_TO_TEXT	H100_X8
meta-llama/Llama-4-Scout-17B-16E-Instruct	IMAGE_TEXT_TO_TEXT	H100_X4
meta-llama/Llama-3.3-70B-Instruct	TEXT_TO_TEXT	A100_80G_X4
meta-llama/Llama-3.2-3B-Instruct	TEXT_TO_TEXT	A100_80G_X1
meta-llama/Llama-3.2-1B-Instruct	TEXT_TO_TEXT	A100_80G_X1
meta-llama/Llama-3.1-8B-Instruct	TEXT_TO_TEXT	A100_80G_X1
meta-llama/Meta-Llama-3-8B-Instruct	TEXT_TO_TEXT	A100_80G_X1
meta-llama/Meta-Llama-3-70B-Instruct	TEXT_TO_TEXT	A100_80G_X4
meta-llama/Llama-2-70b-chat-hf	TEXT_TO_TEXT	A100_80G_X4
meta-llama/Llama-2-13b-chat-hf	TEXT_TO_TEXT	A100_80G_X1
meta-llama/Llama-2-7b-chat-hf	TEXT_TO_TEXT	A100_80G_X1

重要

Open Model Engine(vLLMまたはSGLangランタイムを使用)を介して検証された任意のチャット、埋込み(およびファインチューニング)モデルをインポートできますが、このページの明示的にリストされたモデルのみは、オープンソース・モデル・ランタイムに対してOracleによってこのモデル・ファミリについて評価され、OracleでサポートされているGPU構成でテストされています。上記にかかわらず、Oracleは、互換性のあるモデルのパフォーマンス、可用性、操作またはセキュリティに関連する問題に対して責任を負いません。非リスト・モデルには互換性に問題がある可能性があり、本番で使用する前に、リストされていないモデルをテストすることをお薦めします。OCI Generative AI Imported Model Architectureについて学習します。
インポートされたモデルの場合は、モデル・プロバイダによって指定されたネイティブ・コンテキスト長を使用できます。ただし、効果的な最大コンテキスト長は、OCI生成AIでホスティング専用AIクラスタに選択する基礎となるハードウェア設定によって制限されます。モデルのネイティブ・コンテキスト長を最大限に活用するには、より多くのハードウェア・リソースをプロビジョニングする必要がある場合があります。
ファインチューニング・モデルは、互換性のあるベース・モデルのトランスフォーマ・バージョンと一致し、パラメータ数が元のモデルの±10%以内である場合にのみ使用します。
インポートされたモデルのデプロイ方法に関する使用可能なハードウェアおよびステップは、インポートされたモデルの管理を参照してください。
推奨シェイプがリージョンで使用できない場合は、最も近い使用可能な代替を選択します。たとえば、H100_X2は使用できませんが、A100_80G_X2の場合は、A100_80G_X2を選択します。H100シェイプとA100シェイプの両方が使用可能な場合は、パフォーマンスを向上させるためにH100を選択します。

Oracle Cloud Infrastructureドキュメント

互換性のあるメタ・モデル

Meta Llama