多用性があるAlibabaモデル
大規模言語モデルをHugging FaceおよびOCI Object StorageバケットからOCI生成AIにインポートし、それらのモデルのエンドポイントを作成して生成AIサービスで使用できます。
モデルを選択する前に、このページのモデル表に従って、互換性のあるハードウェア・ユニット・シェイプを選択し、インポートされたモデルをホストする専用AIクラスタの請求を理解するためのガイダンスを確認します。
Alibaba Qwenモデルファミリは、高度な多言語およびマルチモーダル機能を備えています。Hugging Faceのモデル・カードについては、次の表のリンクを参照してください。
Qwen 3 Next
| Hugging FaceモデルID | モデル機能 | 最小専用AIクラスタ・ユニット・シェイプ |
|---|---|---|
| Qwen/Qwen3- 次80B-A3B-Instruct | TEXT_TO_TEXT |
|
Qwen 3.8
| Hugging FaceモデルID | モデル機能 | 最小専用AIクラスタ・ユニット・シェイプ |
|---|---|---|
| クウェン/クウェン3.8-27B | TEXT_TO_TEXT |
|
| Qwen/Qwen3.8-2.4T-A95B-FP8 | TEXT_TO_TEXT |
|
Qwen 3.6
| Hugging FaceモデルID | モデル機能 | 最小専用AIクラスタ・ユニット・シェイプ |
|---|---|---|
| クウェン/クウェン3.6-35B-A3B | IMAGE_TEXT_TO_TEXT |
|
Qwen/Qwen3.6-35B-A3Bをインポートし、ホスティング専用AIクラスタにそのエンドポイントを作成した後、OCIレスポンスAPIを介してモデルをコールできます。Responses APIで使用可能なチャット・モデルの完全なリストは、使用可能なモデルを参照してください。
Qwen 3.5
| Hugging FaceモデルID | モデル機能 | 最小専用AIクラスタ・ユニット・シェイプ |
|---|---|---|
| クウェン/クウェン3.5-397B-A17B | TEXT_TO_TEXT |
|
| クウェン/クウェン3.5-9B | IMAGE_TEXT_TO_TEXT |
|
Qwenイメージ
| Hugging FaceモデルID | モデル機能 | 最小専用AIクラスタ・ユニット・シェイプ |
|---|---|---|
| Qwen/Qwen-Image | TEXT_TO_IMAGE | A100_80G_X1 |
| Qwen/Qwen-Image-Edit | IMAGE_TEXT_TO_IMAGE | A100_80G_X1 |
| クウェン/クウェンイメージ-2512 | TEXT_TO_IMAGE | A100_80G_X1 |
| Qwen/Qwen-Image-Edit-2511 | IMAGE_TEXT_TO_IMAGE | A100_80G_X1 |
| Qwen/Qwen-Image-Edit-2509 | IMAGE_TEXT_TO_IMAGE | A100_80G_X1 |
response_format: "url"は機能せず、HTTP 400不正なリクエスト・エラーを返します。n(イメージ数):0または1のみが動作します。- ストリーミングは互換性がありません。
- 標準以外のイメージ・サイズは、(OpenAI APIとは異なり)HTTP 400を返すのではなく、丸められる場合があります(たとえば、
999x999→992x992)。 - モデル制限のため、透過性が機能しない場合があります。
クウェンQ(Reasoning)
| Hugging FaceモデルID | モデル機能 | 最小専用AIクラスタ・ユニット・シェイプ |
|---|---|---|
| クウェン/QwQ-32B | TEXT_TO_TEXT | A100_80G_X2 |
Qwen 3
| Hugging FaceモデルID | モデル機能 | 最小専用AIクラスタ・ユニット・シェイプ |
|---|---|---|
| クウェン/Qwen3- 埋め込み-0.6B | 埋込み | A10_X1 |
| クウェン/Qwen3- 埋め込み-4B | 埋込み | A10_X2 |
| クウェン/Qwen3- 埋め込み-8B | 埋込み | A100_80G_X1 |
| クウェン/Qwen3-0.6B | TEXT_TO_TEXT | A100_80G_X1 |
| クウェン/Qwen3-1.7B | TEXT_TO_TEXT | A100_80G_X1 |
| クウェン/Qwen3-4B | TEXT_TO_TEXT | A100_80G_X1 |
| クウェン/Qwen3-8B | TEXT_TO_TEXT | A100_80G_X1 |
| クウェン/Qwen3-14B | TEXT_TO_TEXT | A100_80G_X1 |
| クウェン/Qwen3-32B | TEXT_TO_TEXT | A100_80G_X2 |
| クウェン/Qwen3-4B-Instruct-2507 | TEXT_TO_TEXT | A100_80G_X1 |
| クウェン/Qwen3-30B-A3B-Instruct-2507 | TEXT_TO_TEXT | A100_80G_X2 |
| クウェン/Qwen3-235B-A22B-Instruct-2507 | TEXT_TO_TEXT | H100_X8 |
| Qwen/Qwen3-VL-30B-A3B-Instruct | IMAGE_TEXT_TO_TEXT | H100_X2 |
| Qwen/Qwen3-VL-30B-A3B-Instruct-FP8 | IMAGE_TEXT_TO_TEXT |
|
| Qwen/Qwen3-VL-235B-A22B-Instruct | IMAGE_TEXT_TO_TEXT | H100_X8 |
クウェン2.5
| Hugging FaceモデルID | モデル機能 | 最小専用AIクラスタ・ユニット・シェイプ |
|---|---|---|
| Qwen/Qwen2.5-Coder-32B-Instruct | TEXT_TO_TEXT | A100_80G_X2 |
| Qwen/Qwen2.5-0.5B-Instruct | TEXT_TO_TEXT | A100_80G_X1 |
| Qwen/Qwen2.5-1.5B-Instruct | TEXT_TO_TEXT | A100_80G_X1 |
| Qwen/Qwen2.5-3B-Instruct | TEXT_TO_TEXT | A100_80G_X1 |
| Qwen/Qwen2.5-7B-Instruct | TEXT_TO_TEXT | A100_80G_X1 |
| Qwen/Qwen2.5-14B-Instruct | TEXT_TO_TEXT | A100_80G_X1 |
| Qwen/Qwen2.5-32B-Instruct | TEXT_TO_TEXT | A100_80G_X2 |
| Qwen/Qwen2.5-72B-Instruct | TEXT_TO_TEXT | A100_80G_X4 |
| Qwen/Qwen2.5-VL-3B-Instruct | IMAGE_TEXT_TO_TEXT | A100_80G_X1 |
| Qwen/Qwen2.5-VL-7B-Instruct | IMAGE_TEXT_TO_TEXT | A100_80G_X1 |
| Qwen/Qwen2.5-VL-32B-Instruct | IMAGE_TEXT_TO_TEXT | A100_80G_X2 |
| Qwen/Qwen2.5-VL-72B-Instruct | IMAGE_TEXT_TO_TEXT | A100_80G_X4 |
Qwen 2
| Hugging FaceモデルID | モデル機能 | 最小専用AIクラスタ・ユニット・シェイプ |
|---|---|---|
| Qwen/Qwen2-0.5B-Instruct | テキスト間_テキスト | A100_80G_X1 |
| Qwen/Qwen2-1.5B-Instruct | テキスト間_テキスト | A100_80G_X1 |
| Qwen/Qwen2-7B-Instruct | テキスト間_テキスト | A100_80G_X1 |
| Qwen/Qwen2-72B-Instruct | テキスト間_テキスト | A100_80G_X4 |
| Qwen/Qwen2-VL-2B-Instruct | イメージ・テキストからテキストへ | A100_80G_X1 |
| Qwen/Qwen2-VL-7B-Instruct | イメージ・テキストからテキストへ | A100_80G_X1 |
| Qwen/Qwen2-VL-72B-Instruct | イメージ・テキストからテキストへ | A100_80G_X4 |
- インポートされたモデルの場合は、モデル・プロバイダによって指定されたネイティブ・コンテキスト長を使用できます。ただし、効果的な最大コンテキスト長は、OCI生成AIでホスティング専用AIクラスタに選択する基礎となるハードウェア設定によって制限されます。モデルのネイティブ・コンテキスト長を最大限に活用するには、より多くのハードウェア・リソースをプロビジョニングする必要がある場合があります。
- ファインチューニング・モデルは、互換性のあるベース・モデルのトランスフォーマ・バージョンと一致し、パラメータ数が元のモデルの±10%以内である場合にのみ使用します。
- インポートしたモデルをホストできる場所を決定するには、このページの表でモデルの互換性のあるユニット・シェイプを見つけ、「リージョン別のハードウェア・ユニット・シェイプ」のターゲット・リージョンでハードウェア・シェイプが使用可能であることを確認します。モデルをリージョンでホストできるのは、リージョンがそのモデルにリストされたハードウェア・シェイプを提供する場合のみです。
- インポートされたモデルをデプロイするステップは、「インポートされたモデルの管理」を参照してください。
インポートされたモデルをホストする専用AIクラスタの請求
インポートされたモデルをホストする専用AIクラスタでは、OCI Generative AIで利用可能な事前トレーニング済みモデルをホストする専用AIクラスタに適用される744ユニットの最小コミットメントは必要ありません。かわりに、インポートされたモデルの専用AIクラスタには、請求可能な最小期間は1時間です。たとえば、1つのAIユニットを使用し、30分間実行されるクラスタは、1つのAIユニット時間に対して請求されます。
最初の1時間後、料金はクラスタの実際の稼働時間に基づいており、ミリ秒に按分されます。たとえば、1時間1分間実行されるクラスタは、2時間ではなく、その期間について請求されます。
OCIは、クラスタの実行中に5分ごとに使用量レコードをMetering and Billingに送信します。最小1時間に達する前にクラスタが削除された場合、OCIは最小値を満たすまで請求可能な使用量を報告し続けます。クラスタが1時間以上実行された場合、OCIはクラスタが削除されるまで、使用状況レコードの送信を5分ごとに続けます。