OpenAI モデルは、Gemini Enterprise Agent Platform でマネージド API および自己デプロイ モデルとして使用できます。レスポンスをストリーミングして、エンドユーザーのレイテンシを軽減できます。ストリーミング レスポンスでは、サーバー送信イベント(SSE)を使用してレスポンスを段階的にストリーミングします。
gpt-oss 120B
OpenAI gpt-oss 120B は、Apache 2.0 ライセンスでリリースされた 120B のオープンウェイト言語モデルです。推論と関数呼び出しのユースケースに適しています。このモデルは、一般消費者向けハードウェアでのデプロイ用に最適化されています。
120B モデルは、単一の 80 GB GPU で実行しながら、コア推論ベンチマークで OpenAI o4-mini とほぼ同等の性能を実現しています。
gpt-oss 120B モデルカードに移動gpt-oss 20B
OpenAI gpt-oss 20B は、Apache 2.0 ライセンスでリリースされた 20B のオープンウェイト言語モデルです。推論と関数呼び出しのユースケースに適しています。このモデルは、一般消費者向けハードウェアでのデプロイ用に最適化されています。
20B モデルは、一般的なベンチマークで OpenAI の o3-mini と同等の結果を出しつつ、16GB のメモリを備えたエッジデバイス上で動作します。そのため、デバイス上で直接実行するユースケース、ローカルでの推論、高額なインフラを使わずすばやくイテレーションする用途に最適です。
gpt-oss 20B モデルカードに移動OpenAI モデルを使用する
マネージド モデルの場合は、curl コマンドを使用して、 Gemini Enterprise Agent Platform エンドポイントに次のモデル名を使用してリクエストを送信できます。
- gpt-oss 120B の場合は、
gpt-oss-120b-maasを使用します。 - gpt-oss 20B の場合は、
gpt-oss-20b-maasを使用します。
OpenAI モデルにストリーミング呼び出しと非ストリーミング呼び出しを行う方法については、 オープンモデル API を呼び出すをご覧ください。
自己デプロイされた Gemini Enterprise Agent Platform モデルを使用するには:
- Model Garden コンソールに移動します。
- 関連する Gemini Enterprise Agent Platform モデルを見つけます。
- [有効にする] をクリックし、表示されたフォームに記入して必要な商用利用ライセンスを取得します。
パートナー モデルのデプロイと使用の詳細については、 パートナー モデルをデプロイして予測リクエストを行う をご覧ください。
OpenAI モデルのリージョンでの提供状況
OpenAI モデルは、次のリージョンで利用できます。
| モデル | リージョン |
|---|---|
| gpt-oss 120B |
|
| gpt-oss 20B |
|
次のステップ
オープンモデル API を呼び出す方法を確認する。