OpenAI 모델

OpenAI 모델은 Gemini Enterprise Agent Platform에서 관리형 API 및 자체 배포 모델로 사용할 수 있습니다. 대답을 스트리밍하여 최종 사용자의 지연 시간 인식을 줄일 수 있습니다. 스트리밍된 응답은 서버 전송 이벤트 (SSE)를 사용하여 응답을 점진적으로 스트리밍합니다.

gpt-oss 120B

OpenAI gpt-oss 120B는 Apache 2.0 라이선스에 따라 출시된 120B의 오픈-웨이트 언어 모델입니다. 추론 및 함수 호출 사용 사례에 적합합니다. 이 모델은 소비자 하드웨어에 배포하도록 최적화되어 있습니다.

120B 모델은 단일 80GB GPU에서 실행되면서 핵심 추론 벤치마크에서 OpenAI o4-mini와 거의 동등한 성능을 달성합니다.

gpt-oss 120B 모델 카드로 이동

gpt-oss 20B

OpenAI gpt-oss 20B는 Apache 2.0 라이선스에 따라 출시된 20B의 오픈-웨이트 언어 모델입니다. 추론 및 함수 호출 사용 사례에 적합합니다. 이 모델은 소비자 하드웨어에 배포하도록 최적화되어 있습니다.

20B 모델은 일반적인 벤치마크에서 OpenAI o3-mini와 유사한 결과를 제공하며 메모리가 16GB인 에지 기기에서 실행될 수 있으므로 온디바이스 사용 사례, 로컬 추론 또는 비용이 많이 드는 인프라를 사용하지 않는 빠른 반복에 적합합니다.

gpt-oss 20B 모델 카드로 이동

OpenAI 모델 사용

관리형 모델의 경우 curl 명령어를 사용하여 다음 모델 이름으로 Gemini Enterprise Agent Platform 엔드포인트에 요청을 보낼 수 있습니다.

  • gpt-oss 120B의 경우 gpt-oss-120b-maas를 사용합니다.
  • gpt-oss 20B의 경우 gpt-oss-20b-maas를 사용합니다.

OpenAI 모델에 스트리밍 및 비스트리밍 호출을 수행하는 방법을 알아보려면 개방형 모델 API 호출을 참고하세요.

자체 배포된 Gemini Enterprise Agent Platform 모델을 사용하려면 다음 단계를 따르세요.

  1. Model Garden 콘솔로 이동합니다.
  2. 관련 Gemini Enterprise Agent Platform 모델을 찾습니다.
  3. 사용 설정을 클릭하고 제공된 양식을 작성하여 필요한 상업적 사용 라이선스를 받습니다.

파트너 모델 배포 및 사용에 관한 자세한 내용은 파트너 모델 배포 및 예측 요청 을 참고하세요.

OpenAI 모델 리전 가용성

OpenAI 모델은 다음 리전에서 사용할 수 있습니다.

모델 리전
gpt-oss 120B
  • global
gpt-oss 20B
  • us-central1

다음 단계

개방형 모델 API를 호출하는 방법 알아보기