OpenAI 모델은 Gemini Enterprise Agent Platform에서 관리형 API 및 자체 배포 모델로 사용할 수 있습니다. 대답을 스트리밍하여 최종 사용자의 지연 시간 인식을 줄일 수 있습니다. 스트리밍된 응답은 서버 전송 이벤트 (SSE)를 사용하여 응답을 점진적으로 스트리밍합니다.
gpt-oss 120B
OpenAI gpt-oss 120B는 Apache 2.0 라이선스에 따라 출시된 120B의 오픈-웨이트 언어 모델입니다. 추론 및 함수 호출 사용 사례에 적합합니다. 이 모델은 소비자 하드웨어에 배포하도록 최적화되어 있습니다.
120B 모델은 단일 80GB GPU에서 실행되면서 핵심 추론 벤치마크에서 OpenAI o4-mini와 거의 동등한 성능을 달성합니다.
gpt-oss 120B 모델 카드로 이동gpt-oss 20B
OpenAI gpt-oss 20B는 Apache 2.0 라이선스에 따라 출시된 20B의 오픈-웨이트 언어 모델입니다. 추론 및 함수 호출 사용 사례에 적합합니다. 이 모델은 소비자 하드웨어에 배포하도록 최적화되어 있습니다.
20B 모델은 일반적인 벤치마크에서 OpenAI o3-mini와 유사한 결과를 제공하며 메모리가 16GB인 에지 기기에서 실행될 수 있으므로 온디바이스 사용 사례, 로컬 추론 또는 비용이 많이 드는 인프라를 사용하지 않는 빠른 반복에 적합합니다.
gpt-oss 20B 모델 카드로 이동OpenAI 모델 사용
관리형 모델의 경우 curl 명령어를 사용하여 다음 모델 이름으로 Gemini Enterprise Agent Platform 엔드포인트에 요청을 보낼 수 있습니다.
- gpt-oss 120B의 경우
gpt-oss-120b-maas를 사용합니다. - gpt-oss 20B의 경우
gpt-oss-20b-maas를 사용합니다.
OpenAI 모델에 스트리밍 및 비스트리밍 호출을 수행하는 방법을 알아보려면 개방형 모델 API 호출을 참고하세요.
자체 배포된 Gemini Enterprise Agent Platform 모델을 사용하려면 다음 단계를 따르세요.
- Model Garden 콘솔로 이동합니다.
- 관련 Gemini Enterprise Agent Platform 모델을 찾습니다.
- 사용 설정을 클릭하고 제공된 양식을 작성하여 필요한 상업적 사용 라이선스를 받습니다.
파트너 모델 배포 및 사용에 관한 자세한 내용은 파트너 모델 배포 및 예측 요청 을 참고하세요.
OpenAI 모델 리전 가용성
OpenAI 모델은 다음 리전에서 사용할 수 있습니다.
| 모델 | 리전 |
|---|---|
| gpt-oss 120B |
|
| gpt-oss 20B |
|
다음 단계
개방형 모델 API를 호출하는 방법 알아보기