A4X, A4, A3 Ultra, A3 Mega, A3 High (GPU 8개)를 비롯한 GPU용 머신 계열 카테고리입니다. 클러스터링된 GPU를 사용하면 팀에서 특수 네트워킹 패브릭과 동기화된 유지보수를 사용하여 수천 개의 상호 연결된 액셀러레이터를 단일의 긴밀하게 결합된 시스템으로 배포하고 확장할 수 있습니다. 이러한 GPU는 극도의 컴퓨팅, 메모리, 고속 네트워킹 동기화가 필요한 워크로드에 적합합니다. 일반적인 사용 사례로는 수조 개의 매개변수가 있는 파운데이션 모델 사전 학습, 프런티어 모델 서빙, 신약 개발 시뮬레이션이 있습니다.
비상 유지보수 라고도 합니다. 심각한 하드웨어, 소프트웨어 또는 보안 문제로 인해 발생하는 계획되지 않은 유지보수 이벤트입니다. 지원되는 액셀러레이터 머신 유형의 경우 긴급 유지보수는 즉각적인 중단 대신 사전 알림을 제공합니다. 이 알림을 통해 시스템에서 VM을 종료하기 전에 워크로드를 정상적으로 드레인하고 필요에 따라 복구를 트리거할 수 있습니다.
G2, G4, A2, N1+T4, A3 Edge를 비롯한 GPU 머신 계열 카테고리입니다. 일반 GPU를 사용하면 팀에서 조정된 슈퍼컴퓨팅 클러스터의 아키텍처 복잡성을 우회하여 완전한 운영 자율성을 갖춘 NVIDIA 액셀러레이터를 배포하고 확장할 수 있습니다. 이러한 GPU는 고가용성, 셀프서비스 프로비저닝, 독립적인 확장을 우선시하는 워크로드에 적합합니다. 일반적인 사용 사례로는 실시간 추론, RAG, 프로토타입 제작, 중소 규모 모델 학습이 있습니다.
네트워크 패브릭은 클러스터의 모든 블록과 서비스에 걸쳐 지연 시간이 짧은 고대역폭 연결을 제공합니다.
Google Cloud Jupiter는 소프트웨어 정의 네트워킹과 광 회로 스위치를 사용하여 네트워크를 발전시키고 성능을 최적화하는 Google의 데이터 센터 네트워크 아키텍처입니다.