고속 네트워크 패브릭으로 상호 연결된 블록 모음입니다. 각 클러스터는 전역적으로 고유합니다.
A4X, A4, A3 Ultra, A3 Mega, A3 High (8 GPU) 머신의 경우 클러스터는 가속기 용량 블록에 공통의 비차단 네트워크 패브릭을 제공합니다. 클러스터 내에서 노드 간 통신 (east-west 트래픽)은 전체 블록 모음에 대해 차단되지 않습니다.
A4X, A4, A3 Ultra, A3 Mega, A3 High (GPU 8개)를 비롯한 GPU용 머신 제품군 카테고리입니다. 클러스터링된 GPU를 사용하면 팀에서 특수 네트워킹 패브릭과 동기화된 유지보수를 사용하여 상호 연결된 수천 개의 가속기를 긴밀하게 결합된 단일 시스템으로 배포하고 확장할 수 있습니다.
익스트림 컴퓨팅, 메모리, 고속 네트워킹 동기화가 필요한 워크로드에 적합합니다. 일반적인 사용 사례로는 수조 개의 매개변수가 있는 기본 모델 사전 학습, 최첨단 모델 서빙, 신약 개발 시뮬레이션이 있습니다.
긴급 유지보수라고도 합니다. 심각한 하드웨어, 소프트웨어 또는 보안 문제로 인해 발생한 계획되지 않은 유지관리 이벤트입니다.
지원되는 가속기 머신 유형의 경우 긴급 유지보수로 인해 즉시 중단되는 대신 사전 알림이 제공됩니다. 이 알림을 통해 시스템에서 VM을 종료하기 전에 워크로드를 정상적으로 드레인하고 원하는 경우 복구를 트리거할 수 있습니다.
G2, G4, A2, N1+T4, A3 Edge를 포함한 GPU 머신 계열 카테고리입니다.
일반 GPU를 사용하면 팀에서 완전한 운영 자율성을 가지고 NVIDIA 액셀러레이터를 배포하고 확장하여 조정된 슈퍼컴퓨팅 클러스터의 아키텍처 복잡성을 우회할 수 있습니다. 고가용성, 셀프 서비스 프로비저닝, 독립적인 확장성을 우선시하는 워크로드에 적합합니다. 일반적인 사용 사례에는 실시간 추론, RAG, 프로토타입 제작, 중소 규모 모델 학습이 있습니다.