Cloud Run memungkinkan Anda melampirkan GPU untuk men-deploy model terbuka dan menyajikan inferensi AI. Anda dapat melatih, menyesuaikan, dan menjalankan model dengan performa yang dipercepat.
Jika Anda baru mengenal konsep AI, lihat GPU untuk AI. Untuk mempelajari lebih lanjut opsi konfigurasi, lihat dukungan GPU untuk layanan, tugas, dan kumpulan pekerja.
Tutorial untuk layanan
- Menjalankan Gemma di Cloud Run
- Menjalankan inferensi LLM di GPU Cloud Run dengan Gemma dan Ollama
- Menjalankan OpenCV di Cloud Run dengan akselerasi GPU
- Menjalankan inferensi LLM di GPU Cloud Run dengan Hugging Face Transformers.js
Tutorial untuk tugas
- Menyesuaikan LLM menggunakan GPU dengan tugas Cloud Run
- Menjalankan inferensi batch menggunakan GPU di tugas Cloud Run
- Transcoding video yang dipercepat GPU dengan FFmpeg di tugas Cloud Run