Model Kimi tersedia untuk digunakan sebagai API terkelola dan model yang di-deploy sendiri di Gemini Enterprise Agent Platform. Anda dapat melakukan streaming respons untuk mengurangi persepsi latensi pengguna akhir. Respons yang di-streaming menggunakan server-sent events (SSE) untuk melakukan streaming respons secara bertahap.
Model Kimi terkelola
Model Kimi menawarkan model terkelola sepenuhnya dan serverless sebagai API. Untuk menggunakan model Kimi di Agent Platform, kirim permintaan langsung ke endpoint API Agent Platform. Saat menggunakan model Kimi sebagai API terkelola, Anda tidak perlu menyediakan atau mengelola infrastruktur.
Model berikut tersedia dari Kimi untuk digunakan di Gemini Enterprise Agent Platform. Untuk mengakses model Kimi, buka kartu model Model Garden-nya.
Kimi K2 Thinking
Kimi K2 Thinking adalah model penalaran dari Kimi yang unggul dalam pemecahan masalah kompleks dan penalaran mendalam.
Buka kartu model Kimi K2 ThinkingMenggunakan model Kimi
Untuk model terkelola, Anda dapat menggunakan perintah curl untuk mengirim permintaan ke endpoint Gemini Enterprise Agent Platform menggunakan nama model berikut:
- Untuk Kimi K2 Thinking, gunakan
kimi-k2-thinking-maas
Untuk mempelajari cara melakukan panggilan streaming dan non-streaming ke model Kimi, lihat Memanggil API model terbuka.
Untuk menggunakan model Gemini Enterprise Agent Platform yang di-deploy sendiri:
- Buka konsol Model Garden.
- Temukan model Gemini Enterprise Agent Platform yang relevan.
- Klik Enable dan isi formulir yang disediakan untuk mendapatkan lisensi penggunaan komersial yang diperlukan.
Untuk mengetahui informasi selengkapnya tentang men-deploy dan menggunakan model partner, lihat Men-deploy model partner dan membuat permintaan prediksi .
Ketersediaan region model Kimi
Model Kimi tersedia di region berikut:
| Model | Region |
|---|---|
| Kimi K2 Thinking |
|
Langkah berikutnya
Pelajari cara Memanggil API model terbuka.