Model Kimi

Model Kimi tersedia untuk digunakan sebagai API terkelola dan model yang di-deploy sendiri di Gemini Enterprise Agent Platform. Anda dapat melakukan streaming respons untuk mengurangi persepsi latensi pengguna akhir. Respons yang di-streaming menggunakan server-sent events (SSE) untuk melakukan streaming respons secara bertahap.

Model Kimi terkelola

Model Kimi menawarkan model terkelola sepenuhnya dan serverless sebagai API. Untuk menggunakan model Kimi di Agent Platform, kirim permintaan langsung ke endpoint API Agent Platform. Saat menggunakan model Kimi sebagai API terkelola, Anda tidak perlu menyediakan atau mengelola infrastruktur.

Model berikut tersedia dari Kimi untuk digunakan di Gemini Enterprise Agent Platform. Untuk mengakses model Kimi, buka kartu model Model Garden-nya.

Kimi K2 Thinking

Kimi K2 Thinking adalah model penalaran dari Kimi yang unggul dalam pemecahan masalah kompleks dan penalaran mendalam.

Buka kartu model Kimi K2 Thinking

Menggunakan model Kimi

Untuk model terkelola, Anda dapat menggunakan perintah curl untuk mengirim permintaan ke endpoint Gemini Enterprise Agent Platform menggunakan nama model berikut:

  • Untuk Kimi K2 Thinking, gunakan kimi-k2-thinking-maas

Untuk mempelajari cara melakukan panggilan streaming dan non-streaming ke model Kimi, lihat Memanggil API model terbuka.

Untuk menggunakan model Gemini Enterprise Agent Platform yang di-deploy sendiri:

  1. Buka konsol Model Garden.
  2. Temukan model Gemini Enterprise Agent Platform yang relevan.
  3. Klik Enable dan isi formulir yang disediakan untuk mendapatkan lisensi penggunaan komersial yang diperlukan.

Untuk mengetahui informasi selengkapnya tentang men-deploy dan menggunakan model partner, lihat Men-deploy model partner dan membuat permintaan prediksi .

Ketersediaan region model Kimi

Model Kimi tersedia di region berikut:

Model Region
Kimi K2 Thinking
  • global

Langkah berikutnya

Pelajari cara Memanggil API model terbuka.