Model Armor adalah Google Cloud layanan yang dirancang untuk meningkatkan keamanan dan keselamatan aplikasi AI Anda, terutama yang menggunakan Model Bahasa Besar (LLM). Layanan ini berfungsi dengan memeriksa perintah yang dikirim ke model Anda dan respons yang dihasilkan oleh model tersebut, sehingga membantu Anda mengurangi risiko dan menerapkan praktik AI yang bertanggung jawab.
Untuk mengetahui detail tentang temuan yang dibuat Model Armor, lihat Temuan Model Armor.
Mengonfigurasi template
Tentukan cara Model Armor menyaring konten dengan membuat dan menggunakan template Model Armor. Template adalah kumpulan konfigurasi yang dapat digunakan kembali tempat Anda menentukan filter yang akan diaktifkan, tingkat kepercayaan untuk filter, dan jenis penerapan untuk setiap filter. Untuk mengetahui informasi selengkapnya, lihat Membuat dan mengelola template.
Mengonfigurasi setelan tingkat
Untuk memastikan tingkat perlindungan dasar, administrator keamanan dapat mengonfigurasi setelan minimum di tingkat organisasi, folder, atau project. Setelan ini mewajibkan persyaratan filter minimum yang harus dipatuhi oleh semua template Model Armor yang dibuat dalam cakupan tersebut, sehingga membantu mencegah konfigurasi yang terlalu permisif. Untuk mengetahui informasi selengkapnya, lihat Mengonfigurasi setelan tingkat.
Membersihkan perintah dan respons
Saat pengguna mengirimkan perintah ke aplikasi Anda, aplikasi Anda akan mengirimkan perintah ini terlebih dahulu ke Model Armor. Model Armor memproses perintah melalui filter yang diaktifkan dalam template dan menampilkan respons yang menunjukkan apakah ada pelanggaran kebijakan yang ditemukan dan hasil mendetail dari setiap filter. Logika aplikasi Anda kemudian akan menentukan tindakan selanjutnya.
Saat LLM membuat respons, sebelum menampilkan respons ini kepada pengguna, aplikasi Anda akan mengirimkannya ke Model Armor. Model Armor menyaring output LLM menggunakan konfigurasi filter yang ditentukan dalam template dan menampilkan hasil analisis. Aplikasi Anda kemudian akan memutuskan apakah akan menampilkan respons kepada pengguna, dan berpotensi memblokirnya jika pelanggaran ditemukan.
Untuk mengetahui informasi selengkapnya, lihat Membersihkan perintah dan respons.