Hasil pemindaian dikategorikan berdasarkan seberapa besar kemungkinan hasil tersebut mewakili kecocokan. Sensitive Data Protection menggunakan representasi kemungkinan yang dikelompokkan, yang dimaksudkan untuk menunjukkan seberapa besar kemungkinan sepotong data cocok dengan infoTypetertentu.
Cara kerja kemungkinan
Saat mengonfigurasi pemindaian Sensitive Data Protection, Anda menetapkan infoType yang ingin dipindai oleh Sensitive Data Protection. Untuk mempersempit hasil pemindaian, Anda dapat menetapkan tingkat kemungkinan minimum dalam permintaan.
Untuk setiap potensi kecocokan (temuan) yang terdeteksi selama pemindaian, Sensitive Data Protection menetapkan tingkat kemungkinan. Tingkat kemungkinan temuan menjelaskan seberapa besar kemungkinan temuan tersebut cocok dengan infoType yang Anda pindai. Misalnya, Sensitive Data Protection dapat menetapkan kemungkinan LIKELY ke temuan yang terlihat seperti alamat email.
Saat menampilkan hasil, Sensitive Data Protection akan memfilter temuan apa pun yang memiliki kemungkinan lebih rendah dari tingkat kemungkinan minimum yang Anda tetapkan dalam permintaan. Misalnya, jika Anda menetapkan kemungkinan minimum ke
POSSIBLE, Anda hanya akan mendapatkan temuan yang dievaluasi sebagai POSSIBLE,
LIKELY, dan VERY_LIKELY. Jika Anda menetapkan kemungkinan minimum ke VERY_LIKELY, Anda akan mendapatkan jumlah temuan terkecil.
Tingkat kemungkinan
Tabel berikut mencantumkan kemungkinan nilai kemungkinan yang dapat ditetapkan Sensitive Data Protection ke temuan.
| ENUM | Deskripsi |
|---|---|
VERY_UNLIKELY |
Ditandai dengan hal berikut:
|
UNLIKELY |
Ditandai dengan hal berikut:
|
POSSIBLE |
Ditandai dengan hal berikut:
|
LIKELY |
Ditandai dengan satu atau beberapa sinyal kuat untuk infoType tertentu. Sinyal dapat mencakup checksum yang lulus, petunjuk kontekstual yang kuat, dan format spesifik yang unik. |
VERY_LIKELY |
Ditandai dengan banyaknya sinyal kuat untuk infoType tertentu. Sinyal dapat mencakup checksum yang lulus, petunjuk kontekstual yang kuat, dan format spesifik yang unik. |
Memilih tingkat kemungkinan minimum untuk hasil pemindaian
Secara umum, saat Anda menetapkan tingkat kemungkinan minimum yang lebih tinggi dalam permintaan Sensitive Data Protection, hasilnya akan memiliki jumlah positif palsu yang lebih rendah (terkadang disebut noise). Namun, hasil tersebut juga dapat mengecualikan lebih banyak positif benar. Memilih tingkat kemungkinan minimum melibatkan pencarian keseimbangan yang tepat antara perolehan dan presisi.
Misalnya, anggaplah ada 10 alamat jalan dalam dokumen dan Sensitive Data Protection mengidentifikasi 5 alamat jalan. Namun, di antara temuan yang diidentifikasi Sensitive Data Protection, sebenarnya hanya ada 4 alamat jalan.
- Perolehan adalah jumlah instance positif benar dari jumlah total instance yang relevan. Dalam contoh ini, perolehannya adalah 4/10.
- Presisi adalah jumlah instance positif benar dari jumlah total instance yang diidentifikasi Sensitive Data Protection. Dalam contoh ini, presisinya adalah 4/5.
Dalam contoh ini, presisinya tinggi, tetapi perolehannya relatif rendah.
Tingkat kemungkinan minimum yang Anda tetapkan memengaruhi tingkat perolehan dan presisi yang Anda dapatkan dalam hasil pemindaian. Tabel berikut menjelaskan kapan setiap tingkat kemungkinan minimum berguna dan bagaimana perolehan dan presisi bervariasi di setiap tingkat.
| Tingkat kemungkinan minimum | Deskripsi |
|---|---|
LIKELIHOOD_UNSPECIFIED |
Nilai default; sama dengan POSSIBLE. |
VERY_UNLIKELY |
Berguna jika Anda memerlukan perolehan tertinggi. Tingkat kemungkinan minimum ini menghasilkan noise terbanyak. |
UNLIKELY |
Berguna jika Anda memerlukan perolehan yang lebih tinggi. Tingkat kemungkinan minimum ini menghasilkan beberapa noise. |
POSSIBLE |
Berguna jika Anda menginginkan keseimbangan presisi dan perolehan. |
LIKELY |
Berguna jika Anda memerlukan presisi yang lebih tinggi dengan mengorbankan beberapa perolehan. |
VERY_LIKELY |
Berguna jika Anda menginginkan presisi tertinggi dengan mengorbankan perolehan. |
Kemungkinan minimum default
Jika Anda tidak menetapkan kemungkinan minimum dalam permintaan, atau jika Anda menetapkannya ke LIKELIHOOD_UNSPECIFIED, Sensitive Data Protection hanya akan menampilkan temuan dengan kemungkinan POSSIBLE dan lebih tinggi.