Protege las aplicaciones de IA con Model Armor

Model Armor es un Google Cloud servicio diseñado para mejorar la seguridad de tus aplicaciones de IA, en particular, las que usan modelos de lenguaje grandes (LLM). Funciona inspeccionando las instrucciones enviadas a tus modelos y las respuestas que generan, lo que te ayuda a mitigar los riesgos y aplicar prácticas de IA responsable.

Para obtener detalles sobre los hallazgos que crea Model Armor, consulta Hallazgos de Model Armor.

Configurar plantillas

Para definir cómo Model Armor debe filtrar el contenido, crea y usa plantillas de Model Armor. Una plantilla es un conjunto de configuración reutilizable en el que especificas qué filtros habilitar, los niveles de confianza para los filtros y el tipo de aplicación para cada filtro. Para obtener más información, consulta Crea y administra plantillas.

Establecer configuración mínima

Para garantizar un nivel de protección de referencia, los administradores de seguridad pueden configurar la configuración mínima a nivel de organización, carpeta o proyecto. Estos parámetros de configuración exigen requisitos mínimos de filtro que deben cumplir todas las plantillas de Model Armor creadas dentro de ese alcance, lo que ayuda a evitar configuraciones demasiado permisivas. Para obtener más información, consulta Establece la configuración mínima.

Limpiar instrucciones y respuestas

Cuando un usuario envía una instrucción a tu aplicación, esta la envía primero a Model Armor. Model Armor procesa la instrucción a través de los filtros habilitados en la plantilla y muestra una respuesta que indica si se encontraron incumplimientos de políticas y resultados detallados de cada filtro. Luego, la lógica de tu aplicación decide qué hacer a continuación.

Cuando un LLM genera una respuesta, antes de mostrarla al usuario, tu aplicación la envía a Model Armor. Model Armor filtra el resultado del LLM con las configuraciones de filtro definidas en la plantilla y muestra los resultados del análisis. Luego, tu aplicación decide si mostrar la respuesta al usuario, y es posible que la bloquee si se encuentran incumplimientos.

Para obtener más información, consulta Limpia instrucciones y respuestas.

¿Qué sigue?