Supervisión de abusos

Como se describe en la sección 4.3 "Seguridad y abuso de la IA generativa" de las Condiciones del Servicio de Google Cloud Platform, Google utiliza el siguiente proceso para detectar posibles abusos y violaciones de su Política de Uso Aceptable y su Política de Uso Prohibido como parte de la prestación de Servicios de IA Generativa a los clientes.

  • Detección automatizada: Google utiliza clasificadores de seguridad automatizados para detectar posibles abusos e incumplimientos. Para obtener detalles técnicos sobre cómo funcionan los clasificadores de seguridad, consulta Configura filtros de seguridad.

  • Registro de instrucciones: Si los clasificadores de seguridad automatizados detectan actividad sospechosa que requiere una mayor investigación para determinar si un cliente incumplió nuestras políticas, Google puede registrar las instrucciones del cliente únicamente con el propósito de examinar si se produjo un incumplimiento de la PUA o la Política de Uso Prohibido. Estos datos no se usarán para entrenar ni ajustar ningún modelo de IA/AA. Estos datos se almacenan de forma segura durante un máximo de 90 días en la misma región o multirregión que el cliente seleccionó para su proyecto y cumplen con lasGoogle Cloud garantías, como la residencia de datos, la Transparencia de acceso y los Controles del servicio de VPC. Los registros de instrucciones para fines de supervisión del abuso no se encriptan con claves de encriptación administradas por el cliente (CMEK). Los clientes también tienen la opción de solicitar que se los excluya de los registros de abuso (consulta la información a continuación).

    • Acción: Los empleados autorizados de Google pueden evaluar las instrucciones marcadas y comunicarse con el cliente para solicitar aclaraciones. Si no se aborda el comportamiento, o bien el abuso recurrente o grave, se puede suspender o cancelar el acceso del cliente a Gemini Enterprise Agent Platform o a los servicios de Google Cloud.

    • Servicios incluidos en el alcance: Servicios de IA Generativa de Google.

    • Clientes incluidos en el alcance: Solo los clientes cuyo uso de Google Cloud se rige por las Condiciones del Servicio de Google Cloud Platform. Esto significa que los clientes con un Google Cloud Acuerdo Marco están exentos del registro de instrucciones para este monitoreo de abuso de forma predeterminada.

    • Rechazo del cliente: Los clientes pueden solicitar una excepción completando este formulario. Si se aprueba, Google no almacenará ninguna instrucción asociada a la cuenta Google Cloudaprobada.

Seguridad avanzada de la IA

Como se describe en el Anexo sobre Seguridad Avanzada de la IA,Google Cloud implementó un sistema de supervisión de abuso más riguroso para los modelos designados como "IA avanzada".

  • Registro de instrucciones y respuestas: Todas las instrucciones y respuestas se registrarán y almacenarán de forma segura durante un máximo de 30 días con el único propósito de supervisar el abuso. Estos datos no se usarán para entrenar ni ajustar ningún modelo de IA/AA. Estos datos se almacenan en la misma región o multirregión que seleccionó el cliente para su proyecto y cumplen con las garantías deGoogle Cloud , como la residencia de datos, la transparencia de acceso y los Controles del servicio de VPC. Los registros de instrucciones y respuestas para supervisar el abuso no se encriptan con claves de encriptación administradas por el cliente (CMEK). Es posible que no puedas inhabilitar el registro de respuestas a instrucciones cuando uses algunas funciones de IA avanzada. Comunícate con tu equipo de cuentas para obtener más información.

  • Investigación automatizada: Google implementa herramientas de investigación automatizadas, incluidos clasificadores de seguridad, para analizar los datos registrados y detectar posibles abusos e incumplimientos.

  • Acción: Los empleados autorizados de Google pueden evaluar las instrucciones marcadas y comunicarse con el cliente para solicitar aclaraciones. Si no se aborda el comportamiento, o bien si se producen abusos recurrentes o graves, se puede suspender o cancelar el acceso del cliente a Gemini Enterprise Agent Platform o a los servicios de Google Cloud.

  • Servicios incluidos en el alcance: Modelos y funciones designados como "IA avanzada", incluidos los siguientes:

    • Claude Mythos (todas las versiones)
    • Claude Fable (todas las versiones)
    • Claude Sonnet >=5 y Claude Opus >=4.7 cuando se usan para casos de uso prohibidos o de doble uso de alto riesgo cubiertos por el Programa de verificación cibernética de Anthropic
  • Rechazo del cliente: Es posible que no se pueda lograr la retención cero de datos cuando se usan algunas funciones avanzadas basadas en IA. Comunícate con tu equipo de cuentas para obtener más información. Consulta la siguiente sección para saber cómo regir la aceptación del anexo.

El consentimiento para el Anexo de Seguridad de IA Avanzada se requiere una vez por proyecto antes de que se puedan habilitar los modelos de IA avanzada en ese proyecto. El consentimiento se realiza en Model Garden a través de la consola de Google Cloud antes de habilitar cualquier modelo de IA avanzado.

Los usuarios que den su consentimiento deben confirmar que actúan en nombre de su organización y que tienen la autoridad necesaria para vincular al cliente con las obligaciones del anexo. Para dar su consentimiento, el usuario debe tener el permiso aiplatform.consents.update, que se incluye en el rol aiplatform.admin.

Regir el Anexo de Seguridad de IA Avanzada

Para evitar que los usuarios den su consentimiento a este suplemento, los administradores pueden hacer lo siguiente:

Condiciones específicas para socios

El uso de modelos de socios en Gemini Enterprise Agent Platform está sujeto a condiciones específicas de cada socio.

Anthropic

El uso de los modelos de Anthropic en Agent Platform de Gemini Enterprise se rige por las Condiciones del Servicio Comerciales de Anthropic o por otro acuerdo aplicable con Anthropic, y el uso de la IA avanzada de Anthropic se rige por la Sección F de las Condiciones Específicas del Servicio de Anthropic. Los sistemas de supervisión de abuso que se describen en esta página se utilizan para garantizar el cumplimiento de estas condiciones.

Retención de datos

En el caso de Claude Fable 5 de Anthropic en Google Cloud y Mythos 5, las instrucciones y las respuestas se conservan durante un máximo de 30 días. Para usar Claude Fable 5 en Google Cloud y Mythos 5, como lo requiere Anthropic, debes habilitar el uso compartido de estos datos con Anthropic para la supervisión del abuso.

¿Qué sigue?