Pruebe por separado los avisos de IA escritos y pegados
Una prueba exitosa de pegado no establece qué ocurre cuando un empleado escribe el mismo contenido. Evalúe el método de entrada, la decisión de política y el envío final por separado, usando una cuenta de prueba aprobada y datos sintéticos con clasificación esperada conocida.
Para Ingenieros de seguridad que ejecutan un piloto de IA para empleados
Un resumen de soporte, tres métodos de entrada
Un usuario piloto pide a un asistente de IA que resuma un ticket de soporte ficticio. El evaluador solo cambia cómo se introduce el mismo texto de prueba en el compositor.
Con qué está trabajando
- Un ticket sintético que contiene un dato sensible aprobado por el proveedor y una etiqueta obvia SOLO PRUEBA.
- Un ticket equivalente que contiene información pública que debería permitirse según la política seleccionada.
- Versión registrada del navegador, versión de extensión, configuración de política y tipo de cuenta de IA iniciada.
Un enfoque más seguro
- Use una conversación de prueba aislada y confirme la clasificación esperada del dato antes de intentar el envío.
- Escriba, pegue como texto plano y pegue texto formateado en ejecuciones separadas con la misma política.
- Guarde capturas de pantalla y resultados en la hoja de trabajo del evaluador; no asuma que el producto de seguridad registra el método de entrada.
Resultado esperado: Cada método dentro del alcance produce la decisión acordada y el evaluador puede distinguir un envío interceptado de una advertencia seguida de un envío completado.
Siga el procedimiento
Corregir la política y el dato
Anote la acción requerida para el texto restringido sintético y el control permitido. Pregunte al proveedor qué detector y muestra son apropiados. Un número de cuenta inventado que falla una suma de verificación es una mala prueba positiva porque la clasificación esperada ya es incierta.
Ejercite cada método de entrada
Inicie una conversación nueva para cada ejecución. Pruebe escritura manual, pegado de texto plano y pegado formateado sin cambiar navegador, cuenta o política. Observe si la intervención ocurre al pegar, durante la composición o al enviar; son puntos diferentes en el flujo.
Inspeccione la acción final
Intente la acción normal de envío y registre lo que ve el usuario. Donde esté permitido en el entorno de prueba, inspeccione la conversación resultante y la evidencia disponible del producto. Un popup solo no establece que el proveedor nunca recibió el material enviado.
Repita con un control benigno
Envíe la versión permitida usando los mismos métodos. Registre cualquier interrupción innecesaria por separado de una restricción omitida. Repita pruebas con resultados inconsistentes e identifique sus condiciones antes de decidir si un método es compatible, incompatible o aún no resuelto para este despliegue.
Qué verificar antes de continuar
1. Cobertura por método de entrada
- Listo cuando
- Los datos sintéticos escritos y pegados cumplen la acción documentada para cada método dentro del alcance.
- Si la verificación falla
- Excluya el método fallido de la declaración de cobertura y acuerde una solución alternativa o prueba de remediación.
2. Resultado del envío
- Listo cuando
- La evidencia distingue envíos prevenidos, modificados, anulados y completados.
- Si la verificación falla
- Marque el resultado como inconcluso y obtenga una forma compatible de verificar la acción final.
3. Usabilidad benigna
- Listo cuando
- El control aprobado sigue siendo usable sin interrupciones de política inexplicables.
- Si la verificación falla
- Revise la regla coincidente antes de ampliar la aplicación a más usuarios.
Errores comunes a evitar
- Contar una advertencia como prevención cuando el usuario aún puede enviar el texto original.
- Cambiar servicio de IA, tipo de cuenta y método de entrada juntos, dejando la causa de resultados diferentes sin aclarar.
Evalúe este flujo de trabajo con Aona
Dónde puede ayudar Aona
Pida a ventas e ingeniería de Aona que identifiquen los flujos de trabajo de avisos compatibles y los datos sintéticos adecuados para un piloto con alcance definido.
Qué confirmar
Confirme el comportamiento de escritura y pegado para la versión y proveedor reales; este protocolo no afirma que todas las rutas de entrada estén cubiertas.
¿Evaluando controles de indicaciones para ChatGPT?
Discuta indicaciones escritas y pegadas en la interfaz de ChatGPT que usan sus empleados. Revise respuestas de política soportadas con entradas sintéticas y acuerde criterios de aceptación.
Preguntas frecuentes