La privacidad de una aplicación de IA depende de todo el recorrido del dato: navegador, backend, proveedor, modelo, logs, cachés, copias y personas con acceso. Elegir una API o ejecutar un modelo local no permite concluir por sí solo qué información queda protegida.
Clasificar antes de enviar
Separa datos públicos, internos, personales y secretos. Pregunta si el modelo necesita el nombre completo, el identificador o el documento original. Minimizar contexto reduce exposición y también coste. Cuando no sea imprescindible, utiliza datos anonimizados o una referencia interna.
Proveedor, retención y región
Revisa condiciones del servicio, uso de las solicitudes, retención, subcontratistas y ubicación aplicable. La política técnica debe coincidir con las obligaciones de la organización. No afirmes que un proveedor no conserva datos sin verificar la documentación y la configuración concreta.
Modelo local no significa privacidad automática
Un servidor propio puede evitar una transferencia a un tercero, pero tiene usuarios, administradores, logs, backups y vulnerabilidades. Protege el endpoint, cifra donde corresponda, limita permisos y revisa quién puede leer pesos, prompts y respuestas.
Logs, errores y observabilidad
Los registros ayudan a investigar fallos, pero pueden copiar información sensible sin intención. Define campos permitidos, redacción, retención y acceso. Los mensajes de error no deben incluir claves, documentos completos ni datos que la operación no necesita.
Integraciones y datos persistentes
Una aplicación puede enviar contexto a un proveedor, guardar la respuesta en una base de datos o indexar documentos para recuperación. Cada paso tiene su propio ciclo de vida. Borra o anonimiza datos cuando deja de existir una razón para conservarlos y revisa copias.
Acceso y revisión humana
Concede a cada proceso los permisos mínimos. Una herramienta que consulta documentos no necesita borrarlos. Si una salida puede desencadenar una acción sensible, incorpora autorización independiente y una revisión proporcional al impacto.
Qué documentar
Registra categorías de datos, flujo, proveedor o modelo, retención, permisos, cifrado, logs y respuesta ante incidentes. La privacidad es una propiedad del sistema configurado, no una etiqueta del modelo.
Mapa del flujo de datos
Dibuja qué sale del navegador, qué procesa el backend, qué recibe el modelo, qué se guarda y quién accede. Incluye proveedores auxiliares, analítica, colas, cachés y backups. Un diagrama incompleto puede ocultar que la misma información se copia en varios sistemas.
Minimización y separación
Envía la pregunta sin campos que el modelo no necesite y sustituye identificadores directos por referencias cuando sea posible. Separa tenants y evita mezclar contexto de usuarios. Una caché de respuestas debe diferenciar contenido público de respuestas personalizadas.
Controles de acceso
La aplicación debe autorizar la lectura antes de recuperar documentos para el prompt. El modelo no puede conceder permisos por sí mismo. Limita cuentas de servicio, separa lectura y escritura y exige aprobación para acciones sobre datos personales.
Incidentes y eliminación
Define qué hacer si una clave se expone, un log contiene datos o un proveedor cambia sus condiciones. La respuesta debe incluir rotación, revisión de copias y notificación interna según el contexto. La eliminación debe cubrir índices, cachés y backups cuando la política lo exija.
Un mapa por componente
Enumera navegador, backend, proveedor, modelo, base de datos, cachés, colas, índices y copias. Para cada punto indica qué datos entran, qué se conserva y quién accede. La privacidad puede fallar en un log aunque la petición principal no se guarde.
Permisos mínimos
Una aplicación que clasifica documentos no necesita permiso para borrarlos. Un índice vectorial puede ser de solo lectura para el servicio de respuesta. Separa tenants, claves y roles, y revisa accesos cuando cambie el equipo.
Respuesta a incidentes
Define rotación de credenciales, revisión de logs, aislamiento, eliminación de copias y comunicación interna. Un modelo local reduce una transferencia concreta, pero no elimina el riesgo de una cuenta de administrador o un backup expuesto.
Retención y minimización
Define cuánto tiempo se conservan prompts, respuestas, documentos, índices y copias. Elimina lo que ya no tenga una finalidad y restringe exportaciones. Las condiciones del proveedor deben revisarse junto con la configuración efectiva.
Privacidad como proceso
Una nueva fuente, plugin o modelo puede cambiar el flujo de datos. Repite el inventario cuando se modifica la arquitectura y documenta quién aprueba el cambio.
Decisiones que deben revisarse
Revisa especialmente nuevas fuentes documentales, cambios de proveedor y datos añadidos al contexto. La arquitectura puede cambiar su exposición aunque el modelo permanezca igual.
El control depende de configuración, contratos, accesos y retención.
Retención y copias
El ciclo de vida incluye prompts, respuestas, documentos, índices, cachés y backups. Define cuánto tiempo se conservan y quién puede restaurarlos. El borrado de una base de datos no elimina necesariamente todas las copias o exportaciones.
Revisar cambios
Un nuevo proveedor, plugin o campo añadido al contexto puede modificar la exposición. Repite el inventario de datos y permisos después de cada cambio importante.
Un control de principio a fin
Clasifica datos, limita el contexto, protege claves, revisa proveedores y controla logs y copias. La privacidad depende de la configuración completa, no de que el modelo sea local o externo.
Qué revisar periódicamente
Comprueba accesos, retención, exportaciones y nuevas fuentes. Un cambio pequeño en el flujo puede añadir una copia de información sensible.
La revisión debe repetirse cuando cambien proveedor, modelo, fuente o política de retención. Conserva responsables y fecha de cada decisión.

