Revisada el 2026-10-09

Anonimizar es quitar de un documento todo lo que identifique a personas o empresas antes de dárselo a una IA, sin que quede forma razonable de reidentificar.1

Si queda esa forma, el RGPD sigue aplicándose.1 La receta tiene cuatro ideas: decidir qué se sustituye, aplicar los cambios por niveles de riesgo, buscar residuos (también en los metadatos) y entregar una copia nueva sin tocar el original. El método sale de una skill propia para documentos Word.

Por qué

  • Información anónima es la que no se refiere a una persona identificada o identificable. El RGPD no se aplica a ella.2
  • Para decidir si alguien es identificable se tienen en cuenta todos los medios razonablemente utilizables, con factores como el coste, el tiempo y la tecnología disponible.2
  • La AEPD distingue dos conceptos que se confunden: anonimizar (el resultado es un único conjunto de datos que ya no se refiere a nadie) y seudonimizar (los datos no se atribuyen a una persona sin información adicional, que se guarda aparte con medidas técnicas y organizativas).1
  • Los datos seudonimizados siguen dentro del RGPD; los anonimizados quedan fuera mientras no haya probabilidad razonable de reidentificar.1
  • La AEPD presenta la anonimización como un proceso basado en el riesgo, que conviene validar y vigilar con el tiempo. Si se revierte, el RGPD vuelve a aplicarse por completo.1
  • Consecuencia práctica: cambiar «Ana García» por «Persona 1» y conservar una tabla de equivalencias es seudonimizar, no anonimizar.

Requisitos

  • Una copia de trabajo del documento. El original no se modifica nunca.
  • La lista de lo que hay que proteger: personas, empresas y marcas, direcciones, teléfonos, identificadores fiscales, importes y fechas de operaciones reales, dominios y herramientas internas.
  • La lista de lo que se conserva por criterio (normas, instituciones, productos de terceros que no identifican la relación).

Pasos

  1. Fija el encargo: qué se anonimiza, qué se conserva y con qué convención se sustituye (un rol como «el Proveedor» para las partes y campos entre corchetes como [IMPORTE] para datos puntuales).
  2. Inventaría el documento por bloques y mira donde se esconden los residuos: tablas, imágenes con texto, objetos incrustados, encabezados, pies, notas al pie, hipervínculos, texto alternativo de las imágenes, comentarios y metadatos (autor, último autor, empresa).
  3. Clasifica cada cambio en tres niveles:
    • Nivel 1, mecánico: sustituir nombres por roles o campos, quitar enlaces internos, corregir espacios.
    • Nivel 2, con equivalencia verificada: arreglar concordancias o redacción que la sustitución rompe, anotando el antes y el después.
    • Nivel 3, decisión de la persona responsable: cualquier cambio que altere el sentido. No se aplica sin autorización expresa.
  4. Comprueba que la sustitución no altera el sentido: tras cambiar una entidad por un rol, revisa que partes, alcance y plazos siguen igual.
  5. Construye el entregable desde cero (documento nuevo, sin estilos ni metadatos heredados) y no edites el archivo de origen.
  6. Busca residuos con una batería de patrones (nombres, variantes, abreviaturas, dominios) sobre el texto, las tablas, las notas, los metadatos y el texto extraído del PDF ya renderizado. El resultado exigido es cero apariciones.
  7. Revisa el render página a página: tablas, imágenes y correcciones.
  8. Registra los cambios y entrega el documento junto con un informe de lo hecho.
  9. Solo entonces lo usas con la IA. Si el documento va a un proveedor externo, mira antes su política de datos (privacidad de datos en IA).

Errores frecuentes

  • Sustituir solo el texto visible y dejar los datos en metadatos, imágenes o hipervínculos.
  • Confundir seudonimizar con anonimizar y conservar la tabla de correspondencias junto al documento.
  • Eliminar contenido sustantivo para «limpiar»: no se elimina ni se fusiona nada que tenga valor jurídico.
  • Dar por bueno el resultado sin comprobar el render final.
  • Que la propia IA reanonimice sin revisión: el modelo puede pasar por alto variantes o inventar un sustituto (alucinaciones).

Cómo lo uso

  • Tengo una skill propia, anonimizar-documento, que aplica el flujo anterior a documentos Word: pregunta primero el encargo, trabaja por niveles, construye un documento nuevo, pasa baterías de residuos y entrega un registro de cambios, un control y un informe.
  • La skill es genérica; esta ficha no incluye datos de ningún caso real.
  • No he comprobado si el método se aplica igual a PDF o a hojas de cálculo.

Véase también

Referencias

Footnotes

  1. Anonymisation and pseudonymisation. Agencia Española de Protección de Datos (AEPD). Consultado el 2026-10-09. ↩ ↩2 ↩3 ↩4 ↩5

  2. Reglamento (UE) 2016/679 (RGPD), considerando 26. Parlamento Europeo y Consejo, EUR-Lex. Consultado el 2026-10-09. ↩ ↩2