Cómo funciona
Sin magia y sin promesas vagas: esto es exactamente lo que ocurre desde que sueltas un PDF hasta que te lo devolvemos sin datos personales, y por qué cada paso está donde está.
De un PDF se extrae el texto con sus coordenadas exactas; de un Word, el punto concreto del XML donde vive cada fragmento. Ese mapa es lo que después permite sustituir sin destrozar el formato, y es justo el paso que se saltan las herramientas que te devuelven el documento hecho un desastre.
PDF · DOCX · cabeceras, pies y notas al pie incluidosDNI, NIE, CIF, IBAN, tarjetas, número de la Seguridad Social, matrículas y referencias catastrales se identifican con reglas y se validan con su dígito de control. Si la letra del DNI no cuadra, no es un DNI. Esto captura casi la mitad de los datos personales de un escrito jurídico sin que intervenga ningún modelo, y sirve de red de seguridad por si el modelo se despista.
En el servidor · sin llamadas externasNombres, razones sociales, direcciones escritas en prosa, centros de trabajo y los datos del artículo 9 del RGPD —salud, ideología, antecedentes penales— no los encuentra ninguna expresión regular. Ahí entra un modelo abierto que corre en infraestructura europea, en modo sin retención. Y hay un detalle que lo cambia todo: ese modelo nunca reescribe tu documento, solo devuelve una lista de entidades. Por eso no puede inventarse nada.
Modelo abierto · sin retención · no entrena con tus datos«D. Juan Antonio Pérez Molina», «el Sr. Pérez» y «mi mandante» son la misma persona y tienen que recibir la misma etiqueta. Si no, el documento anonimizado queda incoherente y no sirve ni para aportarlo ni para estudiarlo. Cuando hay dos personas con el mismo apellido, la forma corta se deja como está: preferimos no tocar antes que sustituir mal.
Sin gastar un token másNada se reconstruye: se reemplaza en el sitio exacto. En Word se conservan estilos, tablas, numeración y notas. En PDF se aplica redacción real, que elimina los glifos del fichero. La diferencia importa: casi todas las herramientas pintan un rectángulo negro encima y el texto sigue debajo, recuperable copiando y pegando.
Etiqueta, seudónimo, hash o tachadoEl documento ya anonimizado vuelve a pasar por los detectores. Si algo sigue ahí, se te avisa y se te dice dónde. Es el control de calidad, y es también lo que permite emitir el acta de anonimización que acompaña a cada documento.
Acta con hash del fichero y modelo utilizadoMíralo funcionando
Un buscar-y-reemplazar borraría el importe y la cita legal. Anonimizator entiende qué identifica a una persona y qué es el fondo del asunto.
Que D. Juan Antonio Pérez Molina, mayor de edad, con DNI 45.892.113-Y y domicilio en la calle Serrano n.º 47, 3.º B, 28001 Madrid, interpone demanda de reclamación de cantidad frente a Inversiones Delta Sur, S.L., con CIF B-87456323, por la transferencia de 34.500 € ordenada el 12 de marzo de 2024 a la cuenta ES91 2100 0418 4502 0005 1332, sin que a fecha de hoy se haya prestado el servicio contratado. Resultan de aplicación los artículos 1101 y 1124 del Código Civil.
No hace falta renunciar a las herramientas que ya te ahorran tiempo. Hace falta que el documento llegue a ellas sin datos de tu cliente dentro.
Con un plan personal, el documento se trata en servidores de Estados Unidos. Sin contrato de encargado y sin garantías del artículo 44 del RGPD.
Y antes de eso, la queja del cliente, el expediente de la AEPD y la sanción del Colegio por vulnerar el secreto profesional.
Cuarenta minutos por expediente de veinte folios. Al mes, casi una semana de trabajo facturable perdida.
La mayoría de herramientas tapa el texto en el PDF y lo deja debajo. Se recupera copiando y pegando.
Detección en modelos abiertos alojados en la Unión Europea, en modo sin retención y con contrato de encargado del tratamiento firmado.
Qué se detectó, de qué tipo, con qué modelo y el hash del fichero. Tu prueba de diligencia si la AEPD pregunta.
Un escrito de veinte páginas en menos de diez segundos. Puedes soltar diez a la vez y se procesan en paralelo.
En PDF el texto se elimina del fichero de verdad. En Word se sustituye dentro del original: estilos, tablas y notas salen igual que entraron.
Preguntas que nos hacen
Con un plan personal no dispones de contrato de encargado del tratamiento y el tratamiento se realiza fuera de la Unión Europea, lo que choca con los artículos 28 y 44 del RGPD y con el secreto profesional del artículo 542.3 de la LOPJ. Con planes de empresa o API, firmando el contrato y configurando la residencia del dato en Europa, sí es posible cumplir: es otro producto y otro precio. Anonimizator resuelve el problema por otra vía: si el documento ya no lleva datos personales dentro, deja de haber tratamiento que proteger.
No. El original se elimina en cuanto termina el procesado y el documento anonimizado no llega a almacenarse: viaja en la propia respuesta hasta tu navegador. Cuando la petición acaba, en nuestros servidores no queda ninguna copia. De los datos detectados conservamos solo el tipo y la etiqueta con la que se sustituyeron, nunca el valor.
No, porque el documento no se reconstruye. La sustitución se aplica dentro del fichero original: en Word se conservan estilos, tablas, notas al pie y numeración; en PDF se conserva la maquetación y se elimina el texto de verdad mediante redacción real.
Si conservas la tabla de equivalencias que permite deshacer la sustitución, jurídicamente es seudonimización (artículo 4.5 del RGPD) y el documento sigue siendo dato personal para quien tenga acceso a esa tabla. Solo hay anonimización real cuando la reversión es imposible porque no se conserva nada. Por eso el Excel de equivalencias es opcional y lleva el aviso dentro del propio fichero.
Sí. Antes de procesar eliges por tipo de dato: nombres, empresas, identificadores, contacto, datos económicos, bienes, procesales y sensibles. Las fechas vienen desmarcadas de serie, porque en un escrito jurídico suelen ser el hilo del relato y borrarlas lo deja inservible.
Sí, subiendo el documento anonimizado y el Excel de equivalencias que descargaste con él. En Word el resultado queda prácticamente idéntico al original. En PDF el texto vuelve, pero la maquetación no coincide del todo: al anonimizar se elimina el texto del fichero de verdad, y eso es precisamente lo que hace que sea una redacción seria y no un rectángulo pintado encima.
No, y ninguna herramienta lo hace. Un dato puede escaparse por una transcripción defectuosa, por una redacción inusual o por ser un dato indirecto que solo identifica en contexto. Por eso el resultado incluye una verificación automática que te avisa de lo que pueda quedar, y por eso la revisión antes de aportar o publicar sigue siendo tuya.
Crear la cuenta lleva veinte segundos y no pedimos tarjeta.