¿Qué es la tokenización de datos?
La tokenización de datos reemplaza la información sensible con «tokens» no sensibles para protegerla contra posibles exposiciones. Estos marcadores pueden ser utilizados en entornos inseguros que no requieren acceso a los datos reales, mientras que el mapeo de la base de datos de tokens a datos reales se mantiene en un entorno seguro. Los tokens pueden ser completamente aleatorios o diseñados para preservar el formato de los datos reales, como una dirección, un número de teléfono o un número de identificación gubernamental.
La tokenización es un enfoque que las organizaciones pueden adoptar para reducir su riesgo de violaciones de datos y no cumplimiento regulatorio. Al reemplazar datos sensibles con un token en cualquier lugar donde no se necesiten los datos reales, una organización elimina el riesgo de una violación de datos si ese sistema es comprometido por un atacante. Además, los sistemas sin acceso a datos reales y sensibles pueden estar fuera del alcance de las auditorías de cumplimiento, lo que hace que el cumplimiento sea más simple y económico.
Cómo funciona la tokenización de datos
La tokenización es como darle un nombre en clave a una persona o cosa. En lugar de usar su nombre real, se les conoce como Agente Azul en toda comunicación y documentación. De esta manera, un oyente no autorizado no aprende la verdadera identidad de la persona.
Los sistemas de tokenización mantienen un vault central y seguro que protege el mapeo sensible de los datos reales a los marcadores. Cuando los datos sensibles ingresan al sistema, se envían al sistema de tokenización, que genera un token y almacena el mapeo de tokens a datos reales en el vault.
Estos tokens pueden venir en varios formatos. Por ejemplo, una organización puede generar tokens completamente aleatorios de una longitud fija. Alternativamente, la tokenización puede ser preservadora de formato, creando tokens que se asemejan a los datos reales. Por ejemplo, la dirección 123 Main St puede ser tokenizada como 385 W Elm Ave. Crucialmente, no hay forma de revertir el esquema y recuperar el valor no tokenizado sin acceso al vault seguro.
Una vez que la tokenización está completa, el token se utiliza en lugar de los datos reales en cualquier lugar donde no se necesiten los datos reales. Dado que los tokens son únicos, pueden ser utilizados para identificar y rastrear de manera única una cuenta o registro particular, pero la información proporcionada es incorrecta. Sin embargo, si se necesitan los datos reales, se pueden recuperar del vault. Por ejemplo, los únicos sistemas que podrían tener acceso a la dirección real de un cliente son aquellos que manejan la facturación y el envío.
Tokenización de Datos vs Cifrado vs Enmascaramiento
Las empresas pueden implementar varios controles para gestionar el riesgo de que los datos sensibles puedan ser expuestos o abusados. Algunos de los más comunes incluyen:
- Tokenización: La tokenización reemplaza los datos sensibles con un token único y no sensible, mientras almacena el mapeo entre ellos en un vault seguro. Los tokens pueden preservar el formato de los datos tokenizados, lo que puede ser útil si un sistema espera datos de un formato particular. En este enfoque, el vault de tokens es un único punto de falla, revelando todos los datos sensibles si se ve comprometido.
- Cifrado Los algoritmos de cifrado desordenan los datos de una manera que es irreversible sin acceso a la clave de descifrado. Con el cifrado, el acceso a las claves de descifrado se controla para asegurar el acceso a los datos cifrados.
- Enmascaramiento: El enmascaramiento reemplaza parte de los datos sensibles con otros caracteres y es irreversible. Por ejemplo, muchos sistemas solo mostrarán los últimos cuatro dígitos de un número de tarjeta de crédito, reemplazando el resto con asteriscos.
Comparación de Métodos de Protección de Datos
Casos de Uso e Industrias
La tokenización es una herramienta común para simplificar el cumplimiento de los requisitos regulatorios. PCI DSS, HIPAA, GDPR y leyes similares implementan requisitos estrictos para asegurar varios tipos de datos sensibles. La tokenización es útil en estos contextos porque los tokens no necesitan ser asegurados al mismo nivel que los datos reales, siempre que la bóveda permanezca segura.
Por ejemplo, los estudios médicos son un ejemplo principal de cómo se utiliza la tokenización regularmente. En estos estudios, los médicos pueden no conocer las identidades de los pacientes que reciben el medicamento en prueba o un placebo para evitar que sesguen accidentalmente los resultados. En este escenario, a los pacientes se les asignaría un identificador (por ejemplo, un token) que los identifica de manera única sin permitir que los médicos conozcan su verdadera identidad o accedan a sus registros médicos.
La tokenización también puede ser utilizada en contextos donde ciertos sistemas no son lo suficientemente seguros y confiables para manejar datos reales. Por ejemplo, los terminales de punto de venta (POS) o la infraestructura en la nube podrían usar tokens para reemplazar datos sensibles cuando no requieren acceso a la información real.
Beneficios, Riesgos y Limitaciones de la Tokenización de Datos
La tokenización es una herramienta útil para la seguridad de datos por varias razones, incluyendo:
- Exposición Reducida: La tokenización utiliza marcadores de posición para representar datos sensibles en sistemas que no necesitan acceso a ellos. Esto reduce el riesgo de violaciones de datos, ya que los sistemas no pueden exponer datos que no tienen.
- Cumplimiento Simplificado: Las regulaciones exigen controles de seguridad y auditorías para proteger información sensible. La tokenización disminuye el alcance del cumplimiento al limitar los sistemas con acceso a datos sensibles.
- Preservación de Formato: Los datos tokenizados pueden preservar el formato de los datos subyacentes. Esto los hace utilizables con sistemas que esperan datos en un formato particular.
Sin embargo, la tokenización no es una solución perfecta. Tiene varias limitaciones, incluyendo:
- Centralización de la Bóveda: La tokenización se basa en una bóveda segura para proteger los mapeos de los datos reales a los tokens asociados. Si esta bóveda se ve comprometida, entonces los datos sensibles quedan expuestos.
- Bloqueo de Proveedores: La tokenización requiere la capacidad de tokenizar o buscar datos según sea necesario. Si este proceso depende de una solución de proveedor particular, esto introduce el riesgo de bloqueo de proveedores.
- Escalabilidad y Fiabilidad: La bóveda segura es un único punto de fallo, ya que es el único lugar donde se pueden usar los tokens para buscar los datos correspondientes. Si la bóveda está sobrecargada o falla, entonces el rendimiento y la disponibilidad pueden verse afectados.
Integración de la Tokenización de Datos con Otros Controles
La tokenización es un elemento de una estrategia efectiva de seguridad de datos y debe aplicarse junto con otros métodos, como la encriptación o el enmascaramiento. En general, la tokenización es adecuada si hay sistemas que no requieren acceso a datos sensibles pero necesitan algún tipo de identificador único en su lugar, potencialmente en un formato particular.
En contraste, la encriptación proporciona una forma reversible de proteger los datos sensibles de la exposición, lo que la convierte en una buena opción para proteger datos en tránsito o almacenados en una base de datos. Esto complementa la tokenización al ofrecer una opción para asegurar sistemas donde se necesita acceso a datos reales.
Matriz de Decisión para la Tokenización vs Otros Controles
Resumen de la tokenización de datos
La tokenización de datos protege la información sensible de la exposición al reemplazarla con tokens no sensibles cuando es posible. Al eliminar datos sensibles de sistemas que no necesitan acceso a ellos, la tokenización reduce el riesgo de violaciones de datos y el alcance de los requisitos de cumplimiento normativo.
La plataforma de nube SASE de Cato ofrece una solución simple para implementar la prevención de pérdida de datos (DLP) con controles que soportan la tokenización integrados en una red global de PoP. Al combinar la tokenización con otras técnicas de protección de datos, Cato ofrece las herramientas que las empresas necesitan para cumplir con los requisitos de seguridad y cumplimiento. Explora las soluciones de DLP y protección de datos de Cato.
PREGUNTAS FRECUENTES
¿Cuál es la diferencia entre la tokenización de datos y el cifrado?
La tokenización de datos reemplaza los datos sensibles con tokens no sensibles mientras mantiene una tabla de búsqueda dentro de un entorno seguro. La encriptación realiza transformaciones matemáticas en los datos que solo pueden ser revertidas con acceso a la clave de desencriptación correcta.
¿Reduce la tokenización de datos el alcance de auditoría de PCI DSS o GDPR?
La tokenización puede reducir el alcance de auditoría de PCI DSS y GDPR al disminuir el conjunto de sistemas con acceso a datos sensibles. Con la tokenización, solo aquellos sistemas con acceso a los datos reales – no a los tokens – están sujetos a requisitos de cumplimiento y auditorías.
¿Qué sucede si se compromete un almacén de tokens?
Un almacén de tokens mantiene un mapeo completo entre los tokens y los datos reales que representan. Si se compromete, esto expone datos sensibles y permite a un atacante asociar tokens con identidades reales en datos tomados de otros sistemas. Por esta razón, los almacenes de tokens son un único punto de falla y deben ser asegurados con encriptación, controles de acceso y prácticas de seguridad similares.
¿Se puede utilizar datos tokenizados para análisis?
La tokenización reemplaza los datos sensibles con un token único, lo que hace posible realizar análisis sobre los datos tokenizados. Sin embargo, se pierde cierta información como resultado de la tokenización, limitando los datos útiles que se pueden recopilar. Por ejemplo, una empresa puede saber cuántas unidades de un producto fueron compradas, pero no puede desglosar esto por ubicación, etc.
¿Es suficiente la tokenización de datos por sí sola?
La tokenización de datos es un aspecto de un programa de seguridad de datos y no reemplaza la encriptación, DLP y control de acceso. La tokenización solo reduce el conjunto de sistemas que tienen acceso a los datos verdaderos y sensibles; no proporciona ninguna forma de proteger los datos en sistemas que necesitan acceso a estos datos. Por ejemplo, los sistemas de facturación y envío necesitan acceso a direcciones reales, no a las tokenizadas.
¿Es la tokenización sin almacén más segura que usar un almacén de tokens?
No. La tokenización sin almacén utiliza una fórmula matemática para convertir los datos en su forma tokenizada. Este enfoque depende del secreto del algoritmo utilizado para lograr esto. Si un atacante adivina o aprende el algoritmo, entonces todos los datos tokenizados están expuestos.
¿Cómo impacta la tokenización de datos en el rendimiento del sistema?
La tokenización tiene un impacto mínimo en el rendimiento de los sistemas que utilizan datos tokenizados, especialmente si se utiliza la tokenización que preserva el formato. Sin embargo, las operaciones que requieren que los datos sean tokenizados o que se recupere la información real del almacén de tokens son más lentas porque requieren comunicación con el sistema de tokenización, que es un punto centralizado y único de fallo. Estos impactos en el rendimiento pueden ser menores que con la encriptación, y la tokenización debe ser evaluada bajo carga, especialmente en entornos de nube.
This page was machine-translated. If you notice any inaccuracies or have feedback, please feel free to send it to us here.