9m read

¿Qué es la tokenización de datos?

¿Qué encontrarás aquí?

Cato Networks, reconocido como Líder en el Gartner® Magic Quadrant™ 2024 para SASE de proveedor único

Descargar el informe

La tokenización de datos reemplaza la información sensible con «tokens» no sensibles para protegerla contra posibles exposiciones. Estos marcadores pueden ser utilizados en entornos inseguros que no requieren acceso a los datos reales, mientras que el mapeo de la base de datos de tokens a datos reales se mantiene en un entorno seguro. Los tokens pueden ser completamente aleatorios o diseñados para preservar el formato de los datos reales, como una dirección, un número de teléfono o un número de identificación gubernamental.

La tokenización es un enfoque que las organizaciones pueden adoptar para reducir su riesgo de violaciones de datos y no cumplimiento regulatorio. Al reemplazar datos sensibles con un token en cualquier lugar donde no se necesiten los datos reales, una organización elimina el riesgo de una violación de datos si ese sistema es comprometido por un atacante. Además, los sistemas sin acceso a datos reales y sensibles pueden estar fuera del alcance de las auditorías de cumplimiento, lo que hace que el cumplimiento sea más simple y económico.

Cómo funciona la tokenización de datos

La tokenización es como darle un nombre en clave a una persona o cosa. En lugar de usar su nombre real, se les conoce como Agente Azul en toda comunicación y documentación. De esta manera, un oyente no autorizado no aprende la verdadera identidad de la persona.

Los sistemas de tokenización mantienen un vault central y seguro que protege el mapeo sensible de los datos reales a los marcadores. Cuando los datos sensibles ingresan al sistema, se envían al sistema de tokenización, que genera un token y almacena el mapeo de tokens a datos reales en el vault.

Estos tokens pueden venir en varios formatos. Por ejemplo, una organización puede generar tokens completamente aleatorios de una longitud fija. Alternativamente, la tokenización puede ser preservadora de formato, creando tokens que se asemejan a los datos reales. Por ejemplo, la dirección 123 Main St puede ser tokenizada como 385 W Elm Ave. Crucialmente, no hay forma de revertir el esquema y recuperar el valor no tokenizado sin acceso al vault seguro.

Una vez que la tokenización está completa, el token se utiliza en lugar de los datos reales en cualquier lugar donde no se necesiten los datos reales. Dado que los tokens son únicos, pueden ser utilizados para identificar y rastrear de manera única una cuenta o registro particular, pero la información proporcionada es incorrecta. Sin embargo, si se necesitan los datos reales, se pueden recuperar del vault. Por ejemplo, los únicos sistemas que podrían tener acceso a la dirección real de un cliente son aquellos que manejan la facturación y el envío.

Tokenización de Datos vs Cifrado vs Enmascaramiento

Las empresas pueden implementar varios controles para gestionar el riesgo de que los datos sensibles puedan ser expuestos o abusados. Algunos de los más comunes incluyen:

  • Tokenización: La tokenización reemplaza los datos sensibles con un token único y no sensible, mientras almacena el mapeo entre ellos en un vault seguro. Los tokens pueden preservar el formato de los datos tokenizados, lo que puede ser útil si un sistema espera datos de un formato particular. En este enfoque, el vault de tokens es un único punto de falla, revelando todos los datos sensibles si se ve comprometido.
  • Cifrado Los algoritmos de cifrado desordenan los datos de una manera que es irreversible sin acceso a la clave de descifrado. Con el cifrado, el acceso a las claves de descifrado se controla para asegurar el acceso a los datos cifrados.
  • Enmascaramiento: El enmascaramiento reemplaza parte de los datos sensibles con otros caracteres y es irreversible. Por ejemplo, muchos sistemas solo mostrarán los últimos cuatro dígitos de un número de tarjeta de crédito, reemplazando el resto con asteriscos.

Comparación de Métodos de Protección de Datos

Método Reversibilidad Impacto en el Rendimiento Preservación del Formato Casos de Uso Primarios Riesgos Clave y Limitaciones
Tokenización No es matemáticamente reversible Bajo–Moderado Protección de PCI, salud, PII Compromiso de la bóveda, bloqueo del proveedor
Cifrado Reversible con claves Moderado No Transporte de datos, archivo/base de datos Robo de claves, sobrecarga de rendimiento
Cifrado que preserva el formato (FPE) Reversible con claves Moderado Procesamiento de pagos, análisis Superficie de ataque criptográfico ampliada
Enmascaramiento Irreversible Bajo A veces Pruebas, entornos de desarrollo Puede no cumplir con la normativa, pierde fidelidad

Casos de Uso e Industrias

La tokenización es una herramienta común para simplificar el cumplimiento de los requisitos regulatorios. PCI DSS, HIPAA, GDPR y leyes similares implementan requisitos estrictos para asegurar varios tipos de datos sensibles. La tokenización es útil en estos contextos porque los tokens no necesitan ser asegurados al mismo nivel que los datos reales, siempre que la bóveda permanezca segura.

Por ejemplo, los estudios médicos son un ejemplo principal de cómo se utiliza la tokenización regularmente. En estos estudios, los médicos pueden no conocer las identidades de los pacientes que reciben el medicamento en prueba o un placebo para evitar que sesguen accidentalmente los resultados. En este escenario, a los pacientes se les asignaría un identificador (por ejemplo, un token) que los identifica de manera única sin permitir que los médicos conozcan su verdadera identidad o accedan a sus registros médicos.

La tokenización también puede ser utilizada en contextos donde ciertos sistemas no son lo suficientemente seguros y confiables para manejar datos reales. Por ejemplo, los terminales de punto de venta (POS) o la infraestructura en la nube podrían usar tokens para reemplazar datos sensibles cuando no requieren acceso a la información real.

Beneficios, Riesgos y Limitaciones de la Tokenización de Datos

La tokenización es una herramienta útil para la seguridad de datos por varias razones, incluyendo:

  • Exposición Reducida: La tokenización utiliza marcadores de posición para representar datos sensibles en sistemas que no necesitan acceso a ellos. Esto reduce el riesgo de violaciones de datos, ya que los sistemas no pueden exponer datos que no tienen.
  • Cumplimiento Simplificado: Las regulaciones exigen controles de seguridad y auditorías para proteger información sensible. La tokenización disminuye el alcance del cumplimiento al limitar los sistemas con acceso a datos sensibles.
  • Preservación de Formato: Los datos tokenizados pueden preservar el formato de los datos subyacentes. Esto los hace utilizables con sistemas que esperan datos en un formato particular.

Sin embargo, la tokenización no es una solución perfecta. Tiene varias limitaciones, incluyendo:

  • Centralización de la Bóveda: La tokenización se basa en una bóveda segura para proteger los mapeos de los datos reales a los tokens asociados. Si esta bóveda se ve comprometida, entonces los datos sensibles quedan expuestos.
  • Bloqueo de Proveedores: La tokenización requiere la capacidad de tokenizar o buscar datos según sea necesario. Si este proceso depende de una solución de proveedor particular, esto introduce el riesgo de bloqueo de proveedores.
  • Escalabilidad y Fiabilidad: La bóveda segura es un único punto de fallo, ya que es el único lugar donde se pueden usar los tokens para buscar los datos correspondientes. Si la bóveda está sobrecargada o falla, entonces el rendimiento y la disponibilidad pueden verse afectados.

Integración de la Tokenización de Datos con Otros Controles

La tokenización es un elemento de una estrategia efectiva de seguridad de datos y debe aplicarse junto con otros métodos, como la encriptación o el enmascaramiento. En general, la tokenización es adecuada si hay sistemas que no requieren acceso a datos sensibles pero necesitan algún tipo de identificador único en su lugar, potencialmente en un formato particular.

En contraste, la encriptación proporciona una forma reversible de proteger los datos sensibles de la exposición, lo que la convierte en una buena opción para proteger datos en tránsito o almacenados en una base de datos. Esto complementa la tokenización al ofrecer una opción para asegurar sistemas donde se necesita acceso a datos reales.

Matriz de Decisión para la Tokenización vs Otros Controles

Escenario Mejor Control(es) Adecuado(s) Notas: Opción Habilitada por Cato
Procesamiento de tarjetas de pago Tokenización + DLP El token reduce el alcance de PCI; DLP previene filtraciones DLP en línea entregado a través de la nube SASE de Cato
Registros de salud (PHI) Tokenización + Cifrado Los tokens protegen identificadores; cifrado para el tránsito Protección de datos SASE de Cato + DLP
Cargas de trabajo de análisis Cifrado o FPE Los tokens pueden no permitir un análisis granular DLP en línea para monitoreo seguro de consultas
Compartición de archivos SaaS (multi-nube) Tokenización + DLP Previene la exposición accidental entre inquilinos DLP de Cato aplicado en línea a través de aplicaciones

Resumen de la tokenización de datos

La tokenización de datos protege la información sensible de la exposición al reemplazarla con tokens no sensibles cuando es posible. Al eliminar datos sensibles de sistemas que no necesitan acceso a ellos, la tokenización reduce el riesgo de violaciones de datos y el alcance de los requisitos de cumplimiento normativo.

La plataforma de nube SASE de Cato ofrece una solución simple para implementar la prevención de pérdida de datos (DLP) con controles que soportan la tokenización integrados en una red global de PoP. Al combinar la tokenización con otras técnicas de protección de datos, Cato ofrece las herramientas que las empresas necesitan para cumplir con los requisitos de seguridad y cumplimiento. Explora las soluciones de DLP y protección de datos de Cato.

PREGUNTAS FRECUENTES

¿Cuál es la diferencia entre la tokenización de datos y el cifrado?

La tokenización de datos reemplaza los datos sensibles con tokens no sensibles mientras mantiene una tabla de búsqueda dentro de un entorno seguro. La encriptación realiza transformaciones matemáticas en los datos que solo pueden ser revertidas con acceso a la clave de desencriptación correcta.

¿Reduce la tokenización de datos el alcance de auditoría de PCI DSS o GDPR?

La tokenización puede reducir el alcance de auditoría de PCI DSS y GDPR al disminuir el conjunto de sistemas con acceso a datos sensibles. Con la tokenización, solo aquellos sistemas con acceso a los datos reales – no a los tokens – están sujetos a requisitos de cumplimiento y auditorías.

¿Qué sucede si se compromete un almacén de tokens?

Un almacén de tokens mantiene un mapeo completo entre los tokens y los datos reales que representan. Si se compromete, esto expone datos sensibles y permite a un atacante asociar tokens con identidades reales en datos tomados de otros sistemas. Por esta razón, los almacenes de tokens son un único punto de falla y deben ser asegurados con encriptación, controles de acceso y prácticas de seguridad similares.

¿Se puede utilizar datos tokenizados para análisis?

La tokenización reemplaza los datos sensibles con un token único, lo que hace posible realizar análisis sobre los datos tokenizados. Sin embargo, se pierde cierta información como resultado de la tokenización, limitando los datos útiles que se pueden recopilar. Por ejemplo, una empresa puede saber cuántas unidades de un producto fueron compradas, pero no puede desglosar esto por ubicación, etc.

¿Es suficiente la tokenización de datos por sí sola?

La tokenización de datos es un aspecto de un programa de seguridad de datos y no reemplaza la encriptación, DLP y control de acceso. La tokenización solo reduce el conjunto de sistemas que tienen acceso a los datos verdaderos y sensibles; no proporciona ninguna forma de proteger los datos en sistemas que necesitan acceso a estos datos. Por ejemplo, los sistemas de facturación y envío necesitan acceso a direcciones reales, no a las tokenizadas.

¿Es la tokenización sin almacén más segura que usar un almacén de tokens?

No. La tokenización sin almacén utiliza una fórmula matemática para convertir los datos en su forma tokenizada. Este enfoque depende del secreto del algoritmo utilizado para lograr esto. Si un atacante adivina o aprende el algoritmo, entonces todos los datos tokenizados están expuestos.

¿Cómo impacta la tokenización de datos en el rendimiento del sistema?

La tokenización tiene un impacto mínimo en el rendimiento de los sistemas que utilizan datos tokenizados, especialmente si se utiliza la tokenización que preserva el formato. Sin embargo, las operaciones que requieren que los datos sean tokenizados o que se recupere la información real del almacén de tokens son más lentas porque requieren comunicación con el sistema de tokenización, que es un punto centralizado y único de fallo. Estos impactos en el rendimiento pueden ser menores que con la encriptación, y la tokenización debe ser evaluada bajo carga, especialmente en entornos de nube.

Cato Networks, reconocido como Líder en el Gartner® Magic Quadrant™ 2024 para SASE de proveedor único

Descargar el informe

This page was machine-translated. If you notice any inaccuracies or have feedback, please feel free to send it to us here.