Cet article explique comment utiliser des types de données prédéfinis pour identifier des données sensibles afin de prévenir l'exfiltration de données.
Présentation
Le service DLP de Cato utilise des Types de données prédéfinis pour identifier des données sensibles dans un flux de trafic. Vous pouvez ajouter les Types de données à un profil de contenu DLP existant ou en créer un nouveau.
Les Types de données prédéfinis sont :
Le Catalogue de données : Cela contient des centaines de points de données statiques différents adaptés à des pays spécifiques.
Classificateurs ML : Ceux-ci s'adaptent aux modèles de données changeants et identifient avec précision un large éventail de données ou d'images sensibles sans nécessiter de mises à jour manuelles continues.
En plus des Types de données prédéfinis, vous pouvez également créer des Types de données personnalisés. Pour plus d'informations, voir Travailler avec des Types de Données Personnalisés pour DLP.
Comprendre le Catalogue de données
Le Catalogue de données contient des types de données spécifiques à chaque pays qui sont catégorisés dans les catégories de données suivantes :
Classification de documents
Données financières
HIPAA - uniquement pertinent pour les États-Unis
Soins de santé
Identifiants d'éléments - tels que les codes postaux et les clés de licence -
Norme de sécurité des données de l'industrie des cartes de paiement (PCI DSS) - données de carte de crédit
Informations personnelles identifiables - PII
UK National Health Service
Comprendre les classificateurs de Machine Learning
Les Classificateurs ML sont formés pour identifier des documents ou des images sensibles. Utilisant un modèle de similarité avancé de science des données, les Classificateurs ML offrent une meilleure adaptabilité et précision dans la détection des données sensibles, car ils peuvent apprendre et évoluer dynamiquement avec les modèles de données changeants. Par exemple, au lieu de devoir mettre à jour un type de données personnalisé chaque fois qu'un formulaire médical est mis à jour, vous pouvez utiliser le dossier Classificateur ML pour détecter tous les dossiers médicaux. Les Classificateurs ML fournissent une détection complète pour des catégories telles que les dossiers médicaux, les formulaires fiscaux, les brevets, les CV, les formulaires d'immigration, et plus.
Il y a deux Classificateurs ML :
Classificateurs ML prédéfinis: Identifie des données sensibles, par exemple, un curriculum vitae, dans plus de cent langues
Classificateurs ML d'images : Identifie des images sensibles, par exemple, des schémas d'ingénierie ou des captures d'écran
Limites Connues
La numérisation d'image OCR n'est pas prise en charge pour les types de données des Classificateurs ML
Validation des Types de données
Pour garantir que les données de votre environnement correspondent à un type de données prédéfini, vous pouvez valider vos données et vous assurer qu'elles sont correctement identifiées en exportant le texte extrait.
Pour valider les types de données :
Dans le menu de navigation, sélectionnez Sécurité > Types de Données & Profils,, puis cliquez sur l'onglet Types de Données.
Cliquez sur les trois points à la fin de la ligne du type de données que vous souhaitez valider, puis cliquez sur Valider.
Téléversez le fichier ou l'image de test.
Visualisation des Types de données
La page Types de données affiche tous les Types de données que vous pouvez ajouter à un profil. Cela vous permet de rechercher et de comprendre plus sur des Types de données spécifiques que vous utilisez dans votre organisation. Le catalogue montre également le seuil pour chaque type de données, indiquant le nombre minimum d'occurrences pour activer le type de données. Pour plus sur les seuils de type de données, voir Travailler avec des types de données personnalisés pour DLP.

Pour afficher les Types de données :
Dans le menu de navigation, sélectionnez Sécurité > Types de Données & Profils,, puis cliquez sur l'onglet Types de Données.