この記事では、データ流出を防ぐために、定義済みデータ型を使用して機密データを識別する方法を説明します。
概要
CatoのDLPサービスは、定義済みデータ型を使用してトラフィックフロー内の機密データを特定します。 データ型を既存のDLPコンテンツプロファイルに追加するか、新しいものを作成できます。
定義済みデータ型には以下があります:
データカタログ: これは国別に特化した数百の異なる静的データポイントを含んでいます
機械学習(ML)分類子: これらは、変化するデータパターンに適応し、広範囲の機密データや画像を正確に識別します。
定義済みデータ型に加えて、カスタムデータ型を作成することもできます。 詳しくはカスタムデータ型を使用したDLPの運用をご覧ください。
データカタログの理解
データカタログには、国別のデータの種類が含まれており、次のデータカテゴリに分類されています:
文書分類
金融データ
HIPAA - アメリカ合衆国にのみ関連
医療
郵便番号やライセンスキーなどのアイテム識別子 -
支払いカード産業データセキュリティ標準(PCI DSS) - クレジットカードデータ
個人識別情報 - PII
英国国民保健サービス
機械学習分類子の理解
ML分類子は、機密文書や画像を識別するために訓練されています。 高度なデータサイエンスの類似性モデルを使用して、ML分類子は、機密データを検出する際の適応性と精度を向上させます。 たとえば、医療用フォームが更新されるたびにカスタムデータ型を更新するのではなく、レコードML分類子を使用してすべての医療記録を検出できます。 ML分類子は、医療記録、税フォーム、特許文書、履歴書、移民フォームなどのカテゴリーの包括的な検出を提供します。
ML分類器が2種類あります:
事前定義済み ML 分類子: 機密データを識別します。例えば、履歴書は百以上の言語で対応できます
画像ML分類子: 機密画像を識別します。例えば、工学図やスクリーンショット
既知の制限
OCR画像スキャンはML分類器のデータ型に対してサポートされていません
データ型の検証
環境内のデータが定義済みデータ型と一致することを確認するために、データを検証し、エクスポートしたテキストで正しく識別されることを確認できます。
データ型を検証するには:
ナビゲーションメニューから、セキュリティ > データ型 & プロファイル,を選択し、データ型タブをクリックします。
検証したいデータ型の行の最後にある三点ドットをクリックし、検証をクリックします。
テストファイルまたは画像をアップロードします。
データ型の表示
データ型ページには、プロフィールに追加できるすべてのデータ型が表示されます。 これにより、組織で使用している特定のデータ型についての調査と理解が可能になります。 カタログには、各データ型のしきい値も示されています。これにより、データ型を有効化するための最小発生数を示します データ型のしきい値についての詳細は、カスタムデータ型を使用したDLPの運用をご覧ください。

データ型を表示するには:
ナビゲーションメニューから、セキュリティ > データ型 & プロファイル,を選択し、データ型タブをクリックします。