Classification des données
Étiqueter les données sensibles
Classification des données est une leçon Cyber Security Academy gratuite sur CoddyKit. Ceci est la leçon 2 sur 4. Tu peux lire la leçon complète ci-dessous gratuitement — puis la pratiquer en direct dans le navigateur avec un éditeur de code intégré et un tuteur IA 24/7. Elle fait partie du parcours d'apprentissage Cyber Security Academy, et ta progression se synchronise sur le web et l'application CoddyKit. Le cours Cyber Security Academy comprend 4 leçons au total.
Pourquoi classer les données
Vous ne pouvez pas protéger ce que vous n'avez pas catégorisé. La classification des données étiquette les informations selon leur sensibilité afin que les contrôles, les règles d'accès et les politiques de DLP appropriés s'appliquent. Elle constitue le fondement de la DLP et de la plupart des programmes de conformité.
Un schéma de classification
Un schéma courant à quatre niveaux :
- Public : peut être partagé librement.
- Interne : destiné aux employés, avec un faible risque en cas de fuite.
- Confidentiel : sensible, avec un accès restreint.
- Restreint / Secret : sensibilité maximale, contrôles stricts.
Associer les niveaux aux types de données
Associez les niveaux à des exemples concrets afin que le personnel sache où classer les données :
- Public : brochures commerciales.
- Interne : organigrammes, notes de réunion.
- Confidentiel : PII des clients, contrats.
- Restreint : données de cartes, dossiers médicaux, secrets.
Catégories de données réglementées
Certaines données ont une portée juridique :
- PII : informations permettant d'identifier une personne (GDPR).
- PCI : données des titulaires de cartes.
- PHI : informations de santé protégées (HIPAA).
Elles relèvent généralement des catégories Confidentiel ou Restreint.
Étiqueter les données
La classification devient utile lorsqu'elle est étiquetée : la catégorie est associée aux données afin que les outils puissent agir en conséquence.
- Étiquettes de métadonnées stockées avec le fichier.
- Marquages visuels dans les en-têtes et les pieds de page.
- En-têtes et étiquettes dans les courriels et les documents.
Classification manuelle ou automatisée
Deux approches, souvent combinées :
- Manuelle : l'auteur choisit une étiquette lors de la création ; cette méthode est précise, mais incohérente.
- Automatisée : les outils analysent le contenu et appliquent des étiquettes selon des motifs ; cette méthode est évolutive, mais nécessite un affinage.
Découverte et analyse
La plupart des organisations possèdent déjà des données non étiquetées un peu partout. Les outils de découverte des données parcourent les partages de fichiers, les bases de données et les espaces de stockage en nuage pour trouver et classer les données sensibles existantes.
# example: scan a directory for card-like patterns
grep -rEl '[0-9]{4}[- ]?[0-9]{4}[- ]?[0-9]{4}[- ]?[0-9]{4}' /shared/La classification détermine les mesures de contrôle
L’étiquette détermine les règles de traitement :
- Restreint : chiffrer, journaliser les accès et bloquer le partage externe.
- Confidentiel : limiter l’accès aux personnes qui ont besoin d’en connaître.
- Public : aucune restriction.
Les politiques DLP utilisent les étiquettes pour décider s’il faut bloquer un transfert.
Traitement et conservation selon la catégorie
Chaque catégorie doit définir comment les données sont stockées, transmises et partagées, ainsi que leur durée de conservation. Les données restreintes peuvent nécessiter un chiffrement et une courte durée de conservation ; les données publiques n’en nécessitent aucune. Documentez ces règles dans une norme de traitement des données.
Reclassification
La sensibilité des données évolue avec le temps. Un rapport confidentiel sur les résultats devient public après sa publication. Définissez quand et comment les données sont reclassifiées ou rétrogradées afin que les mesures de contrôle restent proportionnées.
Pièges courants
Les programmes de classification échouent lorsque :
- Il y a trop de niveaux, ce qui déroute les utilisateurs (limitez-vous à 3 ou 4).
- Les étiquettes ne sont pas appliquées par les outils.
- Les données historiques ne sont jamais découvertes ni étiquetées.
- Aucun responsable clairement désigné ne gère le dispositif.
Vérification rapide
Appliquez les niveaux de classification.
Récapitulatif
La classification est le fondement de la protection des données :
- Utilisez un dispositif simple à plusieurs niveaux (de Public à Restreint).
- Étiquetez les données au moyen de métadonnées, de marquages et de balises.
- Combinez la classification manuelle et automatisée avec la découverte.
- Laissez l’étiquette déterminer le traitement, la conservation et les mesures DLP.
Questions Fréquemment Posées
La leçon « Classification des données » est-elle gratuite ?
Oui — le texte complet de « Classification des données » est gratuit à lire ici sur le web. Pour la pratiquer de manière interactive (un éditeur de code intégré et un tuteur IA 24/7) et déverrouiller le reste du cours Cyber Security Academy, passe à CoddyKit PRO. Le cours Cyber Security Academy comprend 4 leçons au total.
Qu'est-ce que j'apprendrai dans « Classification des données » ?
Étiqueter les données sensibles Tu pratiques Cyber Security Academy avec du code pratique que tu exécutes directement dans le navigateur, et un tuteur IA 24/7 répond à tes questions au fur et à mesure que tu avances dans la leçon.
Dois-je avoir de l'expérience pour commencer Cyber Security Academy ?
Aucune expérience préalable n'est requise. Cyber Security Academy sur CoddyKit est structuré pour les débutants jusqu'aux apprenants avancés, donc tu peux commencer ici ou depuis le début et avancer à ton rythme. Ceci est la leçon 2 sur 4.
Combien de temps prend la leçon « Classification des données » ?
La plupart des leçons CoddyKit prennent environ 5–10 minutes. Chacune est courte et interactive, tu progresses régulièrement et tu repiques exactement où tu t'es arrêté sur le web et l'app.
Peux-tu écrire et exécuter du code dans cette leçon Cyber Security Academy ?
Oui. Chaque leçon Cyber Security Academy inclut un éditeur de code intégré, tu écris et exécutes du vrai code directement dans ton navigateur et tu reçois des retours IA instantanés — aucune configuration locale requise.
Toutes les leçons de ce cours
- Qu’est-ce que le DLP ?
- Classification des données
- Contrôles DLP
- Menaces internes