0Pricing
HTML Academy · Leçon

URL canoniques et meta `robots`

Contrôlez l’exploration et évitez le contenu dupliqué grâce aux balises meta.

URL canoniques et meta `robots` est une leçon HTML Academy gratuite sur CoddyKit. Ceci est la leçon 3 sur 4. Tu peux lire la leçon complète ci-dessous gratuitement — puis la pratiquer en direct dans le navigateur avec un éditeur de code intégré et un tuteur IA 24/7. Elle fait partie du parcours d'apprentissage HTML Academy, et ta progression se synchronise sur le web et l'application CoddyKit. Le cours HTML Academy comprend 4 leçons au total.

Problème du contenu dupliqué

Les moteurs de recherche peuvent trouver votre page à plusieurs URL :

  • http://example.com/page
  • https://example.com/page
  • https://www.example.com/page
  • https://example.com/page/ (barre oblique finale)
  • https://example.com/page?utm_source=newsletter

Google doit décider quelle URL indexer — et peut pénaliser le contenu dupliqué.

La balise link canonique

Indiquez aux moteurs de recherche l’URL préférée avec rel="canonical" :

<head>
  <!-- This is the canonical URL for this content: -->
  <link rel="canonical" href="https://example.com/blog/html5-guide">
</head>
<!-- No matter which URL the page is accessed from,
     this tag signals to Google which URL to index -->
<!-- Link equity is consolidated at the canonical URL -->

Règles relatives aux URL canoniques

Bonnes pratiques pour les URL canoniques :

  • Utilisez l’URL complète et absolue (protocole compris)
  • Utilisez HTTPS si votre site le prend en charge
  • Soyez cohérent : utilisez toujours une barre oblique finale ou n’en utilisez jamais
  • Chaque page doit avoir une balise canonique — même si elle pointe vers sa propre URL
<link rel="canonical" href="https://example.com/blog/html5-guide">
<!-- NOT: -->
<!-- <link rel="canonical" href="/blog/html5-guide"> relative = bad -->
<!-- <link rel="canonical" href="http://..."> HTTP on HTTPS site = bad -->

Pagination et URL canonique

Pour un contenu paginé, l’URL canonique peut pointer vers la première page ou vers la page elle-même :

<!-- Page 2 of a blog listing: -->
<link rel="canonical" href="https://example.com/blog?page=2">
<!-- Or: consolidate all pages to the first -->
<link rel="canonical" href="https://example.com/blog">
<!-- Also useful: rel="prev" and rel="next" for paginated series -->

Valeurs de meta robots

Contrôlez le comportement des moteurs de recherche pour chaque page :

<meta name="robots" content="index, follow">
<!-- Default: include in index and follow links -->

<meta name="robots" content="noindex">
<!-- Don't index this page -->

<meta name="robots" content="nofollow">
<!-- Don't follow links on this page -->

<meta name="robots" content="noindex, nofollow">
<!-- Don't index AND don't follow -->

<meta name="robots" content="noarchive">
<!-- Don't show cached version in search results -->

Directives spécifiques à Googlebot

Ciblez des robots d’exploration précis avec des directives spécifiques :

<meta name="googlebot" content="noindex">
<!-- Only affects Google's crawler -->

<meta name="bingbot" content="noindex">
<!-- Only affects Bing's crawler -->

<!-- Other values: -->
<meta name="robots" content="max-snippet:50">
<!-- Limit snippet length in search results to 50 characters -->

<meta name="robots" content="max-image-preview:large">
<!-- Allow full-size image previews in Google results -->

En-tête HTTP X-Robots-Tag

Les réglages canonical et robots peuvent également être définis via des en-têtes HTTP (au niveau du serveur) :

# Apache .htaccess:
Header add Link "<https://example.com/page>; rel=canonical"
Header add X-Robots-Tag "noindex"

# This is more powerful because it applies to non-HTML files too
# (PDFs, images, etc.) which can't have meta tags

robots.txt et meta robots

Deux outils pour contrôler les robots d’exploration — avec des fonctions différentes :

  • robots.txt — contrôle les pages auxquelles les robots peuvent accéder (contrôle de l’accès)
  • meta robots — contrôle ce que les robots font des pages auxquelles ils ont accédé (contrôle de l’indexation)

Une page interdite dans robots.txt peut tout de même être indexée si elle est liée depuis un autre endroit. Une page contenant noindex ne sera jamais indexée.

Plan du site et URL canonique

Votre plan du site doit uniquement répertorier les URL canoniques :

<!-- sitemap.xml should list canonical URLs only: -->
<!-- https://example.com/blog/html5-guide (canonical) -->
<!-- NOT: https://www.example.com/blog/html5-guide -->
<!-- NOT: https://example.com/blog/html5-guide/ (trailing slash variant) -->

URL canonique autoréférente

Chaque page doit avoir une URL canonique qui pointe vers elle-même — y compris la page principale :

<!-- On https://example.com/about (the canonical URL itself): -->
<link rel="canonical" href="https://example.com/about">
<!-- This confirms: this IS the canonical URL -->
<!-- Prevents issues if the page is embedded in an iframe or scraped -->

URL canonique dans le commerce électronique

Modèles d’URL canoniques pour les produits avec variantes :

<!-- Product page with color filter: -->
<!-- URL: /products/widget?color=blue -->
<link rel="canonical" href="https://example.com/products/widget">
<!-- All color variants point to the main product page -->
<!-- Avoids duplicate content penalty for parameter variants -->

Vérification rapide

Que doit contenir la valeur de href d’une balise link canonique ?

Récapitulatif : canonical et robots

Éléments essentiels de canonical et robots :

  • <link rel="canonical" href="full-url"> — déclarer l’URL préférée
  • Utilisez des URL absolues pour canonical ; toujours en HTTPS
  • meta robots noindex — exclure de l’index de recherche
  • meta robots nofollow — ne pas suivre les liens
  • robots.txt = contrôle de l’accès ; meta robots = contrôle de l’indexation

Questions Fréquemment Posées

La leçon « URL canoniques et meta `robots` » est-elle gratuite ?

Oui — le texte complet de « URL canoniques et meta `robots` » est gratuit à lire ici sur le web. Pour la pratiquer de manière interactive (un éditeur de code intégré et un tuteur IA 24/7) et déverrouiller le reste du cours HTML Academy, passe à CoddyKit PRO. Le cours HTML Academy comprend 4 leçons au total.

Qu'est-ce que j'apprendrai dans « URL canoniques et meta `robots` » ?

Contrôlez l’exploration et évitez le contenu dupliqué grâce aux balises meta. Tu pratiques HTML Academy avec du code pratique que tu exécutes directement dans le navigateur, et un tuteur IA 24/7 répond à tes questions au fur et à mesure que tu avances dans la leçon.

Dois-je avoir de l'expérience pour commencer HTML Academy ?

Aucune expérience préalable n'est requise. HTML Academy sur CoddyKit est structuré pour les débutants jusqu'aux apprenants avancés, donc tu peux commencer ici ou depuis le début et avancer à ton rythme. Ceci est la leçon 3 sur 4.

Combien de temps prend la leçon « URL canoniques et meta `robots` » ?

La plupart des leçons CoddyKit prennent environ 5–10 minutes. Chacune est courte et interactive, tu progresses régulièrement et tu repiques exactement où tu t'es arrêté sur le web et l'app.

Peux-tu écrire et exécuter du code dans cette leçon HTML Academy ?

Oui. Chaque leçon HTML Academy inclut un éditeur de code intégré, tu écris et exécutes du vrai code directement dans ton navigateur et tu reçois des retours IA instantanés — aucune configuration locale requise.

Toutes les leçons de ce cours

  1. `title` et son rôle dans le SEO
  2. `meta charset`, `viewport`, `author` et `description`
  3. URL canoniques et meta `robots`
  4. Favicon et icône Apple Touch
← Retour à HTML Academy