HTML Academy · Les

Canonieke URL's en robots-meta

Stuur het crawlen aan en voorkom dubbele inhoud met metatags

Les 3 van 413 stappen

Canonieke URL's en robots-meta is een gratis HTML Academy-les op CoddyKit. Dit is les 3 van 4. Je kunt 3 lessen uit dit leerpad gratis volledig lezen — daarna ontgrendelt CoddyKit PRO alle lessen, plus praktische oefeningen met een ingebouwde code-editor en een AI-tutor die 24/7 beschikbaar is. Deze les maakt deel uit van het leertraject HTML Academy. Je voortgang wordt gesynchroniseerd op het web en in de CoddyKit-app. De cursus HTML Academy bevat in totaal 4 lessen.

Probleem met dubbele inhoud

Zoekmachines kunnen je pagina via meerdere URL's tegenkomen:

  • http://example.com/page
  • https://example.com/page
  • https://www.example.com/page
  • https://example.com/page/ (afsluitende schuine streep)
  • https://example.com/page?utm_source=newsletter

Google moet bepalen welke URL moet worden geïndexeerd — en kan dubbele inhoud bestraffen.

De canonical-linktag

Laat zoekmachines de voorkeurs-URL weten met rel="canonical":

<head>
  <!-- This is the canonical URL for this content: -->
  <link rel="canonical" href="https://example.com/blog/html5-guide">
</head>
<!-- No matter which URL the page is accessed from,
     this tag signals to Google which URL to index -->
<!-- Link equity is consolidated at the canonical URL -->

Regels voor canonical-URL's

Goede werkwijzen voor canonical-URL's:

  • Gebruik de volledige, absolute URL (inclusief protocol)
  • Gebruik HTTPS als je site dit ondersteunt
  • Wees consistent: altijd wel of geen afsluitende schuine streep
  • Elke pagina hoort een canonical-tag te hebben — zelfs als het de eigen URL is
<link rel="canonical" href="https://example.com/blog/html5-guide">
<!-- NOT: -->
<!-- <link rel="canonical" href="/blog/html5-guide"> relative = bad -->
<!-- <link rel="canonical" href="http://..."> HTTP on HTTPS site = bad -->

Paginering en canonical

Bij gepagineerde inhoud kan canonical naar de eerste pagina of naar zichzelf verwijzen:

<!-- Page 2 of a blog listing: -->
<link rel="canonical" href="https://example.com/blog?page=2">
<!-- Or: consolidate all pages to the first -->
<link rel="canonical" href="https://example.com/blog">
<!-- Also useful: rel="prev" and rel="next" for paginated series -->

Waarden van meta robots

Bepaal het gedrag van zoekmachines per pagina:

<meta name="robots" content="index, follow">
<!-- Default: include in index and follow links -->

<meta name="robots" content="noindex">
<!-- Don't index this page -->

<meta name="robots" content="nofollow">
<!-- Don't follow links on this page -->

<meta name="robots" content="noindex, nofollow">
<!-- Don't index AND don't follow -->

<meta name="robots" content="noarchive">
<!-- Don't show cached version in search results -->

Specifieke richtlijnen voor Googlebot

Richt je met specifieke richtlijnen op specifieke crawlers:

<meta name="googlebot" content="noindex">
<!-- Only affects Google's crawler -->

<meta name="bingbot" content="noindex">
<!-- Only affects Bing's crawler -->

<!-- Other values: -->
<meta name="robots" content="max-snippet:50">
<!-- Limit snippet length in search results to 50 characters -->

<meta name="robots" content="max-image-preview:large">
<!-- Allow full-size image previews in Google results -->

HTTP-header X-Robots-Tag

Canonical en robots kunnen ook via HTTP-headers worden ingesteld (op serverniveau):

# Apache .htaccess:
Header add Link "<https://example.com/page>; rel=canonical"
Header add X-Robots-Tag "noindex"

# This is more powerful because it applies to non-HTML files too
# (PDFs, images, etc.) which can't have meta tags

robots.txt versus meta robots

Twee hulpmiddelen om crawlers te sturen — met verschillende doelen:

  • robots.txt — bepaalt tot welke pagina's crawlers toegang hebben (toegangscontrole)
  • meta robots — bepaalt wat crawlers doen met pagina's die ze hebben bezocht (indexeringscontrole)

Een pagina die in robots.txt wordt geblokkeerd, kan toch worden geïndexeerd als er vanaf een andere plek naar wordt gelinkt. Een pagina met noindex wordt zeker niet geïndexeerd.

Sitemap en canonical

Je sitemap hoort alleen canonical-URL's te vermelden:

<!-- sitemap.xml should list canonical URLs only: -->
<!-- https://example.com/blog/html5-guide (canonical) -->
<!-- NOT: https://www.example.com/blog/html5-guide -->
<!-- NOT: https://example.com/blog/html5-guide/ (trailing slash variant) -->

Naar zichzelf verwijzende canonical

Elke pagina hoort een naar zichzelf verwijzende canonical te hebben — zelfs de hoofdpagina:

<!-- On https://example.com/about (the canonical URL itself): -->
<link rel="canonical" href="https://example.com/about">
<!-- This confirms: this IS the canonical URL -->
<!-- Prevents issues if the page is embedded in an iframe or scraped -->

Canonical in e-commerce

Canonical-patronen voor e-commerceproducten met varianten:

<!-- Product page with color filter: -->
<!-- URL: /products/widget?color=blue -->
<link rel="canonical" href="https://example.com/products/widget">
<!-- All color variants point to the main product page -->
<!-- Avoids duplicate content penalty for parameter variants -->

Korte controle

Wat moet de href-waarde van een canonical-linktag zijn?

Samenvatting: canonical en robots

Essentiële punten van canonical en robots:

  • <link rel="canonical" href="full-url"> — geef de voorkeurs-URL op
  • Gebruik absolute URL's in canonical; altijd HTTPS
  • meta robots noindex — sluit de pagina uit van de zoekindex
  • meta robots nofollow — volg links niet
  • robots.txt = toegangscontrole; meta robots = indexeringscontrole
Gratis beginnen

Leer HTML met een AI-tutor — gratis

Schrijf echte code en voer die uit in je browser, krijg direct hulp van een AI-tutor die 24/7 beschikbaar is en ga verder waar je gebleven bent op het web of in de app.

Cursussen
40
Lessen
159

Veelgestelde vragen

Is de les “Canonieke URL's en robots-meta” gratis?

Ja — je kunt hier op het web alle 3 lessen van het leerpad HTML Academy, waaronder “Canonieke URL's en robots-meta”, gratis volledig lezen. Daarna ontgrendelt CoddyKit PRO alle lessen, plus interactieve oefeningen met een ingebouwde code-editor en een AI-tutor die 24/7 beschikbaar is. De cursus HTML Academy bevat in totaal 4 lessen.

Wat leer ik in “Canonieke URL's en robots-meta”?

Stuur het crawlen aan en voorkom dubbele inhoud met metatags Je oefent met HTML Academy door code rechtstreeks in de browser uit te voeren. Een AI-begeleider die 24/7 beschikbaar is beantwoordt je vragen terwijl je de les doorwerkt.

Heb ik ervaring nodig om met HTML Academy te beginnen?

Ervaring vooraf is niet nodig. HTML Academy op CoddyKit is opgebouwd voor beginners tot gevorderden, zodat je hier of bij het begin kunt starten en in je eigen tempo kunt leren. Dit is les 3 van 4.

Hoe lang duurt de les “Canonieke URL's en robots-meta”?

De meeste lessen van CoddyKit duren ongeveer 5–10 minuten. Elke les is kort en interactief, zodat je gestaag vooruitgaat en op het web en in de app precies verdergaat waar je was gebleven.

Kan ik code schrijven en uitvoeren in deze les over HTML Academy?

Ja. Elke les over HTML Academy bevat een ingebouwde code-editor, zodat je rechtstreeks in je browser echte code kunt schrijven en uitvoeren en direct feedback van AI krijgt — lokale installatie is niet nodig.

Alle lessen in deze cursus

  1. title en de rol ervan voor SEO
  2. meta charset viewport author en description
  3. Canonieke URL's en robots-meta
  4. Favicon en Apple Touch Icon
← Terug naar HTML Academy