HTML Academy · Lektion

Kanonische URLs und robots-Metaangaben

Steuern Sie das Crawling und vermeiden Sie doppelte Inhalte mit Meta-Tags

Lektion 3 von 413 Schritte

Kanonische URLs und robots-Metaangaben ist eine kostenlose HTML Academy-Lektion auf CoddyKit. Dies ist Lektion 3 von 4. Du kannst die komplette Lektion unten kostenlos lesen – dann übst du sie direkt im Browser mit einem integrierten Code-Editor und einem KI-Tutor rund um die Uhr. Sie ist Teil des HTML Academy-Lernpfads, und dein Fortschritt wird über Web und CoddyKit-App synchronisiert. Der HTML Academy-Kurs umfasst insgesamt 4 Lektionen.

Das Problem doppelter Inhalte

Suchmaschinen können Ihre Seite unter mehreren URLs vorfinden:

  • http://example.com/page
  • https://example.com/page
  • https://www.example.com/page
  • https://example.com/page/ (abschließender Schrägstrich)
  • https://example.com/page?utm_source=newsletter

Google muss entscheiden, welche URL indexiert werden soll — und kann doppelte Inhalte abstrafen.

Das canonical-Link-Tag

Teilen Sie Suchmaschinen mit rel="canonical" die bevorzugte URL mit:

<head>
  <!-- This is the canonical URL for this content: -->
  <link rel="canonical" href="https://example.com/blog/html5-guide">
</head>
<!-- No matter which URL the page is accessed from,
     this tag signals to Google which URL to index -->
<!-- Link equity is consolidated at the canonical URL -->

Regeln für canonical-URLs

Best Practices für canonical-URLs:

  • Verwenden Sie die vollständige absolute URL (einschließlich Protokoll)
  • Verwenden Sie HTTPS, wenn Ihre Website dies unterstützt
  • Seien Sie konsequent: immer mit oder immer ohne abschließenden Schrägstrich
  • Jede Seite sollte ein canonical-Tag besitzen — auch wenn es ihre eigene URL ist
<link rel="canonical" href="https://example.com/blog/html5-guide">
<!-- NOT: -->
<!-- <link rel="canonical" href="/blog/html5-guide"> relative = bad -->
<!-- <link rel="canonical" href="http://..."> HTTP on HTTPS site = bad -->

Paginierung und canonical

Bei paginierten Inhalten kann canonical auf die erste Seite oder auf die jeweilige Seite selbst verweisen:

<!-- Page 2 of a blog listing: -->
<link rel="canonical" href="https://example.com/blog?page=2">
<!-- Or: consolidate all pages to the first -->
<link rel="canonical" href="https://example.com/blog">
<!-- Also useful: rel="prev" and rel="next" for paginated series -->

Werte von meta robots

Steuern Sie das Verhalten von Suchmaschinen für jede Seite:

<meta name="robots" content="index, follow">
<!-- Default: include in index and follow links -->

<meta name="robots" content="noindex">
<!-- Don't index this page -->

<meta name="robots" content="nofollow">
<!-- Don't follow links on this page -->

<meta name="robots" content="noindex, nofollow">
<!-- Don't index AND don't follow -->

<meta name="robots" content="noarchive">
<!-- Don't show cached version in search results -->

Spezifische Anweisungen für Googlebot

Richten Sie spezifische Anweisungen an bestimmte Crawler:

<meta name="googlebot" content="noindex">
<!-- Only affects Google's crawler -->

<meta name="bingbot" content="noindex">
<!-- Only affects Bing's crawler -->

<!-- Other values: -->
<meta name="robots" content="max-snippet:50">
<!-- Limit snippet length in search results to 50 characters -->

<meta name="robots" content="max-image-preview:large">
<!-- Allow full-size image previews in Google results -->

X-Robots-Tag-HTTP-Header

Canonical und robots können auch über HTTP-Header auf Serverebene festgelegt werden:

# Apache .htaccess:
Header add Link "<https://example.com/page>; rel=canonical"
Header add X-Robots-Tag "noindex"

# This is more powerful because it applies to non-HTML files too
# (PDFs, images, etc.) which can't have meta tags

robots.txt im Vergleich zu meta robots

Zwei Werkzeuge zur Steuerung von Crawlern — mit unterschiedlichen Aufgaben:

  • robots.txt — steuert, auf welche Seiten Crawler zugreifen können (Zugriffskontrolle)
  • meta robots — steuert, was Crawler mit aufgerufenen Seiten tun (Indexierungskontrolle)

Eine in robots.txt gesperrte Seite kann trotzdem indexiert werden, wenn sie von anderer Stelle verlinkt ist. Eine Seite mit noindex wird definitiv nicht indexiert.

Sitemap und canonical

Ihre Sitemap sollte nur canonical-URLs auflisten:

<!-- sitemap.xml should list canonical URLs only: -->
<!-- https://example.com/blog/html5-guide (canonical) -->
<!-- NOT: https://www.example.com/blog/html5-guide -->
<!-- NOT: https://example.com/blog/html5-guide/ (trailing slash variant) -->

Selbstreferenzierendes canonical

Jede Seite sollte ein selbstreferenzierendes canonical besitzen — auch die Hauptseite:

<!-- On https://example.com/about (the canonical URL itself): -->
<link rel="canonical" href="https://example.com/about">
<!-- This confirms: this IS the canonical URL -->
<!-- Prevents issues if the page is embedded in an iframe or scraped -->

Canonical im E-Commerce

Canonical-Muster im E-Commerce für Produkte mit Varianten:

<!-- Product page with color filter: -->
<!-- URL: /products/widget?color=blue -->
<link rel="canonical" href="https://example.com/products/widget">
<!-- All color variants point to the main product page -->
<!-- Avoids duplicate content penalty for parameter variants -->

Schnelltest

Welchen Wert sollte das href-Attribut eines canonical-Link-Tags haben?

Zusammenfassung: canonical und robots

Die wichtigsten Grundlagen von canonical und robots:

  • <link rel="canonical" href="full-url"> — bevorzugte URL festlegen
  • Absolute URLs für canonical verwenden; immer HTTPS
  • meta robots noindex — aus dem Suchindex ausschließen
  • meta robots nofollow — Links nicht verfolgen
  • robots.txt = Zugriffskontrolle; meta robots = Indexierungskontrolle
Kostenlos starten

Lerne HTML mit einem KI-Tutor — kostenlos

Schreibe und führe echten Code in deinem Browser aus, bekomme sofortige Hilfe von einem 24/7 KI-Tutor und setze dein Lernen im Web oder in der App fort.

Kurse
40
Lektionen
159

Häufig gestellte Fragen

Ist die Lektion „Kanonische URLs und robots-Metaangaben“ kostenlos?

Ja — der vollständige Text von „Kanonische URLs und robots-Metaangaben“ ist hier im Web kostenlos zu lesen. Um sie interaktiv zu üben (integrierter Code-Editor und 24/7 KI-Tutor) und den Rest des HTML Academy-Kurses freizuschalten, upgrade auf CoddyKit PRO. Der HTML Academy-Kurs umfasst insgesamt 4 Lektionen.

Was lerne ich in „Kanonische URLs und robots-Metaangaben“?

Steuern Sie das Crawling und vermeiden Sie doppelte Inhalte mit Meta-Tags Du übst HTML Academy mit praktischem Code, den du direkt im Browser ausführst, und ein 24/7 KI-Tutor beantwortet deine Fragen während du die Lektion bearbeitest.

Brauche ich Erfahrung, um HTML Academy zu starten?

Keine Vorkenntnisse erforderlich. HTML Academy auf CoddyKit ist für Anfänger bis fortgeschrittene Lernende strukturiert, sodass du hier starten oder von Anfang an beginnen und in deinem eigenen Tempo voranschreiten kannst. Dies ist Lektion 3 von 4.

Wie lange dauert die Lektion „Kanonische URLs und robots-Metaangaben“?

Die meisten CoddyKit-Lektionen dauern etwa 5–10 Minuten. Jede ist kompakt und interaktiv, sodass du stetig Fortschritte machst und genau dort weitermachst, wo du aufgehört hast – im Web und in der App.

Kann ich in dieser HTML Academy-Lektion Code schreiben und ausführen?

Ja. Jede HTML Academy-Lektion enthält einen integrierten Code-Editor, sodass du echten Code direkt in deinem Browser schreibst und ausführst und sofort KI-Feedback erhältst — ohne lokale Einrichtung erforderlich.

Alle Lektionen in diesem Kurs

  1. title und seine Bedeutung für SEO
  2. meta charset viewport author und description
  3. Kanonische URLs und robots-Metaangaben
  4. Favicon und Apple Touch Icon
← Zurück zu HTML Academy