0Pricing
HTML Academy · Lekcja

Kanoniczne adresy URL i meta robots

Kontrolowanie indeksowania i unikanie zduplikowanych treści za pomocą znaczników meta

Kanoniczne adresy URL i meta robots to bezpłatna lekcja HTML Academy na CoddyKit. To lekcja 3 z 4. Możesz przeczytać całą lekcję poniżej za darmo — a potem ćwiczyć ją interaktywnie w przeglądarce z wbudowanym edytorem kodu i tutorem AI dostępnym 24/7. To część ścieżki edukacyjnej HTML Academy, a Twój postęp synchronizuje się między webem a aplikacją CoddyKit. Kurs HTML Academy zawiera 4 lekcji w sumie.

Problem z duplikacją treści

Wyszukiwarki mogą napotkać stronę pod wieloma adresami URL:

  • http://example.com/page
  • https://example.com/page
  • https://www.example.com/page
  • https://example.com/page/ (końcowy ukośnik)
  • https://example.com/page?utm_source=newsletter

Google musi zdecydować, który adres URL zindeksować — i może ukarać witrynę za zduplikowaną treść.

Znacznik link canonical

Należy wskazać wyszukiwarkom preferowany adres URL za pomocą rel="canonical":

<head>
  <!-- This is the canonical URL for this content: -->
  <link rel="canonical" href="https://example.com/blog/html5-guide">
</head>
<!-- No matter which URL the page is accessed from,
     this tag signals to Google which URL to index -->
<!-- Link equity is consolidated at the canonical URL -->

Zasady dotyczące canonical URL

Najlepsze praktyki dotyczące canonical URL:

  • Należy używać pełnego, bezwzględnego adresu URL (wraz z protokołem)
  • Należy używać HTTPS, jeśli witryna go obsługuje
  • Należy zachować spójność: zawsze używać końcowego ukośnika albo nigdy go nie używać
  • Każda strona powinna mieć znacznik canonical — nawet jeśli wskazuje on na jej własny adres URL
<link rel="canonical" href="https://example.com/blog/html5-guide">
<!-- NOT: -->
<!-- <link rel="canonical" href="/blog/html5-guide"> relative = bad -->
<!-- <link rel="canonical" href="http://..."> HTTP on HTTPS site = bad -->

Paginacja a canonical

W przypadku treści podzielonej na strony canonical może wskazywać pierwszą stronę albo bieżącą stronę:

<!-- Page 2 of a blog listing: -->
<link rel="canonical" href="https://example.com/blog?page=2">
<!-- Or: consolidate all pages to the first -->
<link rel="canonical" href="https://example.com/blog">
<!-- Also useful: rel="prev" and rel="next" for paginated series -->

Wartości meta robots

Sterowanie zachowaniem wyszukiwarki dla poszczególnych stron:

<meta name="robots" content="index, follow">
<!-- Default: include in index and follow links -->

<meta name="robots" content="noindex">
<!-- Don't index this page -->

<meta name="robots" content="nofollow">
<!-- Don't follow links on this page -->

<meta name="robots" content="noindex, nofollow">
<!-- Don't index AND don't follow -->

<meta name="robots" content="noarchive">
<!-- Don't show cached version in search results -->

Dyrektywy dotyczące Googlebota

Należy kierować konkretne dyrektywy do konkretnych robotów indeksujących:

<meta name="googlebot" content="noindex">
<!-- Only affects Google's crawler -->

<meta name="bingbot" content="noindex">
<!-- Only affects Bing's crawler -->

<!-- Other values: -->
<meta name="robots" content="max-snippet:50">
<!-- Limit snippet length in search results to 50 characters -->

<meta name="robots" content="max-image-preview:large">
<!-- Allow full-size image previews in Google results -->

Nagłówek HTTP X-Robots-Tag

Elementy canonical i robots można również ustawiać za pomocą nagłówków HTTP (na poziomie serwera):

# Apache .htaccess:
Header add Link "<https://example.com/page>; rel=canonical"
Header add X-Robots-Tag "noindex"

# This is more powerful because it applies to non-HTML files too
# (PDFs, images, etc.) which can't have meta tags

robots.txt a meta robots

Dwa narzędzia do sterowania robotami indeksującymi — o różnych zastosowaniach:

  • robots.txt — określa, do których stron roboty mogą uzyskać dostęp (kontrola dostępu)
  • meta robots — określa, co roboty mogą zrobić ze stronami, do których uzyskały dostęp (kontrola indeksowania)

Strona zablokowana w robots.txt może nadal zostać zindeksowana, jeśli prowadzą do niej odnośniki z innych miejsc. Strona z noindex na pewno nie zostanie zindeksowana.

Mapa witryny a canonical

Mapa witryny powinna zawierać wyłącznie kanoniczne adresy URL:

<!-- sitemap.xml should list canonical URLs only: -->
<!-- https://example.com/blog/html5-guide (canonical) -->
<!-- NOT: https://www.example.com/blog/html5-guide -->
<!-- NOT: https://example.com/blog/html5-guide/ (trailing slash variant) -->

Canonical wskazujący na bieżącą stronę

Każda strona powinna mieć canonical wskazujący na nią samą — także strona główna:

<!-- On https://example.com/about (the canonical URL itself): -->
<link rel="canonical" href="https://example.com/about">
<!-- This confirms: this IS the canonical URL -->
<!-- Prevents issues if the page is embedded in an iframe or scraped -->

Canonical w handlu elektronicznym

Typowe zastosowania canonical w handlu elektronicznym dla produktów z wariantami:

<!-- Product page with color filter: -->
<!-- URL: /products/widget?color=blue -->
<link rel="canonical" href="https://example.com/products/widget">
<!-- All color variants point to the main product page -->
<!-- Avoids duplicate content penalty for parameter variants -->

Szybkie sprawdzenie

Jaka powinna być wartość href znacznika link canonical?

Powtórzenie: canonical i robots

Najważniejsze informacje o canonical i robots:

  • <link rel="canonical" href="full-url"> — deklaruje preferowany adres URL
  • W canonical należy używać bezwzględnych adresów URL, zawsze z HTTPS
  • meta robots noindex — wyklucza stronę z indeksu wyszukiwania
  • meta robots nofollow — nie pozwala podążać za odnośnikami
  • robots.txt = kontrola dostępu; meta robots = kontrola indeksowania

Często zadawane pytania

Czy lekcja „Kanoniczne adresy URL i meta robots” jest bezpłatna?

Tak — pełny tekst „Kanoniczne adresy URL i meta robots” jest dostępny za darmo tutaj w sieci. Aby ćwiczyć ją interaktywnie (wbudowany edytor kodu i tutor AI dostępny 24/7) i odblokować resztę kursu HTML Academy, przejdź na CoddyKit PRO. Kurs HTML Academy zawiera 4 lekcji w sumie.

Co nauczysz się w „Kanoniczne adresy URL i meta robots”?

Kontrolowanie indeksowania i unikanie zduplikowanych treści za pomocą znaczników meta Ćwiczysz HTML Academy z praktycznym kodem, który uruchamiasz bezpośrednio w przeglądarce, a tutor AI dostępny 24/7 odpowiada na Twoje pytania podczas pracy nad lekcją.

Czy potrzebuję doświadczenia, aby zacząć HTML Academy?

Nie wymagamy żadnego doświadczenia. HTML Academy w CoddyKit jest strukturyzowany dla początkujących i zaawansowanych użytkowników, więc możesz zacząć tutaj lub od początku i uczyć się w swoim tempie. To lekcja 3 z 4.

Ile czasu zajmuje lekcja „Kanoniczne adresy URL i meta robots”?

Większość lekcji CoddyKit trwa około 5–10 minut. Każda lekcja to mały, interaktywny krok, dzięki czemu robisz systematyczne postępy i zawsze wracasz dokładnie do tego samego miejsca — na webie i w aplikacji.

Czy mogę pisać i uruchamiać kod w tej lekcji HTML Academy?

Tak. Każda lekcja HTML Academy zawiera wbudowany edytor kodu, więc piszesz i uruchamiasz prawdziwy kod bezpośrednio w przeglądarce i od razu otrzymujesz sprzężenie zwrotne od AI — bez konfiguracji na komputerze.

Wszystkie lekcje w tym kursie

  1. title i jego rola w SEO
  2. meta charset viewport author i description
  3. Kanoniczne adresy URL i meta robots
  4. Favicon i ikona Apple Touch
← Powrót do HTML Academy