Kanoniczne adresy URL i meta robots
Kontrolowanie indeksowania i unikanie zduplikowanych treści za pomocą znaczników meta
Kanoniczne adresy URL i meta robots to bezpłatna lekcja HTML Academy na CoddyKit. To lekcja 3 z 4. Możesz przeczytać całą lekcję poniżej za darmo — a potem ćwiczyć ją interaktywnie w przeglądarce z wbudowanym edytorem kodu i tutorem AI dostępnym 24/7. To część ścieżki edukacyjnej HTML Academy, a Twój postęp synchronizuje się między webem a aplikacją CoddyKit. Kurs HTML Academy zawiera 4 lekcji w sumie.
Problem z duplikacją treści
Wyszukiwarki mogą napotkać stronę pod wieloma adresami URL:
http://example.com/pagehttps://example.com/pagehttps://www.example.com/pagehttps://example.com/page/(końcowy ukośnik)https://example.com/page?utm_source=newsletter
Google musi zdecydować, który adres URL zindeksować — i może ukarać witrynę za zduplikowaną treść.
Znacznik link canonical
Należy wskazać wyszukiwarkom preferowany adres URL za pomocą rel="canonical":
<head>
<!-- This is the canonical URL for this content: -->
<link rel="canonical" href="https://example.com/blog/html5-guide">
</head>
<!-- No matter which URL the page is accessed from,
this tag signals to Google which URL to index -->
<!-- Link equity is consolidated at the canonical URL -->Zasady dotyczące canonical URL
Najlepsze praktyki dotyczące canonical URL:
- Należy używać pełnego, bezwzględnego adresu URL (wraz z protokołem)
- Należy używać HTTPS, jeśli witryna go obsługuje
- Należy zachować spójność: zawsze używać końcowego ukośnika albo nigdy go nie używać
- Każda strona powinna mieć znacznik canonical — nawet jeśli wskazuje on na jej własny adres URL
<link rel="canonical" href="https://example.com/blog/html5-guide">
<!-- NOT: -->
<!-- <link rel="canonical" href="/blog/html5-guide"> relative = bad -->
<!-- <link rel="canonical" href="http://..."> HTTP on HTTPS site = bad -->Paginacja a canonical
W przypadku treści podzielonej na strony canonical może wskazywać pierwszą stronę albo bieżącą stronę:
<!-- Page 2 of a blog listing: -->
<link rel="canonical" href="https://example.com/blog?page=2">
<!-- Or: consolidate all pages to the first -->
<link rel="canonical" href="https://example.com/blog">
<!-- Also useful: rel="prev" and rel="next" for paginated series -->Wartości meta robots
Sterowanie zachowaniem wyszukiwarki dla poszczególnych stron:
<meta name="robots" content="index, follow">
<!-- Default: include in index and follow links -->
<meta name="robots" content="noindex">
<!-- Don't index this page -->
<meta name="robots" content="nofollow">
<!-- Don't follow links on this page -->
<meta name="robots" content="noindex, nofollow">
<!-- Don't index AND don't follow -->
<meta name="robots" content="noarchive">
<!-- Don't show cached version in search results -->Dyrektywy dotyczące Googlebota
Należy kierować konkretne dyrektywy do konkretnych robotów indeksujących:
<meta name="googlebot" content="noindex">
<!-- Only affects Google's crawler -->
<meta name="bingbot" content="noindex">
<!-- Only affects Bing's crawler -->
<!-- Other values: -->
<meta name="robots" content="max-snippet:50">
<!-- Limit snippet length in search results to 50 characters -->
<meta name="robots" content="max-image-preview:large">
<!-- Allow full-size image previews in Google results -->Nagłówek HTTP X-Robots-Tag
Elementy canonical i robots można również ustawiać za pomocą nagłówków HTTP (na poziomie serwera):
# Apache .htaccess:
Header add Link "<https://example.com/page>; rel=canonical"
Header add X-Robots-Tag "noindex"
# This is more powerful because it applies to non-HTML files too
# (PDFs, images, etc.) which can't have meta tagsrobots.txt a meta robots
Dwa narzędzia do sterowania robotami indeksującymi — o różnych zastosowaniach:
- robots.txt — określa, do których stron roboty mogą uzyskać dostęp (kontrola dostępu)
- meta robots — określa, co roboty mogą zrobić ze stronami, do których uzyskały dostęp (kontrola indeksowania)
Strona zablokowana w robots.txt może nadal zostać zindeksowana, jeśli prowadzą do niej odnośniki z innych miejsc. Strona z noindex na pewno nie zostanie zindeksowana.
Mapa witryny a canonical
Mapa witryny powinna zawierać wyłącznie kanoniczne adresy URL:
<!-- sitemap.xml should list canonical URLs only: -->
<!-- https://example.com/blog/html5-guide (canonical) -->
<!-- NOT: https://www.example.com/blog/html5-guide -->
<!-- NOT: https://example.com/blog/html5-guide/ (trailing slash variant) -->Canonical wskazujący na bieżącą stronę
Każda strona powinna mieć canonical wskazujący na nią samą — także strona główna:
<!-- On https://example.com/about (the canonical URL itself): -->
<link rel="canonical" href="https://example.com/about">
<!-- This confirms: this IS the canonical URL -->
<!-- Prevents issues if the page is embedded in an iframe or scraped -->Canonical w handlu elektronicznym
Typowe zastosowania canonical w handlu elektronicznym dla produktów z wariantami:
<!-- Product page with color filter: -->
<!-- URL: /products/widget?color=blue -->
<link rel="canonical" href="https://example.com/products/widget">
<!-- All color variants point to the main product page -->
<!-- Avoids duplicate content penalty for parameter variants -->Szybkie sprawdzenie
Jaka powinna być wartość href znacznika link canonical?
Powtórzenie: canonical i robots
Najważniejsze informacje o canonical i robots:
<link rel="canonical" href="full-url">— deklaruje preferowany adres URL- W canonical należy używać bezwzględnych adresów URL, zawsze z HTTPS
meta robots noindex— wyklucza stronę z indeksu wyszukiwaniameta robots nofollow— nie pozwala podążać za odnośnikami- robots.txt = kontrola dostępu; meta robots = kontrola indeksowania
Często zadawane pytania
Czy lekcja „Kanoniczne adresy URL i meta robots” jest bezpłatna?
Tak — pełny tekst „Kanoniczne adresy URL i meta robots” jest dostępny za darmo tutaj w sieci. Aby ćwiczyć ją interaktywnie (wbudowany edytor kodu i tutor AI dostępny 24/7) i odblokować resztę kursu HTML Academy, przejdź na CoddyKit PRO. Kurs HTML Academy zawiera 4 lekcji w sumie.
Co nauczysz się w „Kanoniczne adresy URL i meta robots”?
Kontrolowanie indeksowania i unikanie zduplikowanych treści za pomocą znaczników meta Ćwiczysz HTML Academy z praktycznym kodem, który uruchamiasz bezpośrednio w przeglądarce, a tutor AI dostępny 24/7 odpowiada na Twoje pytania podczas pracy nad lekcją.
Czy potrzebuję doświadczenia, aby zacząć HTML Academy?
Nie wymagamy żadnego doświadczenia. HTML Academy w CoddyKit jest strukturyzowany dla początkujących i zaawansowanych użytkowników, więc możesz zacząć tutaj lub od początku i uczyć się w swoim tempie. To lekcja 3 z 4.
Ile czasu zajmuje lekcja „Kanoniczne adresy URL i meta robots”?
Większość lekcji CoddyKit trwa około 5–10 minut. Każda lekcja to mały, interaktywny krok, dzięki czemu robisz systematyczne postępy i zawsze wracasz dokładnie do tego samego miejsca — na webie i w aplikacji.
Czy mogę pisać i uruchamiać kod w tej lekcji HTML Academy?
Tak. Każda lekcja HTML Academy zawiera wbudowany edytor kodu, więc piszesz i uruchamiasz prawdziwy kod bezpośrednio w przeglądarce i od razu otrzymujesz sprzężenie zwrotne od AI — bez konfiguracji na komputerze.
Wszystkie lekcje w tym kursie
- title i jego rola w SEO
- meta charset viewport author i description
- Kanoniczne adresy URL i meta robots
- Favicon i ikona Apple Touch