HTML Academy · Pelajaran

URL Kanonik dan meta robots

Kawal perayapan dan elakkan kandungan pendua dengan tag meta

Pelajaran 3 daripada 413 langkah

URL Kanonik dan meta robots ialah pelajaran HTML Academy percuma di CoddyKit. Ini ialah pelajaran 3 daripada 4. Sebanyak 3 pelajaran dalam laluan pembelajaran ini boleh dibaca sepenuhnya secara percuma — selepas itu, CoddyKit PRO membuka akses kepada semua pelajaran, serta latihan praktikal dengan penyunting kod terbina dalam dan tutor kecerdasan buatan yang tersedia 24/7. Pelajaran ini merupakan sebahagian daripada laluan pembelajaran HTML Academy, dan kemajuan anda disegerakkan merentas web serta aplikasi CoddyKit. Kursus HTML Academy merangkumi sejumlah 4 pelajaran.

Masalah Kandungan Pendua

Enjin carian mungkin menemukan halaman anda melalui beberapa URL:

  • http://example.com/page
  • https://example.com/page
  • https://www.example.com/page
  • https://example.com/page/ (garis condong di hujung)
  • https://example.com/page?utm_source=newsletter

Google mesti menentukan URL yang hendak diindeks — dan mungkin mengenakan penalti kerana kandungan pendua.

Tag Pautan Kanonikal

Beritahu enjin carian URL pilihan menggunakan rel="canonical":

<head>
  <!-- This is the canonical URL for this content: -->
  <link rel="canonical" href="https://example.com/blog/html5-guide">
</head>
<!-- No matter which URL the page is accessed from,
     this tag signals to Google which URL to index -->
<!-- Link equity is consolidated at the canonical URL -->

Peraturan URL Kanonikal

Amalan terbaik URL kanonikal:

  • Gunakan URL penuh dan mutlak (termasuk protokol)
  • Gunakan HTTPS jika tapak anda menyokongnya
  • Kekalkan konsistensi: sentiasa dengan atau tanpa garis condong di hujung
  • Setiap halaman harus mempunyai tag kanonikal — walaupun URL itu ialah URLnya sendiri
<link rel="canonical" href="https://example.com/blog/html5-guide">
<!-- NOT: -->
<!-- <link rel="canonical" href="/blog/html5-guide"> relative = bad -->
<!-- <link rel="canonical" href="http://..."> HTTP on HTTPS site = bad -->

Penomboran Halaman dan Kanonikal

Untuk kandungan bernombor halaman, kanonikal boleh menunjuk kepada halaman pertama atau halaman itu sendiri:

<!-- Page 2 of a blog listing: -->
<link rel="canonical" href="https://example.com/blog?page=2">
<!-- Or: consolidate all pages to the first -->
<link rel="canonical" href="https://example.com/blog">
<!-- Also useful: rel="prev" and rel="next" for paginated series -->

Nilai meta robots

Kawal tingkah laku enjin carian bagi setiap halaman:

<meta name="robots" content="index, follow">
<!-- Default: include in index and follow links -->

<meta name="robots" content="noindex">
<!-- Don't index this page -->

<meta name="robots" content="nofollow">
<!-- Don't follow links on this page -->

<meta name="robots" content="noindex, nofollow">
<!-- Don't index AND don't follow -->

<meta name="robots" content="noarchive">
<!-- Don't show cached version in search results -->

Arahan Khusus Googlebot

Sasarkan perayap tertentu dengan arahan khusus:

<meta name="googlebot" content="noindex">
<!-- Only affects Google's crawler -->

<meta name="bingbot" content="noindex">
<!-- Only affects Bing's crawler -->

<!-- Other values: -->
<meta name="robots" content="max-snippet:50">
<!-- Limit snippet length in search results to 50 characters -->

<meta name="robots" content="max-image-preview:large">
<!-- Allow full-size image previews in Google results -->

Pengepala HTTP X-Robots-Tag

Kanonikal dan robots juga boleh ditetapkan melalui pengepala HTTP (pada tahap pelayan):

# Apache .htaccess:
Header add Link "<https://example.com/page>; rel=canonical"
Header add X-Robots-Tag "noindex"

# This is more powerful because it applies to non-HTML files too
# (PDFs, images, etc.) which can't have meta tags

robots.txt berbanding meta robots

Dua alat untuk mengawal perayap — dengan tujuan yang berbeza:

  • robots.txt — mengawal halaman yang boleh diakses oleh perayap (kawalan akses)
  • meta robots — mengawal perkara yang dilakukan oleh perayap terhadap halaman yang telah diakses (kawalan pengindeksan)

Halaman yang tidak dibenarkan dalam robots.txt masih boleh diindeks jika dipautkan dari tempat lain. Halaman dengan noindex pasti tidak akan diindeks.

Peta Tapak dan Kanonikal

Peta tapak anda hendaklah menyenaraikan URL kanonikal sahaja:

<!-- sitemap.xml should list canonical URLs only: -->
<!-- https://example.com/blog/html5-guide (canonical) -->
<!-- NOT: https://www.example.com/blog/html5-guide -->
<!-- NOT: https://example.com/blog/html5-guide/ (trailing slash variant) -->

Kanonikal Rujukan Kendiri

Setiap halaman harus mempunyai kanonikal rujukan kendiri — termasuk halaman utama:

<!-- On https://example.com/about (the canonical URL itself): -->
<link rel="canonical" href="https://example.com/about">
<!-- This confirms: this IS the canonical URL -->
<!-- Prevents issues if the page is embedded in an iframe or scraped -->

Kanonikal dalam E-dagang

Corak kanonikal e-dagang untuk produk dengan varian:

<!-- Product page with color filter: -->
<!-- URL: /products/widget?color=blue -->
<link rel="canonical" href="https://example.com/products/widget">
<!-- All color variants point to the main product page -->
<!-- Avoids duplicate content penalty for parameter variants -->

Semakan Pantas

Apakah nilai href bagi tag pautan kanonikal?

Ulang kaji: Kanonikal dan robots

Asas kanonikal dan robots:

  • <link rel="canonical" href="full-url"> — isytiharkan URL pilihan
  • Gunakan URL mutlak dalam kanonikal; sentiasa HTTPS
  • meta robots noindex — kecualikan daripada indeks carian
  • meta robots nofollow — jangan ikuti pautan
  • robots.txt = kawalan akses; meta robots = kawalan pengindeksan
Percuma untuk bermula

Pelajari HTML dengan tutor kecerdasan buatan — percuma

Tulis dan jalankan kod sebenar dalam pelayar anda, dapatkan bantuan segera daripada tutor kecerdasan buatan yang tersedia 24/7, dan sambung semula dari tempat anda berhenti di web atau dalam aplikasi.

Kursus
40
Pelajaran
159

Soalan Lazim

Adakah pelajaran “URL Kanonik dan meta robots” percuma?

Ya — sebanyak 3 pelajaran dalam laluan pembelajaran HTML Academy, termasuk “URL Kanonik dan meta robots”, boleh dibaca sepenuhnya secara percuma di web ini. Selepas itu, CoddyKit PRO membuka akses kepada semua pelajaran, serta latihan interaktif dengan penyunting kod terbina dalam dan tutor kecerdasan buatan yang tersedia 24/7. Kursus HTML Academy merangkumi sejumlah 4 pelajaran.

Apakah yang akan saya pelajari dalam “URL Kanonik dan meta robots”?

Kawal perayapan dan elakkan kandungan pendua dengan tag meta Anda berlatih HTML Academy menggunakan kod praktikal yang dijalankan terus dalam pelayar, manakala tutor kecerdasan buatan 24/7 menjawab soalan anda semasa anda mengikuti pelajaran.

Adakah saya memerlukan pengalaman untuk memulakan HTML Academy?

Tiada pengalaman terdahulu diperlukan. Pembelajaran HTML Academy di CoddyKit disusun untuk pelajar daripada peringkat pemula hingga lanjutan, jadi anda boleh bermula di sini atau dari awal dan belajar mengikut kadar anda sendiri. Ini ialah pelajaran 3 daripada 4.

Berapa lamakah pelajaran “URL Kanonik dan meta robots” diambil?

Kebanyakan pelajaran CoddyKit mengambil masa kira-kira 5–10 minit. Setiap pelajaran ringkas dan interaktif, jadi anda boleh membuat kemajuan secara berterusan dan menyambung tepat dari tempat anda berhenti di web atau aplikasi.

Bolehkah saya menulis dan menjalankan kod dalam pelajaran HTML Academy ini?

Ya. Setiap pelajaran HTML Academy menyertakan penyunting kod terbina dalam, jadi anda boleh menulis dan menjalankan kod sebenar terus dalam pelayar serta menerima maklum balas kecerdasan buatan serta-merta — tanpa memerlukan persediaan setempat.

Semua pelajaran dalam kursus ini

  1. title dan Peranannya dalam SEO
  2. meta charset viewport author dan description
  3. URL Kanonik dan meta robots
  4. Favicon dan Ikon Sentuhan Apple
← Kembali ke HTML Academy