0Pricing
HTML Academy · บทเรียน

URL หลักและเมตา robots

ควบคุมการรวบรวมข้อมูลและหลีกเลี่ยงเนื้อหาซ้ำด้วยเมตาแท็ก

URL หลักและเมตา robots เป็นบทเรียน HTML Academy ฟรีบน CoddyKit นี่คือบทเรียนที่ 3 จากทั้งหมด 4 บทเรียน คุณสามารถอ่านบทเรียนทั้งหมดด้านล่างฟรี — จากนั้นลองปฏิบัติด้วยตัวคุณเองในเบราว์เซอร์พร้อมตัวแก้ไขโค้ดในตัวและติวเตอร์ AI ตลอด 24/7 บทเรียนนี้เป็นส่วนหนึ่งของเส้นทางการเรียน HTML Academy และความก้าวหน้าของคุณจะซิงค์ข้ามเว็บและแอป CoddyKit คอร์ส HTML Academy มีบทเรียนทั้งหมด 4 บทเรียน

ปัญหาเนื้อหาซ้ำกัน

เครื่องมือค้นหาอาจพบหน้าเว็บของคุณจากหลาย URL:

  • http://example.com/page
  • https://example.com/page
  • https://www.example.com/page
  • https://example.com/page/ (เครื่องหมายทับท้าย)
  • https://example.com/page?utm_source=newsletter

Google ต้องตัดสินใจว่าจะจัดทำดัชนี URL ใด และอาจลงโทษเว็บไซต์ที่มีเนื้อหาซ้ำกัน

แท็กลิงก์หลัก

แจ้ง URL ที่ต้องการให้เครื่องมือค้นหาใช้ด้วย rel="canonical":

<head>
  <!-- This is the canonical URL for this content: -->
  <link rel="canonical" href="https://example.com/blog/html5-guide">
</head>
<!-- No matter which URL the page is accessed from,
     this tag signals to Google which URL to index -->
<!-- Link equity is consolidated at the canonical URL -->

กฎของ URL หลัก

แนวทางปฏิบัติที่ดีสำหรับ URL หลัก:

  • ใช้ URL แบบเต็มและสมบูรณ์ (รวมโพรโทคอล)
  • ใช้ HTTPS หากเว็บไซต์รองรับ
  • ใช้รูปแบบให้สม่ำเสมอ โดยมีหรือไม่มีเครื่องหมายทับท้ายอย่างใดอย่างหนึ่งเสมอ
  • ทุกหน้าควรมีแท็ก URL หลัก แม้ URL นั้นจะเป็น URL ของหน้าเดียวกันเอง
<link rel="canonical" href="https://example.com/blog/html5-guide">
<!-- NOT: -->
<!-- <link rel="canonical" href="/blog/html5-guide"> relative = bad -->
<!-- <link rel="canonical" href="http://..."> HTTP on HTTPS site = bad -->

การแบ่งหน้าและ URL หลัก

สำหรับเนื้อหาที่แบ่งหน้า URL หลักอาจชี้ไปยังหน้าแรกหรือชี้มายังหน้าเดียวกันเอง:

<!-- Page 2 of a blog listing: -->
<link rel="canonical" href="https://example.com/blog?page=2">
<!-- Or: consolidate all pages to the first -->
<link rel="canonical" href="https://example.com/blog">
<!-- Also useful: rel="prev" and rel="next" for paginated series -->

ค่าของเมทาสำหรับโปรแกรมรวบรวมข้อมูล

ควบคุมพฤติกรรมของเครื่องมือค้นหาแยกตามหน้า:

<meta name="robots" content="index, follow">
<!-- Default: include in index and follow links -->

<meta name="robots" content="noindex">
<!-- Don't index this page -->

<meta name="robots" content="nofollow">
<!-- Don't follow links on this page -->

<meta name="robots" content="noindex, nofollow">
<!-- Don't index AND don't follow -->

<meta name="robots" content="noarchive">
<!-- Don't show cached version in search results -->

คำสั่งเฉพาะสำหรับ Googlebot

กำหนดเป้าหมายไปยังโปรแกรมรวบรวมข้อมูลเฉพาะด้วยคำสั่งเฉพาะ:

<meta name="googlebot" content="noindex">
<!-- Only affects Google's crawler -->

<meta name="bingbot" content="noindex">
<!-- Only affects Bing's crawler -->

<!-- Other values: -->
<meta name="robots" content="max-snippet:50">
<!-- Limit snippet length in search results to 50 characters -->

<meta name="robots" content="max-image-preview:large">
<!-- Allow full-size image previews in Google results -->

ส่วนหัว HTTP X-Robots-Tag

สามารถกำหนด URL หลักและ robots ผ่านส่วนหัว HTTP ได้เช่นกัน (ระดับเซิร์ฟเวอร์):

# Apache .htaccess:
Header add Link "<https://example.com/page>; rel=canonical"
Header add X-Robots-Tag "noindex"

# This is more powerful because it applies to non-HTML files too
# (PDFs, images, etc.) which can't have meta tags

robots.txt เทียบกับเมทาสำหรับโปรแกรมรวบรวมข้อมูล

เครื่องมือสองชนิดสำหรับควบคุมโปรแกรมรวบรวมข้อมูล ซึ่งมีจุดประสงค์ต่างกัน:

  • robots.txt — ควบคุมว่าโปรแกรมรวบรวมข้อมูลเข้าถึงหน้าใดได้บ้าง (การควบคุมการเข้าถึง)
  • เมทาสำหรับโปรแกรมรวบรวมข้อมูล — ควบคุมว่าโปรแกรมรวบรวมข้อมูลจะทำอะไรกับหน้าที่เข้าถึงแล้ว (การควบคุมการจัดทำดัชนี)

หน้าที่ไม่อนุญาตใน robots.txt อาจยังถูกจัดทำดัชนีได้ หากมีลิงก์จากที่อื่น ส่วนหน้าที่มี noindex จะไม่ถูกจัดทำดัชนีอย่างแน่นอน

แผนผังเว็บไซต์และ URL หลัก

แผนผังเว็บไซต์ควรแสดงเฉพาะ URL หลักเท่านั้น:

<!-- sitemap.xml should list canonical URLs only: -->
<!-- https://example.com/blog/html5-guide (canonical) -->
<!-- NOT: https://www.example.com/blog/html5-guide -->
<!-- NOT: https://example.com/blog/html5-guide/ (trailing slash variant) -->

URL หลักที่อ้างอิงถึงตัวเอง

ทุกหน้าควรมี URL หลักที่อ้างอิงถึงตัวเอง รวมถึงหน้าหลักด้วย:

<!-- On https://example.com/about (the canonical URL itself): -->
<link rel="canonical" href="https://example.com/about">
<!-- This confirms: this IS the canonical URL -->
<!-- Prevents issues if the page is embedded in an iframe or scraped -->

URL หลักในเว็บไซต์อีคอมเมิร์ซ

รูปแบบ URL หลักสำหรับสินค้าในอีคอมเมิร์ซที่มีตัวเลือกหลายแบบ:

<!-- Product page with color filter: -->
<!-- URL: /products/widget?color=blue -->
<link rel="canonical" href="https://example.com/products/widget">
<!-- All color variants point to the main product page -->
<!-- Avoids duplicate content penalty for parameter variants -->

ตรวจสอบอย่างรวดเร็ว

ค่า href ของแท็กลิงก์ URL หลักควรเป็นอะไร

สรุปทบทวน: URL หลักและโปรแกรมรวบรวมข้อมูล

สาระสำคัญของ URL หลักและโปรแกรมรวบรวมข้อมูล:

  • <link rel="canonical" href="full-url"> — ประกาศ URL ที่ต้องการใช้
  • ใช้ URL แบบสมบูรณ์ใน URL หลัก และใช้ HTTPS เสมอ
  • meta robots noindex — ไม่รวมหน้าไว้ในดัชนีการค้นหา
  • meta robots nofollow — ไม่ติดตามลิงก์
  • robots.txt = การควบคุมการเข้าถึง ส่วนเมทาสำหรับโปรแกรมรวบรวมข้อมูล = การควบคุมการจัดทำดัชนี

คำถามที่พบบ่อย

บทเรียน “URL หลักและเมตา robots” ฟรีหรือไม่

ใช่ — ข้อความเต็มของ “URL หลักและเมตา robots” ฟรีให้อ่านที่นี่บนเว็บ เพื่อปฏิบัติแบบโต้ตอบ (ตัวแก้ไขโค้ดในตัวและติวเตอร์ AI ตลอด 24/7) และปลดล็อคส่วนที่เหลือของคอร์ส HTML Academy ให้อัปเกรดเป็น CoddyKit PRO คอร์ส HTML Academy มีบทเรียนทั้งหมด 4 บทเรียน

คุณจะเรียนรู้อะไรในบทเรียน “URL หลักและเมตา robots”

ควบคุมการรวบรวมข้อมูลและหลีกเลี่ยงเนื้อหาซ้ำด้วยเมตาแท็ก คุณปฏิบัติ HTML Academy ด้วยโค้ดที่ใช้งานได้จริงที่คุณเรียกใช้โดยตรงในเบราว์เซอร์ และติวเตอร์ AI ตลอด 24/7 ตอบคำถามของคุณขณะที่คุณไปผ่านบทเรียน

คุณต้องมีประสบการณ์ก่อนที่จะเริ่มเรียน HTML Academy หรือไม่

ไม่จำเป็นต้องมีประสบการณ์มาก่อน HTML Academy บน CoddyKit ออกแบบมาสำหรับผู้เริ่มต้นไปจนถึงผู้เรียนขั้นสูง คุณสามารถเริ่มต้นที่นี่หรือเริ่มจากตัวแรกและเรียนด้วยความเร็วของคุณเอง นี่คือบทเรียนที่ 3 จากทั้งหมด 4 บทเรียน

บทเรียน “URL หลักและเมตา robots” ใช้เวลานานแค่ไหน

บทเรียน CoddyKit ส่วนใหญ่ใช้เวลาประมาณ 5–10 นาที แต่ละบทเรียนจึงสั้นและเป็นแบบโต้ตอบ คุณสามารถก้าวหน้าอย่างต่อเนื่องและกลับมาเรียนต่อจากตรงที่เพิ่งหยุดบนเว็บและแอปได้เลย

ฉันเขียนและรันโค้ดในบทเรียน HTML Academy นี้ได้ไหม

ได้ บทเรียน HTML Academy ทุกบทมีตัวแก้ไขโค้ดในตัว คุณจึงเขียนและรันโค้ดจริงได้เลยในเบราว์เซอร์ และได้รับข้อเสนอแนะจาก AI ในทันที — ไม่ต้องติดตั้งในเครื่องของคุณ

บทเรียนทั้งหมดในหลักสูตรนี้

  1. title และบทบาทต่อ SEO
  2. meta charset viewport author และ description
  3. URL หลักและเมตา robots
  4. Favicon และ Apple Touch Icon
← กลับไปที่ HTML Academy