URL หลักและเมตา robots
ควบคุมการรวบรวมข้อมูลและหลีกเลี่ยงเนื้อหาซ้ำด้วยเมตาแท็ก
URL หลักและเมตา robots เป็นบทเรียน HTML Academy ฟรีบน CoddyKit นี่คือบทเรียนที่ 3 จากทั้งหมด 4 บทเรียน คุณสามารถอ่านบทเรียนทั้งหมดด้านล่างฟรี — จากนั้นลองปฏิบัติด้วยตัวคุณเองในเบราว์เซอร์พร้อมตัวแก้ไขโค้ดในตัวและติวเตอร์ AI ตลอด 24/7 บทเรียนนี้เป็นส่วนหนึ่งของเส้นทางการเรียน HTML Academy และความก้าวหน้าของคุณจะซิงค์ข้ามเว็บและแอป CoddyKit คอร์ส HTML Academy มีบทเรียนทั้งหมด 4 บทเรียน
ปัญหาเนื้อหาซ้ำกัน
เครื่องมือค้นหาอาจพบหน้าเว็บของคุณจากหลาย URL:
http://example.com/pagehttps://example.com/pagehttps://www.example.com/pagehttps://example.com/page/(เครื่องหมายทับท้าย)https://example.com/page?utm_source=newsletter
Google ต้องตัดสินใจว่าจะจัดทำดัชนี URL ใด และอาจลงโทษเว็บไซต์ที่มีเนื้อหาซ้ำกัน
แท็กลิงก์หลัก
แจ้ง URL ที่ต้องการให้เครื่องมือค้นหาใช้ด้วย rel="canonical":
<head>
<!-- This is the canonical URL for this content: -->
<link rel="canonical" href="https://example.com/blog/html5-guide">
</head>
<!-- No matter which URL the page is accessed from,
this tag signals to Google which URL to index -->
<!-- Link equity is consolidated at the canonical URL -->กฎของ URL หลัก
แนวทางปฏิบัติที่ดีสำหรับ URL หลัก:
- ใช้ URL แบบเต็มและสมบูรณ์ (รวมโพรโทคอล)
- ใช้ HTTPS หากเว็บไซต์รองรับ
- ใช้รูปแบบให้สม่ำเสมอ โดยมีหรือไม่มีเครื่องหมายทับท้ายอย่างใดอย่างหนึ่งเสมอ
- ทุกหน้าควรมีแท็ก URL หลัก แม้ URL นั้นจะเป็น URL ของหน้าเดียวกันเอง
<link rel="canonical" href="https://example.com/blog/html5-guide">
<!-- NOT: -->
<!-- <link rel="canonical" href="/blog/html5-guide"> relative = bad -->
<!-- <link rel="canonical" href="http://..."> HTTP on HTTPS site = bad -->การแบ่งหน้าและ URL หลัก
สำหรับเนื้อหาที่แบ่งหน้า URL หลักอาจชี้ไปยังหน้าแรกหรือชี้มายังหน้าเดียวกันเอง:
<!-- Page 2 of a blog listing: -->
<link rel="canonical" href="https://example.com/blog?page=2">
<!-- Or: consolidate all pages to the first -->
<link rel="canonical" href="https://example.com/blog">
<!-- Also useful: rel="prev" and rel="next" for paginated series -->ค่าของเมทาสำหรับโปรแกรมรวบรวมข้อมูล
ควบคุมพฤติกรรมของเครื่องมือค้นหาแยกตามหน้า:
<meta name="robots" content="index, follow">
<!-- Default: include in index and follow links -->
<meta name="robots" content="noindex">
<!-- Don't index this page -->
<meta name="robots" content="nofollow">
<!-- Don't follow links on this page -->
<meta name="robots" content="noindex, nofollow">
<!-- Don't index AND don't follow -->
<meta name="robots" content="noarchive">
<!-- Don't show cached version in search results -->คำสั่งเฉพาะสำหรับ Googlebot
กำหนดเป้าหมายไปยังโปรแกรมรวบรวมข้อมูลเฉพาะด้วยคำสั่งเฉพาะ:
<meta name="googlebot" content="noindex">
<!-- Only affects Google's crawler -->
<meta name="bingbot" content="noindex">
<!-- Only affects Bing's crawler -->
<!-- Other values: -->
<meta name="robots" content="max-snippet:50">
<!-- Limit snippet length in search results to 50 characters -->
<meta name="robots" content="max-image-preview:large">
<!-- Allow full-size image previews in Google results -->ส่วนหัว HTTP X-Robots-Tag
สามารถกำหนด URL หลักและ robots ผ่านส่วนหัว HTTP ได้เช่นกัน (ระดับเซิร์ฟเวอร์):
# Apache .htaccess:
Header add Link "<https://example.com/page>; rel=canonical"
Header add X-Robots-Tag "noindex"
# This is more powerful because it applies to non-HTML files too
# (PDFs, images, etc.) which can't have meta tagsrobots.txt เทียบกับเมทาสำหรับโปรแกรมรวบรวมข้อมูล
เครื่องมือสองชนิดสำหรับควบคุมโปรแกรมรวบรวมข้อมูล ซึ่งมีจุดประสงค์ต่างกัน:
- robots.txt — ควบคุมว่าโปรแกรมรวบรวมข้อมูลเข้าถึงหน้าใดได้บ้าง (การควบคุมการเข้าถึง)
- เมทาสำหรับโปรแกรมรวบรวมข้อมูล — ควบคุมว่าโปรแกรมรวบรวมข้อมูลจะทำอะไรกับหน้าที่เข้าถึงแล้ว (การควบคุมการจัดทำดัชนี)
หน้าที่ไม่อนุญาตใน robots.txt อาจยังถูกจัดทำดัชนีได้ หากมีลิงก์จากที่อื่น ส่วนหน้าที่มี noindex จะไม่ถูกจัดทำดัชนีอย่างแน่นอน
แผนผังเว็บไซต์และ URL หลัก
แผนผังเว็บไซต์ควรแสดงเฉพาะ URL หลักเท่านั้น:
<!-- sitemap.xml should list canonical URLs only: -->
<!-- https://example.com/blog/html5-guide (canonical) -->
<!-- NOT: https://www.example.com/blog/html5-guide -->
<!-- NOT: https://example.com/blog/html5-guide/ (trailing slash variant) -->URL หลักที่อ้างอิงถึงตัวเอง
ทุกหน้าควรมี URL หลักที่อ้างอิงถึงตัวเอง รวมถึงหน้าหลักด้วย:
<!-- On https://example.com/about (the canonical URL itself): -->
<link rel="canonical" href="https://example.com/about">
<!-- This confirms: this IS the canonical URL -->
<!-- Prevents issues if the page is embedded in an iframe or scraped -->URL หลักในเว็บไซต์อีคอมเมิร์ซ
รูปแบบ URL หลักสำหรับสินค้าในอีคอมเมิร์ซที่มีตัวเลือกหลายแบบ:
<!-- Product page with color filter: -->
<!-- URL: /products/widget?color=blue -->
<link rel="canonical" href="https://example.com/products/widget">
<!-- All color variants point to the main product page -->
<!-- Avoids duplicate content penalty for parameter variants -->ตรวจสอบอย่างรวดเร็ว
ค่า href ของแท็กลิงก์ URL หลักควรเป็นอะไร
สรุปทบทวน: URL หลักและโปรแกรมรวบรวมข้อมูล
สาระสำคัญของ URL หลักและโปรแกรมรวบรวมข้อมูล:
<link rel="canonical" href="full-url">— ประกาศ URL ที่ต้องการใช้- ใช้ URL แบบสมบูรณ์ใน URL หลัก และใช้ HTTPS เสมอ
meta robots noindex— ไม่รวมหน้าไว้ในดัชนีการค้นหาmeta robots nofollow— ไม่ติดตามลิงก์- robots.txt = การควบคุมการเข้าถึง ส่วนเมทาสำหรับโปรแกรมรวบรวมข้อมูล = การควบคุมการจัดทำดัชนี
คำถามที่พบบ่อย
บทเรียน “URL หลักและเมตา robots” ฟรีหรือไม่
ใช่ — ข้อความเต็มของ “URL หลักและเมตา robots” ฟรีให้อ่านที่นี่บนเว็บ เพื่อปฏิบัติแบบโต้ตอบ (ตัวแก้ไขโค้ดในตัวและติวเตอร์ AI ตลอด 24/7) และปลดล็อคส่วนที่เหลือของคอร์ส HTML Academy ให้อัปเกรดเป็น CoddyKit PRO คอร์ส HTML Academy มีบทเรียนทั้งหมด 4 บทเรียน
คุณจะเรียนรู้อะไรในบทเรียน “URL หลักและเมตา robots”
ควบคุมการรวบรวมข้อมูลและหลีกเลี่ยงเนื้อหาซ้ำด้วยเมตาแท็ก คุณปฏิบัติ HTML Academy ด้วยโค้ดที่ใช้งานได้จริงที่คุณเรียกใช้โดยตรงในเบราว์เซอร์ และติวเตอร์ AI ตลอด 24/7 ตอบคำถามของคุณขณะที่คุณไปผ่านบทเรียน
คุณต้องมีประสบการณ์ก่อนที่จะเริ่มเรียน HTML Academy หรือไม่
ไม่จำเป็นต้องมีประสบการณ์มาก่อน HTML Academy บน CoddyKit ออกแบบมาสำหรับผู้เริ่มต้นไปจนถึงผู้เรียนขั้นสูง คุณสามารถเริ่มต้นที่นี่หรือเริ่มจากตัวแรกและเรียนด้วยความเร็วของคุณเอง นี่คือบทเรียนที่ 3 จากทั้งหมด 4 บทเรียน
บทเรียน “URL หลักและเมตา robots” ใช้เวลานานแค่ไหน
บทเรียน CoddyKit ส่วนใหญ่ใช้เวลาประมาณ 5–10 นาที แต่ละบทเรียนจึงสั้นและเป็นแบบโต้ตอบ คุณสามารถก้าวหน้าอย่างต่อเนื่องและกลับมาเรียนต่อจากตรงที่เพิ่งหยุดบนเว็บและแอปได้เลย
ฉันเขียนและรันโค้ดในบทเรียน HTML Academy นี้ได้ไหม
ได้ บทเรียน HTML Academy ทุกบทมีตัวแก้ไขโค้ดในตัว คุณจึงเขียนและรันโค้ดจริงได้เลยในเบราว์เซอร์ และได้รับข้อเสนอแนะจาก AI ในทันที — ไม่ต้องติดตั้งในเครื่องของคุณ
บทเรียนทั้งหมดในหลักสูตรนี้
- title และบทบาทต่อ SEO
- meta charset viewport author และ description
- URL หลักและเมตา robots
- Favicon และ Apple Touch Icon