IndexLaunch
← คู่มือทั้งหมด

เนื้อหาซ้ำและแท็ก Canonical: ส่งผลต่อการจัดทำดัชนีอย่างไร

เหตุใดหน้าที่เกือบเหมือนกันจึงแข่งขันกันเองในการจัดทำดัชนี และแท็ก canonical บอกเครื่องมือค้นหาอย่างไรว่าเวอร์ชันใดที่ควรถูกจัดทำดัชนีและจัดอันดับจริง ๆ

เนื้อหาซ้ำแทบไม่ใช่การคัดลอกวางแบบเต็มรูปแบบ

เนื้อหาซ้ำส่วนใหญ่ไม่ใช่บทความที่เหมือนกันสองบทความ — แต่เป็นหน้าเดียวกันที่เข้าถึงได้ผ่านหลาย URL: มีและไม่มี www มีและไม่มีเครื่องหมายทับท้าย ผ่าน http และ https มีพารามิเตอร์การติดตามหรือการเรียงลำดับต่อท้าย หรือเวอร์ชันที่พิมพ์ง่ายที่อยู่บน URL ของตัวเอง สำหรับ crawler แต่ละอันเป็น URL ที่แตกต่างกันซึ่งบังเอิญแสดงเนื้อหาเดียวกัน

เหตุใดจึงส่งผลเสียต่อการจัดทำดัชนี ไม่ใช่แค่การจัดอันดับ

ข้อสันนิษฐานทั่วไปคือเนื้อหาซ้ำเพียงแค่แบ่งสัญญาณการจัดอันดับระหว่างเวอร์ชันต่าง ๆ ในทางปฏิบัติ เครื่องมือค้นหามักไปไกลกว่านั้นอีกขั้น โดยเลือกเวอร์ชันเดียวที่จะจัดทำดัชนีและมองข้ามส่วนที่เหลือเป็นส่วนใหญ่ — และการเลือกนั้นไม่รับประกันว่าจะเป็นเวอร์ชันที่คุณต้องการจริง ๆ นี่คือหนึ่งในสาเหตุที่พบบ่อยกว่าและไม่ชัดเจนนักที่อยู่เบื้องหลังหน้าที่ติดค้างใน"Crawled - currently not indexed": มันถูก crawl แล้ว ถูกจดจำว่าเทียบเท่ากับ URL อื่น และถูกตัดออกไปเพื่อเลือก URL นั้นแทน

แท็ก canonical ทำอะไรจริง ๆ

แท็ก <link rel="canonical" href="..."> บอก crawler ว่า: หลาย URL อาจนำมาที่นี่ แต่นี่คือเวอร์ชันเฉพาะที่ควรถูกจัดทำดัชนีและได้รับเครดิต ทุกหน้าที่จัดทำดัชนีได้ควรมีแท็ก canonical — รวมถึงแบบอ้างอิงตัวเองที่ชี้ไปยังตัวมันเอง — เพื่อไม่ให้เกิดความคลุมเครือว่า URL ใดที่เนื้อหาของหน้านั้นเองถือว่าเป็นต้นฉบับ

มันเป็นคำใบ้ ไม่ใช่คำสั่ง

เครื่องมือค้นหาปฏิบัติต่อแท็ก canonical เป็นสัญญาณที่แข็งแกร่ง ไม่ใช่กฎที่แน่นอน — เช่นเดียวกับ sitemap หากสัญญาณที่แข็งแกร่งอื่น ๆ ไม่สอดคล้องกัน (เช่น backlink ภายนอกส่วนใหญ่ชี้ไปที่เวอร์ชันที่ไม่ใช่ canonical) เครื่องมือค้นหาสามารถเลือกจัดทำดัชนี URL อื่นที่ไม่ใช่ที่คุณระบุไว้ แท็ก canonical ทำงานได้ดีที่สุดเมื่อสอดคล้องกับสัญญาณอื่นทุกอย่างบนหน้าเว็บ: ลิงก์ภายใน รายการ sitemap และการเปลี่ยนเส้นทางควรตรงกับ URL เดียวกันทั้งหมด

ข้อผิดพลาดในการทำ canonicalization ที่พบบ่อย

  • การชี้แท็ก canonical ไปยัง URL ที่เปลี่ยนเส้นทางไปที่อื่น — crawler ต้องติดตามห่วงโซ่ เพิ่มความยุ่งยากให้กับสัญญาณที่ควรจะขจัดความคลุมเครือ
  • การชี้แท็ก canonical ไปยังหน้าที่มีแท็ก noindexอยู่แล้ว — สัญญาณที่ขัดแย้งกันคู่หนึ่งซึ่งอาจทำให้ทั้งสองเวอร์ชันไม่ถูกจัดทำดัชนีเลย
  • canonical ที่ไม่สอดคล้องกันข้ามชุดการแบ่งหน้า (แต่ละหน้าชี้กลับไปที่หน้า 1) ในขณะที่แต่ละหน้ามีเนื้อหาที่เป็นเอกลักษณ์และจัดทำดัชนีได้ซึ่งคุ้มค่าที่จะแยกไว้
  • บั๊กในเทมเพลตทั่วทั้งเว็บไซต์ที่ทำ canonical ทุกหน้าไปยังหน้าแรก — พบไม่บ่อยแต่ร้ายแรงมาก และควรสุ่มตรวจสอบหลังจากการเปลี่ยนแปลงเทมเพลตใด ๆ

การแก้ไขไปข้างหน้า

เลือกรูปแบบ canonical เดียวสำหรับโดเมนของคุณ (มีหรือไม่มี www มีหรือไม่มีเครื่องหมายทับท้าย) และเปลี่ยนเส้นทางทุกรูปแบบอื่นไปยังรูปแบบนั้นในระดับเซิร์ฟเวอร์ — แท็ก canonical เป็นสัญญาณรองลงมา ไม่ใช่สิ่งทดแทนการไม่ให้บริการ URL ซ้ำเป็นการตอบสนอง 200 ตั้งแต่แรก เมื่อสิ่งนั้นสอดคล้องกันแล้ว ให้แน่ใจว่าsitemapของคุณแสดงเฉพาะเวอร์ชัน canonical ของแต่ละหน้าเท่านั้น — การแสดง URL ที่ไม่ใช่ canonical ส่งสัญญาณที่ขัดแย้งโดยตรงกับแท็ก canonical ของหน้านั้นเอง

ต้องการให้หน้าถัดไปของคุณถูกค้นพบเร็วกว่าการรอ crawl แบบทั่วไปหรือไม่?

IndexLaunch ส่งทุก URL ที่คุณส่งเข้าระบบไปยัง Bing, Yandex, Seznam และ Naver โดยตรงผ่าน IndexNow ทันทีที่คุณเพิ่มเข้าคิว

ดูราคา