IndexLaunch
← คู่มือทั้งหมด

แนวทางปฏิบัติที่ดีที่สุดสำหรับ XML Sitemap เพื่อการจัดทำดัชนีที่เร็วขึ้นและสะอาดขึ้น

สิ่งที่ควรรวมไว้ สิ่งที่ควรตัดออก ขีดจำกัดขนาด และข้อผิดพลาดของ sitemap ที่แอบสิ้นเปลือง crawl budget

sitemap เป็นคำใบ้ ไม่ใช่การรับประกัน

เครื่องมือค้นหามอง sitemap เป็นสัญญาณการค้นพบที่แข็งแกร่ง ไม่ใช่คำสั่ง มันจะไม่บังคับให้จัดทำดัชนีหน้าที่มีคุณภาพต่ำ — สิ่งที่มันทำคือขจัดความสงสัยว่า URL ใดที่คุณถือว่าเป็น canonical และคุ้มค่าที่จะ crawl ซึ่งสำคัญที่สุดบนเว็บไซต์ขนาดใหญ่หรือเว็บไซต์ใหม่

สิ่งที่ควรรวมไว้

  • เฉพาะ URL แบบ canonical เท่านั้น — เวอร์ชันที่แน่นอนที่คุณต้องการให้จัดทำดัชนี
  • เฉพาะ URL ที่ส่งกลับสถานะ 200 และสามารถจัดทำดัชนีได้จริง (ไม่มีแท็ก noindex ไม่ถูกบล็อกโดย robots.txt)
  • วันที่ lastmod ที่ถูกต้อง — อัปเดตเฉพาะเมื่อเนื้อหาของหน้าเว็บเปลี่ยนแปลงอย่างมีนัยสำคัญเท่านั้น ไม่ใช่ทุกครั้งที่ deploy

สิ่งที่ควรตัดออก

  • หน้าที่มีแท็ก noindex — การรวมไว้ใน sitemap ส่งสัญญาณที่ขัดแย้งกัน
  • URL ที่เปลี่ยนเส้นทางหรือเป็น 404 — สิ่งเหล่านี้จะถูกรายงานเป็นข้อผิดพลาดของ sitemap แทนที่จะช่วยการค้นพบ
  • รูปแบบซ้ำหรือมีพารามิเตอร์ของหน้าเดียวกัน (ลำดับการเรียง session ID พารามิเตอร์การติดตาม) — แสดงเฉพาะเวอร์ชัน canonical เดียวเท่านั้น
  • หน้าที่สร้างอัตโนมัติและมีเนื้อหาบางมีน้อย — สิ่งเหล่านี้เป็นสาเหตุที่พบบ่อยของ"Crawled - currently not indexed" และการรวมหลายร้อยรายการจะเจือจางสัญญาณของ sitemap สำหรับหน้าที่สำคัญจริง ๆ

ขีดจำกัดขนาด

ไฟล์ sitemap เดียวจำกัดที่ 50,000 URL และ 50MB แบบไม่บีบอัด เว็บไซต์ขนาดใหญ่ต้องการไฟล์ดัชนี sitemap — ไฟล์เดียวที่แสดงรายการ sitemap ย่อยหลายไฟล์ — แทนที่จะเป็นไฟล์ขนาดใหญ่ไฟล์เดียว เฟรมเวิร์กส่วนใหญ่ (รวมถึงเว็บไซต์นี้) สร้างสิ่งนี้โดยอัตโนมัติ แต่ควรตรวจสอบหากคุณสร้างเองด้วยมือ

การส่งและดูแลรักษา

ส่งครั้งเดียวทั้งใน Google Search Console และ Bing Webmaster Tools และเพิ่มบรรทัด Sitemap: ลงใน robots.txt ของคุณเพื่อชี้ไปที่ตำแหน่งนั้น — ด้วยวิธีนี้ crawler ใดก็ตามที่พบเว็บไซต์ของคุณด้วยตัวเอง โดยไม่มีการส่งมาก่อน ก็สามารถค้นหาได้เช่นกัน หลังจากนั้น sitemap ควรสร้างใหม่โดยอัตโนมัติเมื่อเนื้อหาเปลี่ยนแปลง sitemap ที่ดูแลด้วยมือมักจะล้าสมัยเสมอ

ข้อผิดพลาดที่พบบ่อยที่แอบสิ้นเปลือง crawl budget

  • สร้างครั้งเดียวตอนเปิดตัวและไม่เคยอัปเดตเมื่อมีการเพิ่มหรือลบหน้า
  • ตั้งค่า lastmod ของทุก URL เป็นวันที่ปัจจุบันในทุกการ build — สิ่งนี้ฝึกให้ crawler หยุดเชื่อถือฟิลด์นี้ในฐานะสัญญาณการเปลี่ยนแปลงที่แท้จริง
  • ลืมส่งใหม่หลังจากปรับโครงสร้าง URL ครั้งใหญ่ (เช่น การย้ายโดเมนหรือเปลี่ยน permalink) — Google จะสังเกตเห็นเองในที่สุด แต่การส่งใหม่จะเร่งการเปลี่ยนผ่านให้เร็วขึ้น

ต้องการให้หน้าถัดไปของคุณถูกค้นพบเร็วกว่าการรอ crawl แบบทั่วไปหรือไม่?

IndexLaunch ส่งทุก URL ที่คุณส่งเข้าระบบไปยัง Bing, Yandex, Seznam และ Naver โดยตรงผ่าน IndexNow ทันทีที่คุณเพิ่มเข้าคิว

ดูราคา