Technical SEO
Noindex คืออะไร
Noindex คือคำสั่ง (meta robots tag หรือ HTTP header) ที่บอก search engine ไม่ให้นำหน้าเว็บนั้นเข้าสู่ index แม้ว่าจะสามารถ crawl หน้านั้นได้ก็ตาม
เหมาะกับหน้าที่ไม่มีคุณค่าในการค้นหา เช่น หน้าขอบคุณ (thank-you page), หน้าผลการค้นหาภายในเว็บ หรือหน้าคลังแท็กที่มีเนื้อหาน้อย พึงระวังว่าหน้าที่ถูกบล็อกใน robots.txt จะไม่สามารถถูก crawl ได้ ดังนั้น search engine อาจไม่เห็นคำสั่ง noindex เลย หากต้องการให้ลบออกจาก index ได้อย่างแน่นอน ควรอนุญาตให้ crawl ได้แล้วใส่ noindex
แท็กนี้ต้องการสิทธิ์ crawl จึงจะทำงาน ถ้าบล็อกหน้าใน robots.txt ตัว crawler จะไม่มีวันเห็น noindex และ URL ค้างใน index ได้หลายเดือน โผล่พร้อมคำอธิบายว่าไม่มีข้อมูล ให้เอาออกจาก index ก่อน แล้วค่อยบล็อกถ้ายังจำเป็น อีกกับดักคือหน้า noindex นาน ๆ จะถูก crawl น้อยลงเรื่อย ๆ จนลิงก์ในหน้าไม่ถูกตาม หน้าที่ควรส่งพลังลิงก์ภายในต่อโดยไม่เข้า index เอง มักเหมาะกับ canonical มากกว่า
ตัวอย่าง
ร้านออนไลน์มีระบบค้นหาในเว็บที่สร้าง URL อย่าง /search?q=รองเท้าแดง หน้าผลลัพธ์บาง ๆ หลายพันหน้าถูก index และเจือจางทั้งเว็บ พอใส่ noindex ที่ template การค้นหา หน้าเหล่านั้นหลุดจาก index ของ Google ภายในไม่กี่สัปดาห์โดยที่ผู้ใช้ยังใช้งานได้ปกติ และหน้าหมวดหมู่เข้ามารับอันดับที่เคยถูกเศษหน้าพวกนั้นแบ่งไป
คำถามที่พบบ่อย
- ทำไมหน้า noindex ยังโผล่ใน Google
- ส่วนใหญ่เพราะ robots.txt บล็อกหน้านั้นอยู่ crawler จึงไม่เคยเห็นแท็ก ให้เปิดการ crawl ปล่อยให้ noindex ถูกอ่าน แล้ว URL จะหลุดไปในรอบ crawl ถัด ๆ ไป อีกสาเหตุคือแค่รอจังหวะ recrawl
- หน้าไหนควรใส่ noindex
- หน้าที่ไม่มีคุณค่าการค้นหา ผลค้นหาภายในเว็บ tag archive บาง ๆ หน้า thank you หน้าตัวกรองซ้ำ ของหลงเหลือจาก staging ส่วนหน้าเงินและหน้าที่มีลิงก์เข้าห้ามใส่เด็ดขาด noindex หลงบน template คือฆาตกร traffic แบบเงียบคลาสสิก
คำศัพท์ที่เกี่ยวข้อง
กำลังทำเรื่อง Noindex อยู่ใช่ไหม? ดูว่าการตรวจสอบ SEO (SEO Audit)ของเราช่วยคุณได้อย่างไร
ดูการตรวจสอบ SEO (SEO Audit)