สรุปสั้น ๆ (TL;DR)
- John Mueller จาก Google บอกใน Search Off the Record ตอนที่ 114 (1 ตุลาคม 2569) ว่าฟิลด์ priority และ changefreq ใน sitemap ถูกเลิกใช้แล้ว
- Mueller บอกว่า lastmod จะถูกใช้เฉพาะเมื่อวันที่ในไฟล์ดูสมเหตุสมผล การใส่วันที่ของวันนี้ให้ทุก URL จะถูกเมิน แต่ไม่ถือเป็นสแปม
- สถานะ 'Couldn't fetch' ของ sitemap ที่ถูกต้องอาจมาจาก host load หรือ crawl demand ต่ำ ซึ่ง Mueller บอกว่ามักขึ้นอยู่กับคุณภาพเว็บไซต์ตามที่ระบบรับรู้
- Mueller บอกว่าระบบของ Google ใช้ llms.txt เป็น sitemap ไม่ได้ ขณะที่ RSS feed ส่งใน Search Console ในฐานะ sitemap ได้
XML sitemap ยังสำคัญอยู่ ตามที่ John Mueller จาก Google ระบุ แต่ Google ใช้ข้อมูลในไฟล์เพียงบางส่วนเท่านั้น ในพอดแคสต์ Search Off the Record ของ Google ตอนที่ 114 ชื่อ "Do sitemaps still matter?" ซึ่งเผยแพร่เมื่อวันที่ 1 ตุลาคม 2569 Mueller บอก Martin Splitt เพื่อนร่วมทีม Search Relations ว่า Google เลิกใช้ฟิลด์ priority และ change frequency แล้ว ใช้ lastmod เฉพาะเมื่อวันที่ดูน่าเชื่อถือ และสถานะ "Couldn't fetch" ใน Search Console อาจสะท้อนคุณภาพของเว็บไซต์ ไม่ใช่แค่ไฟล์เสีย Mueller ยังบอกด้วยว่าในตอนนี้ llms.txt ใช้แทน sitemap ในระบบของ Google ไม่ได้
เนื้อหาในตอนนี้มีอะไรบ้าง
ตอนนี้ยาวประมาณ 26 นาที เผยแพร่พร้อมช่วงบท (chapter) และลิงก์ไปยังบทถอดความฉบับเต็มบนหน้าพอดแคสต์ Search Off the Record Splitt เปิดประเด็นจากอีเมลที่เขาได้รับจากเจ้าของเว็บไซต์ซึ่งเห็นข้อความเกี่ยวกับ sitemap ใน Search Console แล้วกังวล ส่วน Mueller เล่าประวัติว่า sitemap มีอายุราว 20 ปี แนวคิดนี้ถูกแชร์ไปยัง Microsoft และ Yahoo ในตอนนั้นจนกลายเป็นมาตรฐานกึ่งทางการที่ตามคำของเขา "อย่างน้อยสามบริษัทตกลงกัน" และโปรแกรมสร้าง sitemap บน Windows ที่เขาเขียนขึ้นเองคือเส้นทางที่ทำให้เขาได้มาทำงานที่ Google
Mueller บอกว่าเป้าหมายแรกเริ่มคือการค้นพบ URL เท่านั้น เว็บไซต์สมัยก่อนรกและ crawl ยาก รายการ URL พร้อมวันที่แก้ไขและลำดับความสำคัญจากเจ้าของเว็บจึงช่วยให้เครื่องมือค้นหารู้ว่าควรโฟกัสตรงไหน แต่ยังคง crawl ต่อเพื่อไม่ให้พลาดอะไร ส่วนที่เหลือของตอนอธิบายว่าแนวคิดเดิมข้อไหนที่ยังใช้ได้อยู่
ฟิลด์ใดใน sitemap ที่ Google ยังใช้
Mueller พูดตรง ๆ ถึงสองฟิลด์ที่ Google ไม่ได้พึ่งพาแล้ว เรื่อง priority เขาบอกว่าเมื่อถาม SEO ให้จัดลำดับหน้าของตัวเอง ทุก URL ก็กลายเป็นความสำคัญสูงสุด ฟิลด์นี้จึงไม่มีประโยชน์ เรื่อง change frequency เขาบอกว่าเว็บมักระบุว่าทุกหน้าใหม่ตลอด ส่วนหนึ่งเพราะหน้าเว็บแบบ dynamic ฝั่งเซิร์ฟเวอร์ถูกสร้างใหม่ทุกครั้งที่มีคนเรียก ซึ่งถูกในทางทฤษฎีแต่ไม่มีประโยชน์ เขาสรุปว่าสองฟิลด์นี้คือฟิลด์ที่ Google เลิกใช้
คู่มือการสร้าง sitemap ของ Google Search Central ก็เขียนไว้ตรงกัน ว่า Google ไม่ใช้ค่า priority และ changefreq และจะใช้ lastmod เมื่อค่านั้นถูกต้องอย่างสม่ำเสมอและตรวจสอบได้ เช่น เมื่อเทียบกับเวลาที่หน้าเว็บถูกแก้ไขครั้งล่าสุด
สิ่งที่ Google ให้ความสำคัญเป็นหลักตามคำของ Mueller คือ URL และวันที่แก้ไข โดยวันที่แก้ไขควรเป็นวันที่หน้านั้นมีการเปลี่ยนแปลงสำคัญครั้งล่าสุด Mueller อธิบายความสัมพันธ์กับ lastmod ว่าเป็นแบบ "รักบ้างเกลียดบ้าง" Google อยากใช้ แต่หลายเว็บใส่ผิด ถ้าวันที่ในไฟล์ sitemap ดูสมเหตุสมผล Google จะพยายามนำมาพิจารณา ถ้าไม่สมเหตุสมผล Google จะหันไปโฟกัสที่ URL แต่ละตัวมากกว่า และประมวลผล URL ใหม่เมื่อพบ
เขายังพูดถึงทางลัดที่พบบ่อย คือการใส่วันที่ของวันนี้ให้ทุก URL Mueller บอกว่า Google จะรู้ว่าไม่ควรโฟกัสกับวันที่เหล่านั้น แต่ไม่ได้ถือเป็นเรื่องสแปมที่ระบบสแปมจะตีตราว่าเว็บไม่ดี คำอธิบายของตอนก็สรุปไว้แบบเดียวกันว่า Google ประเมินความน่าเชื่อถือของวันที่ และจะไม่ใช้ lastmod หากไม่ถูกต้องหรือถูกใช้ในทางที่ผิด
ตารางด้านล่างสรุปสิ่งที่ทีม Search Relations ของ Google พูดถึงองค์ประกอบแต่ละส่วนของ sitemap ในตอนนี้
| องค์ประกอบของ sitemap | สิ่งที่ Google พูดในตอนที่ 114 |
|---|---|
| priority | เลิกใช้แล้ว เพราะเว็บระบุทุก URL เป็นความสำคัญสูงสุดจนไม่มีประโยชน์ |
| changefreq | เลิกใช้แล้ว เพราะเว็บแบบ dynamic รายงานว่าทุกหน้าใหม่ตลอด |
| lastmod | ใช้เมื่อวันที่ในไฟล์ดูสมเหตุสมผล ไม่ใช้เมื่อไม่ถูกต้อง และไม่มีบทลงโทษแบบสแปม |
| URL ที่ใส่ในไฟล์ | ใส่ URL เวอร์ชัน canonical โดยไม่มีพารามิเตอร์ติดตามหรือ timestamp |
| ขีดจำกัดขนาด | 50,000 URL และ 50 MB แบบไม่บีบอัดต่อไฟล์ ไฟล์ index ซ้อนได้ชั้นเดียว |
เว็บไซต์ขนาดเล็กจำเป็นต้องมี sitemap ไหม
Mueller บอกว่าเว็บไซต์ขนาดเล็ก "น่าจะไม่จำเป็นต้องมี sitemap" เพราะ Google crawl ได้เองอยู่แล้ว แต่เขาก็ยอมรับว่าเจ้าของเว็บตัดสินเส้นแบ่งได้ยาก ไม่ว่าจะมี 10 หน้าหรือ 50 หน้า คำแนะนำเชิงปฏิบัติของเขาคือเปิด sitemap ไว้ เพราะระบบจัดการเนื้อหาเกือบทั้งหมด รวมถึงระบบโฮสต์เว็บแบบ static สร้างไฟล์ sitemap ให้เป็นค่าเริ่มต้นอยู่แล้ว และการมี sitemap บนเว็บเล็กไม่มีผลเสีย ไม่ว่าเว็บจะโตขึ้นหรือเล็กอยู่อย่างนั้น
เว็บที่ได้ประโยชน์ชัดเจนตามที่เขาเล่าคือเว็บที่มีเนื้อหาจำนวนมากและเปลี่ยนแปลงสม่ำเสมอ เขายกตัวอย่างเว็บข่าว ซึ่งมี news sitemap แยกต่างหาก และเท่าที่เขาจำได้ ผู้เผยแพร่ควรใส่เฉพาะ 1,000 หน้าล่าสุดที่มีการเปลี่ยนแปลง เขายังยกตัวอย่างอีคอมเมิร์ซด้วย หากราคาสินค้าเปลี่ยน การ crawl ตามปกติอาจรู้ช้าไป แต่ถ้า sitemap บอกว่าหน้าสินค้านั้นเปลี่ยนแล้ว Google ก็ไปที่หน้านั้นได้โดยตรง
URL แบบ canonical ขีดจำกัดขนาด และชื่อไฟล์
Splitt ถามว่าการเติม timestamp ลงใน URL ใน sitemap จะบังคับให้ Google ใช้เวอร์ชันล่าสุดได้ไหม Mueller ตอบว่าไม่ได้ sitemap ควรมี URL ที่เว็บต้องการให้เป็น canonical ในรูปแบบที่ต้องการให้ถูกจัดทำดัชนี ไม่ใช่ URL ที่ติดแท็กติดตามภายในหรือวันที่ ถ้า URL ที่ดูเป็น static มีวันที่ต่อท้าย Google ก็จะพยายามจัดทำดัชนีเวอร์ชันที่ไม่มีวันที่เป็น canonical อยู่ดี เขาเสริมว่า Google ใช้ไฟล์ sitemap ประกอบการเลือก canonical ด้วย หากพบ URL ที่คล้ายกันหลายตัวและหนึ่งในนั้นอยู่ใน sitemap โอกาสที่ Google จะเลือก URL นั้นเป็น canonical ก็จะสูงขึ้นเล็กน้อย
เรื่องขีดจำกัด Mueller ให้ตัวเลข 50,000 URL และ 50 MB ต่อไฟล์ โดย 50 MB วัดจากขนาดก่อนบีบอัด แม้ไฟล์จะถูก gzip ไว้ก็ตาม คำอธิบายของตอนก็ระบุตัวเลขเดียวกัน เจ้าของเว็บส่งไฟล์ sitemap ใน Search Console ได้ไม่จำกัดจำนวน อ้างอิงไว้ใน robots.txt ได้ และใช้ไฟล์ sitemap index ที่ลิงก์ไปยัง sitemap อื่นได้ แต่ซ้อนได้เพียงชั้นเดียว ช่วงท้ายตอน Splitt ระบุว่าใส่ hreflang ใน sitemap ได้ด้วย และ Mueller เสริมว่าส่วนขยายสำหรับรูปภาพและวิดีโอยังรองรับอยู่ แม้เขาจะไม่แน่ใจว่ายังสำคัญแค่ไหน เพราะตอนนี้ Google จดจำรูปภาพและวิดีโอบนหน้าเว็บได้ง่ายขึ้นแล้ว
ชื่อไฟล์ยืดหยุ่นได้ Mueller บอกว่า sitemap ไม่จำเป็นต้องชื่อ sitemap.xml และพูดติดตลกว่าจะตั้งชื่อตามแมวของ Splitt ก็ได้ เจ้าของเว็บบางรายเลือกตั้งชื่อแปลก ๆ และไม่ใส่ไว้ใน robots.txt เพื่อไม่ให้คนอื่นหาเจอ ซึ่งเขาบอกว่าทำได้ แต่มีข้อแลกเปลี่ยน คือต้องส่งไฟล์ให้ Google โดยตรงผ่าน Search Console และต้องส่งให้ Bing แยกต่างหาก
RSS feed, AI crawler และ llms.txt
Mueller บอกว่า RSS feed ใช้เป็น sitemap ได้ และส่งใน Search Console ในฐานะ sitemap ได้ ความต่างอยู่ที่ขอบเขต feed มักแสดงเพียง URL ที่เปลี่ยนล่าสุด 10 หรือ 20 รายการพร้อมวันที่ ระบบจึงเห็นการเปลี่ยนแปลงล่าสุดได้โดยไม่ต้องไล่อ่านไฟล์ sitemap ทุกไฟล์ของเว็บขนาดใหญ่ เขาบอกว่าทั้งสองแบบมีประโยชน์ในการหาหน้าใหม่และหน้าที่อัปเดต
ข้อแลกเปลี่ยนเรื่องชื่อไฟล์ใช้กับ AI crawler เช่นกัน Mueller บอกว่า crawler ที่เก็บข้อมูลไปเทรน AI มักไม่มีหน้าคอนโซลให้เจ้าของเว็บส่ง sitemap ดังนั้นถ้าอยากให้เนื้อหาถูกนำไปใช้ ก็ควรใช้ชื่อมาตรฐาน sitemap.xml หรือพึ่ง RSS feed เขาบอกว่าเคยเห็น AI crawler เข้ามาอ่านทั้งไฟล์ sitemap และไฟล์ RSS ใน server log ของเขาเอง แต่ก็ระบุว่าไม่รู้ว่า crawler เหล่านั้นมีเอกสารอธิบายเรื่องนี้ไว้หรือไม่ และไม่ได้บอกชื่อ crawler สำหรับเว็บที่ใส่ใจการมองเห็นในระบบ AI นี่เป็นหนึ่งในไม่กี่ประเด็นที่จับต้องได้และทำได้ง่ายจากตอนนี้ และเป็นส่วนหนึ่งของงาน GEO (Generative Engine Optimization) ในภาพรวม
เรื่อง llms.txt Splitt ถามว่าจะมาแทน XML sitemap ได้ไหม Mueller ตอบสั้น ๆ ว่า "ไม่" เขาอธิบายว่า llms.txt เป็นไฟล์ markdown ที่บางครั้งมีลิงก์ ใกล้เคียงกับ HTML sitemap มากกว่า XML sitemap และบอกว่า "ความหวังใหญ่กว่าความจริง" ระบบของ Google ใช้ไฟล์นี้เป็น sitemap ไม่ได้เพราะไม่มีรูปแบบที่เข้มงวด และเขาบอกว่าตอนนี้ยังไม่มีสิ่งใดในนั้นเกิดขึ้นจริง แม้ในอนาคตระบบค้นหาอาจประมวลผลไฟล์ markdown ได้ คำแนะนำของเขาคือให้โฟกัสกับสิ่งที่ใช้ได้และมีเอกสารรองรับอยู่ตอนนี้ และไม่ควรพึ่งพาหรือให้ความสำคัญกับ llms.txt แม้ CMS จะสร้างไฟล์ให้อัตโนมัติก็ตาม
HTML sitemap ก็ได้คำตอบคล้ายกัน Mueller บอกว่าเป็นแผนผังสำหรับผู้ใช้ crawl ได้เหมือนหน้าลิงก์ทั่วไป แต่ส่งหรือประมวลผลในฐานะไฟล์ sitemap ไม่ได้ และมักแสดงแค่หมวดหมู่ ไม่ได้ลงรายการสินค้าทุกชิ้น
ทำไม Search Console ขึ้น "Couldn't fetch" ทั้งที่ sitemap ถูกต้อง
คำถามที่เปิดตอนนี้ถูกตอบเป็นเรื่องสุดท้าย Splitt ยกกรณี sitemap ที่ผ่านการตรวจรูปแบบ เข้าถึงได้แบบสาธารณะ และอยู่ใน robots.txt แต่ Search Console กลับรายงานว่าดึงไฟล์ไม่ได้ Mueller บอกว่า Google เห็นกรณีนี้บ่อยในฟอรัม และมีสาเหตุหลักสองข้อ
- Host load ระบบของ Google อาจไม่มีเวลาดึง sitemap เพราะกำลังยุ่งกับงานอื่น และกรณีนี้จะถูกรายงานว่า "Couldn't fetch"
- Crawl demand หากระบบของ Google ตัดสินว่าไม่จำเป็นต้อง crawl เว็บนั้นมาก ก็อาจข้าม sitemap ไปเพราะมีข้อมูลพอแล้ว Mueller บอกว่า crawl demand มักขึ้นอยู่กับคุณภาพของเว็บไซต์ตามที่ระบบรับรู้ และเรื่องนี้มีผลอย่างมากต่อปริมาณที่ Google crawl และจัดทำดัชนี
เขาบอกว่า "จึงไม่ใช่เรื่องเทคนิคล้วน ๆ" บางครั้งระบบของ Google ประเมินว่าคุณภาพโดยรวมของเว็บไม่ได้ดีนัก จึงไม่ใช้เวลา crawl มากและไม่สนใจ sitemap ในตอนนั้น หากคุณภาพดีขึ้นอย่างชัดเจนเมื่อเวลาผ่านไป Google ก็จะกลับไปใช้ไฟล์นั้น คำอธิบายของตอนสรุปว่าสาเหตุมักเป็นการจำกัดตาม host load หรือ crawl demand ต่ำที่ผูกกับคุณภาพของเว็บไซต์ตามที่ระบบรับรู้
สำหรับคนทำงาน เรื่องนี้เปลี่ยนลำดับการแก้ปัญหา หากขึ้น "Couldn't fetch" ต่อเนื่องกับไฟล์ที่ถูกต้องและเข้าถึงได้ ควรดู crawl stats และคุณภาพเนื้อหาด้วย ไม่ใช่แค่ตรวจ XML ซ้ำ เมื่อไฟล์ไม่มีปัญหา ขั้นต่อไปที่เหมาะคือ SEO audit ที่ครอบคลุมการจัดทำดัชนี crawl stats และเนื้อหาที่บางหรือซ้ำซ้อน
ความหมายสำหรับนักการตลาดไทย
ส่วนนี้เป็นการวิเคราะห์โดยนำไปใช้กับตลาดไทย ในตอนนี้ไม่มีเนื้อหาที่เจาะจงประเทศไทย คำแนะนำของ Mueller ใช้ได้ทั่วโลก และนำมาใช้กับเว็บไทยได้โดยตรงหลายจุด Mueller บอกว่า CMS เกือบทั้งหมดสร้าง sitemap ให้เป็นค่าเริ่มต้น สำหรับเว็บไทยที่ใช้ CMS แบบนี้ สิ่งแรกที่ควรเช็กจึงเป็นว่าค่า lastmod สะท้อนการแก้ไขจริง หรือเป็นแค่วันที่ระบบสร้างไฟล์ เว็บสองภาษาไทยและอังกฤษที่จัดการ hreflang ผ่าน sitemap ทำต่อได้ เพราะ Splitt ระบุในตอนนี้ว่าใส่ hreflang ใน sitemap ได้
เว็บอีคอมเมิร์ซไทยที่ปรับราคาช่วงเทศกาล 11.11 และ 12.12 ตรงกับตัวอย่างอีคอมเมิร์ซของ Mueller พอดี การใส่ lastmod ที่ถูกต้องให้หน้าสินค้าที่เปลี่ยนคือสัญญาณที่เขาอธิบายไว้ สำนักข่าวไทยควรเช็กว่า news sitemap มีเฉพาะบทความที่เปลี่ยนล่าสุด และเจ้าของเว็บไทยที่เห็น "Couldn't fetch" ใน Search Console ควรมองว่าอาจเป็นสัญญาณเรื่องคุณภาพตามที่ Mueller บอก ก่อนจะลงมือสร้างไฟล์ใหม่ ทีมที่ดูแล SEO ในประเทศไทย สามารถรวมจุดเช็กเหล่านี้เข้าไปในการตรวจเทคนิคตามรอบปกติได้
สิ่งที่ตอนนี้ไม่ได้บอก
- ไม่มีการประกาศเอกสารใหม่ของ Google หรือฟีเจอร์ใหม่ใน Search Console เพราะนี่เป็นการพูดคุยในพอดแคสต์
- Mueller ไม่ได้ให้ตัวเลขว่าเว็บต้องมีกี่หน้าจึงนับว่า "เล็ก"
- เขาไม่ได้บอกว่า Google วัดอย่างไรว่าวันที่ lastmod ในไฟล์สมเหตุสมผล
- เขาไม่ได้บอกชื่อ AI crawler ที่เห็นใน log และไม่ได้บอกว่า crawler เหล่านั้นใช้ข้อมูล sitemap อย่างไร
คำถามที่พบบ่อยเกี่ยวกับ XML sitemap จาก Google
Google ยังใช้แท็ก priority และ changefreq ใน sitemap อยู่ไหม?
ไม่ใช้แล้ว John Mueller บอกใน Search Off the Record ตอนที่ 114 เมื่อวันที่ 1 ตุลาคม 2569 ว่า priority และ change frequency คือสองฟิลด์ที่ Google เลิกใช้ ปัจจุบัน Google ใช้ URL และวันที่ lastmod เป็นหลัก
ใส่วันที่ lastmod ผิดจะโดนลงโทษไหม?
ไม่โดน Mueller บอกว่าการใส่วันที่ของวันนี้ให้ทุก URL ไม่ได้ถือเป็นเรื่องสแปม แต่ Google จะเลิกพึ่งวันที่เหล่านั้น lastmod จะถูกใช้เฉพาะเมื่อวันที่ในไฟล์ดูสมเหตุสมผล
ทำไม Search Console ขึ้น "Couldn't fetch" ทั้งที่ sitemap ถูกต้อง?
Mueller ให้สาเหตุหลักสองข้อ คือ Google อาจยุ่งเกินกว่าจะดึงไฟล์เพราะ host load หรือ crawl demand ของเว็บต่ำ ซึ่งเขาบอกว่ามักขึ้นอยู่กับคุณภาพของเว็บไซต์ตามที่ระบบรับรู้ หากคุณภาพดีขึ้นอย่างชัดเจน Google จะกลับมาใช้ sitemap
llms.txt ใช้แทน XML sitemap ได้ไหม?
ไม่ได้ Mueller บอกว่าระบบของ Google ใช้ llms.txt เป็น sitemap ไม่ได้เพราะไม่มีรูปแบบที่เข้มงวด และตอนนี้ยังไม่มีสิ่งใดในนั้นเกิดขึ้นจริง เขาแนะนำไม่ให้พึ่งพาหรือให้ความสำคัญกับไฟล์นี้
เว็บไซต์ขนาดเล็กต้องมี sitemap ไหม?
น่าจะไม่จำเป็น Mueller บอกว่า Google crawl เว็บเล็กได้เอง แต่เขาแนะนำให้เปิด sitemap ที่ CMS สร้างให้ไว้ เพราะการมีไฟล์นี้ไม่มีผลเสีย
ขั้นต่อไป
จากตอนนี้ได้เช็กลิสต์สั้น ๆ ดังนี้ ยืนยันว่า sitemap มีเฉพาะ URL แบบ canonical เช็กว่า lastmod สะท้อนการเปลี่ยนแปลงจริง พิจารณาส่ง RSS feed สำหรับการอัปเดตล่าสุด ถือว่า llms.txt เป็นแค่การทดลอง และมองการขึ้น "Couldn't fetch" ต่อเนื่องเป็นสัญญาณให้ทบทวนคุณภาพเว็บไซต์ ทีมที่อยากให้มีคนช่วยตรวจอีกแรง เริ่มได้จากการรีวิวเชิงเทคนิคของข้อมูลการจัดทำดัชนีและการ crawl







