อ่านประมาณ 7 นาที
ระดับกลาง
หมวด: เว็บ
อ้างอิง: Cloudflare Blog — Have it both ways: stay discoverable in search while disallowing AI training
เจ้าของเว็บจำนวนมากติดอยู่กับทางเลือกที่แย่ทั้งสองทาง คือยอมให้บอตของ Google หรือ Bing เอาเนื้อหาไปฝึก AI ด้วย หรือไม่ก็บล็อกบอตนั้นแล้วหายไปจากผลค้นหา เพราะบอตตัวเดียวกันทำทั้งสองหน้าที่ Cloudflare เสนอทางออกเมื่อวันที่ 15 กันยายน 2026 ด้วยการกำหนดสถานะ Accountable ให้ผู้ให้บริการบอตที่แยกสองหน้าที่นี้ออกจากกันได้จริง พร้อมตัวเลือกใหม่ในแดชบอร์ดที่ให้บล็อกการฝึก AI โดยยังอยู่ในผลค้นหาต่อไป บทความนี้อธิบายว่ากลไกนี้ทำงานอย่างไร ต้องเขียน robots.txt แบบไหน และเว็บธุรกิจไทยที่อยากถูก AI อ้างอิงควรตัดสินใจอย่างไร ซึ่งคำตอบไม่ใช่การบล็อกเสมอไป
ปัญหาบอตสองหน้าที่
Googlebot, Bingbot และ Applebot เป็นบอตแบบผสม คือไต่เว็บเพื่อสร้างดัชนีค้นหาและอาจนำเนื้อหาไปฝึกโมเดล AI ด้วย ถ้าเจ้าของเว็บบล็อกบอตทั้งตัว ก็เท่ากับหายจากผลค้นหา ตัวเลขของ Cloudflare สะท้อนความอึดอัดนี้ชัด คือเว็บราว 17 เปอร์เซ็นต์บนเครือข่ายเลือกเปิดกลไกบล็อกการฝึก AI บางอย่าง แต่มีไม่ถึง 1 เปอร์เซ็นต์ที่กล้าบล็อกบอตค้นหา
ทำไมเรื่องนี้จึงกระทบรายได้ Cloudflare อ้างข้อมูลว่าผู้ใช้ที่อ่านสรุปจาก AI มีแนวโน้มจบการค้นหาโดยไม่คลิกเข้าเว็บใดเลยสูงขึ้นกว่า 40 เปอร์เซ็นต์ ในขณะเดียวกันคนที่ถูก AI ส่งมาที่เว็บกลับมีอัตราเปลี่ยนเป็นลูกค้าสูงกว่าคนจากผลค้นหาแบบเดิม 3 ถึงกว่า 5 เท่า ดังนั้นเจ้าของเว็บจึงต้องการควบคุมได้ละเอียดว่าจะให้ AI ใช้เนื้อหาแบบไหน ไม่ใช่เปิดหรือปิดทั้งหมด
สถานะ Accountable คืออะไร
Cloudflare ให้สถานะนี้แก่ผู้ให้บริการบอตที่ทำได้หรือให้คำมั่นชัดเจนใน 4 เรื่อง คือ มีช่องทางให้ปฏิเสธการนำไปฝึก AI ผ่าน robots.txt หรือมาตรฐานเทียบเท่า มีตัวเลือกปฏิเสธการนำไปทำสรุปด้วย AI (มีแล้วหรือจะมีภายในต้นปี 2027) ให้ข้อมูลระดับ URL ว่าหน้าไหนถูกใช้ฝึกและมีสถิติการค้นหาอย่างไร และรับประกันว่าการปฏิเสธการฝึกจะไม่กระทบอันดับในผลค้นหา
ผู้ให้บริการบอตที่ Cloudflare จัดเป็น Accountable ณ 15 ก.ย. 2026 กลุ่ม ผู้ให้บริการ ความหมาย บอตสองหน้าที่ที่แยกได้ Google (Googlebot) · Microsoft (Bingbot) · Apple (Applebot) ปฏิเสธการฝึกได้โดยยังอยู่ในผลค้นหา บอตฝึกอย่างเดียว Amazon · Anthropic · Meta · OpenAI บอตฝึกแยกจากบอตค้นหาอยู่แล้ว จึงไม่มีปัญหาต้องแลก
เขียน robots.txt อย่างไร
สำหรับ Google และ Apple ใช้ชื่อบอตเฉพาะสำหรับการฝึก คือ Google-Extended และ Applebot-Extended ซึ่งเป็นสัญญาณควบคุมการนำไปฝึกโดยไม่แตะบอตค้นหาหลัก ส่วน Bing ตอนนี้ยังใช้แท็ก NOARCHIVE ในหน้าเว็บ และตั้งเป้ารองรับผ่าน robots.txt ภายในต้นปี 2027
ตัวอย่างการตั้งค่าเพื่อปฏิเสธการฝึก AI แต่ยังให้ค้นหาได้ ผู้ให้บริการ วิธี Google ใน robots.txt: User-agent: Google-Extended ตามด้วย Disallow: / · Googlebot ยังไต่ตามปกติ Apple ใน robots.txt: User-agent: Applebot-Extended ตามด้วย Disallow: / Bing ตอนนี้ใช้ <meta name="robots" content="noarchive"> ในหน้า · robots.txt ต้นปี 2027
ข้อจำกัดของ robots.txt คือเป็นแค่คำขอ บอตที่ไม่ประสงค์ดีไม่สนใจอยู่แล้ว Cloudflare จึงเพิ่มการบังคับที่ระดับเครือข่าย โดยเผยแพร่ความต้องการของเว็บใน robots.txt ระบุตัวตนผู้ให้บริการบอตและจัดประเภทพฤติกรรม บล็อกบอตที่ไม่ทำตาม แล้วรายงานผลการปฏิบัติตามจริงของแต่ละรายผ่าน Cloudflare Radar
ตัวเลือกใหม่ในแดชบอร์ด Cloudflare
ตัวเลือกควบคุมบอต AI ระดับโดเมน (เปิดให้ใช้ 15 ก.ย. 2026) ตัวเลือก ผล Allow ปล่อยบอตทุกตัว เว้นที่บล็อกไว้ที่อื่น Disallow AI Training บอตสองหน้าที่ที่ Accountable ยังไต่เพื่อค้นหาได้ · บอตฝึกอื่นถูกบล็อก Block on pages with ads บล็อกบอตฝึกเฉพาะหน้าที่มีโฆษณา Block บล็อกทุกตัว รวมบอตค้นหา = หายจากผลค้นหา
Cloudflare ระบุว่าจะทำงานร่วมกับ IETF ในมาตรฐานที่กำลังร่าง เช่น ai-prefs เพื่อให้สัญญาณเหล่านี้ใช้ได้ข้ามผู้ให้บริการ ไม่ผูกกับเครือข่ายใดเครือข่ายหนึ่ง
เว็บธุรกิจไทยควรเลือกอะไร
คำตอบขึ้นกับว่าเว็บหากินจากอะไร เว็บสำนักข่าวหรือเว็บที่ขายเนื้อหาโดยตรงมีเหตุผลชัดที่จะปฏิเสธการฝึก AI เพราะเนื้อหาคือสินค้า แต่เว็บบริษัทที่ต้องการให้ลูกค้าหาเจอ รวมถึงถูกอ้างอิงในคำตอบของ ChatGPT, Copilot หรือ Gemini อยู่ในสถานการณ์ตรงข้าม การบล็อกบอตของผู้ให้บริการ AI ทั้งหมดอาจทำให้เว็บหายไปจากคำตอบที่ลูกค้าถาม AI ซึ่งข้อมูลของ Cloudflare เองบอกว่าเป็นช่องทางที่เปลี่ยนเป็นลูกค้าได้สูงที่สุด
แนวทางที่เหมาะกับเว็บบริการส่วนใหญ่คือ เปิดให้บอตค้นหาและบอตของ answer engine เข้าถึงหน้าบริการและบทความ ใช้ Google-Extended หรือ Applebot-Extended เฉพาะเมื่อมีเนื้อหาที่ไม่อยากให้ถูกนำไปฝึกจริง ๆ และตรวจใน Cloudflare Radar หรือ log ของตัวเองว่าบอตตัวไหนมาจริง ก่อนตัดสินใจบล็อกจากความกลัวอย่างเดียว ที่สำคัญคือ robots.txt ที่มีหลายกลุ่ม User-agent ต้องเขียนกฎให้ตรงกันทุกกลุ่ม เพราะบอตที่มีกลุ่มของตัวเองจะไม่อ่านกฎของกลุ่มทั่วไปเลย
ทีมงาน Smart Cyber Tech รับทำเว็บไซต์ ที่วางโครงสร้าง robots.txt, sitemap และข้อมูลเชิงโครงสร้างให้เว็บถูกค้นเจอทั้งใน Google และใน answer engine ของ AI พร้อมตั้งค่าการควบคุมบอตบน Cloudflare ให้ตรงกับเป้าหมายธุรกิจ ปรึกษาได้ที่ แบบฟอร์มติดต่อ
สรุปสาระสำคัญ ปัญหาบอตสองหน้าที่ สถานะ Accountable คืออะไร เขียน robots.txt อย่างไร
แหล่งอ้างอิง เรียบเรียงจาก Cloudflare Blog — Have it both ways: stay discoverable in search while disallowing AI training —
อ่านบทความต้นฉบับ ภาพปก: Cloudflare Blog · ลิขสิทธิ์ภาพเป็นของเจ้าของต้นฉบับ ใช้ประกอบการรายงานพร้อมอ้างอิงแหล่งที่มา
มีคำถามเพิ่มเติมเกี่ยวกับบทความนี้? เขียนหาเราได้ที่
info@smart-cyber-tech.com
บริการที่เกี่ยวข้องจากทีมงาน Smart Cyber Tech
แบ่งปันบทความนี้:
LINE
Facebook
X
คัดลอกลิงก์
ปรึกษาทีมของเรา