Claude AI หลุดข้อมูลแชทส่วนตัวบน Google และ Bing จากช่องโหว่การตั้งค่าความเป็นส่วนตัว
สิ่งที่หลายคนเชื่อว่าเป็นการสนทนาลับระหว่างมนุษย์กับ AI อาจไม่ได้เป็นความลับเสมอไป เมื่อล่าสุดมีการค้นพบว่าบทสนทนาจาก Claude แชทบอทชื่อดังจากค่าย Anthropic บางส่วน ถูกนำไปแสดงผลบนหน้าการค้นหาของ Google และ Bing อย่างน่าตกใจ
เหตุการณ์นี้ถูกเปิดเผยโดยผู้ใช้งานใน Reddit ที่พบว่าข้อมูลการแชทที่ควรจะเป็นส่วนตัว กลับปรากฏขึ้นมาให้ใครก็ได้ค้นหาเจอ ซึ่งเนื้อหาที่หลุดออกมามีตั้งแต่การขอคำแนะนำเรื่องพรรคการเมือง ข้อสงสัยทางกฎหมายเกี่ยวกับจริยธรรมของทนายความในรัฐแคนซัส ไปจนถึงการสวมบทบาทสมมติในเชิงอีโรติก
สาเหตุที่ทำให้แชทส่วนตัวกลายเป็นสาธารณะ
ต้นตอของปัญหานี้เกิดจากฟีเจอร์ "Snapshots" ของ Claude ที่อนุญาตให้ผู้ใช้สร้าง URL สาธารณะเพื่อแชร์บทสนทนาเฉพาะส่วนให้ผู้อื่นเข้าถึงได้ ซึ่งตามหลักการแล้ว Anthropic ได้พยายามป้องกันไม่ให้ Search Engine นำลิงก์เหล่านี้ไปทำดัชนี (Index) โดยการใช้ไฟล์ robots.txt
robots.txt คือไฟล์ข้อความมาตรฐานที่เจ้าของเว็บไซต์ใช้เพื่อบอก Web Crawler (โปรแกรมอัตโนมัติที่ Search Engine ใช้เก็บข้อมูลเว็บ) ว่าส่วนใดของเว็บไซต์ที่อนุญาตหรือไม่อนุญาตให้เข้าถึง ซึ่ง Anthropic ได้ระบุห้ามเข้าถึงหน้าแชทที่แชร์มาตั้งแต่เดือนกันยายน 2025
อย่างไรก็ตาม การใช้เพียง robots.txt นั้นไม่เพียงพอ เพราะทั้ง Google และ Bing มีเงื่อนไขทางเทคนิคที่ซับซ้อนกว่านั้น:
- Bing: ระบุในเอกสารทางเทคนิคว่า แม้จะใช้ robots.txt บล็อก Crawler ได้ แต่ผู้พัฒนาควรใส่แท็ก "noindex" ในแต่ละหน้าเว็บด้วยเพื่อป้องกันการแสดงผลในผลการค้นหา
- Google: จะเพิกเฉยต่อคำสั่งใน robots.txt ทันที หากหน้านั้นมีลิงก์จากเว็บไซต์อื่นเชื่อมโยงมาหา และไม่มีการใส่แท็ก "noindex" หรือ "x-robots-tag" ในส่วนหัวของคำตอบ (Response Header)
จากการตรวจสอบของ WIRED พบว่าหน้าแชทของ Claude ที่หลุดออกมานั้น ไม่มีการใส่แท็ก "noindex" ตามที่ Search Engine ยักษ์ใหญ่ทั้งสองแนะนำ ทำให้ข้อมูลเหล่านี้ถูกดึงไปแสดงผลได้
การตอบโต้จากผู้เกี่ยวข้อง
โฆษกของ Anthropic ชี้แจงว่าบริษัทให้สิทธิ์ผู้ใช้ในการควบคุมการแชร์บทสนทนา และไม่ได้ส่งแผนผังเว็บไซต์ (Sitemap) ให้กับ Search Engine โดยเน้นย้ำว่าลิงก์เหล่านี้ไม่สามารถเดาสุ่มได้ และจะเข้าถึงได้ก็ต่อเมื่อผู้ใช้เลือกแชร์ด้วยตนเอง ซึ่งเมื่อแชร์แล้ว เนื้อหานั้นจะกลายเป็นสาธารณะและอาจถูกบริการภายนอกจัดเก็บข้อมูลไว้
ด้าน Google ยืนยันว่าเรื่องนี้เป็นความรับผิดชอบของ Anthropic โดยระบุว่า Search Engine ไม่ได้ควบคุมว่าหน้าใดจะถูกทำให้เป็นสาธารณะ แต่จะปฏิบัติตามคำสั่งควบคุมที่เจ้าของเว็บไซต์ตั้งค่าไว้เท่านั้น
| เครื่องมือ | หน้าที่หลัก | ประสิทธิภาพในการป้องกัน |
|---|---|---|
| robots.txt | บอก Crawler ว่าห้ามเข้าถึงส่วนใดของเว็บ | ต่ำ (อาจถูกละเลยหากมีลิงก์ภายนอกเชื่อมมา) |
| noindex tag | สั่งห้าม Search Engine นำหน้านี้ไปแสดงผล | สูง (เป็นมาตรฐานที่ Google และ Bing ยอมรับ) |
ข้อเท็จจริงสำคัญ
- แชท Claude หลุดสู่สาธารณะผ่านฟีเจอร์การสร้างลิงก์แชร์ (Shared URLs)
- Anthropic ใช้เพียง robots.txt ซึ่งไม่สามารถป้องกันการดัชนีข้อมูลได้สมบูรณ์แบบ
- Google และ Bing แนะนำให้ใช้แท็ก noindex ควบคู่ไปด้วยเพื่อความปลอดภัย
- บริษัท AI หลายแห่ง (Anthropic, Meta, OpenAI) ใช้ robots.txt เพื่อบล็อก Crawler ของคู่แข่งไม่ให้นำข้อมูลไปเทรน AI
- ผู้ใช้ Claude สามารถจัดการความเป็นส่วนตัวได้ที่เมนู Settings > Privacy > Shared chats
คำถามที่พบบ่อย
ทำไมการใช้ robots.txt ถึงป้องกันข้อมูลหลุดไม่ได้ 100%?
เพราะ robots.txt เป็นเพียงคำแนะนำสำหรับ Crawler แต่หาก Search Engine พบลิงก์ที่เชื่อมโยงมายังหน้านั้นจากแหล่งอื่น พวกเขาสามารถนำเนื้อหาในหน้านั้นไปแสดงผลในผลการค้นหาได้ หากไม่มีแท็ก noindex กำกับไว้ในตัวหน้าเว็บเอง
ข้อมูลแชทของฉันจะหลุดได้ในกรณีใดบ้าง?
ข้อมูลจะมีความเสี่ยงหากคุณใช้ฟีเจอร์ "แชร์บทสนทนา" โดยการสร้าง URL สาธารณะ ซึ่งทำให้เนื้อหานั้นเข้าถึงได้ผ่านอินเทอร์เน็ต และอาจถูก Search Engine หรือบริการจัดเก็บข้อมูลภายนอกบันทึกไว้
บริษัท AI ใช้ robots.txt ทำอะไรอีกบ้างนอกจากการป้องกันความเป็นส่วนตัว?
บริษัทอย่าง OpenAI, Meta และ Anthropic ใช้ไฟล์นี้เพื่อสั่งห้ามไม่ให้ Web Crawler ของบริษัทคู่แข่งเข้ามาเก็บข้อมูลในหน้าแชทบอท เพื่อป้องกันไม่ให้คู่แข่งนำข้อมูลไปใช้ในการฝึกฝน (Training) โมเดล AI ของตนเอง
ฉันจะป้องกันไม่ให้แชทของฉันหลุดได้อย่างไร?
วิธีที่ปลอดภัยที่สุดคือหลีกเลี่ยงการสร้างลิงก์แชร์สาธารณะสำหรับข้อมูลที่สำคัญ และสามารถเข้าไปตรวจสอบหรือลบลิงก์ที่เคยแชร์ไว้ได้ที่เมนู Settings > Privacy > Shared chats ภายในแอปพลิเคชัน Claude



