Poe AI กับประเด็นละเมิดลิขสิทธิ์ การดึงข้อมูลจากเว็บไซต์ที่ต้องชำระเงิน
ในยุคที่ปัญญาประดิษฐ์เติบโตอย่างรวดเร็ว ประเด็นเรื่องทรัพย์สินทางปัญญากลายเป็นข้อพิพาทสำคัญ ล่าสุด Poe แพลตฟอร์มแชตบอต AI ภายใต้การดูแลของ Quora (เว็บไซต์ถาม-ตอบชื่อดัง) ซึ่งได้รับการสนับสนุนเงินทุนถึง 75 ล้านดอลลาร์จาก Andreessen Horowitz กำลังถูกจับตามองว่ามีพฤติกรรมช่วยให้ผู้ใช้เข้าถึงเนื้อหาจากเว็บไซต์ข่าวที่ต้องเสียค่าสมาชิก (Paywall) ได้ฟรี
จากการทดสอบพบว่า เมื่อผู้ใช้นำ URL ของบทความที่ถูกล็อกไว้ เช่น จาก WIRED, The New York Times หรือ Bloomberg Businessweek ไปใส่ใน Assistant bot ของ Poe ระบบไม่เพียงแต่จะสรุปเนื้อหาให้เท่านั้น แต่ยังสร้างไฟล์ HTML ขนาดประมาณ 1 MB ซึ่งเป็นการคัดลอกเนื้อหาทั้งหมดของบทความนั้นมาให้ผู้ใช้ดาวน์โหลดจากเซิร์ฟเวอร์ของ Poe ได้โดยตรง
กลไกการทำงานและการเลี่ยงกฎระเบียบเว็บ
เบื้องหลังการทำงานนี้ Assistant bot ซึ่งขับเคลื่อนด้วยโมเดลจากบริษัท Anthropic (บริษัทพัฒนา AI ผู้สร้าง Claude) ไม่ได้เข้าถึงอินเทอร์เน็ตได้ด้วยตัวเอง แต่ใช้ระบบ Crawler หรือโปรแกรมดึงข้อมูลอัตโนมัติของ Quora ในการเข้าไปกวาดข้อมูลจากเว็บไซต์เป้าหมายตามคำสั่งของผู้ใช้
สิ่งที่น่ากังวลคือ จากการตรวจสอบ Log ของเซิร์ฟเวอร์ พบว่า "Quora Bot" ไม่ได้ตรวจสอบไฟล์ robots.txt (ข้อกำหนดที่เจ้าของเว็บไซต์ใช้บอกบอตว่าส่วนใดอนุญาตหรือไม่อนุญาตให้เก็บข้อมูล) ซึ่งถือเป็นการเพิกเฉยต่อ Robots Exclusion Protocol หรือมาตรฐานสากลในการควบคุมการเข้าถึงข้อมูลของบอตบนเว็บ

ข้อโต้แย้งทางกฎหมายและมุมมองจากผู้เชี่ยวชาญ
James Grimmelmann ศาสตราจารย์ด้านกฎหมายดิจิทัลจากมหาวิทยาลัย Cornell ระบุว่ากรณีนี้ถือเป็นการละเมิดลิขสิทธิ์อย่างชัดเจน เนื่องจากมีการสร้างสำเนาเนื้อหาไว้บนเซิร์ฟเวอร์ของตนเอง อย่างไรก็ตาม ทาง Quora ได้โต้แย้งว่า Poe ทำหน้าที่คล้ายกับบริการฝากไฟล์บนคลาวด์ (Cloud Storage) หรือเครื่องมือตัดแปะเว็บ (Web Clipper) ซึ่งเป็นการดำเนินการตามคำสั่งของผู้ใช้และควรเป็นสิ่งที่ทำได้ตามกฎหมาย
| หัวข้อ | มุมมองของสำนักข่าว/ผู้เชี่ยวชาญ | คำชี้แจงจาก Quora/Poe |
|---|---|---|
| การเข้าถึงเนื้อหา | เป็นการขโมยเนื้อหาที่ต้องชำระเงิน (Paywall) | บอตเห็นเฉพาะเนื้อหาที่โดเมนนั้นๆ ยอมส่งให้ |
| สถานะทางกฎหมาย | ละเมิดลิขสิทธิ์ชัดเจนเพราะมีการสำเนาไฟล์ | ทำงานเหมือนบริการ Cloud Storage หรือ Read-it-later |
| มารยาททางเทคนิค | เพิกเฉยต่อ robots.txt และมาตรฐานเว็บ | ยินดีประสานงานทางเทคนิคเพื่อป้องกันเนื้อหา |
ข้อเท็จจริงสำคัญ
- Poe สามารถให้ผู้ใช้ดาวน์โหลดไฟล์ HTML ของบทความที่ติด Paywall ได้
- ระบบใช้ Quora Bot ในการดึงข้อมูลโดยไม่สนใจไฟล์ robots.txt ของเว็บไซต์
- สำนักข่าวชั้นนำ เช่น The New York Times และ Forbes กำลังเผชิญปัญหาการถูก AI ดึงข้อมูลโดยไม่ได้รับอนุญาต
- Adam D’Angelo ผู้ร่วมก่อตั้ง Quora มีความเชื่อมโยงกับทั้ง Facebook (อดีต CTO) และ OpenAI (กรรมการบริหาร)
คำถามที่พบบ่อย
Poe AI ทำงานอย่างไรในการดึงบทความ?
เมื่อผู้ใช้ส่ง URL ให้ Assistant bot ระบบจะใช้ Quora Bot เข้าไปดึงข้อมูลจากหน้าเว็บนั้น แล้วนำเนื้อหามาส่งต่อให้โมเดล AI ของ Anthropic ประมวลผล พร้อมสร้างไฟล์ HTML ให้ดาวน์โหลด
ทำไมกรณีนี้ถึงถูกมองว่าเป็นการละเมิดลิขสิทธิ์?
เพราะมีการคัดลอกเนื้อหาจากเว็บไซต์อื่นมาเก็บไว้ในเซิร์ฟเวอร์ของ Poe และส่งต่อให้ผู้ใช้ ซึ่งเป็นการทำซ้ำเนื้อหาที่มีลิขสิทธิ์โดยไม่ได้รับอนุญาตจากเจ้าของผลงาน
Robots Exclusion Protocol คืออะไรและสำคัญอย่างไร?
คือมาตรฐานที่เจ้าของเว็บใช้สื่อสารกับบอตว่าส่วนใดของเว็บที่ห้ามเก็บข้อมูล การที่ Poe เพิกเฉยต่อสิ่งนี้แสดงถึงการไม่เคารพความเป็นส่วนตัวและข้อกำหนดของเจ้าของเว็บไซต์
ทาง Quora มีแนวทางแก้ไขปัญหานี้อย่างไร?
Quora ระบุว่ายินดีที่จะประสานงานกับทีมเทคนิคของสำนักข่าวต่างๆ เพื่อให้มั่นใจว่าเนื้อหาที่ต้องชำระเงินจะไม่ถูกส่งต่อไปยังผู้ใช้ผ่าน Poe



