Meta ระงับความร่วมมือ Mercor หลังเกิดเหตุข้อมูลรั่วไหลครั้งใหญ่ กระทบห่วงโซ่การฝึก AI

วงการปัญญาประดิษฐ์ (AI) กำลังเผชิญกับความกังวลด้านความปลอดภัยครั้งสำคัญ เมื่อ Meta ตัดสินใจระงับการทำงานร่วมกับ Mercor บริษัทผู้รับเหมาจัดการข้อมูลรายใหญ่แบบไม่มีกำหนด หลังจากตรวจพบการละเมิดความปลอดภัยของข้อมูล (Security Breach) ครั้งรุนแรง ซึ่งเหตุการณ์นี้ส่งผลให้ห้องปฏิบัติการ AI ชั้นนำแห่งอื่น ๆ ต้องเริ่มทบทวนความสัมพันธ์กับ Mercor เพื่อประเมินความเสี่ยงที่อาจเกิดขึ้นกับข้อมูลลับของตน

Mercor ทำหน้าที่เป็นตัวกลางในการจัดหาเครือข่ายมนุษย์จำนวนมหาศาลเพื่อสร้าง Bespoke Datasets หรือชุดข้อมูลที่ปรับแต่งขึ้นเป็นพิเศษ ซึ่งถือเป็น "สูตรลับ" สำคัญในการฝึกฝนโมเดล AI ให้มีประสิทธิภาพ เช่น ChatGPT ของ OpenAI หรือ Claude Code ของ Anthropic ข้อมูลเหล่านี้มีความอ่อนไหวสูงมาก เพราะหากหลุดไปถึงมือคู่แข่ง โดยเฉพาะในสหรัฐฯ และจีน อาจทำให้ความลับด้านกลยุทธ์การฝึกโมเดลถูกเปิดเผยได้

ผลกระทบต่อยักษ์ใหญ่ด้าน AI

ในขณะที่ Meta สั่งหยุดงานทันที แต่ทาง OpenAI ระบุว่ายังไม่ได้ระงับโครงการปัจจุบัน ทว่ากำลังเร่งตรวจสอบว่าข้อมูลการฝึกฝนที่เป็นกรรมสิทธิ์ของบริษัทถูกเปิดเผยหรือไม่ โดย OpenAI ยืนยันว่าเหตุการณ์นี้ไม่มีผลกระทบต่อข้อมูลของผู้ใช้งานทั่วไป ส่วนทาง Anthropic ยังไม่มีการตอบรับอย่างเป็นทางการต่อกรณีดังกล่าว

สำหรับพนักงานรับจ้าง (Contractors) ของ Mercor ที่ทำงานในโครงการของ Meta โดยเฉพาะโครงการ Chordus ซึ่งเป็นระบบที่สอนให้ AI ตรวจสอบคำตอบจากแหล่งข้อมูลบนอินเทอร์เน็ตหลายแห่ง ต้องเผชิญกับภาวะหยุดงานชั่วคราวและไม่สามารถบันทึกชั่วโมงการทำงานได้ จนกว่าจะมีการประเมินขอบเขตของโครงการใหม่อีกครั้ง

สรุปสถานการณ์การรั่วไหลของข้อมูล Mercor
หัวข้อ รายละเอียด
บริษัทที่ได้รับผลกระทบ Meta (ระงับงาน), OpenAI (กำลังตรวจสอบ), Anthropic
สาเหตุการรั่วไหล การโจมตีผ่านเครื่องมือ AI API ที่ชื่อว่า LiteLLM
กลุ่มผู้โจมตีที่คาดการณ์ TeamPCP (มีความเชื่อมโยงกับ Supply Chain Attack)
ประเภทข้อมูลที่เสี่ยง ชุดข้อมูลสำหรับฝึก AI (Proprietary Training Data)

เบื้องหลังการโจมตีและกลุ่มแฮกเกอร์

ต้นตอของปัญหาเกิดจากการที่กลุ่มแฮกเกอร์ชื่อ TeamPCP สามารถเจาะระบบผ่าน LiteLLM ซึ่งเป็นเครื่องมือ API สำหรับ AI โดยการปล่อยอัปเดตที่มีมัลแวร์แฝงตัวอยู่ ทำให้บริษัทที่ติดตั้งอัปเดตดังกล่าวถูกเข้าถึงข้อมูลได้ ซึ่งคาดว่ามีเหยื่อจำนวนหลายพันรายรวมถึงบริษัท AI รายใหญ่

แม้จะมีกลุ่มที่เรียกตัวเองว่า Lapsus$ ออกมาอ้างสิทธิ์ในการเจาะระบบ Mercor และพยายามขายข้อมูลจำนวนมหาศาล (ฐานข้อมูล 200GB, ซอร์สโค้ด 1TB และวิดีโอ 3TB) แต่ผู้เชี่ยวชาญด้านความปลอดภัยระบุว่านี่เป็นเพียงการแอบอ้างชื่อกลุ่มดัง เพื่อสร้างความน่าเชื่อถือในการขายข้อมูล โดยหลักฐานชี้ชัดว่าผู้ลงมือจริงคือ TeamPCP

TeamPCP ถูกมองว่าเป็นกลุ่มที่ขับเคลื่อนด้วยผลประโยชน์ทางการเงินเป็นหลัก และมีพฤติกรรมโจมตีแบบ Supply Chain Attack (การโจมตีผ่านห่วงโซ่อุปทานซอฟต์แวร์) นอกจากนี้ยังมีประวัติการแพร่กระจายมัลแวร์ "CanisterWorm" ในระบบคลาวด์ที่ตั้งค่าเวลาเป็นเขตเวลาของประเทศอิหร่าน ซึ่งแสดงให้เห็นถึงความซับซ้อนในการโจมตีที่อาจมีมิติทางการเมืองแฝงอยู่

ข้อเท็จจริงสำคัญ

  • Meta ระงับการจ้างงาน Mercor อย่างไม่มีกำหนดเพื่อความปลอดภัยของข้อมูล
  • Mercor เป็นผู้จัดหาชุดข้อมูลลับที่ใช้ฝึก AI ให้กับบริษัทชั้นนำอย่าง OpenAI และ Anthropic
  • การรั่วไหลเกิดขึ้นผ่านช่องโหว่ของ LiteLLM ซึ่งเป็นเครื่องมือเชื่อมต่อ API
  • กลุ่ม TeamPCP คือผู้ต้องสงสัยหลักในการโจมตีครั้งนี้ ไม่ใช่กลุ่ม Lapsus$ ตามที่มีการกล่าวอ้าง
  • ข้อมูลที่รั่วไหลส่งผลกระทบต่อ กลยุทธ์การฝึก AI แต่ไม่กระทบต่อข้อมูลส่วนบุคคลของผู้ใช้งาน OpenAI

คำถามที่พบบ่อย

ข้อมูลของผู้ใช้งานทั่วไปใน ChatGPT หรือ Claude รั่วไหลด้วยหรือไม่?

ไม่ ข้อมูลที่ได้รับผลกระทบคือชุดข้อมูลที่ใช้ในการฝึกฝนโมเดล (Training Data) ซึ่งเป็นกรรมสิทธิ์ของบริษัท ไม่ใช่ข้อมูลส่วนบุคคลของผู้ใช้งานทั่วไป

LiteLLM คืออะไร และเกี่ยวข้องกับการรั่วไหลอย่างไร?

LiteLLM เป็นเครื่องมือ API ที่ช่วยให้บริษัทต่างๆ เชื่อมต่อกับโมเดล AI ได้ง่ายขึ้น โดยแฮกเกอร์ได้ฝังโค้ดอันตรายลงในตัวอัปเดตของเครื่องมือนี้ ทำให้สามารถเข้าถึงระบบของบริษัทที่ใช้งาน LiteLLM ได้

ทำไมชุดข้อมูลการฝึก AI ถึงมีความสำคัญมากจนต้องปิดเป็นความลับ?

เพราะชุดข้อมูลเหล่านี้เปรียบเสมือน "สูตรลับ" ที่กำหนดความฉลาดและความสามารถของ AI หากคู่แข่งทราบว่าใช้ข้อมูลประเภทใดหรือฝึกฝนอย่างไร จะสามารถลอกเลียนแบบหรือสร้างโมเดลที่เหนือกว่าได้ทันที

กลุ่ม TeamPCP มีเป้าหมายอะไรในการโจมตีครั้งนี้?

จากบทวิเคราะห์ของนักวิจัยด้านความปลอดภัย เชื่อว่าแรงจูงใจหลักคือเรื่องเงิน (Financial Motivation) ผ่านการข่มขู่เรียกค่าไถ่ข้อมูล แม้จะมีพฤติกรรมบางอย่างที่ดูเหมือนเกี่ยวข้องกับประเด็นทางภูมิรัฐศาสตร์ก็ตาม