Ray-Ban Meta อัปเกรด AI ใหม่ เพิ่มระบบค้นหาด้วยภาพและข้อมูลแบบเรียลไทม์
แว่นตาอัจฉริยะ Ray-Ban Meta กำลังจะก้าวข้ามขีดจำกัดเดิมๆ ด้วยการอัปเดตระบบผู้ช่วย AI ให้มีความสามารถที่ทรงพลังยิ่งขึ้น โดยเน้นไปที่การให้ข้อมูลที่ทันสมัยแบบวินาทีต่อวินาที และการนำเทคโนโลยีการรับรู้สภาพแวดล้อมมาใช้ เพื่อเปลี่ยนให้แว่นตาตัวนี้เป็นเครื่องมือช่วยอำนวยความสะดวกในชีวิตประจำวันได้อย่างแท้จริง
ก้าวข้ามขีดจำกัดด้วยข้อมูลแบบเรียลไทม์
ก่อนหน้านี้ Meta AI มีข้อจำกัดด้าน Knowledge Cutoff หรือการมีฐานข้อมูลที่สิ้นสุดเพียงเดือนธันวาคม 2022 ทำให้ไม่สามารถตอบคำถามเกี่ยวกับเหตุการณ์ปัจจุบัน ผลการแข่งขันกีฬา หรือสภาพการจราจรในขณะนั้นได้ ซึ่งเป็นจุดอ่อนสำคัญสำหรับอุปกรณ์ที่ออกแบบมาเพื่อใช้งานขณะเดินทาง
อย่างไรก็ตาม Andrew Bosworth ประธานเจ้าหน้าที่ฝ่ายเทคโนโลยี (CTO) ของ Meta เปิดเผยว่า ขณะนี้แว่นตา Ray-Ban Meta ในสหรัฐอเมริกาสามารถเข้าถึงข้อมูลแบบเรียลไทม์ได้แล้ว โดยการพัฒนาครั้งนี้ได้รับความช่วยเหลือส่วนหนึ่งจากระบบของ Bing ทำให้ผู้ใช้ได้รับคำตอบที่สดใหม่และแม่นยำตามสถานการณ์ปัจจุบัน

Multimodal AI: เมื่อ AI มองเห็นโลกผ่านสายตาคุณ
สิ่งที่น่าตื่นเต้นที่สุดคือการทดสอบ Multimodal AI ซึ่งเป็นระบบ AI ที่สามารถประมวลผลข้อมูลได้หลายรูปแบบพร้อมกัน (เช่น ทั้งภาพและเสียง) ช่วยให้ผู้ช่วยอัจฉริยะสามารถวิเคราะห์สิ่งที่ผู้ใช้กำลังมองเห็นผ่านเลนส์แว่นตา และตอบคำถามตามบริบทของสภาพแวดล้อมนั้นๆ ได้
ตัวอย่างการใช้งานที่ Mark Zuckerberg และ Andrew Bosworth นำเสนอ ได้แก่ การใช้คำสั่ง "Hey Meta, look and tell me" เพื่อให้ AI ช่วยแนะนำกางเกงที่เข้ากับเสื้อที่กำลังถืออยู่, การระบุชนิดของผลไม้ หรือแม้แต่การแปลข้อความจากภาพมีม (Meme) นอกจากนี้ยังสามารถช่วยคิดคำบรรยายภาพ (Caption) สำหรับรูปถ่ายที่เพิ่งถ่ายเสร็จได้อีกด้วย

แม้ฟีเจอร์นี้จะช่วยลดความรู้สึกว่า AI เป็นเพียงลูกเล่น (Gimmick) และเพิ่มประโยชน์ใช้สอยให้มากขึ้น แต่ในระยะแรกจะเปิดให้ทดสอบในรูปแบบ Beta สำหรับผู้ใช้กลุ่มเล็กๆ ในสหรัฐฯ ที่สมัครใจเข้าร่วมก่อน โดยคาดว่าจะขยายการใช้งานให้กว้างขึ้นภายในปี 2024
| ฟีเจอร์ | ความสามารถเดิม | ความสามารถใหม่ |
|---|---|---|
| การเข้าถึงข้อมูล | จำกัดถึง ธ.ค. 2022 | ข้อมูลเรียลไทม์ (สนับสนุนโดย Bing) |
| การรับรู้สภาพแวดล้อม | เน้นคำสั่งเสียง/ข้อความ | Multimodal AI (วิเคราะห์ภาพที่มองเห็น) |
| การใช้งานจริง | ตอบคำถามทั่วไป | แนะนำการแต่งตัว, แปลภาษา, ระบุวัตถุ |
ข้อเท็จจริงสำคัญ
- ข้อมูลสดใหม่: เลิกใช้ฐานข้อมูลเก่า เปลี่ยนมาใช้ข้อมูลเรียลไทม์ผ่าน Bing ในสหรัฐฯ
- การมองเห็น: ระบบ Multimodal AI ช่วยให้ AI วิเคราะห์สิ่งที่ผู้ใช้มองเห็นได้
- คำสั่งใช้งาน: ใช้คำสั่งเสียง "Hey Meta, look and tell me" เพื่อเริ่มการวิเคราะห์ภาพ
- สถานะการปล่อยฟีเจอร์: เริ่มทดสอบ Beta ในกลุ่มเล็กๆ ในสหรัฐฯ และจะขยายผลในปี 2024

คำถามที่พบบ่อย
Multimodal AI คืออะไร?
คือระบบ AI ที่สามารถเข้าใจและประมวลผลข้อมูลได้มากกว่าหนึ่งรูปแบบในเวลาเดียวกัน สำหรับ Ray-Ban Meta คือการที่ AI สามารถ "มองเห็น" ภาพจากกล้องและ "ฟัง" คำสั่งเสียงเพื่อนำมาวิเคราะห์และตอบคำถามตามบริบทได้
ตอนนี้ทุกคนสามารถใช้งานฟีเจอร์มองเห็นภาพได้หรือยัง?
ยังไม่เปิดให้ใช้งานทั่วไป โดยปัจจุบันอยู่ในช่วงทดสอบ Beta สำหรับผู้ใช้บางส่วนในสหรัฐอเมริกา และมีแผนจะขยายการเข้าถึงในช่วงปี 2024
AI ของ Ray-Ban Meta นำข้อมูลเรียลไทม์มาจากไหน?
Meta ได้นำระบบของ Bing เข้ามาช่วยสนับสนุนบางส่วน เพื่อให้ AI สามารถเข้าถึงข้อมูลปัจจุบัน เช่น ข่าวสาร หรือสภาพจราจรได้
ตัวอย่างการใช้งาน Multimodal AI ในชีวิตประจำวันมีอะไรบ้าง?
ผู้ใช้สามารถให้ AI ช่วยแนะนำการเลือกเสื้อผ้าให้เข้าชุดกัน, แปลข้อความจากป้ายหรือภาพที่เห็น, ระบุชื่อวัตถุหรือผลไม้ และช่วยเขียนคำบรรยายภาพถ่ายได้



