Ray-Ban Meta อัปเกรด AI ใหม่ เพิ่มระบบค้นหาด้วยภาพและข้อมูลแบบเรียลไทม์

แว่นตาอัจฉริยะ Ray-Ban Meta กำลังจะก้าวข้ามขีดจำกัดเดิมๆ ด้วยการอัปเดตระบบผู้ช่วย AI ให้มีความสามารถที่ทรงพลังยิ่งขึ้น โดยเน้นไปที่การให้ข้อมูลที่ทันสมัยแบบวินาทีต่อวินาที และการนำเทคโนโลยีการรับรู้สภาพแวดล้อมมาใช้ เพื่อเปลี่ยนให้แว่นตาตัวนี้เป็นเครื่องมือช่วยอำนวยความสะดวกในชีวิตประจำวันได้อย่างแท้จริง

ก้าวข้ามขีดจำกัดด้วยข้อมูลแบบเรียลไทม์

ก่อนหน้านี้ Meta AI มีข้อจำกัดด้าน Knowledge Cutoff หรือการมีฐานข้อมูลที่สิ้นสุดเพียงเดือนธันวาคม 2022 ทำให้ไม่สามารถตอบคำถามเกี่ยวกับเหตุการณ์ปัจจุบัน ผลการแข่งขันกีฬา หรือสภาพการจราจรในขณะนั้นได้ ซึ่งเป็นจุดอ่อนสำคัญสำหรับอุปกรณ์ที่ออกแบบมาเพื่อใช้งานขณะเดินทาง

อย่างไรก็ตาม Andrew Bosworth ประธานเจ้าหน้าที่ฝ่ายเทคโนโลยี (CTO) ของ Meta เปิดเผยว่า ขณะนี้แว่นตา Ray-Ban Meta ในสหรัฐอเมริกาสามารถเข้าถึงข้อมูลแบบเรียลไทม์ได้แล้ว โดยการพัฒนาครั้งนี้ได้รับความช่วยเหลือส่วนหนึ่งจากระบบของ Bing ทำให้ผู้ใช้ได้รับคำตอบที่สดใหม่และแม่นยำตามสถานการณ์ปัจจุบัน

Article image

Multimodal AI: เมื่อ AI มองเห็นโลกผ่านสายตาคุณ

สิ่งที่น่าตื่นเต้นที่สุดคือการทดสอบ Multimodal AI ซึ่งเป็นระบบ AI ที่สามารถประมวลผลข้อมูลได้หลายรูปแบบพร้อมกัน (เช่น ทั้งภาพและเสียง) ช่วยให้ผู้ช่วยอัจฉริยะสามารถวิเคราะห์สิ่งที่ผู้ใช้กำลังมองเห็นผ่านเลนส์แว่นตา และตอบคำถามตามบริบทของสภาพแวดล้อมนั้นๆ ได้

ตัวอย่างการใช้งานที่ Mark Zuckerberg และ Andrew Bosworth นำเสนอ ได้แก่ การใช้คำสั่ง "Hey Meta, look and tell me" เพื่อให้ AI ช่วยแนะนำกางเกงที่เข้ากับเสื้อที่กำลังถืออยู่, การระบุชนิดของผลไม้ หรือแม้แต่การแปลข้อความจากภาพมีม (Meme) นอกจากนี้ยังสามารถช่วยคิดคำบรรยายภาพ (Caption) สำหรับรูปถ่ายที่เพิ่งถ่ายเสร็จได้อีกด้วย

Image 2

แม้ฟีเจอร์นี้จะช่วยลดความรู้สึกว่า AI เป็นเพียงลูกเล่น (Gimmick) และเพิ่มประโยชน์ใช้สอยให้มากขึ้น แต่ในระยะแรกจะเปิดให้ทดสอบในรูปแบบ Beta สำหรับผู้ใช้กลุ่มเล็กๆ ในสหรัฐฯ ที่สมัครใจเข้าร่วมก่อน โดยคาดว่าจะขยายการใช้งานให้กว้างขึ้นภายในปี 2024

สรุปการอัปเดตฟีเจอร์ใหม่ของ Ray-Ban Meta AI
ฟีเจอร์ ความสามารถเดิม ความสามารถใหม่
การเข้าถึงข้อมูล จำกัดถึง ธ.ค. 2022 ข้อมูลเรียลไทม์ (สนับสนุนโดย Bing)
การรับรู้สภาพแวดล้อม เน้นคำสั่งเสียง/ข้อความ Multimodal AI (วิเคราะห์ภาพที่มองเห็น)
การใช้งานจริง ตอบคำถามทั่วไป แนะนำการแต่งตัว, แปลภาษา, ระบุวัตถุ

ข้อเท็จจริงสำคัญ

  • ข้อมูลสดใหม่: เลิกใช้ฐานข้อมูลเก่า เปลี่ยนมาใช้ข้อมูลเรียลไทม์ผ่าน Bing ในสหรัฐฯ
  • การมองเห็น: ระบบ Multimodal AI ช่วยให้ AI วิเคราะห์สิ่งที่ผู้ใช้มองเห็นได้
  • คำสั่งใช้งาน: ใช้คำสั่งเสียง "Hey Meta, look and tell me" เพื่อเริ่มการวิเคราะห์ภาพ
  • สถานะการปล่อยฟีเจอร์: เริ่มทดสอบ Beta ในกลุ่มเล็กๆ ในสหรัฐฯ และจะขยายผลในปี 2024
You can order wither style with clear or prescription lenses.

คำถามที่พบบ่อย

Multimodal AI คืออะไร?

คือระบบ AI ที่สามารถเข้าใจและประมวลผลข้อมูลได้มากกว่าหนึ่งรูปแบบในเวลาเดียวกัน สำหรับ Ray-Ban Meta คือการที่ AI สามารถ "มองเห็น" ภาพจากกล้องและ "ฟัง" คำสั่งเสียงเพื่อนำมาวิเคราะห์และตอบคำถามตามบริบทได้

ตอนนี้ทุกคนสามารถใช้งานฟีเจอร์มองเห็นภาพได้หรือยัง?

ยังไม่เปิดให้ใช้งานทั่วไป โดยปัจจุบันอยู่ในช่วงทดสอบ Beta สำหรับผู้ใช้บางส่วนในสหรัฐอเมริกา และมีแผนจะขยายการเข้าถึงในช่วงปี 2024

AI ของ Ray-Ban Meta นำข้อมูลเรียลไทม์มาจากไหน?

Meta ได้นำระบบของ Bing เข้ามาช่วยสนับสนุนบางส่วน เพื่อให้ AI สามารถเข้าถึงข้อมูลปัจจุบัน เช่น ข่าวสาร หรือสภาพจราจรได้

ตัวอย่างการใช้งาน Multimodal AI ในชีวิตประจำวันมีอะไรบ้าง?

ผู้ใช้สามารถให้ AI ช่วยแนะนำการเลือกเสื้อผ้าให้เข้าชุดกัน, แปลข้อความจากป้ายหรือภาพที่เห็น, ระบุชื่อวัตถุหรือผลไม้ และช่วยเขียนคำบรรยายภาพถ่ายได้