动察 Beating ข่าวด่วน AI บริษัท AI ระดับองค์กร Cohere ซึ่งได้รับการลงทุนจาก NVIDIA ได้เปิดตัวโมเดล embedding รุ่นใหม่ Embed 5 แบ่งเป็นสองระดับคือ Pro และ Fast โมเดล Embedding มีหน้าที่แปลงข้อความและรูปภาพให้เป็นเวกเตอร์ สำหรับใช้ในการค้นหา RAG และ Agent ในการค้นหาข้อมูล โมเดลทั้งสองรองรับการป้อนข้อมูลแบบข้อความ รูปภาพ และแบบผสม ครอบคลุมมากกว่า 100 ภาษา ความยาว context สูงสุด 128K token
โมเดลทั้งสองใช้พื้นที่เวกเตอร์เดียวกัน องค์กรสามารถใช้ Pro ที่มีคุณภาพสูงกว่าในการสร้างดัชนีเอกสารก่อน จากนั้นใช้ Fast ที่เร็วกว่าในการประมวลผลคำค้นหา โดยไม่จำเป็นต้องสร้างเวกเตอร์ทั้งชุดใหม่ ผลการทดสอบของ Cohere บน 40 ชุดข้อมูลแสดงให้เห็นว่าการสร้างดัชนีด้วย Pro และค้นหาด้วย Fast ให้คะแนนรวมเทียบเท่า 98.4% ของ方案ที่ใช้ Pro ตลอดทั้งกระบวนการ โดยต่างกันประมาณ 1.6%
ในการทดสอบของ Cohere Embed 5 Pro ได้คะแนนเฉลี่ย 85.8 บน ViDoRe V3 ขณะที่ Fast ได้ 84.5 ซึ่งสูงกว่า Voyage 4 Large ที่ได้ 83.7 และ Gemini Embedding 2 ที่ได้ 83.2 ราคาของ Fast อยู่ที่ 0.08 ดอลลาร์ต่อล้าน token ข้อความ ส่วน Pro อยู่ที่ 0.12 ดอลลาร์
