动察 Beating ข่าวด่วน AI, Jina AI เปิดตัวโมเดลแยกวิเคราะห์เอกสาร jina-ocr-v1 ซึ่งสามารถแปลง PDF เอกสารสแกน ตาราง และแผนภูมิเป็น Markdown ได้โดยตรง โดยสร้างจากการฝึกต่อยอดบน DeepSeek-OCR ใช้สถาปัตยกรรม MoE ที่มีพารามิเตอร์รวมประมาณ 3.4 พันล้านตัว และเปิดใช้งานพารามิเตอร์ประมาณ 570 ล้านตัวต่อ Token ขณะถอดรหัส พร้อมเพิ่ม FastMTP speculative decoding
ในการทดสอบเองของ Jina, jina-ocr-v1 ได้ 91.14 คะแนนบน OmniDocBench v1.6 สูงกว่า DeepSeek-OCR-2 อยู่ 0.89 คะแนน และได้ 83.4 คะแนนบน olmOCR-Bench สูงกว่าโมเดลฐาน DeepSeek-OCR ที่มันสร้างขึ้นจริงอยู่ 7.4 คะแนน
ปริมาณการประมวลผล (throughput) เป็นหนึ่งในจุดขายหลักของ Jina บน A100 เดียว ที่ concurrent 32 มันทำได้ 2.57 หน้า/วินาที สูงที่สุดใน 14 ระบบที่ Jina ทดสอบ สูงกว่า DeepSeek-OCR ที่ 2.10 หน้า/วินาทีประมาณ 22%
น้ำหนักโมเดลได้ถูกเผยแพร่บน Hugging Face แล้ว ใช้สัญญาอนุญาต CC BY-NC 4.0 การใช้งานเชิงพาณิชย์ต้องติดต่อ Jina
