lang
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
หน้าแรก
AI
OPRR
ด่วน
ความลึก
กิจกรรม
BlockBeats Pro
เพิ่มเติม
การเงิน
พิเศษ
ระบบนิเวศบล็อกเชน
รายการ
พอดแคสต์
ข้อมูล
BTC
$96,000
5.73%
ETH
$3,521.91
3.97%
HTX
$0.{5}2273
5.23%
SOL
$198.17
3.05%
BNB
$710
3.05%

Jina ปรับแต่ง DeepSeek-OCR เอง ทดสอบเองใน 14 ตัว ได้吞吐หน้าแรก

动察 Beating ข่าวด่วน AI, Jina AI เปิดตัวโมเดลแยกวิเคราะห์เอกสาร jina-ocr-v1 ซึ่งสามารถแปลง PDF เอกสารสแกน ตาราง และแผนภูมิเป็น Markdown ได้โดยตรง โดยสร้างจากการฝึกต่อยอดบน DeepSeek-OCR ใช้สถาปัตยกรรม MoE ที่มีพารามิเตอร์รวมประมาณ 3.4 พันล้านตัว และเปิดใช้งานพารามิเตอร์ประมาณ 570 ล้านตัวต่อ Token ขณะถอดรหัส พร้อมเพิ่ม FastMTP speculative decoding


ในการทดสอบเองของ Jina, jina-ocr-v1 ได้ 91.14 คะแนนบน OmniDocBench v1.6 สูงกว่า DeepSeek-OCR-2 อยู่ 0.89 คะแนน และได้ 83.4 คะแนนบน olmOCR-Bench สูงกว่าโมเดลฐาน DeepSeek-OCR ที่มันสร้างขึ้นจริงอยู่ 7.4 คะแนน


ปริมาณการประมวลผล (throughput) เป็นหนึ่งในจุดขายหลักของ Jina บน A100 เดียว ที่ concurrent 32 มันทำได้ 2.57 หน้า/วินาที สูงที่สุดใน 14 ระบบที่ Jina ทดสอบ สูงกว่า DeepSeek-OCR ที่ 2.10 หน้า/วินาทีประมาณ 22%


น้ำหนักโมเดลได้ถูกเผยแพร่บน Hugging Face แล้ว ใช้สัญญาอนุญาต CC BY-NC 4.0 การใช้งานเชิงพาณิชย์ต้องติดต่อ Jina

นักสืบบนบล็อกเชนเฝ้าติดตามอย่างต่อเนื่อง
แก้ไข/รายงาน
ส่ง
เพิ่มคลัง
เห็นได้เฉพาะตัวเอง
สาธารณะ
บันทึก
เลือกคลัง
เพิ่มคลัง
ยกเลิก
เสร็จสิ้น