动察 Beating ข่าวด่วน AI,DeepSeek เปิดตัว V4.1 Flash อย่างเป็นทางการ โมเดลใหม่มีพารามิเตอร์รวม 552B (5.52 แสนล้าน) ใช้สถาปัตยกรรม Causal-Encoder-Decoder ใหม่ทั้งหมด และรองรับการเข้าใจภาพแบบเนทีฟ นอกจากนี้ยังเป็นโมเดลที่เล็กที่สุดในซีรีส์สถาปัตยกรรมใหม่ของ DeepSeek
สถาปัตยกรรมนี้แยกการประมวลผลอินพุตและเอาต์พุตออกจากกัน เมื่ออ่านอินพุตจะเปิดใช้งานเพียง 8B (8 พันล้าน) พารามิเตอร์ และเมื่อสร้างคำตอบจะเปิดใช้งาน 16B (1.6 หมื่นล้าน) DeepSeek กล่าวว่าสิ่งนี้ทำให้โมเดลขนาดใหญ่ 552B สามารถลดต้นทุนการอนุมานได้ หลังจากผ่านการฝึกอบรมล่วงหน้าแบบใหม่และการเรียนรู้แบบเสริมกำลังในขนาดที่ใหญ่ขึ้น V4.1 Flash ได้แซงหน้า V4 Pro ในเกณฑ์มาตรฐานอย่างเป็นทางการแล้ว
แคชก็ถูกบีบอัดอย่างมากเช่นกัน เมื่อเทียบกับรุ่นก่อนหน้า V4.1 Flash มีความต้องการหน่วยความจำ HBM ลดลงเหลือ 1/4 และความต้องการพื้นที่จัดเก็บ SSD ลดลงเหลือ 1/8 ซึ่งส่วนใหญ่ใช้เพื่อลดต้นทุนเมื่อบริบทมีความยาวมากและการเรียกใช้ Agent ซ้ำๆ
V4.1 Flash เปิดให้ใช้งานผ่าน API แล้ว เพียงเปลี่ยนชื่อโมเดลเป็น deepseek-flash ก็สามารถเรียกใช้งานได้
