lang
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
หน้าแรก
AI
OPRR
ด่วน
ความลึก
กิจกรรม
BlockBeats Pro
เพิ่มเติม
การเงิน
พิเศษ
ระบบนิเวศบล็อกเชน
รายการ
พอดแคสต์
ข้อมูล
BTC
$96,000
5.73%
ETH
$3,521.91
3.97%
HTX
$0.{5}2273
5.23%
SOL
$198.17
3.05%
BNB
$710
3.05%

Qwen3.8-Omni-Flash เปิดตัวแล้ว: ดูวิดีโอด้วยตัวเอง เรียกใช้เครื่องมือ และส่งงานชิ้นสำเร็จรูป

动察 Beating ข่าวด่วน AI อาลี Qianwen เปิดตัวโมเดล原生全模态 Qwen3.8-Omni-Flash รองรับข้อความ รูปภาพ เสียง วิดีโอ และบริบท 1M


รุ่นนี้เสริมความสามารถด้าน Agent เสียงและวิดีโออย่างชัดเจน โมเดลสามารถค้นหาข้อมูลจากวิดีโอด้วยตัวเอง วางแผนงาน แล้วเรียกใช้เครื่องมือภายนอกเพื่อตัดต่อ พากย์เสียง และเรนเดอร์ ทางการได้แสดงตัวอย่างการประมวลผลการประชุมยาว การแปลละครสั้น การบรรยายภาพยนตร์ การผลิต MV และการแปลงวิดีโอเป็นบันทึกข้อความภาพ


เมื่อเจอวิดีโอยาวหลายชั่วโมง มันไม่จำเป็นต้องประมวลผลทั้งหมดตั้งแต่ต้นจนจบ โมเดลจะตัดสินใจก่อนว่าคำตอบอาจอยู่ตรงไหน แล้วค่อยๆ ระบุตำแหน่งคลิปสำคัญทีละขั้น บน OmniVideoBench ความแม่นยำเพิ่มจาก 63.4 เป็น 67.8 การใช้ Token ลดจาก 145,736 เหลือ 79,117 ลดลง 45.7%


Qianwen กล่าวว่า Qwen3.8-Omni-Flash มีคะแนนเฉลี่ยจากการประเมิน 30 รายการสูงกว่า Qwen3.5-Omni-Plus เกิน 26% ความสามารถด้านเสียงและวิดีโอใกล้เคียงกับ Gemini 3.8 Flash ส่วนความสามารถด้านเสียงโดยรวมเกินกว่ารุ่นหลัง ต้นทุนการป้อนข้อมูลเสียงลดลงเกิน 98% การป้อนข้อมูลเสียงและวิดีโอลดลงเกิน 93%


ปัจจุบันน้ำหนักโมเดล Qwen3.8-Omni-Flash ยังไม่เปิดเผย เปิดให้ใช้เฉพาะ API เท่านั้น Qianwen ยังเปิดซอร์ส Qwen-MM-Plugins ซึ่งสามารถติดตั้งใน Claude Code, Codex, Gemini CLI, Qwen Code และ Agent อื่นๆ เพื่อเพิ่มความสามารถในการประมวลผลรูปภาพ เสียง วิดีโอยาว และการตัดต่อวิดีโอ


อีกชุดหนึ่ง Qwen-Live Harness เปรียบเสมือนชั้นจัดการแบบเรียลไทม์ ผู้ใช้สามารถพูดคุยกับโมเดล全模态แบบเรียลไทม์ได้โดยตรง แล้วมอบหมายงานที่ซับซ้อนให้ Agent เบื้องหลังอย่าง Gemini CLI, Claude Code, Codex ดำเนินการต่อเนื่อง มันจะติดตามความคืบหน้าของงาน และเมื่อเสร็จแล้วจะกลับมาบอกผลลัพธ์ให้คุณเอง

แก้ไข/รายงาน
ส่ง
เพิ่มคลัง
เห็นได้เฉพาะตัวเอง
สาธารณะ
บันทึก
เลือกคลัง
เพิ่มคลัง
ยกเลิก
เสร็จสิ้น