据动察 Beating ตรวจสอบพบว่า NVIDIA เปิดตัวโมเดลโอเพนซอร์ส Nemotron 3.5 Lightning ซึ่งออกแบบมาโดยเฉพาะสำหรับเอเจนต์ที่ทำงานระยะยาวเพื่อทำหน้าที่ "งานปฏิบัติการ" โมเดลมีพารามิเตอร์รวม 3 หมื่นล้านตัว แต่เปิดใช้งานเพียง 3 พันล้านตัวต่อ Token โดย主要负责การเรียกใช้เครื่องมือ การตรวจสอบผลลัพธ์ และการจัดตารางงานของเอเจนต์ย่อยในงานความถี่สูง
แนวคิดของ NVIDIA คือการแบ่งงานของเอเจนต์ให้ชัดเจนยิ่งขึ้น การวางแผนที่ซับซ้อนมอบให้โมเดลใหญ่ เช่น Nemotron 3 Ultra ส่วนงานที่ต้องทำซ้ำจำนวนมากมอบให้ Lightning 官方ระบุว่าความเร็วเอาต์พุตสูงสุดสูงกว่าโมเดลระดับเดียวกันได้ถึง 4 เท่า บน PinchBench Lightning มีความแม่นยำถึง 86% และเมื่อความแม่นยำใกล้เคียงกัน การรันงาน 1 หมื่นรายการเสร็จเร็วกว่า Qwen3.6 35B ถึง 30%
โมเดลใช้สถาปัตยกรรม MoE และยังได้รับการฝึกฝนเฉพาะสำหรับ Agent Harness พร้อมเพิ่มการคาดการณ์หลาย Token และการถอดรหัสแบบคาดเดา 官方ให้เวทน้ำหนัก BF16 และ NVFP4 ซึ่งสามารถรันบนอุปกรณ์ท้องถิ่น เช่น RTX 5090, DGX Spark และรองรับ llama.cpp, Ollama, LM Studio และ Unsloth
นอกจากนี้ยังเน้นความสามารถในการปรับแต่งได้ NVIDIA เปิดเผยน้ำหนัก ข้อมูลการฝึกบางส่วน และสูตรการฝึก เพื่อให้องค์กรสามารถฝึกต่อยอดสำหรับงานด้านโค้ด ความปลอดภัย กฎหมาย เป็นต้น ในกรณีตัวอย่างที่官方แสดง Lightning หลังการฝึกต่อยอดมีคะแนนเพิ่มขึ้นอย่างชัดเจนในงานเฉพาะทางหลายรายการ
