动察 Beating ข่าวด่วน AI Anthropic เปิดตัว Claude Opus 5.5 ซึ่งเป็นโมเดลแรกในซีรีส์ Claude 5.5 ทางบริษัทกล่าวว่าโมเดลนี้ทำได้ในระดับ Fable 5.1 ในงานส่วนใหญ่ แต่ต้นทุนสำหรับภาระงานทั่วไปต่ำกว่า Opus 5 ถึง 40% และความเร็วในการส่งออกสูงกว่า 30% ราคา API ลดลงเหลืออินพุต 4 ดอลลาร์ เอาต์พุต 20 ดอลลาร์ต่อล้านโทเคน ซึ่งต่ำกว่า Opus 5 ถึง 20% การอ่านแคชลดลงเหลือ 0.20 ดอลลาร์ ถูกลง 60%
การประเมินด้านการเขียนโค้ดพัฒนาขึ้นชัดเจนที่สุด บน Terminal-Bench 4.0 Opus 5.5 ได้ 66.4% สูงกว่า GPT-6 Astra ที่ 57.9% ส่วน FrontierCode v1.1 ได้ 54.4% เทียบกับ 53.3% Anthropic กล่าวว่าเมื่อรัน FrontierCode ด้วย effort เริ่มต้น เมื่อ Opus 5.5 ทำคะแนนได้เกินคะแนนสูงสุดของ Astra ต้นทุนต่อข้ออยู่ที่ประมาณหนึ่งในห้าของอีกฝ่ายเท่านั้น GDPval-AA v2.1 ก็ได้ 1846 Elo สูงกว่า 1735 ของ Fable 5.1 และ 1542 ของ Astra
อย่างไรก็ตาม มันไม่ได้นำทุกด้าน บน AutomationBench GPT-6 Astra ได้ 41.4% ขณะที่ Opus 5.5 ได้ 40.0% ส่วน Terminal-Bench-Science ก็เป็น Astra ที่ได้คะแนนสูงกว่า
นี่เป็นโมเดลแรกที่เปิดตัวหลังจาก Anthropic ประกาศ "ชะลอการผลักดันโมเดลแนวหน้า" บริษัทกล่าวว่า Opus 5.5 ทำคะแนนได้ดีที่สุดในปัจจุบันในการตรวจสอบพฤติกรรมอัตโนมัติของบริษัท โควตาห้าชั่วโมงของ Pro, Max และ Team ก็ปรับเพิ่มขึ้นพร้อมกัน โดย Sonnet 5.5 และ Haiku 5.5 จะเปิดตัวในอีกไม่กี่สัปดาห์ข้างหน้า
