动察 Beating AI ข่าวด่วน OpenAI เพิ่มการอัปเดต configuration_update ให้กับ GPT-6 Astra ในการสนทนายาวเดียวกันของ Responses API ตอนนี้สามารถปรับระดับ reasoning effort ขึ้นหรือลงได้ตลอดเวลา โดยไม่ต้องเขียน prefix ของ Prompt ที่แคชไว้ใหม่ หากงานยากก็ตั้งเป็น High หรือ xhigh งานง่ายก็ลดกลับเป็น Low ส่วน context ยาวก่อนหน้านี้ยังสามารถนำกลับมาใช้ใหม่ได้ต่อเนื่อง
ก่อนหน้านี้ นี่เป็นหลุมเผาเงินที่ซ่อนอยู่มาก reasoning effort จะถูกใช้เป็นคำสั่งที่จุดเริ่มต้นของ context หากสลับไปยังระดับการคิดใหม่ระหว่างทาง จะทำให้แคชจำนวนมากไม่สามารถนำกลับมาใช้ต่อได้ มีผู้ใช้ Codex ทดสอบจริงพบว่า หลังจากสลับระดับ อัตราการ命中แคชลดลงจาก 98.5% เหลือ 65% และต้องรอรอบถัดไปเพื่อสร้างแคชใหม่จึงจะกลับมาอยู่ที่มากกว่า 97%
สำหรับ Agent ที่ทำงานเป็นเวลานาน การเปลี่ยนแปลงนี้มีประโยชน์มาก เมื่อเจองานยากก็สามารถเพิ่มความเข้มข้นในการคิดชั่วคราว งานง่ายก็ลดกลับลงมา โดยไม่ต้องกังวลว่าเพียงเพราะเปลี่ยนระดับ จะทำให้แคชของ Token หลายแสนตัวก่อนหน้านี้ต้องถูกประมวลผลใหม่เหมือนอินพุตปกติ
