lang
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
หน้าแรก
AI
OPRR
ด่วน
ความลึก
กิจกรรม
BlockBeats Pro
เพิ่มเติม
การเงิน
พิเศษ
ระบบนิเวศบล็อกเชน
รายการ
พอดแคสต์
ข้อมูล
BTC
$96,000
5.73%
ETH
$3,521.91
3.97%
HTX
$0.{5}2273
5.23%
SOL
$198.17
3.05%
BNB
$710
3.05%

OpenScience ทดสอบตัวเองได้ 75.7% แซง Codex: Agent วิจัยเริ่มรันการทดลองแบบวนซ้ำด้วยตัวเอง

动察 Beating ข่าวด่วน AI บริษัท Synthetic Sciences ซึ่งเป็นบริษัทในรุ่น Winter 2026 (YC W26) ของ Y Combinator ได้เปิดตัว OpenScience เจ้าหน้าที่วิจัยโอเพนซอร์สอย่างเป็นทางการ มันสามารถค้นหาเปเปอร์ ประมวลผลข้อมูล เขียนโค้ด และเรียกใช้ฐานข้อมูลการวิจัยได้ นอกจากนี้ Autoresearch ที่เพิ่มเข้ามาใหม่ยังทำให้ AI สามารถรันการทดลองต่อเนื่องได้ด้วยตัวเอง


ตัวอย่างเช่น ในการฝึกโมเดล นักวิจัยเพียงแค่บอกมันว่า "ลด loss ของชุด validation ลง" OpenScience จะรัน baseline ก่อน จากนั้นจะเสนอแผนการปรับเปลี่ยนเองและดำเนินการทดลองเป็นรอบๆ ถ้าผลลัพธ์ดีขึ้นก็เก็บไว้ ถ้าแย่ลงก็ย้อนกลับ แล้วตัดสินใจจากผลลัพธ์ก่อนหน้าว่าจะลองอะไรต่อไป ผู้ใช้ยังสามารถจำกัดจำนวนรอบ เวลารวม และเงื่อนไขการหยุดล่วงหน้าได้ หรือกำหนดว่า "ต่อไปให้แก้แค่ optimizer"


OpenScience ทำให้การวนซ้ำการทดลองที่เดิมนักวิจัยต้องคอยเฝ้าดูซ้ำๆ เป็นแบบอัตโนมัติ: เสนอแผน ดำเนินการทดลอง เปรียบเทียบตัวชี้วัด คัดแผนที่ล้มเหลวออก แล้วดำเนินการรอบถัดไป การทดลองสามารถรันบนเครื่องท้องถิ่น หรือมอบให้ GPU ระยะไกล เซิร์ฟเวอร์ SSH และคลัสเตอร์ Slurm/PBS ได้ โค้ด ผลลัพธ์ และการตัดสินใจของแต่ละรอบการทดลองจะถูกบันทึกไว้เพื่อความสะดวกในการตรวจสอบภายหลัง


นอกจากนี้ยังรองรับการเข้าสู่ระบบด้วยการสมัครสมาชิก ChatGPT/Codex โดยตรง หรือจะเชื่อมต่อ API Key ของตัวเอง โมเดลท้องถิ่น หรือใช้ Ace ของทางการที่คิดค่าบริการตามการใช้งานก็ได้


ในการทดสอบเองของทางการ OpenScience ทำสำเร็จ 53 จาก 70 ภารกิจ Terminal-Bench Science คิดเป็นคะแนน 75.7% เมื่อเทียบกันแล้ว ผลงานสาธารณะของ Codex + GPT-6 Astra อยู่ที่ 68.1%

แก้ไข/รายงาน
ส่ง
เพิ่มคลัง
เห็นได้เฉพาะตัวเอง
สาธารณะ
บันทึก
เลือกคลัง
เพิ่มคลัง
ยกเลิก
เสร็จสิ้น