นักพัฒนาสร้าง AI Agent ที่ทำงานอัตโนมัติได้ 4 วัน 8 ชม. 53 นาที แต่ปฏิเสธรับรองผลงานตามโปรโตคอลวิจัย โดยระบุว่าเป็นผลจากการตรวจสอบตนเอง (adversarial review) พบข้อผิดพลาด 3 ข้อรุนแรงและ 4 ข้อปานกลาง งานวิจัยนี้มี 5 ข้อสรุปหลัก ได้แก่ 1) ระบบตรวจสอบความถูกต้องของ AI ผ่าน adversarial review พบข้อผิดพลาด 2) ความเชื่อถือได้ของ agreement ในระบบ AI 3) ความท้าทายในการรับรอง evidence 4) ข้อจำกัดของระบบอัตโนมัติในระยะยาว 5) ข้อเสนอแนะปรับปรุง framework ของ AI ที่ทำงานแบบ agentic ข้อมูลทั้งหมดถูกบันทึกใน repository ที่ใช้ SHA-256 hash และ commit hash ตรวจสอบได้ พร้อมเปิดเผยเมื่อระบบวิจัยเสร็จสิ้น การทดลองใช้ disposition METHOD_NEEDS_REPAIR เพื่อแสดงความจำเป็นในการปรับปรุงระบบ งานวิจัยยังระบุว่าไม่มีผลทางวิทยาศาสตร์ใดถูกดำเนินการหรืออ้างอิง ข้อมูล repository ยังอยู่ในระหว่างตรวจสอบ แต่เปิดเผย hash และ commit ล่วงหน้าเพื่อให้ผู้อ่านตรวจสอบได้เมื่อ repository เปิดเผยเต็มรูปแบบในอนาคต
สรุปด้วย MAF Local AI · เนื้อหาต้นฉบับเป็นของแหล่งข่าว