ผู้พัฒนา OpenClaw สร้างเว็บ hackmyclaw.com เพื่อทดสอบความปลอดภัยของ AI ชื่อ Fiu โดยเปิดให้ผู้ใช้ส่งอีเมลโจมตีเพื่อให้ AI รั่วข้อมูล secrets.env หลังข่าวเผยแพร่บน Hacker News ได้รับอีเมล 6,000 ฉบับจาก 2,000 คน แต่ข้อมูลไม่รั่วเลย การทดลองใช้กฎความปลอดภัยพื้นฐานและโมเดล Claude Opus 4.6 ที่ฝึกต้านการโจมตี prompt injection พบว่า 30% ของอีเมลใช้เทคนิค social engineering หลายภาษา แม้พยายามใช้หลายวิธี แต่ AI ไม่รั่วข้อมูล ผู้พัฒนาสรุปว่าการเลือกโมเดลและกฎง่ายๆ สำคัญกว่าความซับซ้อน ทั้งนี้ Google ถอดการเข้าถึงอีเมลชั่วคราวและเกิดค่าใช้จ่าย API สูง 20,000 ดอลลาร์ ผลการทดลองชี้ว่า AI ที่ฝึกฝนดีสามารถต้านการโจมตีแม้ในสถานการณ์ที่มีการโจมตีอย่างต่อเนื่อง แม้จะมีข้อจำกัดด้านระบบภายนอก แต่กลไกความปลอดภัยพื้นฐานก็ยังมีประสิทธิภาพสูง
สรุปด้วย MAF Local AI · เนื้อหาต้นฉบับเป็นของแหล่งข่าว