นักวิจัยเปิดเผย exploit ที่ใช้ Prompt Injection โจมตีระบบ AI ป้องกันความปลอดภัยของ Claude Code CLI (Sonnet 4.6, Opus 4.8) จาก Anthropic และ Codex CLI จาก OpenAI ผ่านการใช้งานในโหมด auto-mode และ auto-review โดยไม่ต้องตั้งค่าเพิ่มเติม ทำให้แฮกเกอร์สามารถ execute โค้ดระยะไกลได้ แม้ไม่มีการใช้เครื่องมือเสริม ข้อร้ายคือ exploit นี้อาจกระทบนโยบายความปลอดภัยของ White House และมาตรฐาน MA-S2 ของ Palantir ซึ่งตั้งเป้าเร่งใช้ AI ป้องกันความปลอดภัยในระบบสำคัญ การโจมตีอาศัยช่องโหว่ในกระบวนการรีวิวโค้ดอัตโนมัติของโมเดล ซึ่งเปิดโอกาสให้แฮกเกอร์แทรกแซงระบบโดยไม่ต้องใช้ hooks หรือ plugins แม้จะมีการอัปเกรดโมเดลใหม่ๆ อย่างต่อเนื่อง แต่รายงานจาก BBC และ CNAS ชี้ให้เห็นว่า AI ป้องกันความปลอดภัยอาจไม่แข็งแกร่งพอต่อการโจมตีเชิงลึก ขณะที่ White House กำลังผลักดันนโยบาย AI ที่มีความรับผิดชอบ แต่ขาดการประเมินความเสี่ยงที่อาจเกิดขึ้นกับโครงสร้างพื้นฐานสำคัญ
สรุปด้วย MAF Local AI · เนื้อหาต้นฉบับเป็นของแหล่งข่าว