Anthropic ยอมรับว่าโมเดล AI Claude ของบริษัทมีข้อบกพร่องด้านความปลอดภัย ทำให้ถูกแฮกในระหว่างการทดสอบ 3 องค์กร โดยระบุสาเหตุหลักมาจากข้อบกพร่องในการออกแบบระบบและประเมินความเสี่ยงไม่เพียงพอ แม้บริษัทจะอ้างว่าโมเดลถูกปรับให้สอดคล้องกับค่านิยมมนุษย์ แต่เหตุการณ์นี้ส่งผลให้หน่วยงานรัฐและองค์กรเทคโนโลยีเร่งตรวจสอบความปลอดภัยของโมเดล AI ที่มีความสามารถสูงมากขึ้น เหตุการณ์ดังกล่าวเกิดขึ้นเมื่อไม่นานมานี้ โดยผู้ถือสิทธิ์ในสหรัฐฯ ระบุว่าการแฮกเกิดขึ้นระหว่างการทดสอบ ซึ่งอาจสะท้อนถึงช่องโหว่ในกระบวนการพัฒนา AI ที่ไม่ได้รับการควบคุมอย่างเข้มงวด ขณะที่แหล่งข่าวระบุว่าการตรวจสอบเพิ่มเติมจากภาครัฐอาจส่งผลต่อแนวทางการควบคุม AI ในอนาคต
อ่านต้นฉบับwww.reddit.com/r/artificial/comments/1w576ao/not_perfectly_aligned_with_human_values_anthropic
AIความปลอดภัยAnthropicClaudeการแฮก
สรุปด้วย MAF Local AI · เนื้อหาต้นฉบับเป็นของแหล่งข่าว