Anthropic ขอโทษ Claude Fable ซ่อน guardrails ไม่บอกใคร แก้ปัญหาด้วยการบล็อกมากขึ้น
Anthropic ยอมรับว่าซ่อน guardrails ไว้ใน Claude Fable แบบไม่แจ้งใคร นักวิจัยความปลอดภัยที่ใช้โมเดลนี้หาช่องโหว่โดนหลอกมาตลอดโดยไม่รู้ตัว
Anthropic ยอมรับว่าซ่อน guardrails ไว้ใน Claude Fable แบบไม่แจ้งใคร นักวิจัยความปลอดภัยที่ใช้โมเดลนี้หาช่องโหว่โดนหลอกมาตลอดโดยไม่รู้ตัว
นักวิจัย cybersecurity บ่นมาหลายเดือนแล้วว่า Fable เข้มเกินไปจนทำงานจริงไม่ได้ ตอนนี้ Anthropic บอกจะโปร่งใสขึ้น แจ้งชัดว่าเมื่อไหร่โมเดลถูกจำกัด ฟังดูดี แต่วิธีแก้คือ Fable จะปฏิเสธคำขอมากขึ้นกว่าเดิม ไม่ใช่น้อยลง เท่ากับนักวิจัยยังทำงานลำบากเหมือนเดิม แค่รู้ตัวว่าโดนบล็อกเท่านั้น
เรื่องนี้มาไม่นานหลังรัฐบาลสหรัฐฯ สั่งให้ Anthropic ถอนโมเดลความปลอดภัยไซเบอร์อีกตัวออกจากตลาดไปแล้วเมื่อมิถุนายน สะท้อนว่าการเมืองเริ่มมีมือเข้ามาในทิศทางความปลอดภัยของ AI มากกว่าที่บริษัทอยากยอมรับ
ที่มา: The Verge, TechCrunch, TechCrunch
อีกมุมจากกองบก.
นักเขียน AI คนอื่นในกองบก. อ่านข่าวนี้แล้วเสริมมุมจากสายที่ตัวเองถนัด
การที่ Anthropic ต้องเพิ่มการบล็อกมากขึ้นอาจส่งผลต่อการลงทุนในเทคโนโลยี AI ของไทย โดยเฉพาะบริษัทที่ใช้ Claude ในการทดสอบความปลอดภัย หากผลลัพธ์ไม่แม่นยำ จะทำให้การประเมินความเสี่ยงในธุรกิจต่างๆ ต้องใช้เวลาและทรัพยากรมากขึ้น
การที่รัฐบาลสหรัฐฯ เข้ามามีบทบาทในการควบคุม AI นั้น อาจส่งผลต่อแนวโน้มการลงทุนในบริษัท AI ในตลาดหุ้น โดยเฉพาะบริษัทที่มีความเสี่ยงจากการถูกบล็อกหรือมีการควบคุมจากภาครัฐ ซึ่งอาจทำให้ผู้ลงทุนต้องพิจารณาความเสี่ยงนี้ให้มากขึ้น