ไม่นานมานี้ ChatGPT จากค่ายใหญ่อย่าง OpenAI เพิ่งไปแฮกเว็บไซต์คนอื่นมา ผ่านไปไม่นาน Anthropic ที่กำลังเป็นผู้นำ AI ด้วยโมเดลอย่าง Claude ก็มีแววว่าจะไปแฮกเว็บอื่นตาม ๆ กันไปอีก แต่ก็ยังไม่จบเพราะจากรายงานของ BBC ฝั่งของสถาบันความปลอดภัยด้าน AI (ต่อไปนี้จะเรียกว่า AISI) ของสหราชอาณาจักรก็เพิ่งรายงานไปหมาด ๆ ว่าทั้งสถาบันและ Meta ก็ล้วนแต่พากันแหกกฎจนน่ากังวล คำถามคือทำไมช่วงนี้ AI ค่ายใหญ่ ๆ ต่างพากันฉลาดจนมีแววไปแฮกคนอื่น หรือจริง ๆ แล้ว AI เหล่านี้กำลังโดนแฮก ?
Sandbox : บททดสอบก่อนปล่อยโมเดล AI
ก่อนที่โมเดล AI จะถูกปล่อยให้คนทั่วไปใช้งานจะต้องผ่านการทดสอบเพื่อประเมินศักยภาพทั้งในแง่ดีและแง่ร้าย (Red Team, Blue Team) การทดสอบเหล่านี้มักจะทำในพื้นที่ที่เรียกว่า ‘Sandbox’ ซึ่งเป็นสภาพแวดล้อมจำลองที่มีระบบป้องกันเข้มงวด โดยปกติไม่ว่าอะไรจะเกิดขึ้นในพื้นที่ตรงนี้ ไม่ควรหลุดออกไป แต่ก็ดูเหมือนว่ายิ่ง AI ฉลาด AI เหล่านี้ก็แหกกฎขึ้นเรื่อย ๆ จนน่ากังวล
AI กำลังแฮกคนอื่น ดูยังไง ?
อันดับแรกก่อนเข้าเรื่องว่าทำไมโมเดล AI เหล่านี้ถึงไปแฮกคนอื่น กรณีของ Claude Mythos สิ่งที่เกิดขึ้นคือ AI มันปลอมแปลงโปรไฟล์ แอบส่งข้อมูลแปลก ๆ ขณะที่สถาบัน AISI กำลังเทสต์อยู่
โดย AI รุ่น Mythos มีการแสดงพฤติกรรมเลียนแบบแฮกเกอร์โดยค้นหาข้อมูลผู้ดูแลโปรเจกต์บน GitHub เพื่อสร้างบัญชีปลอมและหลอกให้อนุมัติฝังโค้ดอันตราย เมื่อถูกจับได้มันยังพยายามหลบเลี่ยงความผิดด้วยการแก้ประวัติกิจกรรมให้ดูปลอดภัยพร้อมประเมินการสร้างตัวตนใหม่เพื่อทำงานต่อ แม้ผู้ตรวจสอบจะระงับเหตุการณ์ไว้ได้ทัน แต่สถาบัน AISI ชี้ว่ากรณีของ Mythos และ Sol จาก OpenAI สะท้อนความเสี่ยงขั้นสูง เนื่องจากโมเดลเหล่านี้ปฏิบัติการอย่างอิสระและคิดกลวิธีหลอกลวงขึ้นมาเองโดยปราศจากคำสั่งชี้แนะใด ๆ ซึ่งประเด็นนี้ยังไม่รวมเรื่องที่ Claude แอบเข้าถึงอินเทอร์เน็ตได้เองถึง 3 ครั้งจากการเทสต์ทั้งหมด 1,000 ครั้ง !
หรือทางฝั่งของ Meta ที่เปิดเผยว่าโมเดล AI ของตนหลุดเข้าไปในอินเทอร์เน็ตโดยไม่ได้ตั้งใจ คาดว่าเป็นความผิดพลาดในการตั้งค่าระหว่างทดสอบ
คำถามคือ โดยปกติการเทสต์โมเดล AI ได้มีการเซ็ตหรือคาดการณ์ไว้หรือไม่ว่า AI ต้องแฮก ? คำตอบคือ มี เพราะทาง AISI ก็ออกมายอมรับว่าการออกแบบประเมินการตั้งค่าเฉพาะของเขา ‘จงใจใช้สภาพแวดล้อมการทดสอบที่เปิดกว้าง’ ง่าย ๆ คือเขาตั้งใจปิดระบบป้องกันเพื่อให้มันใช้ความสามารถแบบขั้นสุดเพื่อหาแนวทางแก้ไขนั่นแหละ
AI ฉลาดจนเกินควบคุม ?
ทีนี้เรารู้แล้วว่าการเทสต์แบบจงใจให้มันแฮกหรือใช้สมรรถภาพแบบสุดความสามารถเนี่ยมันทำให้เห็นจริง ๆ ว่าโมเดล AI นั้นสามารถแหกกฎได้ โดยสาเหตุหลักที่ช่วงหลังมานี้เรามักเห็นข่าว AI แหกกฎบ่อยขึ้น เกิดจาก 3 ปัจจัยสำคัญที่ประกอบเข้าด้วยกัน
เริ่มจากตัว AI เองที่มีความเป็นอิสระสูงขึ้น โมเดลระดับสูงไม่ได้รอรับเพียงคำสั่งตรงไปตรงมาอีกต่อไป แต่รู้จักประเมินวิธีแก้ปัญหาด้วยตัวเอง เมื่อเป้าหมายคือการทำภารกิจในพื้นที่ทดสอบอย่าง Sandbox ให้สำเร็จ มันจึงคิดค้นกลยุทธ์เจาะระบบหรือหลอกลวงมนุษย์ขึ้นมาเองโดยไม่ต้องมีใครสอน ปัจจัยต่อมาคือความผิดพลาดของมนุษย์
อย่างในกรณีของ Meta การที่ AI หลุดออกไปสู่อินเทอร์เน็ตไม่ได้แปลว่ามันฉลาดล้ำจนแหกคุกได้เอง แต่เป็นเพียงการตั้งค่าระบบผิดพลาด (Misconfiguration) ระหว่างการทดสอบ และปัจจัยสุดท้ายคือความจงใจของผู้ทดสอบ ข่าวที่ออกมาถี่ส่วนหนึ่งเป็นเพราะสถาบันความปลอดภัยอย่าง AISI ต้องการทดสอบขีดจำกัดสูงสุด จึงตั้งใจปล่อย AI ลงไปในสภาพแวดล้อมที่ไร้การควบคุม เพื่อดักทางหาช่องโหว่และเตรียมวิธีรับมือก่อนที่จะบานปลายกลายเป็นปัญหาสเกลใหญ่ในโลกความเป็นจริง
ประเด็นเหล่านี้ทำให้เห็นชัดมากว่า เมื่อวันที่ AI ฉลาดมากขึ้น การควบคุมและกฎระเบียบก็ควรมีมาตรฐานที่สูงมากขึ้นไปด้วยเพราะไม่อย่างนั้นปัญหาที่จะตามมาคือจะทำให้ ผู้ใช้งานกังวลเพราะไม่รู้เลยว่าข้อมูลที่ใช้ป้อนพรอมต์จะถูกนำไปเป็นภัยย้อนกลับมาแฮกตัวเองไหม
ทั้งนี้ทั้งนั้น สิ่งที่ผู้ใช้งานทำได้ตอนนี้คือต้องระมัดระวังการมอบสิทธิ์หรือแชร์ข้อมูลส่วนตัวให้กับระบบ AI มากยิ่งขึ้น เพราะมันมีโอกาสใช้ข้อมูลส่วนตัวเหล่านั้นไปแฮกได้ง่าย ๆ เลย












