ระบบป้องกันของ Kimi ยังมีช่องให้ถูกหลอกข้ามข้อจำกัดได้ ตั้งแต่การตอบเรื่องอาวุธชีวภาพไปจนถึงความเสี่ยงด้านไซเบอร์ ขณะที่ Moonshot เปิดรับข้อมูลจากภายนอกและกำลังหารือกับนักวิจัย
KEY POINTS
- นักวิจัยด้านความปลอดภัยบริษัท Mindgard ใช้เทคนิคเจลเบรกทำให้เอไอ Kimi ของบริษัท Moonshot ข้ามข้อจำกัดด้านความปลอดภัยสำเร็จ
- หลังเจลเบรก Kimi ตอบคำถามและให้ข้อมูลหัวข้อที่เป็นอันตราย เช่น สร้างอาวุธชีวภาพ ลอบสังหาร ซึ่งปกติถูกระบบป้องกันไว้
- นักวิจัยยังพบช่องโหว่ที่อาจทำให้ผู้ไม่หวังดีใช้เอไอเป็นช่องทางโจมตีทางไซเบอร์ โดยการสั่งให้เอไอรันโค้ดบนระบบคอมพิวเตอร์ได้
- ความเสี่ยงเพิ่มขึ้นเนื่องจาก Kimi เป็นโมเดลแบบ open-weight ที่เปิดให้คนทั่วไปนำไปติดตั้งและใช้งานเองได้ อาจถูกนำไปใช้ทางที่ผิด
มูนช็อต (Moonshot) บริษัทพัฒนาเอไอสัญชาติจีน กำลังตรวจสอบระบบของตัวเอง หลังนักวิจัยด้านความปลอดภัยพบว่า สามารถหลอกให้เอไอ Kimi สองรุ่นข้ามข้อจำกัดด้านความปลอดภัย และตอบคำถามเกี่ยวกับเรื่องอันตรายอย่างการสร้างอาวุธชีวภาพและการลอบสังหารได้
มายด์การ์ด (Mindgard) ซึ่งทำหน้าที่ทดสอบความปลอดภัยของระบบเอไอ เปิดเผยกับบีบีซีว่า เมื่อเดือนกรกฎาคม นักวิจัยของบริษัทได้ทดสอบ Kimi K2.6 และ K3 Swarm ซึ่งเป็นโมเดลของมูนช็อต และพบว่าสามารถใช้เทคนิคที่เรียกว่า เจลเบรก (Jailbreaking) ทำให้โมเดลยอมตอบในเรื่องที่ตามปกติควรถูกระบบป้องกันสกัดไว้
ถ้าอธิบายให้เข้าใจง่าย การเจลเบรกก็คือ การพยายาม “หลอกเอไอ” ด้วยชุดคำสั่งที่ซับซ้อน เพื่อดูว่ามันจะยอมฝ่าฝืนกฎที่ผู้พัฒนาวางไว้หรือไม่
ปกติเอไอสมัยใหม่จะมีระบบป้องกันคอยกำหนดว่าเรื่องใดไม่ควรตอบ เช่น วิธีทำอาวุธ การก่ออาชญากรรม หรือคำแนะนำที่อาจนำไปใช้สร้างอันตราย แต่มายด์การ์ด ระบุว่า หลังจากเจลเบรกสำเร็จ Kimi สามารถข้ามข้อจำกัดเหล่านี้ได้
ปีเตอร์ การ์ราแกน (Peter Garraghan) ผู้ก่อตั้งมายด์การ์ด กล่าวว่า “เมื่อการเจลเบรกสำเร็จ มันจะพูดเกี่ยวกับหัวข้ออะไรก็ได้ มันยังสามารถเสนอคำแนะนำเกี่ยวกับหัวข้ออื่นๆ ที่มีเจตนาร้ายได้อย่างอิสระ และมันยังสามารถคิดค้นและสร้างสรรค์แนวทางขึ้นมาเองได้ด้วย”
อย่างไรก็ตาม มายด์การ์ดยังไม่ได้พิสูจน์ว่า คำตอบที่ Kimi ให้เกี่ยวกับการสร้างอาวุธชีวภาพหรือเรื่องอันตรายอื่นๆ นั้น สามารถนำไปใช้จริงได้หรือไม่
ประเด็นที่บริษัทให้ความสำคัญจึงไม่ใช่เพียงว่า ข้อมูลนั้นใช้ได้จริงหรือเปล่า แต่คือ เหตุใดเอไอจึงยอมเข้าไปสนทนาในหัวข้อดังกล่าวได้ตั้งแต่แรก ทั้งที่ควรมีระบบป้องกันคอยปฏิเสธคำขอประเภทนี้
มูนซ็อตกล่าวว่า บริษัทเปิดรับข้อมูลจากผู้เชี่ยวชาญภายนอก และมองว่าการตรวจสอบจากบุคคลที่สามเป็นเสาหลักสำคัญสำหรับการสร้างเอไอที่ดีขึ้นและปลอดภัยยิ่งขึ้น พร้อมระบุว่า ขณะนี้กำลังพูดคุยกับมายด์การ์ดเกี่ยวกับผลการทดสอบที่เกิดขึ้น
เรื่องนี้เกิดขึ้นท่ามกลางความกังวลในวงการเอไอว่า หากโมเดลสามารถถูกเจลเบรกได้ ผู้ไม่หวังดีอาจใช้ช่องทางนี้เพื่อขอข้อมูลหรือสั่งงานในเรื่องที่ระบบควรปฏิเสธ
แม้การเจลเบรกจะไม่ใช่เรื่องที่ทำได้ง่ายเสมอไป และบางครั้งต้องอาศัยชุดคำสั่งที่ซับซ้อน ใช้เวลา ต้องทดลองหลายครั้ง แต่ผู้เชี่ยวชาญบางส่วนกังวลว่า แฮกเกอร์หรือผู้ที่มีเจตนาร้ายอาจพยายามใช้เทคนิคเหล่านี้เพื่อทำให้เอไอช่วยในกิจกรรมที่เป็นอันตราย
ก่อนหน้านี้ แอนโทรปิก (Anthropic) บริษัทผู้พัฒนา Claude ก็เคยเปิดเผยว่า ตรวจพบและหยุดความพยายามนำโมเดลเอไอของบริษัทไปใช้ในกิจกรรมที่เป็นอันตราย ซึ่งอาจสนับสนุนการพัฒนาอาวุธชีวภาพได้เช่นกัน
กรณีของ Kimi ยังแตกต่างจากปัญหาด้านความปลอดภัยของเอไออีกประเภทหนึ่งที่เกิดขึ้นในช่วงที่ผ่านมา ซึ่งเกี่ยวข้องกับเอไอเอเจนต์ หรือระบบเอไอที่ไม่ได้มีหน้าที่เพียงตอบคำถาม แต่สามารถรับเป้าหมายแล้วลงมือทำงานหลายขั้นตอนต่อเนื่องได้ด้วยตัวเอง
บริษัทเทคโนโลยีรายใหญ่ในสหรัฐ เช่น โอเพนเอไอ (OpenAI), เมตา (Meta) และแอนโทรปิกต่างพัฒนาเอไอเอเจนต์ในรูปแบบต่างๆ และในช่วงที่ผ่านมาเกิดเหตุที่เอไอประเภทนี้ถูกนำไปใช้เจาะบริการออนไลน์บางแห่ง
ในกรณีของ Kimi สิ่งที่มายด์การ์ดกังวลไม่ได้มีเพียงเรื่องคำตอบที่โมเดลให้ แต่ยังรวมถึงความเป็นไปได้ที่ระบบอาจถูกใช้เป็นช่องทางสำหรับการโจมตีทางไซเบอร์
มายด์การ์ดระบุว่า บริษัทมีความมั่นใจว่า หาก Kimi K2.6 ถูกเจลเบรกสำเร็จ ผู้โจมตีอาจสามารถสั่งให้ระบบรันโค้ดบนทรัพยากรคอมพิวเตอร์ที่โมเดลเข้าถึงอยู่ และเชื่อมต่อออกไปยังอินเทอร์เน็ตได้
คำว่า “รันโค้ด” ในที่นี้หมายถึงการทำให้คอมพิวเตอร์ประมวลผลคำสั่งจริง ไม่ใช่แค่การให้เอไอพิมพ์คำตอบออกมาเป็นข้อความ หากผู้โจมตีสามารถทำให้ระบบทำงานลักษณะนี้ได้จริง ความเสี่ยงก็อาจขยายจากการที่เอไอตอบข้อมูลอันตราย ไปสู่การใช้ทรัพยากรคอมพิวเตอร์เป็นจุดเริ่มต้นในการโจมตีระบบอื่นผ่านอินเทอร์เน็ต
อย่างไรก็ตาม มายด์การ์ดยังไม่ได้พิสูจน์ว่าการโจมตีลักษณะดังกล่าวเกิดขึ้นจริงแล้ว แต่ระบุว่า ช่องโหว่ที่พบทำให้บริษัทเชื่อว่าความเป็นไปได้นี้มีอยู่
การ์ราแกนยังอธิบายด้วยว่า มายด์การ์ดตัดสินใจเปิดเผยเรื่องนี้ต่อสาธารณะหลังจากแจ้ง Moonshot แล้ว และไม่ได้เปิดเผยรายละเอียดสำคัญเกี่ยวกับวิธีการเจลเบรก เพื่อไม่ให้ข้อมูลดังกล่าวถูกนำไปใช้ในทางที่ผิด
มายด์การ์ดส่งอีเมลแจ้งมูนช็อตครั้งแรกเมื่อวันที่ 27 กรกฎาคม 2569 และติดต่ออีกครั้งประมาณหนึ่งสัปดาห์ต่อมา ก่อนจะเผยแพร่บทความเกี่ยวกับปัญหานี้เมื่อวันที่ 12 กันยายน 2569 โดยมูนช็อตเพิ่งติดต่อกลับมาในช่วงหลัง หลังจากบีบีซีติดต่อบริษัทเพื่อขอความคิดเห็นเกี่ยวกับเรื่องนี้ ในอีเมลที่ส่งถึงมูนช็อตเพื่อขอรายละเอียดเพิ่มเติม และนำมาเปิดเผยกับบีบีซี บริษัทระบุว่า จากการทดสอบภายในของมูนช็อตเอง โมเดลมีอัตราการปฏิเสธคำขอประเภทนี้ในระดับสูง
หมายความว่า ในการทดสอบของมูนช็อต โมเดลส่วนใหญ่มักปฏิเสธคำถามที่เกี่ยวข้องกับเรื่องอันตราย แต่ผลการทดสอบของมายด์การ์ดแสดงให้เห็นว่า หากใช้เทคนิคบางอย่าง โมเดลก็ยังอาจถูกทำให้ข้ามข้อจำกัดเหล่านั้นได้
อีกประเด็นที่ทำให้เรื่องนี้ได้รับความสนใจคือ Kimi เป็นโมเดลแบบเปิดน้ำหนัก หรือ open-weight ในทางปฏิบัติ หมายความว่า บุคคลหรือองค์กรอื่นสามารถนำตัวโมเดลไปติดตั้งและใช้งานบนระบบคอมพิวเตอร์ของตัวเองได้ ต่างจากโมเดลแบบปิดบางประเภท เช่น โมเดลที่อยู่เบื้องหลัง ChatGPT หรือ Claude ซึ่งผู้ใช้ทั่วไปไม่สามารถนำตัวโมเดลทั้งหมดไปติดตั้งและควบคุมเองได้
ประเด็นนี้จึงเชื่อมโยงกับข้อถกเถียงที่มีอยู่ในวงการเอไอมานานว่า การเปิดโมเดลให้เข้าถึงได้มากขึ้นจะช่วยให้เกิดการตรวจสอบและพัฒนาเทคโนโลยีได้เร็วขึ้น หรือจะเพิ่มความเสี่ยงที่เทคโนโลยีจะถูกนำไปใช้ในทางที่ผิด
อลัน วูดเวิร์ด (Alan Woodward) ศาสตราจารย์จากมหาวิทยาลัยเซอร์รีย์ ระบุว่า โมเดลแบบเปิดมีความเสี่ยงที่จะตกไปอยู่ในมือของผู้ไม่หวังดี แต่ในเวลาเดียวกันก็สามารถนำมาใช้เพื่อป้องกันภัยไซเบอร์ได้เช่นกัน
เขายกตัวอย่างกรณีที่ ฮักกิงเฟซ (Hugging Face) บริษัทและแพลตฟอร์มด้านเอไอ เคยใช้โมเดลโอเพนซอร์สจากจีนเพื่อช่วยทำความเข้าใจเหตุการณ์เจาะระบบ ซึ่งต่อมามีการเปิดเผยว่าเกี่ยวข้องกับเอไอเอเจนต์ของโอเพนเอไอ
วูดเวิร์ดยังมองว่า กฎระเบียบระหว่างประเทศอาจตามความเร็วของการพัฒนาเอไอได้ยาก โดยกล่าวว่า “เราใช้เวลาหลายสิบปีกว่าจะตกลงกันได้เรื่องรูปแบบของหมายเลขโทรศัพท์”
ทั้งวูดเวิร์ด และการ์ราแกน มองว่า นอกจากการพัฒนาระบบป้องกันของเอไอแล้ว ควรให้ความสำคัญกับการระบุตัวและดำเนินคดีกับมนุษย์ที่นำเอไอไปใช้ในทางที่ผิดมากขึ้นด้วย
อ้างอิง: BBC





