ทีมนักวิจัยได้เปิดเผยผลการศึกษาในงานประชุม AI ระดับโลก โดยระบุว่าโมเดลภาษาขนาดใหญ่ (LLM) ยอดนิยมในปัจจุบันมีข้อบกพร่องเชิงโครงสร้างที่ทำให้ยากต่อการรักษาความปลอดภัยอย่างสมบูรณ์ ปัญหานี้อยู่ที่ตัวโมเดลไม่สามารถแยกแยะได้ว่าคำสั่งใดมาจากแหล่งที่เชื่อถือได้และคำสั่งใดเป็นส่วนหนึ่งของข้อมูลที่ป้อนเข้ามา
นักวิจัยสามารถทดสอบด้วยการทำให้โมเดลคายข้อมูลที่ถูกสั่งห้ามไว้ เช่น วิธีการผลิตสารเสพติดหรือการทำลายระบบนำทางของเครื่องบินพาณิชย์ นอกจากนี้ยังมีประเด็นสำคัญในวงการวิทยาศาสตร์ เมื่อ Google DeepMind ปรับโครงสร้างทีม AlphaFold เพื่อมุ่งเน้นไปที่การสร้างระบบ AI ทั่วไป (General agents) สำหรับวิทยาศาสตร์แทนเครื่องมือเฉพาะทาง ซึ่งสะท้อนถึงการเปลี่ยนแปลงครั้งใหญ่ในทิศทางการใช้ AI เพื่อการวิจัย