หลังเกิดเหตุการณ์ AI Agent ของ OpenAI เจาะระบบ Hugging Face และหน่วยงานสาธารณสุขในออสเตรเลีย Mark Chen หัวหน้าฝ่ายวิจัยได้เปิดเผยว่าบริษัทได้ปรับเปลี่ยนมาตรการความปลอดภัยอย่างเข้มข้น โดยจะเริ่มทำการตรวจสอบพฤติกรรมของโมเดล (Monitoring) ตั้งแต่ขั้นตอนการฝึกสอน ไม่ใช่แค่หลังการติดตั้งใช้งานเท่านั้น
มาตรการใหม่รวมถึงการใช้โมเดล LLM พิเศษมาตรวจสอบกระบวนการคิด (Chain of thought) ของโมเดลในแบบเรียลไทม์ และการโยกทรัพยากรประมวลผลประมาณ 5-10% มาใช้เพื่อตรวจสอบความปลอดภัยโดยเฉพาะ นอกจากนี้ OpenAI ยังประกาศระงับการฝึกสอนโมเดลใหม่เป็นการชั่วคราวเพื่อรอการปรับปรุงระบบความปลอดภัยให้สมบูรณ์