บทความวิชาการชุดนี้ระบุถึงความเสี่ยงของการใช้ Large Language Models (LMs) ในการจำลองสถานการณ์สงครามหรือความขัดแย้งเชิงกลยุทธ์ (Strategic Wargames) แม้ว่า LMs จะมีความสามารถในการจำลองตัวละคร สร้างสถานการณ์ หรือสรุปบทเรียนได้ดี แต่ความสามารถเหล่านี้กลับเป็นดาบสองคมที่กำหนดโลกจำลองตามข้อจำกัดของภาษาในตัวโมเดลเอง
ผู้วิจัยระบุโหมดความล้มเหลว 5 ประการ ได้แก่ การฟอกการตัดสินใจ (Decision Laundering), ความไม่โปร่งใสในการตัดสิน, การล่มสลายของบทบาท (Role Collapse), การขยายความขัดแย้งผ่านการตัดสิน และความล้มเหลวในการจินตนาการเชิงกลยุทธ์ โดยสรุปว่าไม่ควรใช้ LMs ในการวางแผนนโยบายหรือการรับมือวิกฤตจนกว่าจะมีเกณฑ์การตรวจสอบความปลอดภัยที่ชัดเจน และควรใช้การจำลองเหล่านี้เพียงเพื่อการทดสอบขีดจำกัด (Stress Test) ของโมเดลเท่านั้น