ความหวังเรื่องการพัฒนาตนเองแบบเรียกซ้ำ (Recursive Self-improvement) ของ AI อาจยังไม่เกิดขึ้นในเร็วๆ นี้ โดยทีมนักวิจัยนำโดย Princeton University พบว่า AI เอเจนท์ในปัจจุบันยังขาดทักษะสำคัญในการทำวิจัยแบบเปิดกว้าง (Open-ended Research) ที่ต้องใช้ความคิดสร้างสรรค์และรสนิยมทางวิชาการ
ในการทดสอบผ่านวิธี 'Shadow Evaluation' โดยให้ Claude Opus 4.8 ตอบคำถามวิจัยจากบทความที่ยังไม่เผยแพร่ ผลปรากฏว่า AI สามารถจัดการงานวิศวกรรม เช่น การรันการทดลองนับร้อยครั้งได้อย่างดีเยี่ยม แต่ในแง่ของคุณภาพงานวิจัยกลับถูกปฏิเสธโดยผู้ประเมินเนื่องจากงานเขียนขาดความลึกซึ้ง ไม่สามารถแก้ไขทิศทางการวิจัยเมื่อพบทางตัน และมักจะยึดติดกับแนวทางที่ไม่มีประสิทธิภาพ