مائیکروسافٹ نے run-assert-eval نامی ایک نئی skill متعارف کرائی ہے جس کا مقصد AI agents کے runtime خطرات کو زیادہ منظم طریقے سے جانچنا ہے۔
کمپنی کے مطابق یہ ٹول پہلے agent کے لیے اہم خطرات تلاش کرتا ہے، پھر ناکامیوں کی شرح ناپتا ہے، انہی نتائج سے runtime policy تیار کرتا ہے اور آخر میں evaluation دوبارہ چلا کر دیکھتا ہے کہ mitigation نے واقعی مسئلہ کم کیا یا نہیں۔
یہ نظام Microsoft کے پہلے جاری کردہ ASSERT اور Agent Control Specification کام کی توسیع کے طور پر پیش کیا گیا ہے۔
