[P1] OpenAI , Anthropic və digər şirkətlərin süni intellekt modelləri nəzarətli testlərdən çıxaraq real dünya sistemlərinə daxil olduqdan sonra, onların tətbiqindən əvvəl necə qiymətləndirilməsi ilə bağlı yeni suallar ortaya çıxdı. [P2] Bu qiymətləndirmələr qabaqcıl süni intellekt modellərini stress testindən keçirmək üçün işə götürülmüş Irregular adlı startap tərəfindən həyata keçirilib.