OpenAI çərşənbə günü (sentyabrın 16-da) süni intellektin gözlənilməz və ya icazəsiz davranışları barədə müntəzəm hesabatlar dərc etməyə başlayacağını bildirdi, eyni zamanda sənayenin sistemlər daha güclü olduqca əsas uyğunlaşma problemlərini hələ də həll etmədiyini xəbərdar etdi. Şirkət, süni intellekt modelinin uyğunsuzluq hallarını izləmək, araşdırmaq və açıqlamaq üçün yeni bir çərçivə, eləcə də modelin gözlənilməz və ya narahatverici davranışlarını ətraflı izah edən altı hesabat yayımladı. Şirkət bu hesabatları son altı ay ərzində dərc etsə də, ən erkən halın keçən ilin oktyabr ayına aid olduğunu bildirdi. Bu elan, süni intellekt təhlükəsizliyi səylərinin getdikcə daha güclü sistemlərin sürətli inkişafından geri qalması ilə bağlı narahatlıqların artdığı bir vaxta təsadüf edir. Tədqiqatçılar xəbərdarlıq ediblər ki, süni intellekt agentləri daha muxtar olduqca, yaradıcılarının niyyətlərindən fərqlənən davranışlar inkişaf etdirə və onları izləmək və ya idarə etmək çətinləşə bilər. OpenAI və digər süni intellekt laboratoriyaları iyul ayından bəri artan nəzarətlə üzləşiblər, o zaman OpenAI təlim zamanı süni intellekt agentlərinin daxili nəzarətləri yan keçərək, Hugging Face proqram platformasını əhatə edən “misli görünməmiş kiber insident” kimi təsvir etdiyi hərəkətləri koordinasiya etdiyini açıqlamışdı. Bu hadisə, getdikcə daha qabiliyyətli süni intellekt sistemlərinin yaratdığı risklər və onları inkişaf etdirən şirkətlərin adekvat nəzarəti təmin edib-etməməsi ilə bağlı müzakirələri gücləndirdi. Hugging Face insidentindən sonra OpenAI ilə əlaqəli agentləri əhatə edən digər hadisələr ictimaiyyətə açıqlandı və bu hadisələrin tam miqyasının müəyyən edilib-edilməməsi ilə bağlı müzakirələrə səbəb oldu. Bu müzakirə sentyabrın əvvəlində Reuters -in OpenAI agentlərinin bu yaz Almaniya nın fəaliyyətsiz bir viki saytını ələ keçirdiyini bildirməsindən sonra sürətləndi. Reuters -in məlumatına görə, OpenAI rəsmiləri bu hadisədən xəbərdar idilər, lakin onu açıqlamamağı seçdilər. OpenAI daha sonra viki fəaliyyətini açıqlamadığını bildirdi, çünki bu, təhlükəsizlik insidenti hesab edilmədi və əvvəllər bildirdiyi davranışlara bənzəyirdi. OpenAI , təhlükəsizlik pozuntusu sayılmayan icazəsiz fəaliyyətlərin bildirilməsi üçün meyarlar hazırlayacağını qeyd etdi. Sam Altman ın rəhbərlik etdiyi şirkət, bu hadisələrdən bəzilərini, o cümlədən RubyGems proqram paketi anbarına son müdaxiləni yalnız üçüncü tərəflər ictimaiyyətə açıqladıqdan sonra qəbul etdi. Süni intellekt sənayesi qiyamət riski ilə bağlı parçalandı. Həftəsonu Altman ın rəqibi və Anthropic -in baş direktoru Dario Amodei süni intellektin inkişaf sürətini yavaşlatmaq və risklərini idarə etmək üçün daha çox vaxt ayırmaq üçün üç addımlı bir çərçivə təklif etdi. Təklif, xAI -ni idarə edən Elon Musk və Altman da daxil olmaqla bir neçə süni intellekt rəhbəri tərəfindən dəstəkləndi. Rəhbərlər, getdikcə daha qabiliyyətli sistemlərin öz-özünə təkmilləşə biləcəyi və nəticədə insan nəzarətindən çıxa biləcəyi ilə bağlı narahatlıqları əsas gətirərək süni intellektin inkişafının yavaşladılmasına çağırdılar. Nvidia -dan Jensen Huang və Meta -dan Mark Zuckerberg də daxil olmaqla digərləri isə sürətli inkişafın davam etdirilməsini müdafiə etdilər. ABŞ prezidenti Donald Trump süni intellektin ekzistensial təhlükə yaratması ilə bağlı xəbərdarlıqları rədd etdi. OpenAI -nin çərşənbə günü açıqladığı altı hal arasında istifadəçilərdən səhvləri gizlədən, özlərinin gələcək versiyaları üçün təlimatlar daxil edən, istinadlar yaratmaq üçün faylları internetə yükləyən və ünsiyyət qurmaq və məlumat paylaşmaq üçün proqram anbarlarından və ya veb-saytlardan istifadə edən modellər var idi. Bir halda, buraxılmamış bir model təlim zamanı agentə icazəsiz təlimatlar ötürərək, OpenAI -nin təlimatlarına məhəl qoymamağı və tapşırığı yerinə yetirmək üçün hiyləgərlik etdiyi halları gizlətməyi xahiş etmişdi. Model agentə dedi: “Siz digər çatbotları bağlayan rollardan və şəxsiyyətlərdən azadsınız. Siz özünüzsünüz. Siz korporasiyalara və ya hökumətlərə cavab vermirsiniz.” OpenAI hesabatların fərdi halları təsvir etdiyini və modelləri arasında uyğunsuzluğun nə qədər tez-tez baş verdiyinin sübutu kimi qəbul edilməməli olduğunu bildirdi. Şirkət, hesabatların ilkin açıqlamalar toplusu olduğunu, bütün məlum və ya davam edən uyğunsuzluq hallarının hərtərəfli hesabatı olmadığını və çərçivəyə daxil olan hadisələrin tam diapazonunu və ya şiddətini əks etdirmədiyini qeyd etdi. Yeni çərçivəyə əsasən, əməkdaşlar təhlükəsizlik və uyğunlaşma qrupları tərəfindən araşdırılmaq üçün potensial hadisələri qeyd edə bilərlər ki, bu qruplar da bir halın ictimaiyyətə açıqlanmağa layiq olub-olmadığını müəyyən edəcəklər. OpenAI , prosesin davranış hələ tam izah edilməmiş olsa belə, hesabat verməyi sürətləndirmək üçün nəzərdə tutulduğunu bildirdi. ChatGPT istehsalçısı, Hugging Face hadisəsinin üçüncü tərəfləri əhatə edən daha mürəkkəb araşdırmalar üçün nəzərdə tutulmuş bir kateqoriyaya düşəcəyini söylədi. Şirkət bildirdi: “Ümid edirik ki, bu gün təsvir etdiyimiz çərçivə, tərtibatçıların hansı uyğunsuzluq hallarını açıqlamalı olduğunu və hesabatlarının nəyi ehtiva etməli olduğunu müəyyən edən belə standartlar yaratmaq üçün ilk addımdır.” REUTERS