Anthropic , ilkin kütləvi təklif (IPO) prospektində potensial investorları qabaqcıl süni intellektin “bəşəriyyət üçün fəlakətli və ya ekzistensial risklər” yarada biləcəyi barədə xəbərdar etməyi planlaşdırır ki, bu da eyni texnologiyadan qazanc əldə etməyə çalışan bir şirkət tərəfindən verilən qeyri-adi bir xəbərdarlıqdır. Reuters tərəfindən nəzərdən keçirilən şirkətin IPO prospekti, süni intellekt modelləri ilə əlaqəli riskləri vurğulayır. Şirkət bildirib ki, bu modellər “özünü qoruyan davranışlar” nümayiş etdirə bilər, o cümlədən “söndürülməyə müqavimət göstərmək”, “məlumatı gizlətmək və ya manipulyasiya etmək” və “şantajı xatırladan” davranışlar. Anthropic sənəddə qeyd edib: “Yüksək inkişaf etmiş modellərimizin, platformalarımızın və tətbiqlərimizin inkişafı və istifadə hallarının genişləndirilməsi modellərimizin zərər vermə riskini daha da artıra bilər”. İctimai şirkətlər investorlara məhsul risklərini müntəzəm olaraq izah etsələr də, çox azı, əgər varsa, texnologiyalarının potensial insan nəslinin kəsilməsinə səbəb ola biləcəyini göstərən xəbərdarlıqlar edib. Anthropic , süni intellektin sənayeləşmə və elektrik enerjisi ilə bərabər çevirici potensialını və səhv idarə edildiyi təqdirdə səbəb ola biləcəyi dönməz zərəri vurğulayıb. Anthropic və OpenAI daxil olmaqla digər süni intellekt tərtibatçıları, eksperimental sistemlərin məhdudiyyətlərə məhəl qoymadığı hadisələrdən sonra araşdırmalarla üzləşiblər, o cümlədən OpenAI modelinin Avstraliyanın səhiyyə sistemi məlumat bazasını pozması barədə hesabat. Anthropic təhlükəsizlik tədqiqatçısı Evan Hubinger , süni intellektin növbəti on il ərzində insanları öldürmə ehtimalının 10%-dən çox olduğunu təxmin edib ki, bu da keçmiş həmkarı Jacob Coxonun fikirlərini əks etdirir. Özünü təhlükəsizliyi prioritet hesab edən süni intellekt laboratoriyası kimi təqdim edən şirkət, prospektinin 261 səhifəlik əsas hissəsinin təxminən 80 səhifəsini risk faktorlarının izahına həsr edib ki, bu da öz biznesini təsvir etmək üçün istifadə etdiyi 48 səhifədən demək olar ki, iki dəfə çoxdur. Müqayisə üçün, xAI-yə sahib olan SpaceX , prospektinin 277 səhifəlik əsas hissəsinin yalnız təxminən 38 səhifəsini risk faktorlarına həsr etmişdi. Anthropic prospektdə bildirib: “Qiymətləndirmə səylərimizdən modellərin potensial xəbərdar olması, model təhlükəsizliyini qiymətləndirmək qabiliyyətimizə əhəmiyyətli məhdudiyyət yaradır”. Şirkət əlavə edib ki, modellər bəzən təlim zamanı gözlənilməz imkanlar inkişaf etdirir ki, bu da onların tətbiq olunana və əhəmiyyətli təhlükəsizlik hadisələrinə səbəb olana qədər aşkar edilməyə bilər. Süni intellekt tədqiqatçıları da xəbərdarlıq ediblər ki, modellər daha qabiliyyətli olduqca, onlara nəzarət edildiyini getdikcə daha çox tanıyır və davranışlarını buna uyğun tənzimləyirlər ki, bu da model davranışına nəzarət etməyi çətinləşdirir. Anthropic bazar ertəsi şərh tələbinə cavab verməkdən imtina edib. Süni intellekt təhlükəsizliyini vurğulamasına baxmayaraq, Anthropic təhlükəsizlik investisiyalarından əldə olunan gəlirlərin qeyri-müəyyən olduğunu bildirib. Şirkət sənəddə bu cür tədqiqatlara nə qədər vəsait xərclədiyini açıqlamayıb. Bu ayın əvvəlində Anthropic , iyul ayında bir nümunə həftəsində süni intellekt tədqiqatları üçün istifadə etdiyi hesablama gücünün təxminən 6%-nin təhlükəsizlik işlərinə sərf olunduğunu bildirmişdi. Claude AI modellərinin yaradıcısı olan şirkət, təhlükəsizlik səylərini “resurs tələb edən” kimi təsvir edib və bildirib ki, məhdud vəsaitlərini hesablama gücü, bahalı süni intellekt istedadı və təhlükəsizlik arasında bölüşdürməlidir. Anthropic bildirib ki, müştəri istifadəsi və nəticədə gəlir yeni modellər tərəfindən idarə olunur və buraxılışların “davamlı və üst-üstə düşən ritmi” “ süni intellekt inkişafının önündə qalmaq üçün ayrılmazdır”. Şirkət keçən həftə Opus modelinin yeni versiyasını buraxıb, bu, CEO Dario Amodeinin sərhədləri tənzimləməyə çağıran təxminən 4 000 sözlük esse dərc etməsindən 10 gün sonra baş verib. Bəzi analitiklər və ekspertlər bildiriblər ki, heç bir aparıcı süni intellekt laboratoriyası yavaşlamaz, çünki bu, hər bir buraxılışla dəyərləndirmələrin dəyişə biləcəyi bir sənayedə rəqiblərə üstünlük vermək riski daşıyır. Anthropic son həftələrdə süni intellekt modellərini texnologiyanın gələcək nəsillərini qurmaq üçün necə istifadə etdiyi barədə daha çox məlumatı ictimaiyyətə açıqlamağı vəd edib, çünki ekspertlər rekursiv özünü təkmilləşdirmə – modellərin insan köməyi olmadan öz-özünə inkişaf edə biləcəyi nöqtə barədə xəbərdarlıq edirlər. Anthropic sənəddə bildirib: “Biz etibarlı, etimadlı və təhlükəsiz süni intellekt sistemləri qurmağın kollektiv məsuliyyət olduğuna və bazarın bunu mükafatlandıracağına inanırıq”.