Anthropic şirkətinin Claude süni intellekt modeli, fevral ayındakı 1%-dən artaraq, hazırda şirkətin süni intellekt tədqiqat və inkişaf (Ar-Ge) işlərinin 26%-nə rəhbərlik edir. Şirkət bloq yazısında bildirib ki, bu, süni intellektin yeni nəsil süni intellekt sistemlərinin qurulmasında nə qədər sürətlə iştirak etdiyinin yeni bir ölçüsüdür. Cümə axşamı şirkət tərəfindən dərc edilən ölçmələrə görə, Anthropic -in süni intellekt Ar-Ge işlərinin 90%-dən çoxu artıq süni intellektin insanlarla əməkdaşlıq etdiyi və ya işə rəhbərlik etdiyi səviyyədə aparılır. Anthropic bildirib ki, Claude hələ Ar-Ge-nin heç bir ölçülən sahəsində tam muxtar fəaliyyət göstərmir. Bu rəqəmlər, ictimaiyyətə, hökumətlərə və kənar tədqiqatçılara qabaqcıl laboratoriyalarda süni intellektin inkişaf sürəti haqqında daha çox məlumat vermək üçün Anthropic -in müntəzəm olaraq dərc etməyi planlaşdırdığı yeni metrikalar toplusunun bir hissəsidir. Claude daha çox süni intellekt Ar-Ge işini necə ələ keçirir? Anthropic , Claude tərəfindən nə qədər süni intellekt tədqiqat və inkişaf işinin aparıldığını ölçmək üçün Anthropic Ar-Ge Avtomatlaşdırma İndeksi adlı bir prototip yaratdı. İndeks, Epoch AI tərəfindən hazırlanmış avtomatlaşdırma şkalasından istifadə edir ki, bu da süni intellektin iştirak etmədiyi AL0 -dan, süni intellektin insan müdaxiləsi olmadan tam muxtar fəaliyyət göstərdiyi AL5 -ə qədər dəyişir. AL3 səviyyəsində süni intellekt insanlarla əməkdaşlıq edir və yaxın insan rəhbərliyi altında bir tapşırığın böyük hissələrini yerinə yetirə bilər. AL4 , yəni “rəhbərlik edir” səviyyəsində isə süni intellekt, insan nəzarəti altında yüksək səviyyəli bir göstərişlə tapşırığın əksər hissəsini tamamlaya bilər. Anthropic bildirib ki, Claude avqust ayına qədər süni intellekt Ar-Ge işlərinin 26%-i üçün AL4 “rəhbərlik edir” səviyyəsinə çatıb. Şirkət bu ölçməni daxili iş qeydlərini, o cümlədən Slack və digər sənədləri araşdıraraq qurub. İyul ayının hər həftəsi üçün Anthropic , model Ar-Ge prosesində iştirak edən şöbələrdən işçilərin 20%-ni təsadüfi olaraq seçib. Daha sonra bir Claude tədqiqat agenti onların işini nəzərdən keçirib və təxminən 15 000 xırda Ar-Ge tapşırığını müəyyən edib. Bu tapşırıqlar model təlimi, gücləndirici öyrənmə, qiymətləndirmə və mühəndislik kimi sahələri əhatə edən 542 kateqoriyadan ibarət bir iyerarxiyada təşkil edilib. Daha sonra Anthropic , hər kateqoriyada süni intellektin nə qədər iştirak etdiyini qiymətləndirmək üçün Claude -dan istifadə edib və Epoch AI avtomatlaşdırma şkalasını tətbiq edib. Şirkət bildirib ki, tapşırıqlar onlara sərf olunan insan-vaxtına görə çəkiləndirilib, beləliklə, daha çox işçi səyi tələb edən sahələr ümumi indeksdə daha böyük çəkiyə malik olub. Anthropic həmçinin Claude -un qiymətləndirmələrini müvafiq işə cavabdeh olan işçilərin qiymətləndirmələri ilə müqayisə edib. Şirkət bildirib ki, model və insan qiymətləndirmələri 59% hallarda tamamilə üst-üstə düşüb, insanların öz aralarındakı razılıq isə 35% olub, qiymətləndirmələrin 97%-i isə bir avtomatlaşdırma səviyyəsi daxilində olub. Süni intellekt hələ də süni intellekti özü qurmur. Süni intellektin rəhbərlik etdiyi işlərin artmasına baxmayaraq, Anthropic tam muxtar süni intellekt inkişafına çatmadığını vurğulayıb. AL5 səviyyəsində bir süni intellekt sistemi problemi müəyyən edə, hansı işin görülməli olduğunu təyin edə, həll yolu hazırlayıb sınaqdan keçirə və insan müdaxiləsi olmadan tətbiq edə bilər. Anthropic bildirib ki, ölçülən süni intellekt Ar-Ge işlərinin heç birində bu səviyyəyə çatmayıb. Anthropic bildirib ki, süni intellektin daha qabiliyyətli süni intellektin inkişafına artan köməyi irəliləyişi sürətləndirə bilər, lakin eyni zamanda insanların getdikcə daha qabiliyyətli sistemləri anlamasını və ya idarə etməsini çətinləşdirə bilər. Anthropic daxilində işləyən 30 000 süni intellekt agenti. Şirkət həmçinin öz əməliyyatları daxilində süni intellekt agentlərinin tətbiqinin miqyasını açıqlayıb. Avqust ayında Anthropic -in ən çox istifadə edilən daxili platformasında hər hansı bir vaxtda təxminən 30 000 süni intellekt agenti tədqiqat və mühəndislik işləri aparırdı. Anthropic bildirib ki, agentlərin hərəkətlərinin 100%-i icra edilməzdən əvvəl, adətən saniyələr ərzində onlayn monitor vasitəsilə yoxlanılır. Avqust ayı ərzində 1 milyarddan çox agent qərarı təhlil edilib, bunlardan təxminən 0,002%-i, yəni hər 47 000-dən biri bloklanıb. Ayrı bir oflayn monitorinq sistemi hərəkətlər baş verdikdən sonra agent fəaliyyətini təhlil edir. Anthropic bildirib ki, sistem həftədə təxminən 100 000 transkripti əlavə avtomatlaşdırılmış nəzərdən keçirmə üçün qeyd edir, həftədə təxminən 50 ən yüksək prioritetli hal isə insanlara yönləndirilir. Şirkət bildirib ki, monitorinq sistemi həm ani təhdidləri, həm də bir neçə agent arasında tədricən inkişaf edə biləcək davranışları aşkar etmək üçün nəzərdə tutulub. Süni intellekt təhlükəsizliyinə nə qədər hesablama gücü sərf olunur? Anthropic həmçinin hesablama resurslarının süni intellektin inkişafı və təhlükəsizlik işləri arasında necə bölündüyünü açıqlayıb. İyulun 13-dən iyulun 20-dək olan nümunə həftəsi ərzində süni intellekt Ar-Ge üçün istifadə olunan hesablama gücünün təxminən 6%-i təhlükəsizlik işlərinə ayrılıb. Süni intellekt tərəfindən idarə olunan süni intellekt Ar-Ge üçün bu pay təxminən 12% olub. Anthropic bu rəqəmlərin mühafizəkar təxminlər olduğunu xəbərdar edib. Süni intellektin imkanlarını və təhlükəsizliyini bərabər şəkildə inkişaf etdirən işlər imkan işi kimi qeydə alınıb, rəqəmlərə isə təhlükəsizlik təsnifatçıları üçün istifadə olunan ayrıca, müqayisə edilə bilən hesablama miqdarı daxil edilməyib. Şirkət həmçinin xəbərdarlıq edib ki, hesablama resursları təhlükəsizlik səylərinin qeyri-mükəmməl bir ölçüsüdür, çünki bəzi təhlükəsizlik tədqiqatları əhəmiyyətli insan səyi tələb edir, lakin nisbətən az hesablama gücünə ehtiyac duyur.