ŞANXAY, ÇİN / ACCESS Newswire / 16 avqust 2026 / 14 avqustda rednote -un model laboratoriyası olan dots studio , dots3 note preview modelinin çəkilərini buraxdı. Model, əvvəllər 2026-cı il Beynəlxalq Riyaziyyat Olimpiadasında (IMO) 42 bal toplayaraq mükəmməl nəticə əldə edən model ilə eyni dots3 seriyasına aiddir və dots3 seriyasında ilk açıq çəkili buraxılışı qeyd edir. Model 280 milyard ümumi parametrə və 16 milyard aktiv parametrə malikdir, 512K tokenə qədər kontekst pəncərəsini dəstəkləyir və mətn, görüntü və səs üzrə multimodal anlayış təklif edir. O, həmçinin mürəkkəb düşünmə və uzunmüddətli agent tapşırıqları üçün optimallaşdırılmışdır. Bir sıra əsas bençmark nəticələrində dots3 - note preview , düşünmə, agent imkanları və multimodal qavrayış sahələrində müqayisə edilə bilən ölçüdə aparıcı Çin modelləri arasında yer alır, xüsusilə də oxşar ölçülü modellər arasında güclü vizual imkanlara malikdir. Şəkil: dots3-note-preview -un əsas Bençmark üzrə qiymətləndirmə nəticələri. Komanda inanır ki, uzunmüddətli real dünya tapşırıqları böyük model imkanlarını inkişaf etdirmək üçün vacib bir növbəti sərhəd olacaq, lakin sənaye bu sahəyə kifayət qədər diqqət yetirməyib. Komanda əvvəllər gündəlik həyat ssenarilərində mürəkkəb tapşırıqlar ətrafında qurulmuş iki bençmark təqdim etmişdi. Dünya üzrə aparıcı modellər bu qiymətləndirmələrdə zəif nəticə göstərmiş, heç biri keçid həddinə çatmamışdı. dots3 note -un açıq çəkili buraxılışı vasitəsilə komanda ən son texniki düşüncələrini daha geniş sənaye ilə bölüşməyə və bu istiqamətdə daha çox araşdırma aparmağa təşviq etməyə ümid edir. Son bir neçə ildə böyük modellər riyaziyyat, kodlaşdırma və mühəndislik kimi nisbətən qapalı tapşırıqlarda sürətlə inkişaf etmişdir. Bu tapşırıqlar vacib bir xüsusiyyəti bölüşür: cavabın doğru və ya yanlış olduğunu müəyyən etmək nisbətən asandır və modellər performansları haqqında aydın rəy ala bilirlər, bu da onları öyrətməyi və davamlı olaraq təkmilləşdirməyi asanlaşdırır. Lakin real dünya tapşırıqları daha mürəkkəbdir. Səyahət planlaşdırmaq, evi təmir etmək və ya toy təşkil etmək günlər, hətta aylar çəkə bilər. İstifadəçilər bütün məhdudiyyətlərini və üstünlüklərini əvvəldən ifadə edə bilməyə bilərlər, qiymət dəyişiklikləri, uçuş dəyişiklikləri və dəyişən hava şəraiti kimi xarici amillər isə yolda ortaya çıxa bilər. Nəticədə, modellər yalnız mətnlərdən kənar məlumatları, o cümlədən şəkilləri və səsləri anlamalı deyil, həm də uzunmüddətli tapşırıqlar boyunca cari planlarının effektiv olub-olmadığını davamlı olaraq qiymətləndirməli və onları yolda təkmilləşdirməli, uğur və ya uğursuzluğu müəyyən etmək üçün sona qədər gözləməməlidirlər. dots studio , böyük modellərin uzunmüddətli real dünya tapşırıqlarında performansını yaxşılaşdırmağa fokuslanır. Bu, studiyanın “Gündəlik həyat üçün qabaqcıl intellekt yaratmaq” missiyasına uyğundur, eyni zamanda rednote -un gündəlik həyat ssenarilərinə uzunmüddətli diqqətini və texnologiyadan adi insanlara fayda vermək inancını davam etdirir. Yeni buraxılmış dots3 - note preview , dots studio -nun uzunmüddətli real dünya tapşırıqlarını idarə edə bilən agentlər qurmaq səylərindəki ən son irəliləyişi təmsil edir. Bir çox düşünmə və agent tapşırıqlarında model, parametr sayının bir neçə qatı olan daha böyük modellərlə rəqabət apara və ya hətta onları üstələyə bilər. Real dünya tapşırıqlarının çətinliklərini həll etmək üçün dots3 - note preview -un arxasındakı texniki yanaşma üç sahəyə fokuslanır: Birincisi, daha güclü multimodal anlayış. Gündəlik həyat ssenarilərində məlumat yalnız mətnlə məhdudlaşmır. Mənzil planları, kotirovkalar, uçuş ekran görüntüləri, xəritələr və səsli qeydlər, modelin real dünya tapşırıqlarını effektiv şəkildə idarə edə bilməsi üçün anlaması lazım olan mürəkkəb məlumat formalarını ehtiva edir. İkincisi, özünü tənqid etmənin tətbiqi. Uzunmüddətli tapşırıqlar yalnız trayektoriyanın sonunda seyrək mükafatlara etibar edə bilməz. RL təlimi zamanı komanda modeli yalnız problemləri həll etmək üçün deyil, həm də yolda öz irəliləyişini qiymətləndirmək üçün öyrədir. Aralıq vəziyyətləri tənqid etməyi öyrənərək – səhvləri müəyyən edərək, fərziyyələrini yenidən qiymətləndirərək və doğru yolda olub-olmadığını təxmin edərək – model uzun trayektoriyalar boyunca daha zəngin öyrənmə siqnalları alır, bu da daha geniş miqyaslı gücləndirici öyrənmə paradiqmasına imkan verir. Eyni özünü tənqid etmə qabiliyyəti nəticə çıxarma zamanı da miqyaslandırıla bilər. Tək bir cəhdə etibar etmək əvəzinə, model öz həllərini iterativ şəkildə nəzərdən keçirə və təkmilləşdirə bilər. IMO 2026 -da bu yanaşma öz potensialını nümayiş etdirdi: iterativ özünü tənqid etmə yolu ilə dots3 note seriyası rəsmi olaraq təsdiqlənmiş 42/42 mükəmməl nəticə və qızıl medal qazandı. Üçüncüsü, TEMPO və uzunmüddətli gücləndirici öyrənmə. Həftələr, hətta daha uzun müddət davam edən tapşırıqlar üçün ənənəvi gücləndirici öyrənmə, son nəticəni hər bir aralıq qərara dəqiq şəkildə aid etməkdə çətinlik çəkir: tapşırıq trayektoriyaları çox uzundur, mənalı rəy isə çox seyrəkdir. Bu dar boğazı həll etmək üçün komanda TEMPO -nu inkişaf etdirdi, bu da ARC-AGI 3 -də GRPO -dan daha güclü performans nümayiş etdirdi. Real dünya tapşırıqlarını mövcud bençmarklardan istifadə edərək ölçmək çətindir. Bunu həll etmək üçün komanda iki qiymətləndirmə çərçivəsi inkişaf etdirdi. Onlardan biri, VibeSearchBench , əsasən istifadəçilərin ehtiyacları tədricən aydınlaşdıqca modelin çoxdövriyyəli axtarış imkanlarını qiymətləndirir. O, 20 domen və 200 tapşırığı əhatə edir, müxtəlif istifadəçi personajlarını simulyasiya edir və modellərdən çoxsaylı qarşılıqlı əlaqə dövrələri vasitəsilə çatışmayan tələbləri tədricən müəyyən etməyi və doldurmağı tələb edir. Digər qiymətləndirmə çərçivəsi, VibeLifeBench , modelin davamlı dəyişən bir mühitdə uzun müddət ərzində tapşırıqları yerinə yetirə bilib-bilmədiyinə fokuslanır. O, real zamanın keçməsini, eləcə də qiymətlər və xidmət statusu kimi xarici dəyişiklikləri simulyasiya edir. Qiymətləndirmə 10 domen və 20 uzunmüddətli tapşırığı əhatə edir, hər tapşırıq 20-30 mərhələni və ümumilikdə 1,247 qiymətləndirmə yoxlamasını əhatə edir. Cari nəticələr göstərir ki, aparıcı modellərin hər iki qiymətləndirmədə hələ də əhəmiyyətli təkmilləşdirmə imkanları var. Məsələn, VibeLifeBench -də sınaqdan keçirilən yeddi aparıcı modelin hamısı keçid həddindən aşağı düşdü, Claude Opus 5 0.325 balla birinci yerdə qərarlaşdı. VibeSearchBench -də Claude Opus 5 31.14 balla liderlik etdi, GPT-5.4 isə sonuncu yerdə qərarlaşdı. Bu nəticələr həm də göstərir ki, modellər yoxlanıla bilən tapşırıqlardan real dünya tapşırıqlarına keçdikcə, onların imkanları hələ də əhəmiyyətli çətinliklərlə üzləşir. dots3 note -un tam versiyasının da yaxın gələcəkdə açıq çəkilərlə buraxılması gözlənilir. dots3 note , dots 3 seriyasının ən yüngül versiyasıdır və tam dots3 seriyası tapşırıq mürəkkəbliyi, cavab sürəti və hesablama xərcləri üçün müxtəlif tələbləri olan tətbiqlər üçün nəzərdə tutulmuş üç səviyyəni – note, jazz və aria -nı əhatə edəcək. dots əvvəllər mətn böyük dil modeli dots.llm1 , çoxdilli sənəd layout parsing modeli dots.ocr və multimodal vizual anlayış böyük modeli dots.vlm1 -in model çəkilərini buraxmışdır. Texniki bloq: https://studio.dots.ai/dots/dots3-en.html HuggingFace : https://huggingface.co/dots-studio/dots3-note-prev dots studio veb-saytı: https://studio.dots.ai/?lang=en Şirkət: dots studio (rednote/Xiaohongshu) Əlaqə: Chao Qiao E-poçt: [email protected] Veb-sayt: https://studio.dots.ai/?lang=en MƏNBƏ: Dots Studio (rednote/Xiaohongshu)