DeepSeek , vizual sorğuları anlaya bilən eksperimental süni intellekt modelini təqdim edərək, alətin ABŞ rəqibi Anthropic PBC -nin qabaqcıl modelinin performansına yaxın olduğunu bildirdi. Hangzhou -da yerləşən şirkət cümə günü bildirdi ki, yeni buraxılış DeepSeek -in əsas mətn əsaslı V4 Flash modelinin multimodal imkanlar əlavə edilmiş eksperimental versiyasıdır, yəni o, şəkillər və ekran görüntüləri kimi vizual sorğuları da təhlil edə və onlara əsasən hərəkət edə bilər. Model DeepSeek-V4-Flash-Vision-Exp adlanır və hazırda DeepSeek API Platforması nda mövcuddur. Eksperimental multimodal model agentlər, əsaslandırma və dünya biliyi daxil olmaqla, mətn imkanları baxımından DeepSeek-V4-Flash ilə uyğun gəlir. Şirkət sosial mediada bildirdi ki, multimodal agent bençmarklarında V4-Flash-Vision-Exp , V4-Flash -dan böyük bir sıçrayış edərək, multimodal agent performansını Opus-4.8 -ə yaxınlaşdırır. Modelin performansı, modelin daimi nəzarət və ya sorğu olmadan hərəkət edə bildiyi multimodal agent imkanlarının sınaqlarında Anthropic PBC -nin qabaqcıl Opus 4.8 modelinə yaxındır. Şəkillər hər biri 384 tokenə qədər, V4-Flash qiymətləri ilə ödəniş üçün tokenləşdirilir və model base64 , xarici URL -lər və ya Files API vasitəsilə qarışıq mətn və şəkil girişini dəstəkləyir. Çin firmaları ABŞ tərtibatçıları ilə süni intellektin ön cəbhəsində qızğın rəqabətdədirlər, onların modelləri tez-tez qiymətin bir hissəsinə oxşar performans təklif edir. Bu ilin əvvəlində DeepSeek -in əsas modelinin gəlişi, aşağı qiymətli, açıq çəkili modellərin nəyə nail ola biləcəyinə dair gözləntiləri yenidən müəyyənləşdirdi.