DeepSeek, deneysel bir multimodal model olan DeepSeek-V4-Flash-Vision-Exp’i yayınladı ve şirketin kendi benchmark’larına göre bu model, Anthropic’in Claude Opus 4.8’ine bazı testlerde yaklaşıyor, hatta bazılarında geçiyor. Model Cuma günü tanıtıldı ve DeepSeek’in görsel yapay zeka yeteneklerini Amerikalı rakiplerinden daha düşük maliyetle geliştirme stratejisinde önemli bir adım olarak konumlandırılıyor.
Yeni model, DeepSeek’in mevcut V4-Flash metin modelinin multimodal bir varyantı. Orijinal metin yeteneklerini — reasoning ve genel bilgi dahil — koruyor, buna ek olarak görsel anlama özellikleri de kazandırıyor.
Benchmark sonuçları
| Benchmark | DeepSeek-V4-Flash-Vision-Exp | Claude Opus 4.8 | Kazanan |
|---|---|---|---|
| ApexBench (Pass@1) | 36.5 | 39.4 | Opus 4.8 |
| Agents’ Last Exam | 27.3 | 25.7 | DeepSeek |
| ZeroBench | 35.0 | 34.0 | DeepSeek |
Yani tablo net bir tek taraflı üstünlük göstermiyor: Opus 4.8 hâlâ ApexBench’te önde, ama DeepSeek’in yeni modeli Agents’ Last Exam ve ZeroBench’te Opus’u geçmiş durumda. Önemli bir çekince var: DeepSeek bu sonuçları kendi “Harness Minimal Mode” ortamında ölçmüş, yani rakamlar bağımsız olarak doğrulanmadı.
Fiyatlandırma ve erişim
DeepSeek-V4-Flash-Vision-Exp şu anda DeepSeek API’de mevcut ve geliştiriciler kendi uygulamalarına entegre edebiliyor. Fiyatlandırma, ABD merkezli rakiplere kıyasla daha düşük tutulacak şekilde tasarlanmış: görseller token sayısına göre faturalanıyor ve görsel başına 384 token ile sınırlandırılmış.
Model lansmanıyla birlikte DeepSeek, Harness framework’ünün 0.1.1 sürümünü de yayınladı — bu sürüm yeni model için yerleşik destek sunuyor. Ayrıca bir Files API tanıtıldı: geliştiriciler bir görseli bir kez yükleyip, sonrasında bir file ID üzerinden tekrar tekrar (ek maliyet ödemeden) referans verebiliyor.
Rekabet bağlamı
Bu lansman, Alibaba ve Moonshot AI gibi yerli rakiplerin yanı sıra Anthropic ve OpenAI gibi ABD firmalarından gelen yoğun rekabetin ortasında gerçekleşiyor. Bloomberg bu çıkışı, DeepSeek’in Anthropic’in ileri yapay zeka teknolojisindeki konumuna yönelik süregelen meydan okumasının bir parçası olarak değerlendiriyor.
DeepSeek-V4-Flash-Vision-Exp, Çinli yapay zeka laboratuvarları arasında orta seviye modellerde multimodal ve agentic yetenekleri güçlendirme yönündeki daha geniş bir eğilimi de yansıtıyor. Bu deneysel modelin geleceği geliştirici benimsemesine bağlı olacak — ki bu da yapay zeka rekabetinin bir sonraki evresinin giderek görsel reasoning yapabilen uygun fiyatlı modellere odaklanacağına işaret ediyor.
Kaynak: Dataconomy

Bir yanıt yazın