DeepSeek, Anthropic’in Opus 4.8’ine meydan okuyan görsel model DeepSeek-V4-Flash-Vision-Exp’i tanıttı

DeepSeek, deneysel bir multimodal model olan DeepSeek-V4-Flash-Vision-Exp’i yayınladı ve şirketin kendi benchmark’larına göre bu model, Anthropic’in Claude Opus 4.8’ine bazı testlerde yaklaşıyor, hatta bazılarında geçiyor. Model Cuma günü tanıtıldı ve DeepSeek’in görsel yapay zeka yeteneklerini Amerikalı rakiplerinden daha düşük maliyetle geliştirme stratejisinde önemli bir adım olarak konumlandırılıyor.

Yeni model, DeepSeek’in mevcut V4-Flash metin modelinin multimodal bir varyantı. Orijinal metin yeteneklerini — reasoning ve genel bilgi dahil — koruyor, buna ek olarak görsel anlama özellikleri de kazandırıyor.

Benchmark sonuçları

Benchmark DeepSeek-V4-Flash-Vision-Exp Claude Opus 4.8 Kazanan
ApexBench (Pass@1) 36.5 39.4 Opus 4.8
Agents’ Last Exam 27.3 25.7 DeepSeek
ZeroBench 35.0 34.0 DeepSeek

Yani tablo net bir tek taraflı üstünlük göstermiyor: Opus 4.8 hâlâ ApexBench’te önde, ama DeepSeek’in yeni modeli Agents’ Last Exam ve ZeroBench’te Opus’u geçmiş durumda. Önemli bir çekince var: DeepSeek bu sonuçları kendi “Harness Minimal Mode” ortamında ölçmüş, yani rakamlar bağımsız olarak doğrulanmadı.

Fiyatlandırma ve erişim

DeepSeek-V4-Flash-Vision-Exp şu anda DeepSeek API’de mevcut ve geliştiriciler kendi uygulamalarına entegre edebiliyor. Fiyatlandırma, ABD merkezli rakiplere kıyasla daha düşük tutulacak şekilde tasarlanmış: görseller token sayısına göre faturalanıyor ve görsel başına 384 token ile sınırlandırılmış.

Model lansmanıyla birlikte DeepSeek, Harness framework’ünün 0.1.1 sürümünü de yayınladı — bu sürüm yeni model için yerleşik destek sunuyor. Ayrıca bir Files API tanıtıldı: geliştiriciler bir görseli bir kez yükleyip, sonrasında bir file ID üzerinden tekrar tekrar (ek maliyet ödemeden) referans verebiliyor.

Rekabet bağlamı

Bu lansman, Alibaba ve Moonshot AI gibi yerli rakiplerin yanı sıra Anthropic ve OpenAI gibi ABD firmalarından gelen yoğun rekabetin ortasında gerçekleşiyor. Bloomberg bu çıkışı, DeepSeek’in Anthropic’in ileri yapay zeka teknolojisindeki konumuna yönelik süregelen meydan okumasının bir parçası olarak değerlendiriyor.

DeepSeek-V4-Flash-Vision-Exp, Çinli yapay zeka laboratuvarları arasında orta seviye modellerde multimodal ve agentic yetenekleri güçlendirme yönündeki daha geniş bir eğilimi de yansıtıyor. Bu deneysel modelin geleceği geliştirici benimsemesine bağlı olacak — ki bu da yapay zeka rekabetinin bir sonraki evresinin giderek görsel reasoning yapabilen uygun fiyatlı modellere odaklanacağına işaret ediyor.

Kaynak: Dataconomy

Comments

Bir yanıt yazın

E-posta adresiniz yayınlanmayacak. Gerekli alanlar * ile işaretlenmişlerdir