Qwen 3.8 Max ve DeepSeek V4 Pro 0813 aynı ay yayınlandı: Çinli açık cephe frontier eşitliğine ulaştı — 2.4T multimodal + Terminal Bench’te 87.9 puan lider

Ağustos 2026, açık ağırlıklı AI cephesinde iki büyük flagship duyurusu ile geçti. İkisi de Çinli. İkisi de frontier seviyede. İkisi de aynı temel mesajı veriyor: Çin AI ekosistemi, artık “ucuz alternatif” değil, doğrudan frontier oyuncusu.

Alibaba Qwen 3.8 Max — 3 Ağustos 2026’da resmi lansman. 2.4 trilyon toplam parametre, 95B aktif MoE. Text, image, video input. 1M token context, 131K max output. API fiyatı: $2/M input, $6/M output.

DeepSeek V4 Pro 0813 — 13 Ağustos 2026’da GA (general availability). Nisan’dan bu yana preview’de olan modelin resmi versiyonu. 1M context, 384K output. Terminal Bench 2.1’de 87.9 puan — DeepSeek V4 Flash 0731’in 82.7 skorunu geçiyor.

İkisi birlikte, kapalı frontier lab’lara (OpenAI, Anthropic, Google) somut baskı uyguluyor. Detaylara bakalım.

Qwen 3.8 Max: 2.4T parametre, açık ağırlık geliyor

Alibaba, Qwen 3.8 Max’i 19 Temmuz’da Shanghai’daki World AI Conference’te preview etti. 3 Ağustos’ta resmi API lansmanı geldi. Ve kritik: 10 Ağustos haftası açık ağırlıklar Hugging Face ve ModelScope’a yükleniyor.

Ana özellikler:

  • Toplam parametre: 2.4 trilyon.
  • Aktif parametre: 95B per token.
  • Aktivasyon oranı: ~%4.
  • Mimari: Sparse Mixture-of-Experts, multimodal.
  • Context window: 1M token.
  • Max output: 131,072 token.
  • Modalite: Text, image, video input.
  • Fiyat: $2/M input, $6/M output.

Benchmark rakamları OpenAI’ı ve Anthropic’i sarstı:

Benchmark Qwen 3.8 Max Claude Fable 5 GPT-5.6 Sol Max Gemini 3.1 Pro
OSWorld-Verified 86.1 85.0 83.2 76.2
PaperBench 93.0

OSWorld-Verified, computer use / agentic task benchmark’ının yeni sürümü. Kapalı frontier ile eşit ya da üstü. PaperBench, akademik makale okuma/anlama testi — Qwen’in en yüksek rapor edilen skoru.

Alibaba’nın hamlesi Moonshot Kimi K3’ün 15 Temmuz lansmanının hemen sonrası. Yani Çinli laboratuvarlar arasında da yoğun rekabet var.

DeepSeek V4 Pro 0813: agent kraliyeti

DeepSeek V4 Pro, Nisan 2026’da preview olarak duyuruldu. 13 Ağustos 2026’da resmi GA versiyonu — DeepSeek-V4-Pro-0813 — yayınlandı.

Odak alanı net: agent capabilities. Multi-step workflow, tool use, code execution — hepsi bu modelde optimize.

Ana rakamlar:

  • Terminal Bench 2.1: 87.9 — DeepSeek V4 Flash 0731’in 82.7 skorunu 5.2 puan geçiyor.
  • DeepSWE: 62.7 — V4 Flash 0731’in 54.4’ünü 8.3 puan geçiyor.
  • NL2Repo: 61.5 — V4 Flash 0731’in 54.2’sini geçiyor.
  • Context: 1M token, output: 384K token.
  • Thinking mode ve non-thinking mode — kullanıcı seçimi.

Uyarı: vendor-reported iyileşmeler bazı benchmark’larda 49.9 puana kadar iddia edildi — ama bunlar henüz bağımsız reprodükte edilmedi. Yaklaşımda dikkatli olmak gerek.

Fiyat: 12x artış

DeepSeek V4 Pro’nun en dikkat çekici tarafı: fiyat artışı. Klasik DeepSeek stratejisi “en ucuz”du. V4 Pro 0813 ile bu değişti:

  • V4 Flash 0731 output: $0.18/M token.
  • V4 Pro 0813 output (peak hours): $3.96/M token22x artış.
  • V4 Pro 0813 output (off-peak): daha düşük.

Yani DeepSeek, “commodity model” konumundan “premium frontier model” konumuna geçti. Ana neden: V4 Pro artık gerçek anlamda GPT-5.6 Sol, Claude Fable 5 seviyesinde. Bu seviye için Anthropic ve OpenAI $15-75/M output token istiyor — DeepSeek $3.96 hala 4-19x daha ucuz.

İki modelin karşılaştırması

Qwen 3.8 Max DeepSeek V4 Pro 0813
Toplam parametre 2.4T Bilinmiyor (muhtemelen 1-2T)
Aktif parametre 95B Bilinmiyor
Context window 1M 1M
Max output 131K 384K
Modaliteler Text + image + video Text
Ana güç Multimodal + OSWorld agent Terminal / kod agent
Input fiyat $2/M Değişken
Output fiyat $6/M $3.96/M (peak)
Açık ağırlık Evet (10 Ağustos haftası) Preview’deki gibi henüz belirsiz
Companion küçük model Qwen 3.8 27B (açık ağırlık) V4 Flash 0731 (mevcut)

Hangisi kim için?

Multimodal agent workflow’lar (computer use, browser automation, video anlama): Qwen 3.8 Max. OSWorld-Verified’de kapalı frontier ile eşit. Video input desteği kritik avantaj.

Pure agentic coding (terminal, repo, SWE task): DeepSeek V4 Pro 0813. Terminal Bench 2.1’de 87.9 — şu ana kadarki en yüksek açık ağırlıklı skor.

Uzun-form content generation (kitap, uzun rapor, hukuki döküman): DeepSeek V4 Pro 0813. 384K max output, tek response’ta bütün bir kitap üretebilir.

Multimodal reasoning (grafik analiz, doküman OCR, video özet): Qwen 3.8 Max.

Enterprise on-prem deployment: Qwen 3.8 Max. Açık ağırlık avantajı, self-host için kritik.

Cost-sensitive high-volume: Hala DeepSeek V4 Flash 0731 (V4 Pro değil). Flash’in $0.18/M output fiyatı kadar ucuz yok.

Neden aynı ay? Rekabet dinamiği

Qwen 3.8 Max ve DeepSeek V4 Pro 0813’ün aynı ay yayınlanması tesadüf değil. Çinli AI cephesinde şu anda 5-6 ana oyuncu var:

  • Moonshot (Kimi K3) — 15 Temmuz
  • Alibaba (Qwen 3.8 Max) — 3 Ağustos
  • DeepSeek (V4 Pro 0813) — 13 Ağustos
  • Tencent (Hy3) — Temmuz
  • Z.ai (GLM-5.2) — Temmuz
  • MiniMax (H3 / M3) — Ağustos

Her lab, diğerinin lansmanına yanıt vermek istiyor. Kimi K3’ün 2.8T rakamına Qwen 2.4T ile cevap, sonra DeepSeek benchmark üstünlüğü ile ikinci hamle. Kapalı frontier lab’ların (Anthropic, OpenAI) alışkın olduğu “6 ay bir release” tempolarından çok farklı bir hız.

Bu yoğun rekabet, kullanıcı için iyi:

  • Fiyatlar düşüyor (ana modeller için).
  • Benchmark rakamları yükseliyor.
  • Yeni özellikler (multimodal, uzun context, agentic capability) hızla standart hale geliyor.

Kapalı frontier lab’lar için ne demek?

OpenAI, Anthropic, Google için tablo giderek zorlaşıyor.

Fiyat baskısı. DeepSeek V4 Pro 0813’ün $3.96/M output fiyatı, Claude Fable 5’in $75/M ve GPT-5.6 Sol’un ~$60/M fiyatına karşı 15-19x daha ucuz. Enterprise CFO’lar için bu, cost/benefit hesabını sarsıyor.

Yetenek convergence’i. OSWorld, SWE-bench, Terminal Bench gibi pratik benchmark’larda Çinli modeller kapalı frontier ile eşitleniyor. “En iyi model” farkı, spesifik use case’e bağlı — artık dominance yok.

Açık ağırlık avantajı. Qwen 3.8 Max, açık ağırlık olarak yayınlanınca, self-host için tek gerçek frontier seçenek oluyor. Anthropic ve OpenAI, kapalı model iş modeliyle bunu offer edemiyor.

Cevap seçenekleri kısıtlı:

  1. Fiyat düşürmek (marj kaybı).
  2. Enterprise-only özellikler (SOC2, HIPAA, data residency) ile diferansiyel yaratmak.
  3. Kendi açık ağırlık stratejisine geçmek (OpenAI için GPT-oss yaklaşımı, Anthropic için hiç yok).
  4. Frontier’ı yeniden hızlandırmak — Claude Opus 5, GPT-6, Gemini 3 Ultra gibi yeni nesil ile.

Türk kullanıcı için pratik değer

Türkiye’deki kullanıcılar ve şirketler için iki model somut fırsatlar sunuyor:

1. Cloud API cost optimizasyonu. Together AI, Fireworks, DeepInfra, Groq üzerinden Türkiye’den her iki modele erişilebilir. GPT-4 tabanlı workflow’lar için maliyet %60-90 düşebilir.

2. Enterprise on-prem. Qwen 3.8 Max’in açık ağırlığı geldiğinde, Türk bankalar (KVKK), savunma sanayi (ASELSAN, Roketsan), sağlık grupları için self-hosted frontier AI mümkün olacak. 8x H200 sunucu setup’ıyla çalıştırılabilir.

3. Türkçe fine-tune fırsatı. Qwen 3.8 27B (açık ağırlık companion model), Türk akademik grupları için ideal. Boğaziçi NLP, ODTÜ NLP, Sabancı VNGRS ekipleri için Türkçe fine-tune ve yayın üretim fırsatı.

4. Kod cephesinde DeepSeek V4 Pro 0813 top choice. Türk yazılım şirketleri için Cursor + DeepSeek V4 Pro entegrasyonu, Claude Sonnet 5 alternatifi olarak değerlendirilmeli.

Sonuç: Çinli açık cephe frontier eşitliğine ulaştı

Ağustos 2026, açık ağırlıklı AI tarihinin en yoğun aylarından biri. Kimi K3 (Temmuz sonu), Qwen 3.8 Max (3 Ağustos), DeepSeek V4 Pro 0813 (13 Ağustos) — üç haftada üç frontier-eşit Çinli açık model.

Anlatı basit ve net: Çin AI ekosistemi artık “ikinci lig” değil. OpenAI ve Anthropic, kapalı frontier segmentte hala lider — ama farkı hızla kapanıyor. Ve fiyat cephesinde Çin, katı katı üstün.

Önümüzdeki 3-6 ay içinde beklentiler:

  • OpenAI ve Anthropic’in fiyat düşürme baskısı devam edecek.
  • Kapalı lab’lar, enterprise segmentine daha çok odaklanacak (compliance, integration).
  • Consumer chatbot segmentinde Çin modelleri (Kimi, Qwen, DeepSeek) doğrudan rekabet edecek.
  • Yeni Amerikan açık ağırlık cephesi (Thinking Machines Inkling, Meta Muse Glimmer, Poolside Laguna) hızla iterate edecek — ama daha önce yazdığımız gibi hala Çin’in gerisinde.

Modelleri denemek isteyenler için:

  • Qwen 3.8 Max: API üzerinden alibabacloud.com veya OpenRouter. Açık ağırlıklar 10 Ağustos haftasında Hugging Face’te.
  • DeepSeek V4 Pro 0813: api-docs.deepseek.com veya OpenRouter.

2026 sonuna doğru Kimi K4, Qwen 4, DeepSeek V5 gibi bir sonraki nesil bekleniyor. Cepheye giren her yeni model, kapalı frontier lab’lara olan baskıyı artırıyor. AI ekonomisinin 2027-2028 dinamiği, tam bu rekabetin nasıl çözüldüğüne bağlı.

Comments

Bir yanıt yazın

E-posta adresiniz yayınlanmayacak. Gerekli alanlar * ile işaretlenmişlerdir