DeepSeek, V4-Flash modeli için büyük bir güncellemeyi sessizce yayınladı — ve küçük, ucuz model artık kendi çok daha büyük kardeşini geride bırakıyor.

31 Temmuz'da Hugging Face'te açık ağırlıklarla yayınlanan güncelleme (deepseek-ai/DeepSeek-V4-Flash-0731), verimlilik odaklı model için sıra dışı bir ana işaret ediyor. DeepSeek'in kendi kıyaslamaları, V4-Flash'ın artık 1.6 trilyon parametreli amiral gemisi V4 Pro (Preview)'yu ajan kodlamada geçtiğini gösteriyor. Artificial Analysis'ın bağımsız kontrolleri de GPQA Diamond gibi diğer kıyaslamalarda iyileşme buldu; raporlanan hiçbir gerileme yok.

V4-Flash, toplam 284 milyar parametreli ancak token başına yalnızca 13 milyar aktif parametreli bir Mixture-of-Experts modeli ve 1 milyon tokenlık bağlam penceresini destekliyor. OpenRouter'da milyon giriş tokenı başına yaklaşık 0,087 dolar ve milyon çıkış tokenı başına 0,17 dolar — öncü rakiplerin maliyetinin çok küçük bir kısmı; bu yüzden bu haftaki haberler onu '50 kat daha pahalı modelleri yenen' model olarak nitelendirdi.

Yayın, DeepSeek'in ağırlıkları bekletmek yerine hemen paylaşma alışkanlığını sürdürüyor. Şirket, güncellemenin ajan iş akışları, kodlama asistanları ve yüksek işlem hacimli sohbet için ayarlandığını ve Claude Code, OpenClaw ile OpenCode gibi araçlarla entegre olduğunu belirtiyor.

Gözlemciler V4-Flash-0731'i bir sonraki V4 Pro güncellemesi için umut verici bir işaret olarak görüyor — ve fiyat-performans sınırının, yapay zeka harcamaları tartışmasının tam ortasında ne kadar hızlı ilerlediğinin bir hatırlatıcısı.