Ekonomi
DeepSeek yeni yapay zeka modeli V4.1 Flash'ı piyasaya sürdü
10.09.2026 11:09
Çinli yapay zeka girişimi DeepSeek, yeni mimari ailesinin en küçük modeli DeepSeek V4.1 Flash'ı kullanıma sundu. Şirket, yeni modelin daha yüksek kapasite, hızlı çıkarım, güçlü işlem hacmi ve daha büyük modellere ölçeklenme amacıyla geliştirildiğini açıkladı. Lansman, DeepSeek'in Şanghay'daki teknoloji odaklı STAR Market'te halka arz hazırlıklarına başladığının bildirildiği bir dönemde gerçekleştirildi. DeepSeek, 8 Eylül'de modeli "deepseek-v4.1-flash-expires-on-0910" kimliğiyle iki günlük API testine açmış ve sürümü "ara versiyon" olarak tanımlamıştı. Şirket, 9 Eylül'de yaptığı açıklamada resmî modelin 10 Eylül civarında kullanıma sunulacağını bildirdi. DeepSeek'in iddiasına göre V4.1 Flash; kapasite, maliyet, hız ve işlemlerin tamamlanma süresinde V4 Pro'yu geride bırakıyor. Metin ve görsel tek modelde birleşti V4.1 Flash, yalnızca önceki V4 Flash modelinin hızlandırılmış bir sürümü değil, yeni bir model yapısı olarak tanıtıldı. Şirketin açıklamasına göre model, metin ve görsel girdilerini yerel olarak işleyebilen çok modlu bir mimariye sahip. Önceki V4 Flash metin tabanlı çalışırken görsel işlemler için ayrı bir Vision-Exp sürümüne ihtiyaç duyuyordu. V4.1 Flash'ın iki işlevi tek model ve bağlantı noktası altında birleştirdiği belirtildi. Yeni modelin milyon token ölçeğindeki bağlam penceresini koruduğu ifade edilse de henüz ayrıntılı bir model kartı veya teknik rapor yayımlanmadı. Model ağırlıklarının açık biçimde sunulup sunulmayacağı da açıklanmadı. İlk testlerde hız 500 tokeni aştı Bağımsız ölçümlerde önceki V4 Flash modelinin saniyede yaklaşık 120-140 çıktı tokeni ürettiği belirtilirken, ilk topluluk testlerinde V4.1 Flash'ın göreve bağlı olarak saniyede 280-500 token hızına ulaştığı bildirildi. Düşük yoğunluklu bazı denemelerde hızın 500 tokenin üzerine çıktığı kaydedildi. Bu sonuçlar topluluk ölçümlerine dayanırken yeni model için henüz üçüncü taraf performans puanı bulunmuyor. Bazı ilk kullanıcılar, uzun bağlamlı bilgi erişimi ve kod üretimi görevlerinde işlemlerin beş ila altı kat daha hızlı tamamlandığını bildirdi. Ancak token başına ücret değişmediği için yüksek üretim hızının dakika başına harcamayı artırabileceği, görev başına toplam maliyetin düşüp düşmediğinin ise üretilen token ve tekrar sayısına bağlı olacağı belirtildi. Önbellekli girdide yüzde 60 indirim DeepSeek, lansmanla birlikte Flash model ailesinin fiyat tarifesini de düşürdü. Pekin saatiyle 12.00'de yürürlüğe giren tarifeye göre yoğun olmayan saatlerde önbellek isabetli girdinin bir milyon token başına fiyatı 0,05 yuandan 0,02 yuana indirildi. Böylece bu kalemde yüzde 60 indirim yapıldı. Önbellek isabetsiz girdinin fiyatı 1,5 yuandan 1 yuana, çıktı fiyatı ise 4,5 yuandan 4 yuana çekildi. Yoğun saatlerde fiyatlar, yoğun olmayan saatlerdeki seviyelerin iki katı olarak uygulanacak. V4.1 Flash ile önceki V4 Flash aynı fiyat tarifesine tabi olacak. Bu nedenle yeni modelin temel farkının token başına maliyetten çok daha yüksek işlem hızı ve çok modlu yapısı olduğu değerlendiriliyor.