Şirket, yeni modelin daha yüksek kapasite, hızlı çıkarım, güçlü işlem hacmi ve daha büyük modellere ölçeklenme amacıyla geliştirildiğini açıkladı.

Lansman, DeepSeek'in Shanghai'deki teknoloji odaklı STAR Market'te halka arz hazırlıklarına başladığının bildirildiği bir dönemde gerçekleştirildi.

DeepSeek, 8 Eylül'de modeli "deepseek-v4.1-flash-expires-on-0910" kimliğiyle iki günlük API testine açmış ve sürümü "ara versiyon" olarak tanımlamıştı. Şirket, 9 Eylül'de yaptığı açıklamada resmî modelin 10 Eylül civarında kullanıma sunulacağını bildirdi. DeepSeek'in iddiasına göre V4.1 Flash; kapasite, maliyet, hız ve işlemlerin tamamlanma süresinde V4 Pro'yu geride bırakıyor.

Metin ve görsel tek modelde birleşti

V4.1 Flash, yalnızca önceki V4 Flash modelinin hızlandırılmış bir sürümü değil, yeni bir model yapısı olarak tanıtıldı. Şirketin açıklamasına göre model, metin ve görsel girdilerini yerel olarak işleyebilen çok modlu bir mimariye sahip. Önceki V4 Flash metin tabanlı çalışırken görsel işlemler için ayrı bir Vision-Exp sürümüne ihtiyaç duyuyordu. V4.1 Flash'ın iki işlevi tek model ve bağlantı noktası altında birleştirdiği belirtildi. Yeni modelin milyon token ölçeğindeki bağlam penceresini koruduğu ifade edilse de henüz ayrıntılı bir model kartı veya teknik rapor yayımlanmadı. Model ağırlıklarının açık biçimde sunulup sunulmayacağı da açıklanmadı.

Çin: Yapay zeka konusunda ABD ile temas halindeyiz
Çin: Yapay zeka konusunda ABD ile temas halindeyiz
İçeriği Görüntüle

Önbellekli girdide yüzde 60 indirim

DeepSeek, lansmanla birlikte Flash model ailesinin fiyat tarifesini de düşürdü.Pekin saatiyle 12:00 de yürürlüğe giren tarifeye göre yoğun olmayan saatlerde önbellek isabetli girdinin bir milyon token başına fiyatı 0,05 yuandan 0,02 yuana indirildi. Böylece bu kalemde yüzde 60 indirim yapıldı.

Önbellek isabetsiz girdinin fiyatı 1,5 yundan 1 yuana, çıktı fiyatı ise 4,5 yuandan 4 yuana çekildi. Yoğun saatlerde fiyatlar, yoğun olmayan saatlerdeki seviyelerin iki katı olarak uygulanacak.

V4.1 Flash ile önceki V4 Flash aynı fiyat tarifesine tabi olacak. Bu nedenle yeni modelin temel farkının token başına maliyetten çok daha yüksek işlem hızı ve çok modlu yapısı olduğu değerlendiriliyor.