Çin merkezli yapay zeka girişimi DeepSeek, yeni mimari ailesinin en gelişmiş küçük modeli olan DeepSeek V4.1 Flash‘ı teknoloji dünyasının beğenisine sundu. Şirket tarafından yapılan açıklamalarda; yeni modelin daha yüksek kapasite, artırılmış çıkarım hızı, güçlü işlem hacmi ve büyük modellere ölçeklenme potansiyeliyle tasarlandığı belirtildi.
Söz konusu lansman, DeepSeek’in Şanghay’daki teknoloji odaklı STAR Market’te halka arz (IPO) hazırlıkları yaptığı döneme denk gelmesiyle de dikkat çekti. Şirket, 8 Eylül tarihinde “deepseek-v4.1-flash-expires-on-0910” kimliğiyle iki günlük geçici bir API testi gerçekleştirmiş ve bu sürümü ara versiyon olarak nitelendirmişti. Yapılan planlamaların ardından resmî model 10 Eylül itibarıyla erişime açıldı.
DeepSeek’in iddialarına göre V4.1 Flash; toplam kapasite, maliyet optimizasyonu, hız ve işlemlerin tamamlanma süresi gibi kritik metriklerde önceki nesil V4 Pro modelini geride bırakmayı başarıyor.
Metin ve Görsel İşleme Yeteneği Tek Çatı Altında
V4.1 Flash, yalnızca önceki V4 Flash modelinin hızlandırılmış bir varyasyonu değil, sıfırdan tasarlanan yenilikçi bir mimari olarak öne çıkıyor. Şirketin paylaştığı detaylara göre model, metin ve görsel girdilerini aynı anda ve yerel olarak işleyebilen güçlü bir çok modlu mimari ile donatıldı.
Önceki V4 Flash sürümü ağırlıklı olarak metin tabanlı çalışırken, görsel işlemler için ayrı bir Vision-Exp sürümüne ihtiyaç duyuyordu. Yeni V4.1 Flash ise bu iki temel işlevi tek bir model ve tek bir bağlantı noktası (endpoint) altında birleştiriyor. Modelin milyon token ölçeğindeki devasa bağlam penceresini koruduğu ifade edilirken, henüz kapsamlı bir teknik rapor veya model kartı paylaşılmış değil. Model ağırlıklarının açık kaynak olarak sunulup sunulmayacağı ise önümüzdeki günlerde netleşecek.
Bağımsız Testlerde Saniyede 500 Token Sınırı Aşıldı
Yapay zeka topluluğu tarafından gerçekleştirilen ilk bağımsız testlerde elde edilen sonuçlar büyük ses getirdi. Önceki V4 Flash modelinin saniyede ortalama 120-140 çıktı tokeni ürettiği bilinirken, V4.1 Flash modelinin göreve bağlı olarak saniyede 280 ile 500 token arasında bir hıza ulaştığı raporlandı. Düşük yoğunluklu bazı denemelerde ise hızın 500 token sınırını aşarak rekor tazelediği kaydedildi.
İlk kullanıcı geri bildirimleri, özellikle uzun bağlamlı bilgi erişimi ve gelişmiş kod üretimi görevlerinde işlemlerin 5 ila 6 kat daha hızlı tamamlandığını gösteriyor. Bununla birlikte uzmanlar, token başına ücretlendirme sabit kalmasına rağmen yüksek üretim hızının dakika başına toplam harcamayı artırabileceğine, görev başına maliyet avantajının ise üretilen token miktarına göre değişiklik göstereceğine dikkat çekiyor.
Önbellekli Girdilerde Yüzde 60’a Varan İndirim
Yenilikçi modelin duyurusuyla birlikte Flash ailesinin fiyat tarifesinde de stratejik indirime gidildi. Pekin saatiyle öğle saatlerinde yürürlüğe giren yeni tarifeye göre, yoğun olmayan saatlerde önbellek isabetli girdilerin milyon token başına fiyatı 0,05 yuandan 0,02 yuana düşürülerek yüzde 60 oranında indirim sağlandı.
Buna ek olarak önbellek isabetsiz girdilerin fiyatı 1,5 yuandan 1 yuana, çıktı fiyatı ise 4,5 yuandan 4 yuana çekildi. Yoğun saatlerde ise fiyatlandırma, yoğun olmayan saatlerin iki katı olarak uygulanmaya devam edecek. V4.1 Flash ile önceki V4 Flash modellerinin aynı fiyat tarifesini paylaşması, yeni sürümün temel avantajının birim maliyet düşüşünden ziyade çarpıcı işlem hızı ve çok modlu yetenekler olduğunu bir kez daha kanıtlıyor.
Yorumlar (0)