Bu içerik Yapayzeka360.com.tr telif hakları ile korunmaktadır. 5846 sayılı FSEK kapsamında izinsiz kopyalanması, çoğaltılması ve başka sitelerde yayınlanması yasaktır. İçerik çalma tespiti yapılmıştır. Kaynak: https://yapayzeka360.com.tr
DeepSeek V4.1 Flash Çıktı: 552B Parametre, Asimetrik Mimari ve %60'a Varan İndirim
Yapay zeka mimarisinde verimlilik standartlarını baştan tanımlayan DeepSeek, merakla beklenen yeni nesil amiral gemisi DeepSeek V4.1 Flash modelini resmi olarak yayımladı. Şirket, yeni mimari serisinin en kompakt üyesi olan modelin; daha yüksek zeka tavanı, olağanüstü çıkarım hızı ve yerel çok modlu (multimodal) görsel kavrama yetenekleriyle donatıldığını açıkladı.
Devrimsel Mimar: Girdide 8B, Çıktıda 16B Aktif Parametre
Modelin teknik raporuna göre DeepSeek V4.1 Flash, toplamda 552 milyar parametreye (552B) sahip bir Uzmanlar Karması (MoE) yapısına sahip. Ancak geleneksel modellerin aksine, çığır açan bir Asimetrik Causal-Encoder-Decoder mimarisi kullanıyor:
KV Cache Depolama İhtiyacı 437'de Bire İndirildi
Otonom ajanların uzun bağlamlı görevlerinde sunucuları en çok zorlayan unsur olan KV Cache (Bellek Önbelleği) tüketiminde tarihi bir rekor kırıldı. V4.1 Flash, bir önceki nesle kıyasla yüksek bant genişlikli bellek (HBM) ihtiyacını 4'te 1'e, SSD depolama gereksinimini ise 8'de 1'e düşürdü. Şirketin ilk nesil modelleriyle kıyaslandığında toplam bellek ayak izinin 437'de 1'e gerilediği belgelendi.
API Adı 'deepseek-flash' Oldu, Fiyatlar %60 Düştü
DeepSeek API platformunda doğrudan deepseek-flash çağrısıyla erişilebilen model, mimari tasarruflar sayesinde liste fiyatlarında %60'a varan indirimle sunuldu. Tencent WorkBuddy ve OpenCode platformlarının ilk gün itibarıyla tam entegrasyon sağladığı modelin tüm teknik ağırlıkları ve mimari raporu Hugging Face üzerinde açık erişime açıldı.
İlgili Etiketler:
Bu Habere Tepkiniz
İçeriği nasıl bulduğunuzu tek tıkla belirtinYorumlar 0
Yorum YazHenüz yorum yapılmamış
Bu haber hakkında ilk değerlendirmeyi yapan siz olun!
Düşüncelerinizi Paylaşın