Alibabada Pazartesi günü tanıtılan Qwen3.8-Max, Çin’in bugüne kadarki en büyük yapay zeka modeli olarak duyuruldu; hisseler anında %7 artış gösterdi. DeepSeek’in ise V4-Flash modeli fut da agresif fiyatlandırma ile öne çıktı, Claude Fable 5’ten 100 kattan fazla ucuz. Reuters raporuna göre bu iki gelişme, Çinli şirketlerin yapay zeka alanındaki hızlı ilerlemesini gözler önüne seriyordu. Hatta Alibaba’nın hisseleri Hong Kong’da tek bir gün içinde 7% yükseldi, nihayet bu çabalar öne çıkarak değer kazandı.
Qwen3.8-Max, 2,4 trilyon parametreyle geliyor, böylece Moonshot AI’ın Kimi K3’teki 2,8 trilyon parametresine yaklaştı. 2,4 trilyon parametresi, bu modelin otomatik olarak daha iyi olduğu anlamına gelmez; ama büyük bir hesaplama kapasitesini ve veri ölçeğini gösterir. Arena.AI’da metin modelleri kategorisinde en üst sırayı alırken, görsel analizde Claude Fable 5’in bir sürümüne geride kaldı. Modelin tek bir token’da 1 milyon token’a kadar içerik işlemesi, uzun belgelerin tek seferde işlenebilmesini sağladı.
DeepSeek V4-Flash, fiyat açısından en ucuz model olarak belirlendi. 1 milyon giriş token’i için 0,14 dolar, çıkış token’i için 0,28 dolar talep ediyor. Test başına ortalama maliyet 3 sent, Kimi K3 için 86 sent, OpenAI’ın GPT-5.6 Sol modeli için 1,86 dolar ve Claude Fable 5 için 3,15 dolar. Bu rakamlar, sadece açık fiyatı göstermez, aynı zamanda modelin işlemesi gereken adımları da hesaba katıyor. Böylece düşük fiyatlı bir model bile, çok adım gerektirirse pahalıya mal olabilir.
Pazarın bu rekabeti, açık ağırlıklı modellere olan talebin artmasını gösteriyor. Omdia’nın baş analisti Lian Jye Su, “Çinli yapay zekâ şirketleri önemli bir pazar buldu. Birçok iş akışı, sektörün en iyi modeline ihtiyaç duymuyor” diyerek, “Yeterince iyi, uygun fiyatlı, şeffaf ve erişilebilir modellere ihtiyaç duyuyorlar” diye devam etti. Açık ağırlıklı modeller, geliştiricilere sistemleri çalıştırma ve uyarlama özgürlüğü veriyor; kapalı kaynaklı OpenAI, Anthropic ve Google ise farklı bir yol izliyor.
Qwen3.8-Max’ün “uzmanlar karışımı” tasarımı, isteği sistemin uzman bölümlerine dağıtarak 95 milyar parametreyi aynı anda kullanan bir yapı sunuyor. Böylece maliyetler ve yanıt gecikmeleri azalıyor. Alibaba, 16 günde tamamladığı bir yazılım mühendisliği projesiyle, modelin gerçek dünya uygulamalarında ne kadar hızlı çalışabileceğini gösterdi. Modelin 2,4 trilyon parametresi, yalnızca 95 milyarı aynı anda aktif tutarak, verimliliği maksimize ediyor.
DeepSeek’in V4-Flash’ın test başına 3 sent gibi düşük maliyeti, Çin’in yapay zeka ekosisteminin rekabetçi fiyatlandırma stratejisini yansıtıyor. Şirket, halka arz için hazırlık yaparken, 2025’te R1 ve V3 modellerinin küresel çapta büyük ilgi görmesiyle ilgili planlarını duyurdu. Bu, ABD’li şirketlerin yapay zekâya harcadığı büyük miktarlar hakkında soru işaretleri yaratıyor, çünkü Çinli şirketler maliyetleri düşürürken güçlü sistemler geliştiriyor.
İnanır mısınız, bu rekabet gelecekte yapay zeka modellemeyi nasıl şekillendirecek? Gelişmeleri yakından takip ediyoruz…
Kaynak: Orijinal Haber