Alibaba, 125 milyar toplam parametreli ancak token başına sadece 6 milyar parametre çalıştıran düşük maliyetli Qwen3.8-Flash-Next modelini yayımladı.
Alibaba bünyesindeki Qwen ekibi, Qwen4 mimarisinin ilk önizlemesi niteliğindeki çok modlu uzmanlar karması (MoE) modeli Qwen3.8-Flash-Next'i duyurdu. Toplamda 125 milyar parametreye sahip olan model, işlem sırasında token başına yalnızca 6 milyar parametreyi etkinleştiriyor. Qwen ekibinin paylaştığı bilgilere göre model, yaklaşık dokuzda bir oranındaki eğitim maliyetiyle Qwen3.7-Plus modelinden daha yüksek bir başarım sergiliyor. Karşılaştırma yapılan Qwen3.7-Plus, 397 milyar parametreye ve token başına 17 milyar aktif parametreye sahipti.
Yeni mimaride, Qwen4 için planlanan yeniliklerden biri olan 51 milyar parametrelik özgün bir N-gram yerleştirme katmanı bulunuyor. Yaygın sözcük gruplarını bağımsız girdiler olarak bir ifade sözlüğünde tutan bu katman, grafik işlem birimi (GPU) yerine doğrudan standart sistem belleğinde (RAM) düşük bir ek maliyetle çalışabiliyor. Model, temel olarak 262.144 tokenlik bir bağlam penceresini desteklerken YaRN yöntemi kullanılarak bu kapasite 1 milyon tokene kadar genişletilebiliyor. Modelin teknik raporu GitHub üzerinde, model ağırlıkları ise Hugging Face ve ModelScope platformlarında yayımlandı.
Alibaba tarafından paylaşılan kıyaslama sonuçlarına göre Flash-Next, 284 milyar toplam ve 13 milyar aktif parametreye sahip DeepSeek-V4-Flash ile Anthropic'in Claude Opus 4.6 modellerini geride bıraktı. Yazılım projelerindeki hataları bağımsız çözme yeteneğini ölçen kodlama testlerinde model, DeepSWE üzerinde 58,7 ve SWE-bench Pro üzerinde 62,5 puana ulaştı. Ofis ve üretkenlik alanındaki CoWorkBench testinde 73,9 puan alan model, aynı testte 45,1 alan DeepSeek-V4-Flash'ın önüne geçti. Profesyonel iş akışlarını ölçen JobBench testinde ise 55,7 puan kaydedildi. Bilimsel akıl yürütme testi GPQA Diamond'da 91,7, programlama testi LiveCodeBench v6'da ise 91,9 puan elde edildi.
Üretim sürümü QwenCloud üzerinde Qwen3.8-Flash adıyla sunulan modelin API fiyatı, 1 milyon girdi tokenı için 0,16 dolar ve 1 milyon çıktı tokenı için 0,47 dolar olarak açıklandı. Alibaba, Ağustos 2026 başında amiral gemisi olarak tanıttığı Qwen3.8-Max modelinin hemen altında bir performans sergileyen bu sürümün, girdi ve çıktı maliyetlerinde yaklaşık 12 kat daha ucuz olduğunu belirtti. Pazardaki açık kaynaklı modellerin maliyet avantajı, OpenAI ve Anthropic gibi büyük sağlayıcılar üzerindeki fiyat rekabetini artırıyor.
Neden önemli?Modelin eğitim ve çıkarım maliyetlerini ciddi oranda düşürmesi, açık kaynak yapay zekâ pazarında OpenAI ve Anthropic gibi rakipler üzerindeki fiyat baskısını artırıyor.
Şu ana kadar bildiklerimiz
- Qwen3.8-Flash-Next, 125 milyar toplam parametreye sahip olmasına karşın token başına yalnızca 6 milyar parametre etkinleştiriyor.
- Sistem, QwenCloud üzerinden milyon girdi tokenı başına 0,16 dolar ve milyon çıktı tokenı başına 0,47 dolar fiyatla sunuluyor.
- Model, SWE-bench Pro kodlama testinde 62,5 ve CoWorkBench ofis iş yükü testinde 73,9 puan elde etti.
Cevabı beklenen sorular
- Qwen4 mimarisinin tam sürümünün ne zaman yayımlanacağı ve diğer donanım ortamlarındaki optimizasyon seviyesi henüz açıklanmadı.



