Kısaca

Qwen, ses ve video verilerini eşzamanlı işleyebilen, bir milyon token bağlam kapasiteli ve araç kullanabilen yeni ajan modeli Qwen3.8-Omni-Flash'ı tanıttı.

Qwen, yapay zekâ ajanları için geliştirdiği ilk çok modlu modeli olan Qwen3.8-Omni-Flash'ı kullanıma sundu. Bir milyon tokenlik geniş bir bağlam penceresine sahip olan model; ses ve video girdilerini eşzamanlı olarak işleyebilme, çıkarım yapabilme ve kendi başına araç kullanarak video günlük düzenleme, kısa video çevirisi yapma ve film özetleme yetenekleriyle tanıtıldı. Qwen Studio, Qwen Cloud ve doğrudan geliştirici API'si üzerinden erişime açılan model, gerçek zamanlı kamera ve mikrofon etkileşimi kurabilmek amacıyla Qwen-Live Harness altyapısıyla destekleniyor.

Modelin duyurulan fiyatlandırma tarifesi, geliştirici ve kurumsal maliyetler açısından pazardaki en yakın rakiplerin oldukça altında konumlanıyor. Qwen3.8-Omni-Flash'ın API kullanım ücreti, bir milyon girdi tokeni için 0,15 dolar ve bir milyon çıktı tokeni için 0,47 dolar olarak belirlendi. Şirketin paylaştığı operasyonel maliyet hesaplamalarına göre ses girdisi saat başına 0,01 doların altında kalırken, saniyede bir kare hızındaki 720p çözünürlüklü sesli video işleme maliyeti yanıt üretimi hariç yaklaşık 0,20 dolar seviyesinde tutuluyor. Karşılaştırma tarafında yer alan Google'ın Gemini 3.8 Flash modeli ise tanıtım tarifesinde bir milyon girdi tokeni için 0,75 dolar, çıktı için 3,75 dolar talep ediyor; üstelik Gemini 3.8 Flash fiyatlarının 1 Ocak 2027 tarihinde iki katına çıkarılacağı duyurulmuş bulunuyor.

Geliştiricilerin çalışma ortamlarına entegrasyonu hızlandırmak için açık kaynaklı Qwen-MM-Plugins paketi de duyuruyla birlikte paylaşıldı. Bu eklentiler video düzenleme, konuşmacı tanıma, videodan PDF formatında not çıkarma ve yeniden kullanılabilir iş akışlarını doğrudan Claude Code, Gemini CLI ve Qwen Code gibi ajan platformlarına taşıyor. Google tarafında Gemini 3 Flash ve 3.6 Flash modelleri kurumsal iş akışlarında ve kod asistanlarında yaygın şekilde konumlandırılırken, Qwen'in açık kaynak araç desteği ve çok modlu eklenti ekosistemiyle harici geliştirici araçlarına doğrudan bağlanması pazardaki rekabeti farklı geliştirici katmanlarına yayıyor.

Performans tarafında Qwen, modelin ses ve video görevlerinde Gemini 3.8 Flash düzeyine yakın sonuçlar verdiğini öne sürüyor; ancak bağımsız kıyaslama platformlarının kapsamlı test sonuçları henüz bu iddiayı doğrudan teyit etmiş değil. Açıklanan 720p video işleme maliyeti yalnızca girdi basamağını kapsıyor ve modelin üreteceği yanıt tokenlerinin harcamalarını içermiyor. Google ekosisteminde Gemini 3.6 Flash bir milyon girdi tokeni için 1,50 dolar, çıktı için 7,50 dolar seviyesinde fiyatlandırılırken ve hafif sürüm Gemini 3.5 Flash-Lite girdi başına 0,30 dolar, çıktı başına 2,50 dolar talep ederken, Qwen3.8-Omni-Flash'ın sunduğu 0,15 dolarlık girdi ve 0,47 dolarlık çıktı birim maliyeti, çok modlu video işleme süreçlerinde geliştiriciler için en düşük giriş eşiklerinden birini oluşturuyor.

Neden önemli?Modelin sunduğu düşük girdi ve çıktı maliyetleri, çok modlu video işleme ve otonom ajan iş akışlarını geliştiriciler için çok daha ekonomik bir ölçeğe taşıyor.

Şu ana kadar bildiklerimiz

  • Qwen3.8-Omni-Flash bir milyon token bağlam penceresine sahip olup ses ve video verilerini eşzamanlı işleyebilmektedir.
  • Modelin API kullanım ücreti bir milyon girdi tokeni için 0,15 dolar, bir milyon çıktı tokeni için 0,47 dolar olarak açıklandı.
  • Açık kaynaklı Qwen-MM-Plugins eklentileri; Claude Code, Gemini CLI ve Qwen Code gibi araçlara video düzenleme ve konuşmacı tanıma yetenekleri kazandırmaktadır.

Cevabı beklenen sorular

  • Qwen3.8-Omni-Flash modelinin bağımsız kıyaslama testlerindeki performansı, şirketin iddia ettiği Gemini 3.8 Flash seviyesini tam olarak karşılayacak mı?
  • Açık kaynak eklentilerin üçüncü taraf geliştirici ajanları arasındaki benimsenme hızı video işleme maliyetlerini nasıl etkileyecek?
Kaynaklar ve belgeler

Bu haberde kullanılan belgelere aşağıdaki bağlantılardan ulaşabilirsiniz.