Bağlam uzunluğu
1M token
API giriş (1M token)
$0.15
API çıkış (1M token)
$0.47
Kullanıcı planı
Sadece API
Türkçe destek
Orta
Çok modlu
Evet
Hızı
Hızlı
OpenAI uyumlu
Evet
Ne İçin Kullanılır?
- ✓Video ve ses analizi, multimedya özetleme
- ✓Video düzenleme ve film/klip sonrası iş akışları
- ✓Ajan görevlerinde omni-modal girdi işleme
- ✓Uzun context gerektiren belge ve medya işleme
Güçlü Yönler
- ↑1M token context
- ↑Native metin/görsel/ses/video girişi
- ↑1M token başına 0,15 / 0,47 dolar
- ↑29 değerlendirmede Qwen3.5-Omni-Plus'a göre ortalama %25+ artış
- ↑Context cache ve batch desteği
- ↑DashScope ve OpenAI protokol uyumu
Dikkat Edilecekler
- ↓Kapalı kaynak, sadece API
- ↓Çıkış modalitesi yalnızca metin
- ↓Knowledge cutoff resmi kaynakta belirtilmedi
Qwen3.8-Omni-Flash, Alibaba'nın 18 Eylül 2026'da duyurduğu omni-modal model. Qwen'in kendi tanımıyla buradaki sıçrama "omni-modal içeriği anlamak"tan "görevi planlamak, araçları çağırmak ve işi teslim etmek"e geçiş: model sadece izleyip dinlemiyor, sonucu üretip veriyor. Metin, görsel, ses ve videoyu tek oturumda alıp metin üretiyor, context window 1 milyon token. Ses ve video tarafı bu sürümün en ayırt edici yeri. Qwen'in verdiği rakamlara göre 29 değerlendirmede ortalama skor Qwen3.5-Omni-Plus'a kıyasla %25'ten fazla artıyor; sesli-görüntülü ajan ve kodlama işlerinde WildClawBench-MM'de 36,5, AgenticVBench'te 22,3 puan kazanç var. Pratik karşılığı video düzenleme, müzik video kurgusu, film yapımı ve anlatım, multimedya özetleme ile sesli-görüntülü diyalog işleri. Uzun videoda "ajan modu" tüm kareleri işlemek yerine soruya göre nereye bakacağına kendi karar veriyor: OmniVideoBench'te doğruluk 63,4'ten 67,8'e çıkarken sorgu başına token 145.736'dan 79.117'ye düşüyor. Uzamsal ses konumlandırma ise ayrı bir sürümde, Qwen3.8-Omni-Flash-Realtime'da. Fiyat giriş 0,15 dolar, çıkış 0,47 dolar (1M token). Context cache, structured outputs, prefix completion, function calling ve batch desteği var; DashScope ve OpenAI protokollerinin ikisiyle de uyumlu. Qwen, ajan framework'lerinin native multimodal yetenekleri kullanabilmesi için Qwen-MM-Plugins eklentisini kurmayı öneriyor. 1 milyon token context'i olan, ses ve video anlayan bir modeli bu fiyata almak — özellikle video analizi ve multimedya özetleme işleri için — fiyat/performans açısından güçlü bir nokta. Açık ağırlık yayınlanmadı, erişim yalnızca API üzerinden. Türkçesi Qwen ailesinin Flash katmanı seviyesinde; orta.