MiMo-V2.6-Flash
Xiaomi
Son güncelleme: 23 Eylül 2026
🖥️ Bu model bilgisayarında çalışır mı?
Ağırlıkları açık, ama tüketici donanımında pratik değil: 309B toplam parametre — Q4 nicelemede bile tek tüketici kartına sığmaz. Aynı gün çıkan MiMo-V2.6-Distill-Qwen-9B yerelde çalışabilir boyutta.
MIT lisanslı açık ağırlık, 309B toplam / 15B aktif (MoE). GGUF sürümleri mevcut ama çok kartlı ya da yüksek RAM'li kurulum ister.
Ekran kartını seç, çalışır mı gör →Bağlam uzunluğu
1M token
API giriş (1M token)
$0.14
API çıkış (1M token)
$0.28
Kullanıcı planı
Ücretsiz (açık kaynak)
Ücretsiz plan mevcut
Türkçe destek
Zayıf
Çok modlu
Evet
Hızı
Hızlı
OpenAI uyumlu
Evet
Ne İçin Kullanılır?
- ✓Yüksek frekanslı ve toplu API kullanımı
- ✓Multimodal veri işleme (görsel/ses/video girişi)
- ✓Maliyet kritik ajan görevleri
- ✓Uzun context gerektiren belge işleme
Güçlü Yönler
- ↑1M token context'te 0,14 / 0,28 dolar — segmentin en ucuzlarından
- ↑MIT lisanslı açık ağırlık
- ↑DeepSWE v1.1: 48,8 → 65,7, MiMo-V2.5-Pro'yu geçiyor
- ↑Native metin/görsel/ses/video girişi
- ↑Cache hit 0,0028 dolar
Dikkat Edilecekler
- ↓Türkçe desteği zayıf
- ↓309B parametre — yerel kurulum için ağır
- ↓Knowledge cutoff resmi kaynakta belirtilmedi
MiMo-V2.6-Flash, Xiaomi'nin 21 Eylül 2026'da Pro ile birlikte açık kaynak yayınladığı, serinin ucuz ve hızlı üyesi. 309 milyar toplam parametreli, token başına 15 milyar parametre aktive eden bir Mixture-of-Experts yapısı kullanıyor ve hibrit attention mekanizmasına sahip. Native olarak metin, görsel, ses ve video girişini işliyor; context window 1.048.576 token. Eğitim tarafında Flash da Pro ile aynı ölçekli RL sürecinden geçmiş; 6 günden kısa süren canlı eğitimde yaklaşık 850 bin dolarlık maliyetle 30 adım tamamlanmış. Xiaomi, DeepSWE v1.1 skorunun 48,8'den 65,7'ye çıktığını ve Flash'ın MiMo-V2.5-Pro'yu kapsamlı şekilde geçtiğini söylüyor. Yani Flash, önceki neslin amiral gemisini geride bırakan bir ucuz katman olarak konumlanmış. Fiyat gerçekten agresif: giriş 0,14 dolar, çıkış 0,28 dolar (1M token), yine V2.5 ile aynı tarife. Cache hit 0,0028 dolar, batch API'de 0,07 / 0,14 dolar. 1M token context'e sahip, açık ağırlıklı bir model için bu seviye piyasada nadir; o çapta bir context'i bu fiyata veren alternatif sayısı bir elin parmaklarını geçmiyor. MIT lisansıyla yayınlandığı için kendi donanımında da çalıştırabilirsin ama 309B parametre sınıfı yerel kurulum için hâlâ ağır. Daha küçük donanımda denemek istersen Xiaomi aynı gün MIT lisanslı MiMo-V2.6-Distill-Qwen-9B'yi de yayınladı. Yüksek frekanslı çağrılar, toplu veri işleme ve maliyetin kritik olduğu ajan görevleri için tasarlanmış. Türkçe performansı aile genelinde zayıf.
En Yakın Alternatif
Gerekli Programlar
Açık ağırlıklı bir modeli kendi bilgisayarında çalıştırmak için bir model yöneticisi gerekir. İkisi de ücretsiz, ikisi de Windows, Mac ve Linux'ta çalışır.
LM Studio — görsel arayüz isteyenler için
Modeli listeden seçip indiriyorsun, terminal yok. Yeni başlayan için en kısa yol.
Ollama — terminalden çalıştıranlar için
Terminalden tek komutla model indirip çalıştırıyorsun, arayüz yok. Bu modelin Ollama kütüphanesinde hazır bir sürümü olup olmadığını ollama.com'da arayarak görebilirsin.
Donanım tarafı
Büyük modeller için ekran kartı yetmiyorsa, iş istasyonu sınıfı donanımın ne verdiğini rehberde ölçtük.
DGX Spark rehberi →