Nemotron 3 Nano
NVIDIA
Son güncelleme: 31 Ağustos 2026
🖥️ Bu model bilgisayarında çalışır mı?
Q4 quantization ile en az 5 GB VRAM ya da birleşik bellek ister — 24 GB ve üstünde rahat çalışır.
4B dense sürüm; 30B-A3B MoE sürümü 24GB ister
30B-A3B sürümü Q4 ~21GB (tek 24GB GPU); 4B dense ~5GB
Ekran kartını seç, çalışır mı gör →Bağlam uzunluğu
1M token
API giriş (1M token)
—
API çıkış (1M token)
—
Kullanıcı planı
—
Ücretsiz plan mevcut
Türkçe destek
Orta
Çok modlu
Hayır
Hızı
Hızlı
OpenAI uyumlu
Hayır
Ne İçin Kullanılır?
- ✓Yerel ajan ve otomasyon
- ✓Kod yazma ve inceleme
- ✓Uzun belge işleme
- ✓Maliyet duyarlı üretim
Güçlü Yönler
- ↑MoE ile düşük aktif parametre, yüksek hız
- ↑Tek 24GB GPU ile çalışabilir
- ↑Açık ağırlık, veri ve tarif
- ↑1M token bağlam
Dikkat Edilecekler
- ↓Türkçe performansı test edilmeli
- ↓Multimodal giriş yok (Omni ayrı model)
- ↓En üst düzey doğrulukta değil
NVIDIA'nın Aralık 2025'te çıkardığı Nemotron 3 ailesinin en küçük üyesi. 31,6 milyar toplam parametreli ama MoE mimarisi sayesinde her token'da yalnızca ~3,6 milyar aktif parametre kullanıyor — yani küçük bir modelin hızıyla daha büyük modele yakın doğruluk. Hybrid Mamba-Transformer yapısı uzun bağlamda hız avantajı veriyor, 1M token'a kadar context destekliyor. Ağırlıkları, eğitim verisi ve tarifleri açık; ticari kullanıma uygun. 30B-A3B sürümü Q4'te ~21GB'a sığıyor, 24GB'lık bir RTX 4090'da rahat dönüyor; ayrıca ~5GB'a sığan 4B dense sürümü var. Ollama ve LM Studio ile yerelde ücretsiz çalışıyor. Kod, akıl yürütme ve ajan görevleri için tasarlanmış — hazır bir asistan değil, kendi altyapına gömeceğin bir motor.
En Yakın Alternatif
Gerekli Programlar
Açık ağırlıklı bir modeli kendi bilgisayarında çalıştırmak için bir model yöneticisi gerekir. İkisi de ücretsiz, ikisi de Windows, Mac ve Linux'ta çalışır.
LM Studio — görsel arayüz isteyenler için
Modeli listeden seçip indiriyorsun, terminal yok. Yeni başlayan için en kısa yol.
Ollama — terminalden çalıştıranlar için
Ollama'yı kurduktan sonra aşağıdaki satırı terminale yapıştırıp Enter'a bas; model kendiliğinden iniyor ve sohbet açılıyor.
ollama run nemotron-3-nanoDonanım tarafı
Büyük modeller için ekran kartı yetmiyorsa, iş istasyonu sınıfı donanımın ne verdiğini rehberde ölçtük.
DGX Spark rehberi →