⚡ Öne ÇıkanBilgisayarımda hangi ücretsiz yapay zeka çalışır?
Ana Sayfa/Rehberler/Ollama Nedir, Nasıl Kullanılır? Açık Mod
AI Asistan

Ollama Nedir, Nasıl Kullanılır? Açık Model İndirme ve API Rehberi (2026)

9 Eylül 2026

*Yukarıdaki butona tıkla ve ekle. Yapay zeka gelişmelerini Google’da her zaman üstte gör.

Ollama Nedir, Nasıl Kullanılır? Açık Model İndirme ve API Rehberi (2026)

Ollama nedir, Windows'a nasıl kurulur, açık model nasıl indirilir ve API nasıl kullanılır — adım adım Türkçe rehber. LM Studio karşılaştırması, Ollama Cloud ve Android gerçeği dahil.

Yapay zekaya aylık abonelik ödemekten sıkıldıysan ve "kendi bilgisayarımda çalışan bir AI asistanım olsun" diyorsan, karşına çıkacak ilk araç Ollama. ChatGPT ve Claude'un aksine bulutta çalışmaz; modeli bilgisayarına indirir, internet olmadan da kullanırsın. Bu rehberde Ollama'nın ne olduğunu, Windows'a nasıl kurulacağını, açık modelin nasıl indirileceğini ve API'sinin nasıl kullanılacağını adım adım gösteriyorum. Telefonda (Android) kullanım ve Ollama Cloud konusunu da netleştiriyorum — çünkü bu ikisi hakkında internette bolca yanlış bilgi var.

Başlamadan bir netlik: Ollama'yı kullanmak için kod yazmayı bilmene gerek yok, ama komut yazacaksın — siyah bir ekrana birkaç satır. Bu sana zor geliyorsa aşağıdaki karşılaştırmaya bak; muhtemelen aradığın şey LM Studio.

Ollama Nedir?

Ollama, açık kaynak yapay zeka modellerini kendi bilgisayarında çalıştırmanı sağlayan ücretsiz bir araçtır. MIT lisanslı, yani hem kullanımı hem ticari kullanımı serbest. macOS, Windows ve Linux'ta çalışır.

Ollama'nın arkasındaki fikir basit: açık kaynak modeller (Llama, Qwen, Gemma, DeepSeek gibi) internette ücretsiz duruyor ama bunları indirip çalıştırmak teknik bilgi ister. Ollama bu işi tek komuta indirir:

ollama run qwen3

Bu komut modeli indirir, kurar ve sohbeti başlatır. Model dosyalarını (GGUFiaçık kaynak modellerin optimize edilmiş, tek dosyalık formatı), bağımlılıkları ve GPU ayarlarını senin yerine halleder.

Ollama'ya "ChatGPT'nin açık kaynak muadili" demek yanlış olur — o bir sohbet uygulaması değil, bir model çalıştırıcıdır (runner). Sohbet edebilirsin ama asıl gücü şurada: çalıştırdığı her model aynı anda yerel bir API sunar. Yani kendi uygulaman, kendi ajanın veya bir araç bu modele internet üzerinden değil, localhost üzerinden bağlanır.

Ollama Ne İşe Yarar?

Dört ana kullanım alanı var:

  1. İnternetsiz, sınırsız sohbet. Model bilgisayarında çalıştığı için kota, limit veya kesinti yok. Verilerin de bilgisayarından çıkmaz.
  2. Gizlilik gerektiren işler. Hastane kaydı, sözleşme, mali veri gibi içeriği üçüncü taraf sunucuya göndermek istemiyorsan Ollama bunu yerel çözer.
  3. Geliştirme ve otomasyon. Yerel API sayesinde modeli kendi script'ine, ajanına veya n8n gibi otomasyon araçlarına bağlarsın.
  4. Model karşılaştırma. Yeni çıkan açık modelleri abonelik ödemeden test eder, hangisinin senin işine yaradığını görürsün.

Ollama mı, LM Studio mu? Önce Bunu Netleştir

Yerel yapay zekada iki isim öne çıkıyor ve aslında en başta vereceğin karar bu. Ollama terminale komut yazarak, LM Studio ise fareyle tıklayarak çalışır. İkisi de ücretsiz, ikisi de aynı açık modelleri aynı hızda çalıştırır — fark modelde değil, senin onu nasıl kullandığında.

Ollama LM Studio
Nasıl kullanılır Terminale komut yazarsın Programı açar, tıklarsın
Model indirme ollama run model-adi Listeden seçip "Download"
Sohbet ekranı Terminalde; görsel arayüz için ek kurulum Programın içinde hazır
Yerel API Kurulumla birlikte açık (localhost:11434) Sunucuyu elle başlatırsın (localhost:1234)
Kime göre Modeli kendi projesine/otomasyonuna bağlayacak olan İlk kez deneyen, sadece sohbet etmek isteyen
Fiyat Ücretsiz, açık kaynak (MIT) Uygulama ve yerel modeller ücretsiz — iş yerinde kullanım dahil

Net cevabı vereyim: bilgisayarında ilk kez yerel model çalıştıracaksan LM Studio ile başla. İndirirsin, kurarsın, listeden bir model seçip konuşmaya başlarsın; terminal yüzü görmezsin. Ollama'ya şu üç durumda geç: modeli kendi uygulamana veya otomasyonuna bağlayacaksın, aynı modeli birden fazla araca servis edeceksin, ya da terminalde çalışmak sana zaten doğal geliyor.

İkisini aynı anda kurabilirsin, birbirlerini bozmazlar — farklı portlarda çalışıyorlar. Daha geniş kıyas için yerel AI rehberime bakabilirsin.

[mindi_yorum]
💰 İkisi de ücretsiz — LM Studio uygulaması ve yerel modeller iş yerinde bile ücretsiz, Ollama MIT lisanslı
🟢 Yanlış seçim diye bir şey yok: ikisini de kurup on dakikada hangisinin sana oturduğunu görebilirsin
🟡 "Ollama daha güçlüdür" diye bir şey yok — aynı modeller, aynı donanım, aynı hız. Fark arayüz ve entegrasyonda
🔵 Sadece sohbet edeceksen terminal öğrenmek için Ollama'ya gelme; LM Studio'da aynı modeli iki tıkla çalıştırırsın

Ollama Windows'a Nasıl Kurulur?

Ollama download Windows için iki yol var. Hangisini seçersen seç, kurulum birkaç dakika sürer.

Komutları Nereye Yazacaksın?

Bu rehberdeki ollama ... komutlarının hepsi terminaleibilgisayara komut yazdığın, metin tabanlı pencere yazılır — Ollama'nın bir tıklamalı arayüzü yok. Terminali açmak:

  • Windows: Başlat'a PowerShell yaz, çıkan sonuca tıkla. Yönetici gerekiyorsa sağ tıkla ve "Yönetici olarak çalıştır" de. Kısayol: Win + X → "Terminal".
  • macOS: Cmd + BoşlukTerminal yaz → Enter.
  • Linux: Ctrl + Alt + T.

Açılan pencereye komutu yazıp Enter'a basarsın; kopyaladığın bir komutu yapıştırmak için Ctrl + V ya da sağ tık işini görür. Komut çalışırken pencereyi kapatma — model indirmesi orada ilerliyor.

Yol 1 — Kurulum dosyası (en kolay): ollama.com/download adresinden Windows sürümünü indir (OllamaSetup.exe), çift tıkla, kurulumu bitir.

Yol 2 — PowerShell komutu: Terminali yönetici olarak aç ve şunu çalıştır:

irm https://ollama.com/install.ps1 | iex

Windows sürümü NVIDIA GPU'ları otomatik kullanır; NVIDIA kartı olmayan makinelerde modern işlemci komut setleriyle (AVX/AVX2) idare eder. Sanallaştırma veya WSL kurulumu gerekmez — doğrudan Windows native çalışır.

Kurulumdan sonra Ollama arka planda kendiliğinden başlar ve görev çubuğunda tepsi ikonu olarak durur. Önemli detay: Ollama kurulduğu andan itibaren API'yi http://localhost:11434 adresinde otomatik yayınlar. Ayrı bir "sunucuyu başlat" adımı yok.

Kurulumu doğrulamak için yeni bir terminal aç ve şunu yaz:

ollama --version

Sürüm numarası geliyorsa hazırsın. macOS ve Linux'ta kurulum benzer: macOS installer'ı indir, Linux'ta curl -fsSL https://ollama.com/install.sh | sh komutunu çalıştır.

Açık Model Nasıl İndirilir?

Ollama'nın model kütüphanesi ollama.com/library adresinde. Yüzlerce model var; hepsi açık kaynak. İndirme işlemi iki komuttan biriyle olur:

ollama pull qwen3        # sadece indirir
ollama run gemma4        # indirir ve sohbeti başlatır

ollama run zaten indirmemişse modeli otomatik çeker, o yüzden çoğu kişi sadece ollama run kullanır. İlk indirme birkaç GB olabilir — model boyutuna göre dakikalar sürer.

Hangi modeli seçmeli? En kritik karar bu. Model boyutu doğrudan donanımına bağlı:

Model boyutu Yaklaşık indirme Gereken RAM/VRAM Kime göre
3-4B (küçük) ~2-3 GB 4 GB üstü Zayıf donanım, basit sohbet
7-9B (orta) ~5 GB 8 GB üstü Günlük kullanım için tatlı nokta
14B ~9 GB 16 GB üstü Daha iyi akıl yürütme
30-35B ~20 GB 32 GB üstü Ciddi işler
70B+ ~40 GB+ 48 GB+ En güçlü açık modeller

Rakamlar Q4 sürümler içindir: quantizeimodeli sıkıştırıp daha az bellek kullanmasını sağlayan yöntem; kaliteyi az miktarda düşürür edilmiş, en yaygın kullanılan biçim. ollama pull indirme boyutunu baştan gösterir, emin değilsen başlatınca görürsün.

Bilgisayarında kaç GB RAM olduğunu bilmiyorsan: Windows'ta Ctrl + Shift + Esc ile Görev Yöneticisi'ni aç, "Performans" sekmesinde "Bellek" yazan yere bak. macOS'ta sol üstteki elma → "Bu Mac Hakkında".

Pratik kural: 8 GB RAM'li bir dizüstü bilgisayarda 7-9B aralığı rahat çalışır; 24 GB RAM ve 6 GB VRAM gibi orta seviye bir ekran kartın varsa 7-9B modelleri GPU'da hızlı, 14B'yi kısmen GPU kısmen RAM'de çalıştırabilirsin.

Ollama'da çalıştırabileceğin modellerin mindilot'taki sayfaları:

Hangi modelin hangi işe yaradığını hangi yapay zeka modeli ne için kullanılır rehberinde karşılaştırabilirsin.

Dikkat: Model adının sonundaki :8b, :27b gibi etiketler boyutu belirtir. Aynı model ailesinin farklı boyutları ayrı ayrı indirilir. Örneğin ollama run qwen3 yerine ollama run qwen3:32b yazarsan daha büyük sürümü çekersin.

Ollama ile Sohbet Nasıl Başlar?

Model indikten sonra terminalde doğrudan konuşmaya başlarsın:

ollama run granite4.2:8b
>>> Türkçe destekli kısa bir e-posta taslağı hazırla...

Çıkış yapmak için /bye, modeli değiştirmek için /load model-adi yazabilirsin. Görsel arayüz istiyorsan iki seçenek var:

Ollama API Nasıl Kullanılır?

Bu bölüm, modeli kendi uygulamasına veya otomasyonuna bağlamak isteyenler için. Sadece sohbet edeceksen atlayıp "Ollama Cloud Nedir?" bölümüne geçebilirsin — bir şey kaçırmazsın.

Ollama'nın asıl gücü API'sinde •iki programın birbiriyle konuşmasını sağlayan bağlantı noktası•. Kurulumla birlikte http://localhost:11434 adresinde bir API ayağa kalkar. İki uç nokta (endpoint) öne çıkar:

1. Yerel API (/api/generate): Tek seferlik metin üretimi için:

curl http://localhost:11434/api/generate -d '{
  "model": "granite4.2:8b",
  "prompt": "Neden gökyüzü mavi?",
  "stream": false
}'

2. Sohbet API'si (/api/chat): Çok turlu konuşma için — mesaj geçmişini gönderirsin, model bağlamı hatırlar:

curl http://localhost:11434/api/chat -d '{
  "model": "qwen3:32b",
  "messages": [
    {"role": "user", "content": "Merhaba, adın ne?"},
    {"role": "assistant", "content": "Ben yerel çalışan bir AI asistanım."},
    {"role": "user", "content": "Peki nerede yaşıyorsun?"}
  ]
}'

3. OpenAI uyumlu uç nokta (/v1): OpenAI'nin API formatını kullanan her uygulama, sadece temel adresi değiştirerek Ollama'daki yerel modeli kullanabilir. Python örneği:

from openai import OpenAI

client = OpenAI(
    base_url="http://localhost:11434/v1",   # OpenAI yerine Ollama
    api_key="ollama"                          # yerel, anahtar gerekmez
)

response = client.chat.completions.create(
    model="granite4.2:8b",
    messages=[{"role": "user", "content": "Türkçe özet çıkar"}]
)
print(response.choices[0].message.content)

Bu uyumluluk sayesinde ChatGPT veya Claude API'si için yazılmış birçok aracı, kod değiştirmeden yerel modele çevirebilirsin. API dünyasına yeni başlıyorsan yapay zeka API'si nedir rehberimde temel kavramları bulabilirsin.

Dikkat: Ollama API'si varsayılan olarak yalnızca kendi bilgisayarından erişime açıktır (localhost). Bunu ağa açmak (OLLAMA_HOST=0.0.0.0) güvenlik riski taşır — modeli çalıştıran makineye erişen herkes API'yi de kullanabilir. Ağ erişimi gerekiyorsa mutlaka kimlik doğrulama katmanı ekle.

Ollama Cloud Nedir?

Ollama Cloud, Ollama'nın kendi bulut hizmeti. Yerel donanımı olmayanlar için açık modelleri NVIDIA'nın bulut altyapısında (NCP) çalıştırır. ollama.com/cloud adresinden hesap açarsın, API anahtarı alırsın, aynı OpenAI-uyumlu API'yi bu kez internete açık bir uç noktada kullanırsın.

Fiyatlandırma katmanlı: Free $0 (başlangıç modelleri + sınırlı kullanım kredisi), Pro $20/ay (aylık $60 kullanım kredisi), Max $100/ay (aylık $300 kredi, 10 eşzamanlı istek), Team $500/ay (takımla paylaşılan $1.000 kredi). Kullanım token başına, modele göre ücretlendirilir. Yani "önce ücretsiz dene, yetmezse abone ol" modeli.

Cloud'un yerelden farkı net: verilerin artık kendi bilgisayarında değil, NVIDIA bulutunda işlenir. Ollama, ortak sağlayıcılardan "log tutmama, eğitimde kullanmama, veri saklamama" taahhüdü alıyor ama gizlilik senin için kritikse yerel kurulum hâlâ tek güvenli seçenek. Cloud modelleri tool calling (araç çağırma) destekliyor, yani ajan iş akışlarında da kullanılabilir.

Ollama Android ve APK: Telefonda Kullanımın Gerçeği

Ollama Android araması yapanların çoğu "telefonumda model çalıştırayım" sanıyor. Gerçek şu: Ollama'nın resmi bir Android uygulaması veya APK'sı yok. Ollama'yı telefonda kullanmanın iki yolu var, ikisi de modeli telefonda çalıştırmaz:

  1. Kendi bilgisayarına bağlan: Bilgisayarında Ollama çalışıyorsa, aynı Wi-Fi ağındayken üçüncü parti bir client uygulamayla (örneğin Ollama Mobile) bilgisayarındaki modele telefonundan bağlanırsın. Telefon sadece arayüzdür; model bilgisayarda çalışır.
  2. Ollama Cloud kullan: Yukarıda anlattığım Cloud hizmetine API anahtarıyla bağlanan bir client uygulama kurarsın. Model bu kez NVIDIA bulutunda çalışır.

Kritik uyarı: Google Play'de "Ollama" adını taşıyan çok sayıda uygulama var ve çoğu resmi değil. Örneğin "Ollama App: AI Tools Insight" adlı uygulamanın puanı 1.6 — bu, Ollama ile ilgisi olmayan, isim benzerliğinden trafik toplayan bir uygulama. APK sitelerinde dolaşan "Ollama APK" dosyaları da aynı şekilde üçüncü parti veya kötü amaçlı olabilir. Ollama'yı yalnızca resmi sitesi ollama.com üzerinden indir. Telefonda client uygulama arıyorsan açık kaynak kodlu, topluluk tarafından bilinen bir uygulamayı seç ve Ollama ile ilişkisini doğrula.

Ollama'nın Eksileri Neler?

Dürüst olmak gerekirse her şey toz pembe değil:

  • Donanım sınırı. Büyük modeller ciddi RAM/VRAM ister. 70B+ modelleri çoğu kişisel bilgisayarda çalışmaz; çalışsa bile yavaştır. Abonelikli bulut modelleri (ChatGPT, Claude) her donanımda en güçlü modeli kullanır — Ollama'da donanımın senin tavanın.
  • Model kalitesi farkı. 2026'da açık modeller çok yol aldı ama en güçlü kapalı modellerle (örneğin Claude, GPT) aradaki fark özellikle karmaşık akıl yürütmede hâlâ hissediliyor. Model karşılaştırması için Türkçesi en iyi modeller testimize bakabilirsin.
  • Terminal eşiği. Ollama komut satırıyla kullanılır; görsel arayüz için ekstra kurulum (Open WebUI vb.) gerekir. Terminalden hoşlanmıyorsan LM Studio daha kolay başlangıç olabilir.
  • Türkçe desteği modele göre değişir. Türkçesi güçlü bir model seçmezsen cevaplar İngilizce ağırlıklı veya bozuk olabilir. Llama, Qwen ve Gemma ailelerinin güncel sürümleri Türkçede genelde iyidir ama önce küçük boyutla test et.

[mindi_yorum]
💰 Ollama tamamen ücretsiz ve açık kaynak; Cloud'da Free katman $0, üstü $20/ay Pro'dan başlıyor — asıl maliyetin donanım (ya da Cloud aboneliği)
🟢 Tek komutla model indirip çalıştırmak gerçekten bu kadar kolay; OpenAI-uyumlu API sayesinde mevcut araçları yerel modele çevirmek dakikalar alıyor
🟡 "Resmi Android uygulaması" diye bir şey yok — Play Store'daki Ollama adlı uygulamaların çoğu sahte; APK indirmeden önce iki kez düşün
🔵 Başlarken en büyük hata 70B modeli indirmek. 8 GB RAM'li makinelerde 7-9B aralığıyla başla, yetmediğini görürsen boyut büyüt

Şimdi Ne Yapacaksın?

  1. Terminale hiç girmek istemiyorsan LM Studio ile başla — aynı modeller, tıklamalı arayüz. Devam ediyorsan Ollama'yı indir ve kur
  2. Terminalde ollama run gemma4 veya ollama run granite4.2:8b çalıştır — model iner, sohbet başlar
  3. Türkçe cevap kalitesini test et; beğenmezsen ollama run qwen3 gibi başka bir model dene
  4. Görsel arayüz istiyorsan Open WebUI veya AnythingLLM rehberini uygula
  5. API'yi kendi projende kullanmak için localhost:11434/v1 uç noktasını OpenAI-uyumlu client'ına tanıt
  6. Telefonda kullanmak istersen Ollama Cloud'a kaydol veya aynı Wi-Fi'da client uygulamayla bilgisayarına bağlan