GroqNedir?
KodGroq, kendi geliştirdiği LPU (Language Processing Unit) işlemcisiyle yapay zeka çıkarımını (inference) olağanüstü hızlı ve düşük maliyetli hale getiren bir platformdur. OpenAI uyumlu API'si sayesinde geliştiriciler, tek satır kod değişikliğiyle Llama, Qwen, GPT-OSS gibi popüler modelleri saniyede yüzlerce token hızında çalıştırabilir.

Mindi Ne Düşünüyor?✅ OpenAI ile tam uyumlu API sayesinde geçiş sadece 2 satır kod. Llama 3.1 8B'de 840 TPS ile sektörün en hızlı çıkarım platformlarından biri. Fiyatlandırma lineer ve öngörülebilir, saklı maliyet yok. Batch API ile %50 tasarruf mümkün.
⚠️ Türkçe arayüz ve dokümantasyon yok; Türkçe destek modelin yeteneklerine bağlı. Çıkarım hızı yüksek olsa da bazı büyük modellerde en ucuz sağlayıcı değil.
🔀 OpenAI, Anthropic, Together AI, DeepInfra alternatifleri arasında hız/maliyet oranıyla öne çıkıyor.
Canopy Labs'in Orpheus TTS (Text-to-Speech) modeli GroqCloud'da kullanıma sunuldu. Yüksek kaliteli metinden konuşma sentezi için optimize edilmiş bu model, Groq'un LPU altyapısında düşük gecikmeyle çalışıyor.
Mindi Skoru





Yorum bırakmak için giriş yapmanız gerekiyor.
Groq Hakkında
✓ Groq Kimler İçin?
✕ Groq Kimler İçin Uygun Değil?
Groq Detaylı İnceleme
Groq, 2016 yılında Jonathan Ross tarafından kuruldu. Ross, Google'da Tensor Processing Unit (TPU) ekibinin kurucu üyelerindendi ve bu deneyimini Groq'un LPU mimarisine taşıdı. Geleneksel GPU'ların aksine, LPU'lar sıralı (deterministic) bir hesaplama modeli kullanır. Bu, her bir token'ın işlenme süresinin öngörülebilir ve tutarlı olmasını sağlar — GPU'lardaki bellek bant genişliği darboğazını ortadan kaldırır.
GroqCloud, geliştiricilere "Tokens-as-a-Service" modeliyle hizmet verir. OpenAI ile birebir uyumlu API sayesinde geçiş sadece iki satır kod değişikliği gerektirir. Platform; Llama 3.1 8B (840 TPS, $0.05/M giriş, $0.08/M çıkış), Qwen3 32B (662 TPS), Llama 3.3 70B (394 TPS) ve GPT-OSS 120B (500 TPS) gibi modeller sunar. Batch API ile toplu işlemlerde %50'ye varan indirim sağlanır.
Fiyatlandırma lineer ve öngörülebilirdir: saklı maliyetler, boş altyapı ücreti veya sürpriz faturalar yoktur. Ayrıca Prompt Caching özelliği sayesinde önbelleğe alınan giriş token'larında %50'ye varan tasarruf elde edilebilir.
Ses alanında Whisper V3 Turbo ile konuşma tanıma ($0.04/saat) ve Canopy Labs Orpheus ile metin-konuşma ($22/M karakter) desteği sunar. Compound AI Systems ile birden fazla modelin birbiriyle iletişim kurarak web araması, kod çalıştırma gibi görevleri yerine getirmesi sağlanır.
2025 yılı itibarıyla 2 milyondan fazla geliştirici GroqCloud'u kullanmakta ve şirket Seri D yatırım turunda $750 milyon toplamıştır. McLaren Formula 1 takımı gibi büyük markalar da Groq'u tercih etmektedir.
Fiyatlandırma
Groq'ta aylık abonelik yok — kullandığın token kadar ödüyorsun. Ücretsiz başlanıyor, ihtiyaç büyüdükçe ödemeli kullanıma geçiliyor. Fiyatlar milyon token başına, USD (groq.com/pricing, 1 Ağustos 2026).
| Model | Giriş (M token) | Çıkış (M token) | Hız |
|---|---|---|---|
| Llama 3.1 8B Instant 128k | $0,05 | $0,08 | 840 TPS |
| GPT OSS 20B 128k | $0,075 | $0,30 | 1.000 TPS |
| GPT OSS 120B 128k | $0,15 | $0,60 | 500 TPS |
| Llama 3.3 70B Versatile 128k | $0,59 | $0,79 | 394 TPS |
| Qwen 3.6 27B 131k | $0,60 | $3,00 | 500 TPS |
Ses tarafında Whisper V3 Large transkript edilen saat başına $0,111, Whisper Large v3 Turbo $0,04 — istek başına en az 10 saniye faturalanıyor. Metin-konuşma için Canopy Labs Orpheus İngilizce milyon karakter başına $22, Suudi Arapçası $40.
Faturayı düşüren iki mekanizma var. Prompt caching cache hit olduğunda giriş token'ını yarıya indiriyor — gpt-oss-120b'de $0,15 yerine $0,075 — ve özelliğin kendisi için ek ücret alınmıyor, indirim sadece isabet olduğunda işliyor. Batch API ise işi asenkron kuyruğa atıp %50 indirim veriyor; karşılığında 24 saatten 7 güne uzayabilen bir işlenme penceresini kabul ediyorsun, buna karşılık standart rate limit'lerin etkilenmiyor.
Compound sistemlerdeki yerleşik araçlar ayrı faturalanıyor: temel web araması 1.000 istek başına $5, gelişmiş arama $8, site ziyareti $1, kod çalıştırma saat başına $0,18. Minimax M2.7 gibi enterprise-only modeller, fine-tune edilmiş modeller ve on-prem kurulumlar liste dışında — onlar için Groq'la ayrıca görüşülüyor.