⚡ Öne ÇıkanBilgisayarımda hangi ücretsiz yapay zeka çalışır?
Ana Sayfa / Araçlar / Kod / Together AI
Together AI

Together AINedir?

Kod
together.ai
Son güncelleme: 6 Eylül 2026
ÜcretliTR Kısmi

Açık kaynak AI modellerini tek API'den çalıştır, fine-tune et ya da NVIDIA GPU kümesi kirala.

Together AI ekran görüntüsü
Platform Seçin:Web
MindiMindi Ne Düşünüyor?

✅ DeepSeek V4 Pro, MiniMax M3, GLM-5.2, Kimi K3 gibi açık modelleri OpenAI uyumlu tek API'den çağırıyorsun; aynı hesapta fine-tuning, değerlendirme ve saatlik H100/B200 kiralama da var.
⚠️ Ücretsiz deneme yok — hesabı açmak için minimum 5$ kredi yüklemen gerekiyor.
🔀 Sadece düşük gecikmeli inference lazımsa Groq daha dar ve basit bir seçim; Together fine-tuning ve GPU kümesi gerektiğinde öne çıkıyor.

🕐 Güncelleme Geçmişi
16 Temmuz 2026
Inkling serverless'ta, Dedicated Model Inference yenilendi

Thinking Machines'in 552,8 milyar parametreli Inkling modeli serverless listesine eklendi — 524.288 token bağlam, NVFP4 quantization, 1M token başına 1,00$ girdi / 4,05$ çıktı / 0,17$ cache'li girdi. Aynı gün Dedicated Model Inference elden geçti: tek komutla endpoint kurulumu, A/B testi ve gölge deney desteği, istek ya da GPU metriğine göre otomatik ölçekleme, boşta sıfıra inme.

Tüm değişiklikleri gör (4)

Mindi Skoru

mindilotmindilotmindilotmindilotmindilot
Henüz oylanmadı

Yorum bırakmak için giriş yapmanız gerekiyor.

Together AI Hakkında

Together AI, açık kaynak yapay zeka modellerini üretimde çalıştırmak için kurulmuş bir bulut platformu. 2022'de Vipul Ved Prakash, Ce Zhang, Percy Liang ve Chris Ré tarafından kuruldu; Temmuz 2026'da Aramco Ventures liderliğindeki 800 milyon dolarlık Series C turuyla 8,3 milyar dolar değerleme aldı. Üç ana iş yapıyor. Serverless inference: DeepSeek V4 Pro, MiniMax M3, GLM-5.2, Kimi K3, Qwen3.7, gpt-oss gibi açık modelleri OpenAI uyumlu tek API'den token başına ücretle çağırıyorsun — görsel, video, ses, transkripsiyon ve embedding modelleri de aynı çatı altında. Model shaping: LoRA veya tam fine-tuning, DPO ve LLM-as-a-judge tabanlı değerlendirme. Compute: H100'den GB300'e kadar NVIDIA GPU kümeleri, saatlik ya da rezervasyonlu. Temmuz 2026'da eklenen Provisioned Throughput ile GPU saati hesabı yapmadan token bazlı rezerve kapasite alabiliyorsun; öngörülebilir fatura isteyen ekipler için tasarlanmış. Ücretsiz deneme sürümü yok — platformu kullanmaya başlamak için en az 5 dolarlık kredi yüklemen gerekiyor. Startup Accelerator programına kabul edilen ekiplere 50.000 dolara kadar kredi veriliyor.

Together AI Kimler İçin?

Açık kaynak modelleri üretimde çalıştıran geliştiriciler, kendi modelini fine-tune etmek isteyen ekipler, GPU kümesi kiralayan araştırmacılar, kapalı model API maliyetinden kaçmak isteyen ürün ekipleri

Together AI Kimler İçin Uygun Değil?

Kod yazmadan hazır bir sohbet arayüzü arayanlar; ücretsiz deneme bekleyenler — hesap açmak için minimum 5$ kredi zorunlu

Together AI Detaylı İnceleme

Together AI'ı en yalın haliyle şöyle tarif edebilirim: kapalı model API'lerinin yaptığı işi açık kaynak modellerle yapan bir bulut. Llama, DeepSeek, Qwen, Kimi, GLM ya da gpt-oss'u kendi sunucuna kurmadan, OpenAI uyumlu tek bir uçtan çağırıyorsun; işin büyürse aynı platformda fine-tune ediyor, gerekirse doğrudan GPU kümesi kiralıyorsun.

Şirket 2022'de kuruldu. Kurucu kadroda CEO Vipul Ved Prakash'ın yanında Stanford'dan Ce Zhang, Percy Liang ve Chris Ré var — FlashAttention gibi, bugün neredeyse her LLM eğitiminde kullanılan tekniklerin çıktığı çevre. Temmuz 2026'da Aramco Ventures liderliğinde 800 milyon dolarlık Series C aldı ve değerlemesi 8,3 milyar dolara çıktı; Şubat 2025'teki turun 2,5 katı.

Rakiplerinden farkı kapsam. Groq ya da OpenRouter tek bir işi (hızlı inference, model yönlendirme) iyi yapar; Together inference, fine-tuning, değerlendirme, sandbox ve çıplak GPU kümesini aynı faturada topluyor.

Temel Özellikler

Serverless inference. Yüzlerce açık modeli token başına ücretle çağırıyorsun; metin dışında görsel, video, ses, transkripsiyon, embedding ve moderasyon modelleri de var. Batch API'yle toplu işlerde daha ucuza çalışıyorsun.

Provisioned Throughput. Temmuz 2026'da eklendi. GPU saati hesabı yapmak yerine "throughput unit" alıyorsun; kapasite rezerve, fatura öngörülebilir. MiniMax M3 ve GLM-5.2 gibi modellerde PTU dakikası 0,05$.

Dedicated inference. Modeli tek kiracılı GPU'da çalıştırıyorsun — sabit performans, hard rate limit yok, kendi özel modelini de deploy edebiliyorsun. H100 saatlik 5,49$, B200 8,99$.

Fine-tuning. LoRA veya tam fine-tuning, DPO desteğiyle. 16B'ye kadar modellerde LoRA 1M token başına 0,48$; DeepSeek ve GLM-5 gibi büyük modeller için ayrı fiyat tablosu var. Her işte minimum 4$ ücret uygulanıyor.

Evaluations. Kendi alanın için LLM-as-a-judge değerlendirme setleri kuruyorsun: modelleri, promptları ve konfigürasyonları karşılaştır, çıktıları puanla ve sınıflandır.

Sandbox. LLM'in ürettiği kodu güvenli çalıştırmak için code interpreter (60 dakikalık oturum 0,03$) ve daha büyük geliştirme ortamları için vCPU/RAM bazlı ücretlendirilen VM sandbox'lar.

GPU Clusters. H100 saatlik 3,99$'dan başlıyor, H200 5,99$, B200 8,19$. 7 günden uzun rezervasyonlarda fiyat kademeli düşüyor; GB200 ve GB300 NVL72 için satışla görüşmen gerekiyor.

Kullanım Senaryoları

Kapalı model API faturası şişen ürün ekipleri için en somut kullanım, iş yükünün bir kısmını açık modele kaydırmak — sınıflandırma, özetleme, etiketleme gibi "frontier model gerekmeyen" işler.

Kendi verisiyle model şekillendirmek isteyenler için fine-tuning + evaluation ikilisi tek yerde: eğitiyorsun, LLM-as-a-judge ile ölçüyorsun, aynı API'den servis ediyorsun.

Araştırmacılar ve model eğiten ekipler için GPU kümesi tarafı var; saatlik başlayıp aylık rezervasyona geçebiliyorsun.

Ajan geliştirenler içinse sandbox ve batch API kombinasyonu iş görüyor: ajanın ürettiği kodu izole çalıştır, toplu işleri gece indirimli tarifede geçir.

Fiyatlandırma

Ücretsiz deneme yok; hesabı açmak için minimum 5$ kredi yüklüyorsun. Ödeme kullandıkça.

Serverless inference (1M token, girdi/çıktı):

Model Girdi Çıktı
gpt-oss-120B 0,15$ 0,60$
MiniMax M3 0,30$ 1,20$
Qwen3.7-Plus 0,32$ 1,28$
GLM-5.2 1,40$ 4,40$
DeepSeek V4 Pro 1,74$ 3,48$
Kimi K3 3,00$ 15,00$

Compute ve şekillendirme:

Kalem Fiyat
GPU cluster — H100 / H200 / B200 (saatlik) 3,99$ / 5,99$ / 8,19$
Dedicated inference — H100 / B200 (saatlik) 5,49$ / 8,99$
Fine-tuning (16B'ye kadar, LoRA, 1M token) 0,48$
Code interpreter (60 dakikalık oturum) 0,03$
Paylaşımlı dosya sistemi 0,16$ / GiB / ay

Fiyatlar sık değişiyor ve model listesi neredeyse her hafta güncelleniyor; kritik bir hesap yapacaksan resmi fiyat sayfasından teyit et.

Sık Sorulan Sorular