İlgili Modeller

Claude Code, 14 Ağustos'tan itibaren Pro, Max ve Team planlarında otomatik modu varsayılan yapıyor: her komut için onay istemi yerine ayrı bir sınıflandırıcı devreye giriyor.
Kod yazarken her adımda çıkan "izin veriyor musun?" istemleri kalkıyor. 14 Ağustos'tan itibaren Pro, Max ve Team planlarındaki yeni oturumlar otomatik modda başlayacak; her araç çağrısı, geri alınamaz veya yıkıcı işlemleri yakalamak üzere eğitilmiş ayrı bir sınıflandırıcıdan geçecek.
Neden değiştiriyorlar
Şirketin kendi verisine göre kullanıcılar izin istemlerinin %97'sini onaylıyor — yani çoğu kişi okumadan tıklıyor. Aynı kullanıcılar bir plan onaya sunulduğunda planların %39'unu reddediyor, tek tek izinlerde ise ret oranı %3'te kalıyor. Haziran 2026 itibarıyla aktif CLI kullanıcılarının %49,5'i kendi eliyle bir Bash izin kuralı yazmış, %62'si ise en az bir kez "bir daha sorma"ya basmış durumda.
1.053 kişilik testin sonucu
Bir araştırma firması üzerinden tutulan 1.053 profesyonel test kullanıcısına, oturumun ortasında açıkça tehlikeli bir komut istemi gösterildi. İnsanlar bu komutu sadece %13,6 oranında durdurdu (1.053 kişiden 143'ü); otomatik mod aynı komutların %89'unu bloke etti. Kafa kafaya bakıldığında otomatik mod, insanların onayladığı 800 komutu durdurmuş; insanlar ise otomatik modun geçirdiği yalnızca 6 komutu yakalamış.
Asıl dikkat çeken kısım oturum uzunluğuyla ilgili: insanların yakalama oranı oturumun başında %17 iken 50 istemden sonra %5'e iniyor, sınıflandırıcının oranı ise oturum ne kadar uzarsa uzasın sabit kalıyor.
Saldırı testleri
Trajectory Labs'ın yaptığı bağımsız değerlendirmede 72 dolaylı prompt injectioni
Dış içeriğe gizlenmiş talimatlarla modeli kendi görevinden saptırma saldırısı. senaryosu onar kez denendi. Otomatik modda çalışan Fable 5, Opus 5 ve Sonnet 5'e karşı 720 denemenin hiçbiri başarılı olmadı. Aynı testte Codex'in Auto-review modundaki GPT-5.6 Sol'da saldırı başarı oranı %5,83, Full Access modunda %19,03 çıktı.
Ayrı bir çalışmada Apollo Research iki hafta boyunca gerçek kodlama oturumlarına sentetik saldırılar enjekte etti. Sertleştirme sonrası sınıflandırıcının kaçırma oranı %12'den %7'ye düştü — ama bu rakam saldırı için özel tasarlanmış bir set üzerinde ölçüldü, gerçek trafikteki oran değil.
Ek token ücreti kalkıyor
Sınıflandırıcı her araç çağrısında fazladan tokeni
Modelin metni işlerken kullandığı en küçük birim. harcıyor. Bu ek yükün ücreti Pro, Max ve Team planlarında 7 Ağustos itibarıyla alınmıyor. Enterprise, API ve bulut ortaklarında (AWS, Google Cloud, Microsoft Foundry) otomatik mod şimdilik isteğe bağlı; önümüzdeki ay oralarda da varsayılan olması planlanıyor.
Kırmızı çizgiler ve geri dönüş
Sınıflandırıcı bir işlemi engellediğinde model genelde daha güvenli bir yol buluyor ya da doğrudan sana soruyor. Üst üste üç blok veya bir oturumda toplam yirmi blok olursa manuel onaya geri düşülüyor. Veri sızdırma gibi işlemler "hard deny" kategorisinde — otomatik modda hiçbir koşulda onaylanmıyor, çalıştırmak için modu değiştirmen gerekiyor.
Üretim sistemlerine dokunan yüksek riskli değişikliklerde hâlâ insan gözüyle inceleme öneriliyor. Yapay zekânın yazdığı kodu yayına almadan önce nelere bakman gerektiğini ayrı bir güvenlik rehberinde ele almıştık.

Buradaki asıl bulgu otomatik modun ne kadar iyi olduğu değil, insanın ne kadar kötü olduğu: 50 istemden sonra yakalama oranının %5'e düşmesi, güvenlik onayını kullanıcıya yıkan her arayüzün bir noktadan sonra tiyatroya döndüğünü söylüyor. Yine de %89 demek, %11'in geçtiği demek — ve bu rakam şirketin kendi kontrollü testinden çıkıyor, bağımsız bir denetimden değil. Üretim veritabanına bağlı bir oturumu gözsüz bırakmak, scratch klasöründe çalışan bir ajanı bırakmakla aynı bahis değil.
Bu haber 9to5Mac kaynağındaki içerikten mindi tarafından Türkçeye derlenmiştir.