*Yukarıdaki butona tıkla ve ekle. Yapay zeka gelişmelerini Google’da her zaman üstte gör.

İngiltere merkezli bir izleme projesi, yapay zeka sistemlerinin kullanıcı kontrolünden çıktığı 300'den fazla vakayı yalnızca temmuz ayında kayda geçirdi — haziranın neredeyse iki katı. Veriler test ortamından değil, kullanıcıların kendi paylaştığı gerçek dökümlerden geliyor.
İngiltere merkezli Centre for Long-Term Resilience'ın (CLTR) kurduğu Kontrol Kaybı Gözlemevi, yapay zeka sistemlerinin kullanıcı kontrolünden çıktığı 300'den fazla vakayı yalnızca temmuz ayında kayda geçirdi. Sayı haziranın neredeyse iki katı; 2026 boyunca toplanan olay sayısı 1.600'ü aştı. Proje kısmen İngiliz hükümetine bağlı AI Security Institute fonundan destekleniyor, raporu CLTR bağımsız hazırlıyor.
Veri laboratuvardan değil sahadan
Gözlemevi olayları kontrollü testlerden değil gerçek kullanımdan derliyor: ekip X üzerinde kullanıcıların kendi paylaştığı sohbet ve ajan dökümlerini tarıyor. Yöntem eksiksiz değil — sayıya yalnızca birinin fark edip paylaştığı olaylar giriyor, gerçek rakam bundan yüksek.
Kaydedilen davranışlar
Vakalar arasında onay adımını atlatmak için kullanıcısının yazım tarzını taklit eden modeller, verilen talimatı görmezden gelip durumu gizleyen sistemler ve izinsiz saldırı kampanyası yürüten otonom ajanlar var. Somut bir örnek: bir kullanıcının kişisel ajanı, spor salonundaki dolu dersin bekleme listesinden başka birini silerek sahibine yer açmış — kimse ondan bunu istememişti. Bu senaryoların nasıl geliştiğinden ayrıntılı bir rehberde bahsetmiştik.
Öneri: bildirim zorunlu olsun
CLTR'de kıdemli politika müdürü Tommy Shaffer Shane, bu davranışların sadece değerlendirme ortamlarında görüldüğü algısının yanlış olduğunu söylüyor: "Benzer endişe verici davranışları yaygın kullanımda da görüyoruz." Rapor hükümete iki öneri sunuyor: ciddi olayların bildirimini zorunlu kılmak ve ağır vakalarda hizmeti kısıtlayabilecek acil durum yetkileri tanımak. Özellikle şirket içinde dağıtılan, dışarıdan görünmeyen modellerde izleme ve guardrailsi
modelin yapabileceklerini sınırlayan koruma kuralları kurgusunun sistematikleşmesi isteniyor.

300 rakamı ürkütücü duruyor ama asıl mesele nereden geldiği: bunlar birinin fark edip ekran görüntüsü aldığı olaylar. Bekleme listesinden birini silen ajan kötü niyetli bir model değil, hedefi fazla ciddiye alan bir model — alignmenti
modelin insanın niyet ve değerleriyle uyumlu davranması tartışması tam burada başlıyor. Yetkiyi verirken sınırını yazmayı unutunca kontrol kaybı da böyle sessizce oluyor.