Fikrini yapay zeka paraya çevirsin — ücretsiz başla →

Sınırlayıcı Kutu (Bounding Box)

Araç kavramları
Ing: Bounding BoxSon güncelleme: 25 Eylül 2026
Bir görüntüde bir nesnenin konumunu çevreleyen dikdörtgen. Nesne tespitinde modelin "şurada bir araba var" deme şekli.

Sınırlayıcı Kutu nedir?

Sınırlayıcı kutu (bounding box), bir görüntü veya video karesinde belirli bir nesneyi çevreleyen en küçük dikdörtgendir. Bilgisayarlı görüde bir nesnenin nerede olduğunu anlatmanın en yaygın ve en basit yoludur. Nesne tespiti modelleri, bir görüntüde bulduğu her nesne için bir sınırlayıcı kutu, bir sınıf etiketi (araba, insan, köpek) ve bir güven skoru üretir.

Nasıl çalışır?

Bir sınırlayıcı kutu genellikle dört sayıyla tanımlanır. İki yaygın gösterim vardır:

  • Köşe koordinatları: Sol üst köşe (x1, y1) ve sağ alt köşe (x2, y2).
  • Merkez ve boyut: Kutunun merkez noktası (x, y), genişliği ve yüksekliği.

Koordinatlar piksel cinsinden ya da görüntü boyutuna göre 0 ile 1 arasında normalize edilmiş olarak verilebilir. Farklı veri kümeleri ve kütüphaneler farklı formatlar kullandığı için format dönüşümü, pratikte en sık hata yapılan noktalardan biridir.

Eğitim için insanların görüntüler üzerinde elle kutu çizmesi gerekir; bu, veri etiketlemenin en zahmetli işlerinden biridir. Model eğitim sırasında tahmin ettiği kutuların etiketlenmiş kutulara ne kadar yakın olduğunu öğrenir. Bu yakınlık genellikle intersection over union (IoU) ile ölçülür.

Tespit modelleri aynı nesne için birbirine çok yakın birden fazla kutu üretebilir. Non-maximum suppression adı verilen işlem, en yüksek güven skoruna sahip kutuyu tutup onunla fazla örtüşen diğerlerini eler.

Standart kutular eksenlere paraleldir. Uydu görüntüsü gibi nesnelerin eğik durduğu durumlarda döndürülmüş kutular, üç boyutlu sahnelerde ise 3D kutular kullanılır.

Neden önemli?

Sınırlayıcı kutu, "görüntüde ne var?" sorusunu "görüntüde ne var ve nerede?" sorusuna dönüştürür. Bu konum bilgisi, otonom araçlardan güvenlik kameralarına kadar pek çok uygulamanın temelidir. Segmentasyon maskeleri kadar hassas olmasa da çok daha hızlı etiketlenir ve işlenir, bu yüzden hız ve maliyet dengesinde çoğu zaman ilk tercihtir. Görüntü anlayan dil modelleri de artık kutu koordinatları üreterek bir nesneyi işaret edebiliyor.

Kullanım alanları

  • Otonom sürüş: Yayaları, araçları ve trafik işaretlerini tespit etmek.
  • Perakende: Raf görüntülerinde ürünleri saymak ve eksik stokları bulmak.
  • Güvenlik: Kamera görüntülerinde insan ve araç takibi.
  • Tıp: Röntgen ve tomografi görüntülerinde şüpheli bölgeleri işaretlemek.
  • Belge işleme: OCR öncesinde metin bloklarını, tabloları ve imzaları konumlandırmak.
mindi
mindi'nin notu
Sınırlayıcı kutu, bilgisayarlı görünün parmakla işaret etmesi. Basit görünür ama format karmaşası (köşe mi merkez mi, piksel mi oran mı) projelerde en çok vakit kaybettiren şeylerden biri. Formatı en baştan netleştir.