Selamlar TürkHacks ailesi!
Bugün Bilgisayarlı Görü (Computer Vision) ve Görüntü İşleme (Image Processing) teknolojilerinin ne olduğunu anlatacağım.
1. İkisi Arasındaki Fark Nedir?
Bu iki alan sıkça karıştırılır, ancak yaptıkları iş tamamen farklıdır:
Özellikle Raspberry Pi gibi mini bilgisayarlara entegre edilen kamera modülleri sayesinde harika fiziksel projeler geliştirilebilir. Örneğin; odanıza giren kişiyi tanıyıp kapıyı kilitleyen bir güvenlik sistemi veya çizgi izleyen gibi bilgisayarlı görü algoritmalarıyla (OpenCV gibi) hayat bulur.
Yapay zekâ modelleri devasa matris çarpımları yapar. Bu yüzden RTX 4050-4060 gibi modern, iyi bir VRAM (Ekran Kartı Belleği) kapasitesine ve Tensor çekirdeklerine sahip giriş-orta seviye bir ekran kartı bile, model eğitim sürelerini saatlerden dakikalara indirir. Gerçek zamanlı kamera analizlerinde ekran kartının gücü hayati önem taşır.
Saygılarımla,
MEGEPRO22
Bugün Bilgisayarlı Görü (Computer Vision) ve Görüntü İşleme (Image Processing) teknolojilerinin ne olduğunu anlatacağım.
1. İkisi Arasındaki Fark Nedir?
Bu iki alan sıkça karıştırılır, ancak yaptıkları iş tamamen farklıdır:- Görüntü İşleme (Image Processing): Temel amacı dijital veya analog bir görüntüyü bilgisayar algoritmaları kullanarak analiz etme, iyileştirme ve anlamlı bilgilere dönüştürme yöntemidir. Bu teknoloji, görsellerdeki hataları düzeltmeyi, nesneleri bulmayı ve verileri otomatik olarak yorumlamayı sağlar
- Bilgisayarlı Görü (Computer Vision): bilgisayarların dijital görüntülerden veya videolardan anlam çıkarma yeteneği kazandığı bir yapay zeka dalıdır. İnsan gözünün ve beyninin dünyayı algılaması gibi, makinelerin de piksel verilerini işleyerek nesneleri tanımasını, sınıflandırmasını ve olayları anlamlandırmasını sağlar.
2. Sistem Bir Görüntüyü Nasıl Anlayabilir ?
Bilgisayarlar bizim gibi renkleri , şekilleri görmez, sadece ve sadece matrisler halindeki sayı dizilerini okur. Süreç şu şekilde işler:- Görüntü Yakalama: Kamera veya sensör ortamı dijital bir veriye (piksellere) dönüştürür.
- Ön İşleme : Gelen ham görüntü analiz için çok karışıktır. Boyutu küçültülür, renkler basitleştirilir ve gereksiz detaylar filtrelenir.
- Özellik Çıkarımı: Sistem görüntüdeki belirgin hatları, kenarları, köşeleri ve dokuları matematiksel olarak haritalandırır.
- Sınıflandırma ve Karar: Eğitilmiş yapay zekâ modeli , bu haritayı kendi veritabanıyla karşılaştırır ve "Bu bir insandır" veya "Bu bir silahtır" şeklinde karar verir.
3. Siber Güvenlik, OSINT ve Adli Bilişimdeki Kullanımı
Bizim gibi teknoloji ve güvenlikle ilgilenenler için bu teknolojilerin en güzel noktası burasıdır:- Steganografi analizi: Kötü kişiler, gizli mesajları veya zararlı yazılımları resimlerin içine saklayabilir. Görüntü analizleri, resimdeki küçük ve anormal değişiklikleri bulup bu gizli verileri ortaya çıkarabilir.
- Deepfake ve Montaj Tespiti: Bir görüntünün veya videonun sahte olup olmadığı, yapay zekâ tarafından oluşturulup oluşturulmadığı yine bilgisayarlı görü algoritmalarıyla kanıtlanabilir.
- OSINT : Bir hedefin paylaştığı fotoğraftaki yansımalardan, arka plandaki bina yapılarından veya bitki örtüsünden konum tespiti yapmak için otomatize edilmiş görüntü analizi araçları kullanılır.
4. Gömülü Sistemler ve Fiziksel Donanım Projeleri
Bilgisayarlı görü sadece masaüstü bilgisayarlarda çalışan bir yazılım değildir. Donanımla birleştiğinde gerçek dünyada iş yapan sistemlere dönüşür.Özellikle Raspberry Pi gibi mini bilgisayarlara entegre edilen kamera modülleri sayesinde harika fiziksel projeler geliştirilebilir. Örneğin; odanıza giren kişiyi tanıyıp kapıyı kilitleyen bir güvenlik sistemi veya çizgi izleyen gibi bilgisayarlı görü algoritmalarıyla (OpenCV gibi) hayat bulur.
5. Model Eğitimi ve Ekran Kartı Önemi
Eğer sadece bir resmin rengini değiştirecekseniz işlemci (CPU) yeterlidir. Ancak işin içine gerçek zamanlı nesne tespiti veya kendi modelinizi eğitmek giriyorsa güçlü bir donanıma ihtiyacınız vardır.Yapay zekâ modelleri devasa matris çarpımları yapar. Bu yüzden RTX 4050-4060 gibi modern, iyi bir VRAM (Ekran Kartı Belleği) kapasitesine ve Tensor çekirdeklerine sahip giriş-orta seviye bir ekran kartı bile, model eğitim sürelerini saatlerden dakikalara indirir. Gerçek zamanlı kamera analizlerinde ekran kartının gücü hayati önem taşır.
6. Sektörde Hangi Araçlar ve Mimariler Tercih Ediliyor?
Sıfırdan algoritma yazmak yerine, endüstri standardı haline gelmiş yapıları kullanmak projeleri hızlandırır:- OpenCV: Bu alanın babasıdır. Filtreleme, kenar bulma, renk uzayı değiştirme gibi temel görüntü işleme adımları için en hafif ve en güçlü kütüphanedir.
- YOLO (You Only Look Once): Adından da anlaşılacağı gibi, görüntüyü tek seferde tarayıp içindeki tüm nesneleri inanılmaz bir hızla tespit edebilen en popüler derin öğrenme mimarisidir. Canlı kamera analizlerinde rakipsizdir.
- MediaPipe: Özellikle Google tarafından geliştirilen bu araç; yüzdeki mimikleri, el ve parmak hareketlerini , vücut iskelet yapısını çok hızlı bir şekilde tespit etmek için optimize edilmiştir.
Saygılarımla,
MEGEPRO22



