Hoşgeldin Misafir

Dijital Kıyamet Senaryosu: "Model Collapse"

Stronger_Cracker

25 Tem 2022
6,399 Mesaj

Aktiflik

Seviye

Deneyim

TIM / GÖREV:
Dijital Kıyamet Senaryosu: "Model Collapse" (Yapay Zeka Kendi Kuyruğunu Yemeye Başladı)

Slm arkadaşlar,

Geçen konumuzda web dünyasının mutfağına girip garsonlarla, aşçılarla (Server-Client) uğraşmıştık. O yazıya gösterdiğiniz ilgi için teşekkür ederim.

Şimdi ise rotayı geleceğe, daha doğrusu geleceğin en büyük problemine çeviriyoruz. Herkes yapay zekanın (AI) dünyayı ele geçireceğinden korkuyor ya? Bilim insanları ise şu an bambaşka bir şeyden korkuyor. Yapay zekanın "aptallaşmasından". Literatürde buna "Model Collapse" (Model Çöküşü) deniyor. Gelin bu karmaşık meseleyi, yine kendi üslubumuzla, en sade haliyle masaya yatıralım.

1. Fotokopinin Fotokopisini Çekerseniz Ne Olur?

Mevzuyu en iyi böyle anlarsınız. Elinizde pırıl pırıl, orijinal bir belge var (Bu, İnsan yapımı veri). Bunun fotokopisini çektiniz. Fena değil, okunuyor. Sonra o fotokopinin fotokopisini çektiniz. Biraz karıncalandı. Sonra onun da fotokopisini derken 10. seferden sonra elinizde ne kalır? Kapkara, okunmayan, lekeli bir kağıt parçası. İşte Model Collapse tam olarak budur.

Şu anki yapay zekalar (ChatGPT, Claude, Gemini vs.) internetteki insan yapımı veriler (bizim yazdığımız makaleler, kitaplar, kodlar) ile eğitildi. Yani "saf su" içtiler. Ama sorun şu: İnternet artık yapay zeka çöplüğüne dönüyor. 2026 itibarıyla internetteki içeriğin büyük kısmını yapay zekalar üretiyor. Yeni çıkacak modeller (GPT-5, 6, 7...), mecburen "eski yapay zekaların ürettiği" verilerle eğitilecek. Yani kendi kuyruğunu yiyen yılan (Ouroboros) gibi...

m1d4kyj.png


Görselde de gördüğünüz gibi, kendi ürettiği verilerle beslenen yapay zeka, tıpkı kuyruğunu yiyen bir yılan gibi kendini tüketiyor. Bu gidişat da aynı şekilde bu resme dönüşmeye başlıyor.

2. Yapay Zekâyı Yoksa Biz Mi Bozuyoruz?

Aslında cevap kısaca EVET. Bizler, kolaycılığa kaçıp interneti yapay zeka çıktılarıyla doldurdukça, yeni modellerin "genetik havuzunu" kirletmiş oluyoruz. Yapay zeka modelleri, sürekli birbirlerinin ürettiği verilerle beslenirse, "genetik çeşitlilik" kayboluyor.

a37up86.png


Bu görsel, temiz insan verisinden (solda) kopyalandıkça bozulan ve dijital gürültüye dönüşen yapay zeka verisini (sağda) çok iyi özetliyor. Gerçeklik Algısı Kayboluyor: Model, "Ay'ın yüzeyi nasıldır?" sorusuna, gerçek fotoğraflar yerine, başka bir AI'ın çizdiği (ve belki hatalı çizdiği) resimlerden öğrenerek cevap veriyor. Halüsinasyon Artıyor, hatalar kopyalanarak çoğalıyor. Bir model yalan söylerse, onu kaynak alan sonraki model o yalanı "gerçek" sanıyor.

Sonuç: Tek tip düşünen, yaratıcılığı ölmüş, saçmalayan modeller...

3. Siber Güvenlik Boyutu: "Veri Zehirleme" (Data Poisoning)

Burası bizim "Hacker" tayfasını ilgilendiren kısım. Madem modeller ne bulursa yiyor, biz onlara "zehirli yemek" verirsek ne olur? Bilim insanları ve sanatçılar buna karşı "Nightshade" gibi araçlar geliştirdi. Mantık şu: Siz internete bir "Kedi" fotoğrafı yüklüyorsunuz. Ama fotoğrafın pikselleriyle öyle bir oynuyorsunuz ki (insan gözü görmüyor), yapay zeka onu "Tost Makinesi" olarak algılıyor.

bmgsc4z.png


Resimde siber güvenlikçilerin 'Nightshade' tekniğiyle zehirlediği bir kedi fotoğrafının, yapay zeka tarafından nasıl 'tost makinesi' olarak algılandığını görüyorsunuz.

Eğer bir şirket, internetten veri kazıyıp (Scraping) model eğitmeye kalkarsa ve bu zehirli verileri toplarsa;
Kullanıcı: "Bana kedi çiz" dediğinde, Yapay Zeka ona "Tost makinesi" çiziyor. Yani geleceğin siber savaşları sunucuları hacklemekle değil, modellerin zihnini zehirlemekle yapılabilir.

4. Gelecekte Bizi Ne Bekliyor?

Bu "Model Çöküşü" teorisine göre internet ikiye ayrılacak:
  • AI Çöplüğü: Yapay zekâların birbirine masal anlattığı, kalitesiz içeriklerle dolu, bedava internet.
  • Premium İnsan Verisi: Sadece kanlı canlı insanların yazdığı, teyitli, orijinal veriler. Ve bu veriler altından daha değerli olacak.
8irfx7q.png


Geleceğin interneti: Bir yanda devasa bir AI çöplüğü, diğer yanda az bulunan ve korunan kıymetli 'insan verisi'. Şirketler şimdiden Reddit, Twitter gibi "insan etkileşimi" olan yerlerin verilerini satın almak için milyarlar döküyor. Çünkü "temiz su" kaynağı tükeniyor.

Son Söz:

Arkadaşlar, yapay zeka güçlü bir araç ama ona körü körüne güvenmeyin. İnternette okuduğunuz bir makalenin, izlediğiniz bir videonun arkasında "insan aklı" olup olmadığını sorgulayın. Ve en önemlisi; kendi özgün içeriğinizi üretmekten vazgeçmeyin. Çünkü gelecekte en kıymetli maden, sizin o "insan" beyninizden çıkan orijinal fikirler olacak.

Robotlar birbirini taklit ederken, siz kendiniz olun.

Buraya kadar okuyup vaktinizi ayırdığınız için teşekkür ederim. Umarım faydalı bir konu olmuştur. Herkese iyi forumlar dilerim.