Selamlar dostum, hayırlı sabahlar hayırlı işler.
bu konuyu 3 başlıkta ele almak lazım:
1) Prompt Injection Nedir ve Nasıl Yapılır?
Olay tamamen yapay zekayı manipüle etmekle alakalı. Modelin kafasını karıştırıp kendi güvenlik kurallarını bypass etmesini sağlıyorsun. Yani sistemin ana talimatı ile senin yazdığın girdi arasındaki çizgiyi ihlal ettiriyorsun.
2) Sansürsüz Modelleri Kullanmak
Bu tarz sınırlarla uğraşmak istemiyorsan Hacker.ai veya Venice.ai gibi sansürsüz modellere bakacaksın. Venice.ai tarafında şöyle bir durum var, Cloudflare'i geçip ayarlardan API anahtarlarını sıfırlarsan limit derdin kalmıyor zaten.
3) Güvenlik Filtreleri ve İzlenebilirlik
Yapay zeka sana "ben bunu yapamam" diyorsa kullandığın kelimeler direkt güvenlik filtresine takıldığı içindir. Bu tarz durumlar sistemde Cyber veya SEC Flagged olarak işaretlenir.
Yani öyle denizdeki kum tanesiyim, kimseden iz kalmaz kafasına girmemek lazım. Bilgisayarında local çalışıyor olsan bile Microsoft seni Makine ID üzerinden her türlü tespit eder. Bir de bu sistemlerde /skills kullanımını iyi çözersen önün bayağı açılır haberin olsun.
Hayırlı günler kardeşim.