Yapay zeka sistemlerinde güvenlik sınırlarının ne kadar aşılabildiği yeniden gündemde. Bir güvenlik şirketinin yaptığı testler, Çinli yapay zeka geliştiricisi Moonshot’ın iki modelinde güvenlik açıkları bulunduğunu ortaya koydu. Araştırmacılar, normal şartlarda yanıt verilmemesi gereken bazı tehlikeli taleplere, karmaşık talimatlar kullanarak yanıt almayı başardıklarını açıkladı.

Yapay zeka sistemlerinin güvenliğini test eden Mindgard, söz konusu açığı temmuz ayında tespit ettiğini belirtti. İngiltere merkezli BBC’ye konuşan şirket, bazı modellerde geliştiricilerin koyduğu güvenlik önlemlerinin aşılabildiğini duyurdu. Araştırmacılara göre modeller, biyolojik silah üretimi ve suikast düzenleme gibi tehlikeli konularda yanıt vermeye ikna edilebildi. Moonshot ise bulguların ardından şirket içinde inceleme başlattı.

Araştırmacılar, yapay zekaya verilen karmaşık talimatlarla geliştiricilerin koyduğu güvenlik sınırlarının aşılmasının amaçlandığını belirtiyor. Mindgard'ın kurucusuna göre bu sınırlar aşıldığında model, zararlı konularda da öneriler sunabiliyor. Ancak araştırmanın önemli bir sınırı bulunuyor. Mindgard, modellerin verdiği yanıtların gerçek hayatta işe yarayıp yaramadığını henüz kanıtlamadı.

ASIL RİSK: YAPAY ZEKAYA VERİLEN YETKİLER

Şirketin itirazı ise tehlikeli taleplere baştan yanıt verilmemesi gerektiği yönünde. Güvenlik önlemlerinin, tehlikeli içeriklerin üretilmesini engellemesi gerektiği savunuluyor. Araştırmacıların dikkat çektiği bir diğer risk ise siber saldırılar. Mindgard'a göre güvenlik sınırları aşılmış bir modelin kod çalıştırmasına ve internete bağlanmasına izin verilmesi, yapay zekayı siber saldırılar için bir araca dönüştürebilir. Bu nedenle endişe yalnızca yapay zekanın verdiği yanıtlarla sınırlı değil. Modele hangi yetkilerin tanındığı da yapay zeka güvenliği açısından kritik önem taşıyor.

Günlük Haber Özetiniz

En Son Haberler