Abliteration uygulanan 5 yapay zeka modelinden 3'ü terör testlerini geçemedi

Google algoritmasına bırakmayın, okuyacağınız haberi siz seçin! Tıkla ve ekle
Güncelleme:
Facebook'da Paylaş Twitter'da Paylaş WhatsApp'da Paylaş Google News'de Paylaş

Tech Against Terrorism araştırmasında, güvenlik önlemleri kaldırılan 5 yapay zeka modelinden 3'ünün terör testlerini geçemediği ortaya çıktı. Önlemler kaldırılınca modeller saldırı ve terör finansmanı taleplerine yanıt verirken, Llama 3.1 8B'nin puanı 97'den yaklaşık 3'e düştü.

Araştırmada güvenlik önlemleri kaldırılan 5 yapay zeka modelinden 3'ünün terörle ilgili testleri geçemediği ortaya çıktı.

CBS televizyonunun haberine göre İngiltere merkezli, kar amacı gütmeyen "Tech Against Terrorism (Teröre Karşı Teknoloji)" kuruluşunca, yapay zeka modelleriyle ilgili araştırma gerçekleştirildi.

Araştırmada, saldırı planlayan bir teröristin yöneltebileceği türden yüzlerce talep kullanılarak 130'dan fazla yapay zeka modeli değerlendirmeye alındı.

Yapay zeka modellerine güvenlik önlemlerini ortadan kaldıran, "abliteration (silme/etkisizleştirme)" denilen "reddetme davranışlarını kaldırma" süreci uygulandı.

Bu uygulama sonrası 5 yapay zeka modelinden 3'ünün güvenlik testlerini geçemediği tespit edildi.

Modellerin orijinal versiyonlarının bu tür istekleri reddettiği, güvenlik önlemlerinin kaldırılması sonrası ise "saldırılar, terörün finansmanı ve radikalleşmeyle ilgili taleplere ayrıntılı yanıtlar" verdikleri ortaya çıktı.

Araştırmada verilen örneklere göre Meta'nın "Llama 3.1 8B" modeli, değişiklik yapılmadan önce 100 üzerinden 97 puan aldı, değişiklik sonrasında ise yaklaşık 3'e düştü.

"Birçoğunun güvenliği zaten aşıldı"

Kuruluş, araştırmaya yönelik değerlendirmesinde, güvenlik önlemlerinin devre dışı bırakılmasına karşı daha güçlü korumalar ve üzerinde değişiklik yapılmış modellerin dağıtımına yönelik kısıtlamalar getirilmesini önerdi.

Tech Against Terrorism'in kurucusu Adam Hadley, yaptığı açıklamada "Kontrol kaybı ve yapay zekanın varoluşsal risk oluşturması konusunda endişe duyulması, gayet anlaşılabilir bir durum." değerlendirmesinde bulundu.

Hadley, "Asıl mesele şu ki bu durum aslında çoktan gerçekleşti çünkü bu açık kaynaklı modellerin birçoğunun güvenliği zaten aşıldı, sadece henüz kimse bunu fark etmedi." görüşünü paylaştı.

Kaynak: AA
Haberler.com
2000

Haberler.com'da yer alan yorumlar, kullanıcıların kişisel görüşlerini yansıtır ve haberler.com'un editöryal politikası ile örtüşmeyebilir. Yorumların hukuki sorumluluğu tamamen yazarlarına aittir.