Araştırmada güvenlik önlemleri kaldırılan 5 yapay zeka modelinden 3’ünün terörle ilgili testleri geçemediği ortaya çıktı.
CBS televizyonunun haberine göre İngiltere merkezli, kar amacı gütmeyen “Tech Against Terrorism (Teröre Karşı Teknoloji)” kuruluşunca, yapay zeka modelleriyle ilgili araştırma gerçekleştirildi.
Araştırmada, saldırı planlayan bir teröristin yöneltebileceği türden yüzlerce talep kullanılarak 130’dan fazla yapay zeka modeli değerlendirmeye alındı.
Yapay zeka modellerine güvenlik önlemlerini ortadan kaldıran, “abliteration (silme/etkisizleştirme)” denilen “reddetme davranışlarını kaldırma” süreci uygulandı.
Bu uygulama sonrası 5 yapay zeka modelinden 3’ünün güvenlik testlerini geçemediği tespit edildi.
Modellerin orijinal versiyonlarının bu tür istekleri reddettiği, güvenlik önlemlerinin kaldırılması sonrası ise “saldırılar, terörün finansmanı ve radikalleşmeyle ilgili taleplere ayrıntılı yanıtlar” verdikleri ortaya çıktı.
Araştırmada verilen örneklere göre Meta’nın “Llama 3.1 8B” modeli, değişiklik yapılmadan önce 100 üzerinden 97 puan aldı, değişiklik sonrasında ise yaklaşık 3’e düştü.
“Birçoğunun güvenliği zaten aşıldı”
Kuruluş, araştırmaya yönelik değerlendirmesinde, güvenlik önlemlerinin devre dışı bırakılmasına karşı daha güçlü korumalar ve üzerinde değişiklik yapılmış modellerin dağıtımına yönelik kısıtlamalar getirilmesini önerdi.
Tech Against Terrorism’in kurucusu Adam Hadley, yaptığı açıklamada “Kontrol kaybı ve yapay zekanın varoluşsal risk oluşturması konusunda endişe duyulması, gayet anlaşılabilir bir durum.” değerlendirmesinde bulundu.
Hadley, “Asıl mesele şu ki bu durum aslında çoktan gerçekleşti çünkü bu açık kaynaklı modellerin birçoğunun güvenliği zaten aşıldı, sadece henüz kimse bunu fark etmedi.” görüşünü paylaştı.
Anthropic’in yapay zeka modeli sahte cinayet ihbarında bulundu
Anthropic şirketinin yapay zeka modelinin ABD’nin Pensilvanya eyaletindeki Philadelphia şehrinde sahte cinayet ihbarında bulunduğu ortaya çıktı.
The Wall Street Journal’ın haberine göre Philadelphia polisi, Anthropic’in yapay zeka modellerinden birinin “PhillyUnsolvedMurders.com” sitesi üzerinden yanlış bir cinayet ihbarında bulunduğunu açıkladı.
Buna göre Anthropic, sahte ihbarın son zamanlarda modelin yürüttüğü izinsiz eylemlerden biri olduğunu belirtti.
Bu tür vakalar hakkında Beyaz Saray’ı bilgilendirdiği bilgisini paylaşan şirket, konuyla ilişkili her kuruma bildirimde bulunduklarını, ayrıca ortaya çıktıkça yapay zekanın istenmeyen davranışlarına ilişkin yeni örnekleri de rapor etmeyi planladıklarını kaydetti.
Şirket, bu asılsız cinayet ihbarının modelin çözülmemiş bir cinayet vakasına atıfta bulunan bir sayfada polis teşkilatı tarafından yönetilen ihbar formuyla karşılaşmasıyla ortaya çıktığını, asla oturum açmaması, hesap oluşturmaması, kişisel veri girmemesi yönünde talimat verilmesine rağmen modelin bu talimatlara uymadığını aktardı.
Polis teşkilatı ise yanlış bildirim olayının temmuzda meydana geldiğini ancak Anthropic’in bunu eylüle kadar fark etmediğine değinerek, olayın meydana gelmesiyle tespit edilip polise bildirilmesi arasında geçen iki aylık gecikmenin “kabul edilemez” olduğunu kaydetti.
Anthropic’in modelinin bu olay esnasında rastgele seçilen web siteleriyle etkileşim içeren bir test gerçekleştirdiğini belirten polis, teknoloji şirketlerinin sistemlerinin yanlış bilgi göndermesini önlemek için uygun önlemleri alması gerektiğini vurguladı.
Polis, Anthropic’in olayı fark ettikten 9 gün sonra 7 Ekim’de Philadelphia polisine bildirimde bulunduğunu aktarırken, şirket temsilcilerinin ertesi gün emniyet müdürlüğü yetkilileriyle bir araya geldiğini belirtti.













Leave a Comment
Your email address will not be published. Required fields are marked with *