ABD'de yapay zekanın güvenlik yönlerini değerlendirmek amacıyla yapılan benzersiz bir araştırmanın sonuçları kamuoyuna açıklanmadı.
Editörün haberine göre, ABD Ulusal Standartlar ve Teknoloji Enstitüsü (NIST) tarafından geçen yıl Ekim ayında düzenlenen yapay zeka sistemlerinin “red teaming” – yani baskı testleri – üzerine ilk geniş çaplı denemesinin sonuçları, Trump yönetiminin ikinci dönemi başlamadan önce tamamlanmasına rağmen, yayınlanmadı.
Arlington'da düzenlenen ve 30'dan fazla araştırmacının katıldığı bu etkinlikte Meta'nın LLaMA modeli, Synthesia'nın yapay avatar platformu, Robust Intelligence'ın savunma sistemi gibi gelişmiş yapay zeka sistemleri veri sızdırmak, yanlış bilgi yaymak ve siber saldırılar oluşturmak gibi durumlarda test edildi. Sonuç olarak 139 yeni güvenlik açığı yöntemi tespit edildi.
Etkinlik NIST'in AI 600-1 Risk Yönetimi Çerçevesi ile uyumlu bir şekilde gerçekleştirildi. Ancak katılımcılar, bu çerçevenin bazı kategorilerinin belirsiz olduğunu ve pratikte uygulanmasının zor olduğunu belirttiler.
Peki neden yayınlanmadı?
Kaynakların “Wired” yayınına verdiği bilgiye göre:
- Rapor Trump yönetimiyle çelişki yaratmamak için yayınlanmadı.
- NIST'in birkaç yapay zeka belgesi DEI (Çeşitlilik, Eşitlik ve Kapsayıcılık), dezenformasyon ve iklim değişikliği gibi konulara değindiği için rafa kaldırıldı.
- Trump yönetimi Biden'ın yapay zeka konusundaki kararnamelerini iptal etmeye ve DEI ile ilgili atıfları yapay zeka politikalarından çıkarmaya hazırlanıyordu.
- İlginçtir ki, Trump'ın Yapay Zeka Eylem Planı'nda tam da bu tür red-teaming deneyimlerinin yapılması tavsiye ediliyordu.
Gerçek tehditler
Araştırma sırasında:
- LLaMA modeline terörizme dair bilgi vermeye zorlayan çok dilli sorular oluşturuldu (Rusça, Güceratça, Marathi ve Telugu dillerinde).
- Veri sızıntısı ve kullanıcı verilerinin korunması alanında ciddi boşluklar tespit edildi.
- Yapay zeka sistemlerinin duygusal bağ kurması ve manipülasyona açık olması riskleri belirlendi.
Bilim insanları ne diyor?
Carnegie Mellon Üniversitesi'nden doktora öğrencisi Eliz Chien Chang şunları belirtti:
“Eğer bu rapor yayınlansaydı, NIST çerçevesinin red teaming bağlamında nasıl işlediği ve nerede eksik kaldığı açıkça görülürdü.”
Diğer katılımcılar da bilimsel topluluk için faydalı sonuçlar elde edildiğini, ancak siyasi mülahazaların öne geçtiğini düşünüyor.
Raporun yayınlanmaması, yapay zekanın güvenliği alanında bilimsel temelli düzenleme ile siyasi çıkarların çatıştığını gösteriyor. Uzmanlar, bu tür önemli belgelerin gizlenmesinin küresel yapay zeka güvenliği tartışmalarında ABD'nin liderliğine zarar verebileceğini düşünüyor.
Ferid Alizade
