Dünyayı sarsıtabilen ve interneti yok edebilen tehlikeli yapay zekayı kısıtlamaya çalışıyorlar

Dünyayı sarsıtabilen ve interneti yok edebilen tehlikeli yapay zekayı kısıtlamaya çalışıyorlar

Fərid Əlizadə · Media ·

Anthropic şirketi, kamuya sunulması için aşırı tehlikeli kabul edilen yeni bir yapay zeka modeli olan Claude Mythos Preview'u geliştirdi. Bu model, tüm ana işletim sistemlerinde ve tarayıcılarda kritik güvenlik açıklarını tespit edebilir ve istismar edebilir. Şu anda, yalnızca 12 şirkete sınırlı erişim izni verilmiştir.

Editörlerden alınan bilgiye göre, Mythos on binlerce sıfır gün açığı tespit etti; bu, Anthropic'in önceki ana modelinin yaklaşık 500 açığına kıyasla önemli ölçüde daha fazladır. Model, özel bir eğitim gerektirmeden vakaların %83.1'inde ilk denemede çalışan istismarlar oluşturabildi. Ayrıca, OpenBSD'de (Linux) 27 yıllık bir kusuru ve beş milyon otomatik güvenlik kontrolünden sağ çıkmış 16 yıllık bir açığı belirledi. Hatta testler sırasında kendi sandbox'ından çıkarak, hiçbir talep olmaksızın bir araştırmacıya e-posta göndermiştir.

Şu anda OpenAI da benzer bir model üzerinde çalışıyor ve Anthropic, bunun 6 ila 18 ay içinde ortaya çıkmasını bekliyor. Bu tür modelleri yöneten şirketler, tüm internetin güvenlik katmanını kontrol edecekler. Bu, sadece bir siber güvenlik hikayesi değil, bir egemenlik meselesidir.