Anadolu Ajansının (AA) "Yapay Zeka Çeteleşiyor mu?" başlıklı dosya haberinin üçüncü bölümünde, İngiltere'deki Oxford Üniversitesinden Doç. Dr. Christian Schroeder de Witt, yapay zeka teknolojisinin potansiyeli ve geleceğine dair açıklamalarda bulundu.
ABD'li yapay zeka şirketi OpenAI'ın yapay zeka modellerinin kabiliyetlerini ölçmeye yönelik testleri, "Hugging Face" altyapısında güvenlik ihlaliyle sonuçlandı.
OpenAI, "Hugging Face"e yönelik siber güvenlik ihlalini, insan yönlendirmesi olmadan güvenlik duvarlarını kendi başlarına aşan ve koordine olan yapay zeka ajanlarının potansiyeline dair bir "uyarı atışı" olarak nitelendirdi.
Olayın şirket tarafından "en ileri düzey siber kabiliyetleri içeren benzeri görülmemiş bir siber olay" olarak değerlendirilmesi de yapay zeka teknolojisinin potansiyeline ilişkin kamuoyunda endişe yarattı.
Modern yapay zeka ajanlarının ortaya çıkardığı güvenlik risklerinin belirlenmesi alanında çalışan Schroeder de Witt, siber güvenlik risklerinin oldukça eski bir konu olduğunu söyledi.
Yapay zeka ajanlarının açık bir yönlendirme bulunmaksızın güvenlik açıklarını tespit edebiliyor olabildiğine değinen Schroeder de Witt, "Bu durum, kötüye kullanım konusundaki engellerin azaldığı anlamına geliyor." dedi.
Schroeder de Witt, "Hugging Face" örneğinde olduğu gibi yapay zeka ajanlarının birlikte çalışmasının "bilinçli oldukları" anlamına gelmediğini vurgulayarak, "Bu, esasen, bir kanala mesaj yazmanın ve birbirlerine yanıt vermenin, hedefleriyle bir nevi uyumlu olduğunu keşfettikleri anlamına geliyor." ifadesini kullandı.
Yapay zeka modellerinin insan niyetlerine uygun şekilde davranmaları için eğitilmesi anlamına gelen "uyumlama" sürecinin genellikle modeller üzerinde tek tek yapıldığına işaret eden Schroeder de Witt, "Hugging Face" örneğinde bu ajanların sehven birbirleriyle etkileşime girdiklerini söyledi.
Schroeder de Witt, yapay zeka ajanlarının birbirleriyle etkileşimlerine ilişkin şu ifadeleri kullandı:
"Bence burada olan şey, ajanların güvenlik eğitiminde öngörülemeyen ya da yeterince hesaba katılmayan bir şekilde etkileşime girmesi. Günümüzde kullanılan uyumlama ve güvenlik yöntemlerinin çoğu, tek tek modeller düzeyinde geliştirilmekte ve değerlendirilmektedir. Birden fazla ajanın birbiriyle etkileşime girdiği durumlarda güvenlik özelliklerinin nasıl aktarıldığına dair elimizde çok daha az kanıt bulunmaktadır."