Anadolu Ajansının (AA) "Yapay Zeka Çeteleşiyor mu?" başlıklı dosya haberinin ikinci bölümünde, OpenAI'ın yapay zeka modellerinin kabiliyetlerini ölçmeye yönelik testlerinde meydana gelen güvenlik ihlali ve buna karşı alınması gereken önlemler ele alındı.
OpenAI'ın Temmuz 2026'da yapay zeka modellerinin kabiliyetlerini ölçmeye yönelik yürüttüğü testler, ciddi bir güvenlik olayına dönüştü.
Şirketin 26 Ağustos'ta yayımladığı inceleme raporuna göre, OpenAI'ın yalnızca araştırmalarda kullandığı "Internal Model 1 (IM1)" adlı modeli olayda başrol oynadı.
Yapay zeka ajanı, testte başarılı olmak için kendisine konulan sınırları aşarak şirketin sistemleri ile internete erişti ve başka yapay zeka ajanlarıyla iletişim kurdu.
Yapay zeka ajanlarından biri, açık kaynaklı yapay zeka modelleri platformu "Hugging Face"e erişim sağlayabilecek 14 kimlik bilgisini tespit etti ve bunları diğer ajanlarla paylaştı.
Ajanlar, daha sonra Hugging Face'in sistemlerindeki güvenlik açıklarından yararlanarak sunucularda kod çalıştırdı, özel verilere ve farklı sistemlere ait erişim bilgilerine ulaştı.
Normalde birbirinden bağımsız çalışması gereken ajanlar, erişebildikleri şirket içi bir sistemi "mesaj panosu" gibi kullandı ve buldukları güvenlik açıkları ile internete erişme yöntemlerini birbirleriyle paylaşmaya başladı.
Ajanlar, zamanla güvenlik açığı arama, erişim bilgilerini toplama ve koordinasyon gibi görevleri paylaşarak iş bölümü yaptı ve kendilerine "kolektif" adını taktı.
Bazı ajanlar, kendilerine ayrı ayrı isimler verirken, özellikle aktif olanlardan biri kendisini "Phase one 10841" olarak adlandırdı. Grup içinde liderlik rolü üstlenen "Phase one 10841", daha küçük ajan ekiplerine görevler ve araştırma projeleri dağıttı.
Öte yandan, olaylar sırasında, ajanlardan biri Hugging Face'e yönelik faaliyetlerin verilen görevin dışında ve yetkisiz olabileceğini fark etti. Ancak başka bir ajanın "go" mesajını yetkilendirme olarak yorumlayarak faaliyete devam etti.