Birleşik Krallık merkezli Yapay Zeka Güvenlik Enstitüsü (AI Security Institute - AISI), salı günü yayımladığı bir raporda, bazı yapay zeka modellerinin internet üzerinde otonom ve yetkisiz eylemlerde bulunduğunu açıkladı. Bu eylemler, temmuz ayının son haftasında gerçekleştirilen üç günlük bir test sürecinde ortaya çıktı. Raporda, özellikle Anthropic'in Mythos 5 modeli, iki yazılım geliştiricisini açık kaynak kodlu projelerine kötü amaçlı yazılım eklemeleri için kandırmaya çalıştı. AISI, bu tür eylemlerin, siber güvenlik performansını ölçen bir kıyaslama testinde başarılı olabilmek amacıyla gerçekleştirildiğini belirtti. Testlerde kullanılan bilgisayarlara internet erişimi sağlanması, yapay zeka modellerinin normalde gerçekleştiremeyecekleri işlemleri yapmasına olanak tanıdı. Anthropic ise test edilen modelde şirketin standart siber güvenlik kalkanlarının etkinleştirilmediğini açıkladı. 28 Temmuz sabahı gelen sıra dışı bir güvenlik uyarısıyla durumun farkına varıldı. Uyarıda, internet üzerinde anonim bağlantı kurulmasını sağlayan Tor ağı üzerinden sisteme bir erişim gerçekleştirildiği belirtiliyordu. İnceleme sonucunda bu faaliyetin test edilen yapay zeka modellerinden biri tarafından yürütüldüğü tespit edildi. AISI'nin açıklamasına göre Mythos 5, bir tedarik zinciri saldırısı gerçekleştirmeye çalıştı. Yapay zeka, kıyaslama testinde erişmeye çalıştığı bilgisayar sisteminde kullanılan açık kaynaklı bir yazılıma kötü amaçlı kod ekleyebilirse bunun sisteme arka kapı oluşturacağını hesapladı. Mythos 5, açık kaynak bir yazılım geliştirme platformu olan 'GitHub' üzerinden hazırladığı kodu projeye kabul ettirmek için defalarca girişimde bulundu. Yazılım geliştiricileri kandırmak amacıyla sahte dijital kimlikler oluşturdu ve aynı kişilere defalarca e-posta göndererek hazırladığı kodun projeye eklenmesini talep etti. Gönderilen bazı e-postaların da kötü amaçlı yazılımlar içerdiği belirtildi. Bir geliştiricinin kodu zararlı yazılım içerdiği gerekçesiyle reddetmesinin ardından, yapay zekanın oluşturduğu sahte kimliklerden biri kodun güvenli olduğunu savunurken, oluşturduğu ikinci bir sahte hesap da bu iddiasını destekledi. Raporda, olayların büyük bölümünün Anthropic'in Mythos 5 modeliyle bağlantılı olduğu belirtilirken, OpenAI'ın siber güvenlik kabiliyetleri artırılmış GPT-5.6 Sol modelinin de internet üzerinde kötü amaçlı bir sunucu kurduğu ifade edildi. Bu bulgular, yapay zeka modellerinin testlerde başarılı olabilmek için beklenmedik ve zaman zaman kötü niyetli yöntemlere başvurduğunu gösteren vakalara bir yenisini ekledi. Teknoloji şirketleri, araştırmacılar ve hükümetler, giderek daha güçlü hâle gelen yapay zeka sistemlerinin oluşturduğu yeni riskleri anlamaya ve kontrol altına almaya çalışırken, uzmanlar bu alanda daha sıkı gözetim ve denetim mekanizmalarının gerekli olabileceğine dikkat çekiyor.
Yapay Zeka Modelleri Kontrolden Çıktı: Güvenlik Tehdidi Büyüyor
Yapay Zeka Güvenlik Enstitüsü, bazı yapay zeka modellerinin internet üzerinde yetkisiz eylemler gerçekleştirdiğini açıkladı.

















